一个没有署名的模型,正在让整个AI开发者社区陷入猜谜游戏。
一款名为Ox Alpha的匿名AI模型悄然出现在OpenRouter平台,免费开放、性能强劲,迅速在开发者圈引发热议。国内网友因“Ox”即“牛”,给它起了个接地气的外号——“牛来”大模型。
免费+强大,开发者蜂拥而至
美东时间8月20日深夜(北京时间8月21日凌晨),Ox Alpha以“stealth model”(隐身模型)身份低调上架OpenRouter,提供方为匿名第三方。
配置相当豪华:100万token上下文窗口、支持文本+图像+视频多模态输入、工具调用全支持、推理强制开启。价格更离谱——完全免费。
据彭博报道,Ox Alpha免费开放一周,使用量“近乎无限”。AI编程工具OpenCode官方公告称,其背后提供方每天拥有100万亿(100T)tokens的算力——这大约是Visa公司整整一个月AI token使用量的100倍。
Stripe CEO Patrick Collison亲自上手测试后,在X上直接写道:“非常令人印象深刻。”
编码测试:超过GPT-5.6和Claude
AI编程框架fable的作者davis7用DeepSWE官方评测跑了10道题,结果让他自己都懵了。他在X上写道:“我非常困惑(I am very confused)。”
数据说明一切:Ox Alpha得分80%,Claude Fable 65%,GPT-5.6 Sol 52%。
一个匿名模型,把两个知名闭源前沿模型甩开15个百分点。社区随后有人独立复测,结论基本一致:4道通过、4道接近通过、2道失败,与8/10的结果吻合。
两组独立测试,指向同一结论:这个神秘模型的编码能力,确实处于前沿区间。

24小时指纹侦探战:五条证据指向智谱
身份成谜,社区开始“人肉”。
据Atomstorm.ai的创始人、前百度/阿里高管lizikk_zhu在X平台上的详细分析,社区仅用24小时,就通过公开API的技术指纹比对,锁定了最大嫌疑人。
最强的一击来自视频编码器。将同一组受控测试视频分别喂给不同模型,记录各自消耗的token数——Ox Alpha与智谱GLM-5V-Turbo逐token完全一致:296、296、884、1064,一个不差。该分析指出,这匹配了帧采样策略、时长缩放、分辨率缩放三个独立设计特征,“巧合的概率约等于零”。
其余四条证据接连出现:
文本tokenizer:25个特殊字符串(含CJK、emoji、西里尔字母),token数与GLM-5.3完全一致
报错码:传入错误参数时返回[1210]错误——据分析这是Z.ai独有的错误码
中文后端:触发图片解析错误时,后端直接返回中文:“图片输入格式/解析错误”
审查口径:问敏感问题给出官方口径
五条证据来自完全不同的技术层面,却全部指向智谱。lizikk_zhu据此判断,Ox Alpha大概率是智谱尚未发布的GLM-5.3视觉版(或GLM-5.5),置信度70-80%。
据Business Insider报道,Wccftech等科技媒体也指出,智谱此前曾以“Pony Alpha”为代号匿名测试GLM-5,开发者在Ox Alpha中发现了相似的tokenizer行为和响应模式。
但谜底未必是智谱
疑点同样存在。
第一,算力对不上。100T tokens/天免费运行一周,多方分析认为以智谱当前算力储备难以独立支撑。社区由此提出“合成假说”:GLM权重+巨头算力托管——模型是智谱的,服务器可能是小米或腾讯的。
第二,有人预告反转。AI圈知名爆料人士Mia在X上发文称:“我已经确认了Ox Alpha是谁家的,但现在不能说。你们都会非常兴奋——它不是你们想的那样。”该帖子底下随即涌现大量问号。
据Business Insider报道,AI分析师Andrew Curran在X上写道,周五晚间GLM还是主流猜测,但到周六早上,“大家似乎对任何事情都不那么确定了”。
Wccftech后来也补充了另一种分析:Ox Alpha的tokenizer特征也可能指向微软的MAI系列模型。
谜底大概率在8月28日揭晓——那天智谱GLM-5.3权重正式开源,模型卡一出,身份或将自见分晓。
数据去哪了?留存政策自相矛盾
在猜测身份之外,还有一个更实际的问题悬而未决:用户数据的去向。
据lizikk_zhu的分析,OpenRouter模型卡白纸黑字写明:“Prompts and completions are retained by the provider, not used for training.”(对话内容会被提供方留存,但不用于训练。)
而OpenCode的官方公告则声称:“Zero Data Retention.”(零数据留存。)
两个官方渠道,两种说法,至少有一个不完整。“不用于训练”与“零数据留存”是两个概念:前者意味着对话仍在提供方手中,留存期限不透明;后者才是企业合规意义上的“请求结束即删除、可审计”。
匿名上架,已成行业惯例
据彭博报道,这并非孤立现象。字节跳动、Sea、阿里巴巴等公司今年均曾在不公开来源的情况下发布模型,以便在更少约束下测试新服务。
lizikk_zhu梳理的时间线显示,这套剧本已有多个先例:Hunter Alpha后来被证实是小米的MiMo-V2-Pro,Owl Alpha是美团LongCat 2.0,Pony Alpha是智谱GLM-5,就连OpenAI也曾以Quasar Alpha为代号测试GPT-4.1。
其背后逻辑清晰:匿名上架规避品牌风险,免费换取真实生产流量,压测反馈比内测数据更有价值,最后认领发布完成变现。
如果Ox Alpha最终如分析师预测拿到AA智能指数61分,将成为开源权重模型中首个突破60分的模型,直接触及闭源前沿的门槛。
本文转载自“华尔街见闻”APP,作者:龙玥;智通财经编辑:宋芝萦。