OpenRouter 在 8 月 20 日悄悄挂上了一个叫 Ox Alpha 的模型,模型ID是stealth/ox-alpha。它完全免费,输入输出价格都是$0,支持100万token上下文,能吃图片和视频,还内置工具调用——单看参数表,这是一份相当豪华的"白送"。但真正值得多问一句的,不是它有多强,而是没人知道它是谁,而它留下的每一条对话记录,都攥在一个匿名provider手里。

这不是OpenRouter第一次干这种事。此前的匿名模型Hunter Alpha,后来被证实就是小米的MiMo-V2-Pro。Ox Alpha大概率也是某个即将商业化模型的马甲,免费和"不用于训练"的承诺听起来体贴,实际上和真正的零数据留存完全是两回事。

百万上下文撑场面,真实流量却来自Claude Code

Ox Alpha被定位成一个专门啃代码和长程agentic任务的推理模型:1,048,576 token的上下文窗口,最多能输出131,072个token,推理强制开启,分low/high/max三档强度。性能数据也摆在页面上——P50延迟约1.92秒,吞吐量约52 tokens/秒,近3天uptime做到99.99%,这个速度不算惊艳,但胜在稳定。

驱动它最大流量的应用不是某个测评榜,而是Anthropic的Claude Code,紧跟其后的是Hermes Agent、Oh-My-Pi这类agent工具。这说明它已经被真实的编程agent场景接进了生产链路,不是躺在实验室里跑分的样子货。

把它和市面上的主流模型摆在一起看,"免费"两个字的分量才立得住:

模型输入价格/M输出价格/M
Claude Opus 4.8约$5约$25
GPT-5.5约$5约$30
Gemini 3.7 Flash约$0.375约$1.875
Ox Alpha$0$0

免费的代价:留存不是训练,但也不是安全

OpenRouter的页面写得很清楚——匿名provider会留存用户的prompt和completion,只是承诺不用来训练。这句话看着安心,但和企业客户真正在意的零数据留存(ZDR),是两个完全不同的法律承诺。社区里不少人把"不用于训练"直接当成"ZDR"来转发,这是一个典型的误读。

两种承诺,差别在这里 不用于训练 provider仍会留存对话 可能用于评测、改进 数据留存期限不透明 不等于数据安全 零数据留存 ZDR 请求结束即删除 通常写入合同条款 企业客户可审计 Ox Alpha目前不满足
免费不是没代价,只是换了种收费方式
  • 风险.如果代码库里带客户数据、密钥或未公开的商业逻辑,把它扔进一个身份不明的匿名模型,风险不在"会不会训练",而在"会不会被留存到你不知道的地方"。

一次拒答,比价格标签更诚实的身份线索

Ox Alpha的开发方选择匿名,但用户的提问替它露了馅。有人反馈,它在涉及台湾、天安门等政治敏感话题时会拒答或突然截断回应——这不是技术瑕疵,更像是一种行为指纹,通常被社区解读为指向有中国背景的实验室。社区猜测的候选名单里,有小米MiMo V3、智谱GLM-5.3、MiniMax,也有LongCat相关的说法,但都没有得到官方确认。

隐身模型的老套路 Hunter Alpha 匿名上线测试 身份揭晓 确认为小米MiMo-V2-Pro Ox Alpha 2026年8月上线,免费 身份未知 拒答敏感词是唯一线索

一个实验室为什么愿意免费开放一个百万上下文、支持工具调用的推理模型,还承诺不拿去训练?比较合理的解释是压力测试——借OpenRouter和Claude Code这样的真实流量渠道,收集生产级的agentic编程反馈,同时不承担正式发布的品牌责任。也有人猜是为商业化前的市场铺垫。这些都只是推测,原文和社区讨论都没有给出确凿证据。

眼下能看到的"编程能力强"评价,几乎全是轶事——有开发者说它在做桌面转网页任务时token消耗更少、迭代次数更低,但样本量小,也没有受控、可复现的基准测试能把它和Claude Opus 4.8或GPT-5.5放在同一把尺子上比较。

谁该用,谁该等等

对愿意拿业务边缘任务练手的开发者,Ox Alpha确实是一个便宜的百万上下文试验场,挂在Claude Code这类agent后面跑跑看没什么损失。但涉及客户数据、内部代码库或者任何不想被匿名provider留存的内容,现在还不是往里塞的时候。接下来真正该盯的,是它会不会像Hunter Alpha一样最终被"认领"、免费期结束后价格怎么定,以及是否会有人拿出一份经得起复现的基准测试成绩。