【科技圈 De 那点事 - 报道】8 月 27 日消息,一款代号为 Ox Alpha 的匿名 AI 模型近日在开发者圈引发热议。这款于 8 月 20 日悄然登陆 OpenRouter 平台的神秘模型,因性能强劲且完全免费,迅速积累了大量用户。更引人注目的是,前百度及阿里高管、Atomstorm.ai 创始人 lizk_zhu 在 X 平台发布详细技术分析,五条证据指向智谱 AI。OpenRouter 数据显示,Ox Alpha 的使用量已达 DeepSeek 的两倍以上。

国内网友给 Ox Alpha 起了个接地气的外号," 牛来 "。
Ox,牛。Alpha,开端。合起来就是 " 牛来了 "。这个命名里藏着开发者们的期待,也藏着中国 AI 圈一个不算秘密的秘密,有些好东西,是先放出来让人用,再慢慢揭开面纱的。
神秘上线:8 月 20 日的 " 匿名惊喜 "
Ox Alpha 的登场方式,本身就带着一股神秘色彩。
2026 年 8 月 20 日,AI 模型聚合平台 OpenRouter 突然上线了一款代号为 Ox Alpha 的新模型。没有发布会,没有官方博客,没有技术白皮书,只有一个简洁的模型卡片,上面写着,支持文本、图像、视频三模态输入,上下文窗口约 100 万 token,最大输出长度 13.1 万 token,预览期间完全免费。

这种 " 静默上线 " 的方式在 AI 圈并不常见。OpenAI 发布 GPT-4 时搞了直播,Google 发布 Gemini 时开了大会,Meta 发布 Llama 时发了论文。但 Ox Alpha 的发布方,选择了沉默。
沉默反而激发了开发者们的好奇心。模型上线后,开发者们迅速展开了 " 民间评测 "。有人在代码生成任务上测试,发现它的表现接近顶级闭源模型;有人在多模态理解任务上测试,发现它对图像和视频的解析能力出人意料地强;还有人在长文本处理任务上测试,发现 100 万 token 的上下文窗口不是虚标,确实能处理整本书的输入并给出连贯的摘要。
口碑在开发者社区里迅速发酵。OpenRouter 的使用量数据,成了最直观的证明。
使用量翻倍 DeepSeek:数据不会说谎
OpenRouter 是一个中立的 AI 模型聚合平台,开发者可以在上面调用各种模型的 API,平台会统计每个模型的调用量。这个数据,比任何宣传文案都更有说服力。
Ox Alpha 上线不到一周,其使用量就超过了 DeepSeek 的两倍。
DeepSeek 是谁?它是中国 AI 公司深度求索推出的开源模型系列,以高性能和低成本著称,在全球范围内拥有庞大的开发者用户群。能在使用量上超越 DeepSeek,意味着 Ox Alpha 不是一个小众的实验品,而是一个被大规模采用的实用工具。
更值得注意的是,Ox Alpha 是在 " 完全免费 " 的预览期内达到这个数据的。免费确实会吸引用户,但免费不等于留存。如果模型本身不够好用,开发者们试用几次就会离开,不会持续调用。使用量持续攀升,说明 Ox Alpha 的 " 留存率 " 很高,开发者们是真的在用它解决实际问题。
这个数据也让行业观察者开始重新审视中国 AI 模型的竞争格局。过去,DeepSeek 被视为中国开源模型的标杆,其性价比优势让全球开发者侧目。现在,一个匿名模型在上线一周内就实现了使用量的反超,这背后意味着什么?
五条证据链:技术溯源指向智谱 AI
Ox Alpha 的匿名状态没有持续太久。
8 月 26 日,Atomstorm.ai 创始人 lizk_zhu 在 X 平台发布了一条长推文,详细分析了 Ox Alpha 的技术特征,并给出了五条指向智谱 AI 的证据。
lizk_zhu 不是普通网友。他是前百度、阿里的高管,在 AI 基础设施领域有深厚的技术背景。他的分析不是猜测,是基于技术细节的推理。
第一条证据,token 分布。lizk_zhu 团队对 Ox Alpha 的 token 分布进行了精细分析,发现其与智谱 GLM-5.3 的 token 分布 " 几乎完全吻合 "。token 分布是模型内部的 " 指纹 ",不同架构、不同训练数据的模型,其 token 分布会有显著差异。两个模型的 token 分布高度一致,说明它们很可能共享相同的架构和 tokenizer。
第二条证据,模型行为模式。在特定的提示词测试集上,Ox Alpha 的回答风格、推理路径、错误模式,与智谱 GLM 系列表现出高度相似性。这种 " 行为指纹 " 比 token 分布更难伪造,因为它涉及到模型内部的决策机制。
第三条证据,多模态架构。Ox Alpha 支持文本、图像、视频三模态输入,这与智谱在 GLM-5 系列中力推的多模态方向一致。更重要的是,Ox Alpha 在处理多模态任务时的特定行为,比如对图像中文字的定位方式、对视频时序的理解方式,与智谱公开的技术细节高度吻合。
第四条证据,上下文窗口实现。100 万 token 的上下文窗口不是简单的 " 把窗口开大 ",它涉及到注意力机制的优化、内存管理的技巧、长距离依赖的建模。lizk_zhu 指出,Ox Alpha 处理超长上下文时的特定优化策略,与智谱在长文本领域的技术积累高度一致。

第五条证据,发布时间线。Ox Alpha 上线的时间点,恰好是智谱 GLM-5.5 发布前夕。在科技行业," 先放匿名版测试市场反应,再正式官宣 " 是一种常见的策略。智谱有动机、有能力、也有先例这么做。
五条证据,从不同技术层面指向同一个结论。这不是巧合能解释的。
智谱的 " 阳谋 ":为什么要匿名发布
如果 Ox Alpha 确实是智谱的作品,那为什么要匿名发布?
这个问题,可以从几个角度来理解。
第一,技术验证。匿名发布可以让模型在最真实的市场环境中接受检验。没有品牌光环,没有官方背书,开发者们纯粹基于模型本身的质量来决定是否使用。这种 " 裸奔 " 测试,比任何内部评测都更能暴露模型的真实水平。如果 Ox Alpha 在匿名状态下都能获得高使用量,说明它的技术实力确实过硬。
第二,竞争策略。中国 AI 大模型的竞争已经进入白热化阶段。百度、阿里、字节、DeepSeek、智谱,各家都在抢开发者、抢市场份额。匿名发布一个强力模型,可以在不触发竞争对手警觉的情况下,快速积累用户和数据。等到正式官宣时,已经有了扎实的用户基础和市场口碑。
第三,风险规避。AI 模型的发布涉及监管合规、安全评估、伦理审查等多个环节。匿名发布可以在一定程度上绕过这些流程,让模型先跑起来,再逐步完善合规手续。这种做法有争议,但在竞争激烈的市场环境中,并不少见。
第四,制造话题。不可否认," 神秘模型 " 本身就是一个极好的营销话题。从 8 月 20 日上线到 8 月 26 日被 " 认领 ",这一周的时间里,Ox Alpha 在开发者社区里引发了大量自发讨论。这种 " 病毒式传播 " 的效果,是花钱做广告都买不来的。
智谱的这一步棋,走得既大胆又精明。
中国 AI 模型的 " 暗战 ":从明面竞争到匿名博弈
Ox Alpha 事件,折射出中国 AI 大模型竞争的一个新趋势,从明面上的发布会、论文、排行榜,转向了更隐蔽的匿名博弈。
过去,AI 模型的竞争是 " 阳光下的竞争 "。各家发布模型,打榜、发论文、开发布会,光明正大地争夺开发者和用户。但现在,竞争的方式变得更加多元和隐蔽。匿名发布、A/B 测试、灰度上线,这些互联网产品常用的策略,正在被 AI 公司们借鉴。
这种转变的背后,是市场竞争的加剧。中国 AI 大模型赛道已经拥挤不堪,各家模型的能力差距在缩小,差异化越来越难做。在这种情况下," 出奇制胜 " 比 " 正面硬刚 " 更有效。匿名发布一个强力模型,可以在竞争对手反应过来之前,快速抢占用户心智和市场份额。
但这种方式也有风险。匿名发布意味着没有官方的技术支持和文档,开发者在使用过程中遇到问题只能靠自己摸索。如果模型出现严重缺陷或安全漏洞,发布方也无法及时响应。更重要的是,匿名发布可能引发监管层面的关注,毕竟 AI 模型的发布涉及数据安全、内容合规等敏感问题。
Ox Alpha 的 " 认领 ",某种程度上是对这些风险的化解。既然已经被技术溯源指向智谱,与其继续匿名引发更多猜测和争议,不如顺势官宣,把话题转化为品牌曝光。

写在最后
Ox Alpha 的故事,还有一个有趣的注脚。
国内网友给它起的外号 " 牛来 ",在 A 股圈子里有特殊的含义。" 牛来了 " 是股民们对市场大涨的期待和调侃。把这个词套在一个 AI 模型上,既是对模型性能的肯定,也暗含了对中国 AI 产业的期待。
从 DeepSeek 到 Ox Alpha,中国 AI 模型正在经历一个从 " 追赶 " 到 " 并跑 " 甚至 " 领跑 " 的转变。DeepSeek 证明了中国的开源模型可以在全球范围内与 Llama、Mistral 等西方模型竞争。Ox Alpha 则证明了中国模型可以在匿名状态下,仅凭技术实力就赢得开发者的青睐。
智谱 " 认领 "Ox Alpha 之后,下一个问题随之而来,GLM-5.5 会是什么样?如果 Ox Alpha 只是预览版就已经如此强劲,正式版又会带来哪些惊喜?
中国 AI 大模型的 " 暗战 ",才刚刚开始。


登录后才可以发布评论哦
打开小程序可以发布评论哦