Ox Alpha 隐身 AI 模型:一款匿名发布在 OpenRouter 和 OpenCode 上的模型,具备 100 万 token 的多模态上下文窗口和免费近乎无限使用的特性,引发社区侦探式追踪——分词器指纹分析最强烈指向未公开发布的智谱 AI GLM 模型,但其开发者身份仍未披露。
TECH

Ox Alpha 隐身 AI 模型:一款匿名发布在 OpenRouter 和 OpenCode 上的模型,具备 100 万 token 的多模态上下文窗口和免费近乎无限使用的特性,引发社区侦探式追踪——分词器指纹分析最强烈指向未公开发布的智谱 AI GLM 模型,但其开发者身份仍未披露。

35+
Signals

战略概览

  • 01.
    Ox Alpha 于 2026 年 8 月 20 日作为一款匿名隐身模型出现在 OpenRouter 和 OpenCode 上,提供 1,048,576 token(100 万)的多模态上下文窗口,支持文本、图像和视频输入,最多可生成 131,072 个 completion token。
  • 02.
    OpenCode 在大约一周内将其免费开放,宣称每日容量高达 100 万亿 token,且‘近乎无限使用’,尽管至少有一位早期用户报告在首次提示时即遭遇速率限制。
  • 03.
    OpenRouter 明确声明其并非该模型的开发者、所有者或提供方,其政策指出提示和生成内容由提供方保留(仅不用于训练)——这一细节与营销语言中描述的‘零数据保留’形成矛盾,令人不安。
  • 04.
    独立的分词器分析和基准测试最强烈指向智谱 AI 的 GLM 系列(可能是未发布的 GLM-5.3 或 GLM-6 变体),尽管竞争理论则指向微软、小米以及 GLM 与 xAI 的混合体。

六个月内第五个神秘模型——发布数日内即被指纹识别

Ox Alpha 并非凭空出现。Pony Alpha 最终被证实为智谱 AI 的 GLM-5,一款 7440 亿参数的专家混合模型。Hunter Alpha 被证实为小米的 MiMo-V2-Pro。Elephant Alpha 后来被归因于蚂蚁集团的灵犀 Ling-2.6-flash,而 Owl Alpha 则属于美团的 LongCat-2.0 [4]。这些模型均以‘动物+Alpha’的代号在 OpenRouter 上发布,引发了一波基准测试热潮,最终被揭露为中国实验室的正式发布。Ox Alpha 于 2026 年 8 月 20 日在 OpenRouter 和 OpenCode 上线,是这一序列中约六个月内的第五个成员 [4]

此次事件引人注目的是社区迅速展开指纹识别的速度。在 Ox Alpha 发布数日内,分词器探测、基准复现和 API 错误分析已在公共领域广泛传播,远早于 OpenRouter 或任何实验室确认更名 [2]。这种速度应用了最终揭露 Pony Alpha、Hunter Alpha、Elephant Alpha 和 Owl Alpha 身份的相同侦探方法——这引发了一个问题:实验室还能指望匿名测试真正保持匿名多久?

三种指纹识别方法,三种不同答案

支持智谱 AI 起源的最强技术证据来自分词器分析:独立研究者 Sushaanth Srinivasan 进行了探测测试,将 Ox Alpha 的分词器与已知 GLM 分词器对比,报告在所有测试中完全匹配 [2]。独立研究者 Ben Davis 在 10 项 DeepSWE 编码子集上对该模型进行基准测试,结果显示其优于 GLM 5.3、Grok 4.6 和 GPT 5.6,并以 99% 的置信度得出结论:它是来自 Z.ai 的未发布 GLM-5.3 系列变体 [5]

但分词器证据并非一致。Robert Lukoszko 进行了自己的分析,得出 Ox Alpha 使用 cl100k_base 分词器的结论,这完全与 GLM 理论相矛盾,反而仅与微软的 Phi/MAI 系列匹配 [2]。Gael Breton 提出折中理论——基于 GLM 的模型,但通过 xAI 的基础设施提供服务,他将其命名为‘Composer 3’ [2]。除了分词器争议外,社区的法医工作还指出数字 API 错误代码和强制的 reasoning_content 字段,评论者认为这些是 Z.ai/GLM 特有的特征,为 GLM 一派增加了第四个数据点,尽管这些细节主要通过非正式社区测试传播,而非正式技术报告。

另一条证据线索完全来自编码基准测试之外:独立动手测试者将 Ox Alpha 用于复杂的视觉生成任务——轨道 3D 仪表盘、舰船战斗游戏、SVG 插图、交互式 3D 对象和全栈应用——一致认为其视觉和创意生成输出是突出优势,对他们而言比驱动身份争议的编码得分更具辨识度。多个独立测试者在远离上述 DeepSWE 风格测试套件的任务上达成一致,表明 Ox Alpha 的能力概况可能超越编码,进入真正广泛的多模态技能集。

‘零数据保留’声明与 OpenRouter 自身政策不符

OpenCode 在免费周的发布宣传中使用了‘零数据保留’这一短语,与 100 万 token 上下文窗口和多模态支持并列。但 OpenRouter 自身的 stealth/ox-alpha 模型页面声明提示和生成内容由提供方保留,仅不用于训练 [1]——这与真正的零保留有实质性差异,在免费前沿级访问的兴奋中容易被忽视。

第三方报道在发布时就指出了营销语言与实际声明政策之间的差距 [4]。对于一个开发者未知且按设计不可问责的模型,这种区别比对知名实验室更重要:用户通过‘零数据保留’免费试用发送专有代码或敏感提示,无法验证谁在保留其数据,或保留多久,仅依赖 OpenRouter 的标准免责声明,即其仅路由请求。

一项审查测试使‘它来自中国’理论复杂化

并非所有侦探工作都是技术性的。在 Reddit 上,用户用敏感的中国相关问题测试 Ox Alpha,发现其回答比典型的中国开发模型更开放,后者通常会拒绝或回避这些话题。由此产生的标题为‘Ox Alpha 不可能是中国的’的讨论帖认为,这种行为证据与分词器和基准证据支持的 GLM/智谱归因相矛盾。

其他用户反驳称,内容护栏通常作为与基础模型训练数据分离的过滤层应用,因此模型在架构和分词器层面可以是 GLM 基础,但根据其安全层在特定部署中的配置,对敏感政治问题的回答可能不同。这种区分——行为测试衡量护栏配置,技术测试衡量模型血统——是一个有用的提醒,即在这些隐身模型谜团中,并非所有‘证据’都具有同等分量,这一点在更广泛的竞争归因理论综述中隐含 [2]

前沿基准声明与免费层级经济性的怀疑相冲突

在性能方面,上述 10 项 DeepSWE 基准测试中,Ox Alpha 得分为 80%,而 Fable 为 65%,GLM 5.3 和 Grok 4.6 均为 62%,GPT 5.6 为 52% [5]——这一结果足够强劲,以至于更有趣的问题不是分数本身,而是提供它的免费层级是否经济可持续。社区在其他地方的测试报告了在非正式编码和视觉生成任务上的类似相对排名,尽管小样本量(10 题基准)也招致了对其过度解读的怀疑。

这种怀疑延伸到发布背后的商业逻辑。涵盖发布的理论综述指出,即使智谱 AI 是否拥有足够的计算能力来维持每日 100 万亿 token 的免费服务能力也存疑 [2],另有报道指出至少一位用户在首次提示时即遭遇速率限制——直接削弱了用于营销免费周的‘近乎无限使用’声明 [3]。前沿级基准分数和听起来不可持续的免费提供,在此情况下是同一未解之谜的两面。

历史背景

更早的匿名隐身模型 Pony Alpha 后来被揭示为智谱 AI 的 GLM-5,一款 7440 亿参数的专家混合模型。
匿名隐身模型 Hunter Alpha 随后被揭示为小米的 MiMo-V2-Pro。
匿名隐身模型 Elephant Alpha 后来被归因于蚂蚁集团的灵犀 Ling-2.6-flash。
于 2026 年 4 月下旬出现的匿名隐身模型 Owl Alpha,后来被揭示为美团的 LongCat-2.0。
Ox Alpha 作为这一模式中第五个匿名‘Alpha’命名模型出现在 OpenRouter 和 OpenCode 上,社区指纹识别工作在发布数日内即开始。

关键关系图

关键玩家
主题

Ox Alpha 隐身 AI 模型:一款匿名发布在 OpenRouter 和 OpenCode 上的模型,具备 100 万 token 的多模态上下文窗口和免费近乎无限使用的特性,引发社区侦探式追踪——分词器指纹分析最强烈指向未公开发布的智谱 AI GLM 模型,但其开发者身份仍未披露。

OP

OpenRouter

Platform hosting the model under the identifier stealth/ox-alpha; explicitly disclaims being the developer, owner, or provider

OP

OpenCode

Terminal-based coding agent tool that added Ox Alpha to its free Zen plan and publicized its 100T-token/day capacity claim

Z.

Z.ai / Zhipu AI

Leading suspected developer, based on tokenizer fingerprinting matching the GLM family and forensic benchmarking; possibly an unreleased GLM-5.3 or GLM-6 variant

XI

Xiaomi (MiMo team)

Secondary suspected developer, based on Xiaomi's history of anonymous stealth releases and a CFO comment about a new MiMo generation in training

事实来源

5 条引用
  1. [1] OpenRouter: stealth/ox-alpha model card
  2. [2] Which Lab Is Behind The Viral Ox Alpha Model? These Are The Theories
  3. [3] Stealth Model Ox Alpha Available For Free For A Week On OpenRouter And OpenCode
  4. [4] Ox Alpha Stealth Model: What We Know
  5. [5] A Mystery Model Called Ox Alpha Just Topped Coding Benchmarks For Free

来源文章

Top 5

THE SIGNAL.

Analysts

进行了探测测试,将 Ox Alpha 的分词器与已知 GLM 分词器对比,发现所有测试中完全匹配。

Sushaanth Srinivasan
分词器分析支持 GLM/智谱归因理论

认为 Ox Alpha 使用 cl100k_base 分词器,与 GLM 理论相矛盾,反而仅与微软的 Phi/MAI 模型家族匹配。

Robert Lukoszko
将 Ox Alpha 归因于微软的 Phi/MAI 系列而非 GLM

结合指向 GLM 的分词器线索和指向 xAI 的服务基础设施线索,将结果命名为‘Composer 3’。

Gael Breton
提出混合理论——基于 GLM 的模型通过 xAI 基础设施提供服务

引用早期在 SWE 和网络类别中的基准结果,作为其优于当前所有前沿模型的证据。

Ananay Arora
强烈断言 Ox Alpha 是智谱 AI 的 GLM 模型,可能命名为 GLM-6

在 10 项 DeepSWE 子集上进行了法医和基准分析,Ox Alpha 超越了 GLM 5.3、Grok 4.6 和 GPT 5.6,得出结论其可能是未发布的 GLM-5.3 系列变体。

Ben Davis (independent researcher)
99% 确信 Ox Alpha 源自中国的 Z.ai(智谱 AI)
The Crowd

Ox Alpha (stealth model) is free for the next week - 1M Context - Multi-modal - Zero Data Retention Generous rate limits, near unlimited usage We have capacity for 100T tokens per day, lets see what you can do

@@opencode14309

New stealth model: Ox Alpha Ox Alpha is a frontier model built for efficient coding, sustained agentic work, and real-world production use. - 1M token context window - Text, image, and video input Try it now and share feedback to improve the model!

@@OpenRouter3855

JUST IN: Mysterious new “Ox Alpha” AI model appears on OpenRouter with a 1 million token context window, multimodal capabilities, & no disclosed owner.

@@Polymarket1463

A stealth model called Ox-Alpha has been released, outperforming Fable on SWE.

@u/troll_khan681
Broadcast
Ox Alpha Is INSANE – Testing the Mysterious New Stealth Model!

Ox Alpha Is INSANE – Testing the Mysterious New Stealth Model!

OX Alpha FREE — Testing the Mysterious Stealth AI Model

OX Alpha FREE — Testing the Mysterious Stealth AI Model

Ox Alpha (FR*EE Stealth Model) - The AI Model Built for Long Horizon Coding & Complex Reasoning

Ox Alpha (FR*EE Stealth Model) - The AI Model Built for Long Horizon Coding & Complex Reasoning