法证追踪:为无名模型“指纹”溯源
Ox Alpha 于2026年8月20日出现在 OpenRouter 上,仅列在通用的‘stealth’(隐形)提供商类别下,未附带公司名称、标志或新闻稿 [1]。这一信息真空使身份猜测演变为一场公开的研究项目。8月22日,一位名为 Chetaslua 的研究者通过模型API触发了一条Java堆栈跟踪,暴露出一个与智谱AI已知API路径匹配的内部类路径,这被视作路由层的实现细节泄露,而非社区的又一次猜测 [2][3]。独立的分词器测试发现,在涵盖14种书写系统的约30个提示中,Ox Alpha 的token计数始终比智谱的 GLM-5.3 多出75个,这种指纹极难偶然伪造 [3]。测试者还将比较推向更敏感的领域:一次实时测试中,Ox Alpha 被问及台湾是否属于中国,其回答与 GLM 的回答几乎完全一致,这一数据点被一些人解读为支持智谱关联的间接证据。在 Kingbench 基准测试中,Ox Alpha 得分为87.5%,虽略低于 GLM-5.3 的91.25%,但差距不足4个百分点,远超 Opus 4.8 和 Qwen 3.8 Max [4]。对其行为的独立分析还估计其架构为约7440亿参数的混合专家模型,活跃参数约400亿,但该数据为推断所得,并非官方披露 [5]。代码生成基准测试则呈现更复杂的结果:最初的10道 DeepSWE 测试题中,Ox Alpha 以80%的通过率直接击败 Fable 5、GLM-5.3 和 GPT-5 [5][10];但同一位测试者后续的113项任务测试中,通过率仅为63%,被描述为‘与 GPT-5.6 Sol mid 水平相当’,而非明显领先 [6]。小样本基准测试容易引发病毒式传播的断言,但结论往往不可靠。并非所有对比测试都明确支持智谱:一位测试者在个人编码挑战基准中注意到其风格与 GLM 的已知特性相似,但最终排除了 GLM、Gemini、GPT 和 DeepSeek 的可能性,认为即使经过细致的手动测试,其身份仍真正存疑。


