智谱AI的GLM-5.3-Flash神秘模型发布
TECH

智谱AI的GLM-5.3-Flash神秘模型发布

28+
Signals

战略概览

  • 01.
    智谱AI(Z.ai)于2026年8月26日确认,在OpenRouter和OpenCode上以代号‘牛阿尔法’(中国用户昵称为‘牛来’)测试的匿名模型,正是其新款GLM-5.3-Flash。
  • 02.
    GLM-5.3-Flash是一款原生多模态专家混合模型,总参数量达3200亿,每token激活180亿参数。
  • 03.
    该模型上下文窗口约为100万token,并以MIT许可证发布,权重已上传至Hugging Face。
  • 04.
    标准API定价为每百万输入token 0.15美元,每百万缓存输入token 0.03美元,每百万输出token 0.50美元。

社区在智谱AI承认前就已‘指纹识别’牛阿尔法

当‘stealth/ox-alpha’于2026年8月20日悄然出现在OpenRouter上时,它既无公司名称、也无参数数量或技术报告——价格甚至显示为两个零[1]。但这一信息真空并未阻止开发者推断其归属。研究人员进行了一项分词器测试,发现其与智谱AI的GLM-5.3在分词上存在恒定的75个token差异,将其视频编码器与GLM-5V-Turbo逐token比对,并注意到其API错误格式与智谱现有服务一致[1]——三项独立的技术指纹均指向同一家实验室,比任何官方确认早了数天。

智谱AI自身对该事件的描述与上述推断吻合:该模型在OpenCode和OpenRouter上匿名测试,正是为了在正式发布前收集真实世界反馈[2]。这是一种刻意策略,而非意外泄露——一款具备前沿能力的模型以虚假身份测试,以确保使用模式和错误报告反映的是真实开发者行为,而非发布日的炒作效应。智谱AI于2026年8月26日通过其官方X账号确认身份,并发布模型权重,正式将牛阿尔法与GLM-5.3-Flash关联[3]。此次揭晓几乎完全验证了社区的侦探工作——这既说明了智谱技术指纹的可追溯性,也体现了社区调查的高超水平。

牛阿尔法的匿名试运行成为OpenRouter史上最大发布

试运行期间的数据才是真正的大新闻。该模型在正式发布前已处理了62万亿token;发布后,它在OpenRouter的编码系统中排名第一,处理了10.3万亿token——约占每周编码总量的31%,并占据平台总周token份额近20个百分点,同期超过DeepSeek两倍以上[4]。对于一款在大部分使用期间都无人能正式命名的模型而言,这种采用曲线异常迅猛。

关注进一步加剧,因为关注者身份特殊。Stripe首席执行官帕特里克·科里森(Patrick Collison)公开称该匿名模型“非常令人印象深刻”——时机值得注意,因为Stripe就在前一天刚刚收购了OpenRouter[5]。一款无名模型表现优于知名竞品,加上高调背书,正是为何这款隐身模型在智谱AI发声前,已成为一篇报道所称的‘时间线上的热议话题’[5]。其他报道则直白地指出:GLM-5.3-Flash凭借超低定价‘主导’了OpenRouter[6]

‘无需英伟达’的声明推动股价——但至今未获验证

智谱AI称,GLM-5.3-Flash的全部推理负载运行在约10万台国产中国芯片上,而非英伟达硬件[7]。这一声明产生了真实金融影响:智谱AI在港交所上市的股票在发布后收盘上涨逾12%,市场将此解读为证据,表明中国实验室可完全依赖国产硅基芯片运行一款登顶榜单的模型[4]

但这也是故事中外界无法核实的部分。确切的芯片数量和供应商均无法独立确认,智谱AI也拒绝透露是哪些芯片制造商生产了这些硬件——使得国产芯片的说法完全依赖公司自身陈述[8]。这一信息缺口至关重要,因为该声明承载着沉重的地缘政治分量:它被解读为一个信号,表明中国AI产业可在出口管制背景下,无需英伟达处理器即可处理大规模全球推理工作负载[4]。更广泛的报道将此视为更大趋势的一部分——价格压缩与开放权重正迫使闭源模型提供商加速效率优化,预示着一个更趋多极化的AI基础设施格局,其中成本领先和硬件多样性将成为主要差异化因素[9]。股价上涨和病毒式传播的使用图表是真实的;但其下隐藏的未具名、未验证的芯片供应链,为‘中国不需要英伟达’这一叙事提供的基础,远比报道本身所暗示的要脆弱得多。

‘百分之一价格’的说法经不起细看

智谱AI创始人唐杰将GLM-5.3-Flash的经济性表述得极为鲜明:人工智能分析指数评分为57,价格约为前沿模型的1/100,同时仍占据OpenRouter近20%的周token份额[10]。公布的API标准定价在纸面上支持了‘便宜’这一说法——每百万输入token 0.15美元,每百万缓存输入token 0.03美元,每百万输出token 0.50美元[11]

但正是这个 headline 数字,在开发者将其用于真实代理工作负载后,集中引发了怀疑。问题出在缓存输入费率:开发者将其与DeepSeek的Flash层级定价直接比较后指出,一旦计入缓存命中行为,GLM-5.3-Flash的实际缓存费率约为DeepSeek的两倍——大幅侵蚀了表面节省的成本。这种张力具有启发意义:基准分数和每token标价容易写入发布公告;但模型在持续、高缓存、真实编码流量下的定价表现,才是决定‘百分之一价格’对决定是否迁移的团队是否成立的关键数字。

历史背景

神秘模型‘stealth/ox-alpha’于2026年8月20日悄然出现在OpenRouter上,无公司名称、参数数量或技术报告,价格为零。
智谱AI通过其X账号正式确认牛阿尔法即GLM-5.3-Flash,并在Hugging Face上以开放权重形式公开发布该模型。
智谱AI在港交所上市的股票在发布及强劲的OpenRouter使用数据后,收盘上涨逾12%,达1160港元。

关键关系图

关键玩家
主题

智谱AI的GLM-5.3-Flash神秘模型发布

Z.

Z.ai / Zhipu AI

开发GLM-5.3-Flash的中国AI实验室,通过匿名‘牛阿尔法’隐身测试收集真实世界反馈,后于2026年8月26日正式确认模型身份。

JI

Jie Tang

智谱AI创始人,公开确认牛阿尔法的身份、其基准分数、相比前沿模型的定价,以及其运行于国产中国芯片上并占据OpenRouter周token份额榜首的事实。

OP

OpenRouter

模型市场,自2026年8月20日起托管匿名‘stealth/ox-alpha’列表,该模型随后登上周使用量排行榜首位。

PA

Patrick Collison (Stripe CEO)

公开称该神秘模型‘非常令人印象深刻’——值得注意的是,Stripe就在前一天收购了OpenRouter。

ZH

Zhipu AI (Hong Kong-listed shares)

市场对发布做出直接反应:在公告及报道的OpenRouter使用数据后,股价收盘上涨逾12%。

事实来源

12 条引用
  1. [1] Ox Alpha: The Mystery Model That Topped OpenRouter Usage
  2. [2] Z.ai launches GLM-5.3-Flash under MIT license
  3. [3] Zhipu identifies Ox Alpha as GLM-5.3-Flash and releases model weights
  4. [4] Zhipu AI shares jump after viral Ox Alpha model revealed as GLM-5.3-Flash, running on Chinese chips
  5. [5] GLM-5.3-Flash: The Stealth Model That Became the Talk of the Timeline
  6. [6] GLM-5.3-Flash Dominates OpenRouter With Ultra-Low Pricing
  7. [7] Zhipu's GLM-5.3-Flash Runs on 100,000 Domestic Chips
  8. [8] Ox Alpha Was GLM-5.3-Flash: China Inference Chip Claim Stands Unverified
  9. [9] The Chinese AI model GLM-5.3-Flash runs without Nvidia and costs a fraction of what the competition does
  10. [10] Ox Alpha (GLM-5.3-Flash) Was Powered by Pure Chinese Chips, Is Priced at 1/100th of Frontier: Z.ai Founder Jie Tang
  11. [11] Z.ai Releases GLM-5.3-Flash, a 320B-A18B Natively Multimodal MoE with a 1M-Token Context
  12. [12] GLM-5.3-Flash - Z.ai Docs

来源文章

Top 5

THE SIGNAL.

Analysts

称这款匿名神秘模型令人印象深刻。

Patrick Collison
Stripe首席执行官(该公司刚收购OpenRouter)

确认牛阿尔法即GLM-5.3-Flash,公布了其基准分数、相比前沿模型的超低定价,并称其完全运行于国产中国芯片上,同时占据OpenRouter周token份额榜首。

Jie Tang
智谱AI创始人
The Crowd

Ox Alpha has been unveiled as GLM-5.3-Flash, but what's shocking is that the 100T tokens per day is served on Chinese chip. (1/3)🧵

@@SemiAnalysis_2842

Ox Alpha = GLM-5.3 Flash AA = 57 , 1/100 frontier price, Powered by pure Chinese chips. Delivered nearly 20% weekly token share (no. 1) on OpenRouter. Thanks to all for the support.

@@jietang2558

FREE access boosted again! The viral mystery model Ox Alpha has officially revealed its true identity as GLM-5.3-Flash—now live with 100% free access! As the first natively multimodal model in the GLM-5 series, GLM-5.3-Flash packs 320B total...

@@BAI_AGI253

GLM-5.3-Flash: Frontier Intelligence, Flash Cost

@u/BriguePalhaco1300
Broadcast
GLM 5.3 Flash (Fully Tested): What do you need to RUN THIS LOCALLY?

GLM 5.3 Flash (Fully Tested): What do you need to RUN THIS LOCALLY?

GLM 5.3 Flash Might Be The New Mystery Model & NEW DeepSeek Model!

GLM 5.3 Flash Might Be The New Mystery Model & NEW DeepSeek Model!

GLM 5.3 Flash JUST DROPPED... And It's Almost As Good As MAX?!

GLM 5.3 Flash JUST DROPPED... And It's Almost As Good As MAX?!