Google Gemini 4 Argon 发布及受限的 Fairwind 访问权限
TECH

Google Gemini 4 Argon 发布及受限的 Fairwind 访问权限

30+
Signals

战略概览

  • 01.
    谷歌于2026年9月30日在其官方博客上宣布推出 Gemini 4 Argon,将其定位为面向软件工程、企业知识工作和网络安全防御的前沿智能模型。
  • 02.
    该模型的输出令牌限制已扩展至行业领先的1,000,000个,高于上一代的64,000个。
  • 03.
    Argon 在 CWE-bench v1 网络安全基准测试中以68%的得分与 GPT-6 Astra 并列第一。
  • 04.
    谷歌正通过其 Fairwind 项目向受信任的防御方以及内部谷歌团队独家发布移除网络安全限制的 Argon 版本,而公开版本则保留标准防护措施。
  • 05.
    入门定价为每百万输入token 2美元、每百万输出token 10美元,缓存输入token可享受95%的折扣;入门期后的标准定价为每百万输入token 4美元、输出token 20美元,与Claude Opus 5.5的基础定价一致。
  • 06.
    Argon 正分阶段推出,首先面向受信任的网络安全合作伙伴,而非面向所有开发者开放,谷歌正与美国政府协调在发布前进行安全评估。
  • 07.
    Argon 能够在无需人工协助的情况下自主定位、验证并修补关键软件漏洞,包括通过安全供应商 Wiz 的免费 Scan for Good 项目发现的、此前前沿模型均未察觉的全球医院所用医疗软件中的严重漏洞。
  • 08.
    发布次日,Alphabet 股价在盘前交易中上涨1.9%。

深度分析

双用途的访问控制机制:为何谷歌刻意保留其最佳模型

Gemini 4 Argon 在 CWE-bench v1 网络安全基准测试中以68%的得分并列第一 [1],并且能够无需人工干预自主定位、验证并修补关键软件漏洞 [2]。正是这种自主发现漏洞的能力,使得谷歌不愿向所有人开放无限制版本。内部团队及650多个 Fairwind 项目合作伙伴——包括政府、关键基础设施运营商、核心科技平台和学术防御研究机构 [3]——可获得移除网络安全限制的 Argon 版本,而公开发布版本则保留标准防护措施 [1]。Fairwind 的访问并非随意:合作伙伴必须使用防钓鱼的多因素身份验证,将使用范围限制在内部安全、事件响应和渗透测试团队,追踪员工访问记录,并通过合作伙伴组织本身的背景审查 [3]。谷歌还正与美国政府协调分阶段推出,在扩大访问前进行发布前的安全评估 [4]。Fairwind 项目自身描述中的明确框架是:受信任的防御方将获得一个适应窗口——即领先优势——在此之前,该能力的攻击性用途尚未扩散 [3]。

营销差距:自我报告的基准分数遭遇员工质疑

Argon 的标志性成就是在 CWE-bench v1 上以68%的得分与 GPT-6 Astra 并列 [1],但该分数来自谷歌自身的公告,且 Argon 并未立即作为广泛可用的开发者模型推出,外部研究人员无法在首日进行压力测试 [5]。独立方面对该模型实际地位的评估更为保守:the-decoder 引述的行业分析师称 Argon 与 OpenAI 的最佳模型水平相当,但落后于 Anthropic 的模型,认为这是对一家七个多月未推出新前沿模型的公司而言的一次强劲复苏,而非明确胜利 [6]。这种发布宣传与独立评估之间的差距,因另一份报告而进一步加剧:拥有直接访问权限的谷歌员工对 Argon 的实际编码表现表示怀疑,尽管公司正在公开宣传其发布 [7]。这并不意味着基准数字是虚假的,但它确实意味着公告中最响亮的数字目前是独立验证最少的。

实际中访问控制的重要性:其他模型错过的医院软件漏洞

限制 Argon 无限制版本的最清晰现实论据并非理论性的。安全供应商 Wiz 已在使用其免费的 Scan for Good 项目运行 Argon,该项目扫描关键公共基础设施中的高风险暴露并免费修复 [2]。通过该项目,Argon 发现了一个暴露敏感个人信息的严重漏洞,存在于全球医院使用的医疗软件中——而此前的前沿模型完全错过了这一漏洞 [2]。这一发现直接解释了为何 Fairwind 的合作伙伴名单如此构建:该项目650多个合作伙伴明确包括医疗、电信、能源和金融等关键基础设施运营商 [3],正是 Wiz 发现所涉及的行业。一个能够发现医院自身安全团队都未察觉漏洞的模型,从定义上讲,也可能帮助攻击者率先发现相同漏洞——这正是将无限制版本仅通过经审查的防御方而非公开 API 密钥分发的全部理由。

竞争背景:定价、七个月的空窗期与网络安全模型先例

Argon 的发布发生在谷歌七个多月未推出新前沿模型之后,竞争对手借此拉开了差距 [6]。定价反映了这种压力:Argon的入门定价——每百万输入token 2美元、每百万输出token 10美元——在入门期内将GPT-6 Astra的标价API价格压低了约五倍,之后将过渡至标准的每百万输入token 4美元、输出token 20美元定价,与Claude Opus 5.5的基础定价持平 [5]。Omdia 首席分析师 Lian Jye Su 将此次发布描述为谷歌在追赶而非明确领先,指出该公司在网络安全和编码领域起步较晚,但 Gemini 4 将其重新推回前沿,尤其是在网络安全方面 [8]。对网络安全调优模型进行访问限制对谷歌而言也并非新举措:2026年7月在 CodeMender 项目中宣布的 Gemini 3.5 Flash Cyber 已仅限于政府和受信任合作伙伴 [9],其姊妹模型 Gemini 3.8 Flash Cyber 在 CWE-bench v0 上的得分构成了 Argon 当前所领先的直接基准谱系 [10]。

历史背景

宣布推出 CodeMender 项目中的安全调优模型 Gemini 3.5 Flash Cyber,访问权限仅限于政府和受信任合作伙伴——这是对双用途网络安全模型进行访问限制的早期先例。
前代模型在 CWE-bench v0 上以47.2%的 Pass@1 得分,平均每次运行成本为3.64美元,相比之下 Fable 5 为47.8%,GPT-5.6 Sol 为44.2%,构成了 Argon 当前所领先的基准谱系。
通过其官方博客公开发布 Gemini 4 Argon,初始访问通过 Fairwind 项目进行,而非全面开放。

关键关系图

关键玩家
主题

Google Gemini 4 Argon 发布及受限的 Fairwind 访问权限

事实来源

10 条引用
  1. [1] Gemini 4 Argon: our next era of frontier intelligence
  2. [2] Google's Gemini 4 Argon can find and patch critical vulnerabilities
  3. [3] Fairwind Program
  4. [4] Google Gemini 4 arrives as Wall Street shifts to personal agents
  5. [5] Google unveils Gemini 4 Argon, retaking benchmark lead over OpenAI and Anthropic - but in limited release
  6. [6] Google's Gemini 4 Argon closes the gap with OpenAI and Anthropic but doesn't take a clear lead
  7. [7] Google grapples with employee skepticism about new Gemini model
  8. [8] Tech Download: Google's Argon, the frontier race with OpenAI and Anthropic
  9. [9] Google's Flash Cyber and CodeMender target cybersecurity
  10. [10] Gemini 3.8 Flash Cyber CWE-bench benchmarks

来源文章

Top 5

THE SIGNAL.

Analysts

“谷歌在网络安全和编码领域‘起步较晚’,但 Gemini 4 将公司推回了人工智能前沿,尤其是在网络安全方面。”

Lian Jye Su, Chief Analyst, Omdia
Google is catching up rather than clearly leading

“根据早期独立证据,Argon 与 OpenAI 的最佳模型水平相当,但落后于 Anthropic 的模型,这对于一家七个多月未推出新前沿模型的公司而言是一次强劲复苏。”

Unnamed industry analysts cited by the-decoder
Argon is a recovery, not a clear win
The Crowd

“Introducing Gemini 4 Argon – our new frontier model. It's built for complex workflows across coding, enterprise knowledge work, and cybersecurity defense – rolling out today to a set of trusted testers through our Fairwind Program.”

@@GoogleDeepMind42888

“SITUATION EXPLAINED: Google says Gemini 4 Argon wins 14 of 19 benchmarks. Its employees say it's benchmaxxed. - Google's first frontier model since Gemini 3 last November, with a new high of 77.9% on DeepSWE - Bloomberg: employees with direct access say it struggles on real tasks”

@@MTSlive94

“🤡想想挺搞笑的:Google 又发布了一个你用不了的“最强模型”! Gemini 4 Argon 昨天官宣了。 基准写得很满:长程软件工程 DeepSWE 季称 77.9%,知识工作、网络安全也领先或并列第一,输出拉到 1M tokens,入门价 $2 / $10 每百万 token。 问题只有一个:普通开发者、API 访问被限制”

@@NFT_Chen44

“Gemini 4 Argon solved hallucinations.”

@u/drhenriquesoares1600
Broadcast
Gemini 4 Argon

Gemini 4 Argon

Gemini 4 Argon (In-depth benchmark analysis): Did Google make a big comeback?

Gemini 4 Argon (In-depth benchmark analysis): Did Google make a big comeback?

Gemini 4 Argon: Is Google Actually Back?

Gemini 4 Argon: Is Google Actually Back?