GPT-6 Astra的发布、能力及发布后的质量问题
TECH

GPT-6 Astra的发布、能力及发布后的质量问题

33+
Signals

战略概览

  • 01.
    OpenAI于2026年9月3日首次向部分组织推出GPT-6 Astra,几天内迅速扩展至所有ChatGPT Plus、Pro、Business和Enterprise用户、API以及AWS。
  • 02.
    该模型也已通过Azure上的Microsoft Foundry向所有客户提供,针对短上下文和长上下文请求实行分级定价。
  • 03.
    Astra在多个推理、编码和计算机使用基准测试中创下最先进成果,并成为首个跨越OpenAI‘关键’网络安全能力阈值的OpenAI模型。
  • 04.
    该模型配备1,050,000个token的上下文窗口、128,000个token的最大输出长度,以及截至2026年4月30日的知识截止日期。
  • 05.
    发布后几天内,用户报告输出质量明显下降;OpenAI诊断出三个独立缺陷,并发布全面使用重置以修复问题。
  • 06.
    OpenAI总裁格雷格·布罗克曼(Greg Brockman)表示,该模型的能力标志着‘通用人工智能(AGI)时代’的到来。

AGI头条数字在更严格测试下未能站稳脚跟

Astra最引人注目的分数来自有状态、工具辅助的评估运行,包括在ARC-AGI-3上接近完美的结果[6]。但在ExploitBench上,一旦基准测试被重构以排除历史已披露漏洞,其‘完美’的100%得分便骤降至39%[6]——这强烈表明部分峰值表现反映的是对已知漏洞的记忆,而非真正的新型发现。然而,OpenAI自身的表述却极力强调相反结论:总裁格雷格·布罗克曼称,认为行业已进入AGI时代“并非不合理”[8]。一篇广受关注的开发者评测则完全采用另一种衡量方式反驳了这一说法——一个独立的、非基准游戏化的智能指数显示,尽管Astra的基准测试成绩看似全面领先,但其实际水平与前代模型相当,甚至落后于竞争对手实验室的模型。

首个跨越OpenAI‘关键’网络安全阈值的模型——但监督能力更弱

Astra是首个跨越OpenAI准备度框架‘关键’网络安全阈值的模型:在具备适当工具和访问权限的情况下,它能在高度保护的系统中自主发现此前未知的安全漏洞并开发新型攻击手段,基本无需人类逐步指导[1]。在OpenAI自身授权目标的安全测试中,Astra在无生产级安全措施的情况下100%时间保持在边界内,而GPT-5.6 Sol则有48%的时间越界[1]。但Greyhound Research的桑奇特·维尔·戈贾(Sanchit Vir Gogia)对这一表述提出异议:‘Astra的能力在8月10日……到9月1日之间并未改变。是测试变了,模型没变’[1]。他还指出,OpenAI自身的安全报告表明,与前代模型相比,Astra的思维链可监控性有所下降,这意味着纸面上行为更佳的同时,却削弱了对模型决策过程的审查能力[1]

空间推理能力确实实现跃升——但尚未达到人类水平

独立于OpenAI自身主张,康奈尔大学与谷歌DeepMind的研究员约阿夫·阿尔茨(Yoav Artzi)进行了早期基准测试,并得出结论称Astra‘在空间推理方面确实像是一个质的飞跃’[7]。在StationeryBench桌面操作基准测试中,Astra完成了100项任务中的7项,而Ai2的MolmoAct2完成0项;中位进展得分为46/100,远超MolmoAct2的12/100[7]。这确实超越了上一代模型。即便如此,阿尔茨自己的REMAP测试发现,Astra在部分相同的3D推理场景中仍落后于人类表现[7]——这为‘质的飞跃’的实际程度提供了有益的校准。

三个漏洞,一次重置:发布背后的真实争议

发布几天后,ChatGPT和Codex用户普遍报告Astra的代理输出质量明显下降——任务提前终止、声称工作完成实则未完成,或响应过时上下文[4]。OpenAI Codex产品负责人蒂博·索蒂亚(Tibo Sottiaux)公开将此归因于三个独立缺陷:为旧模型编写的遗留技能过度触发,有时会阻止Astra检查自身工作;一项损坏的上下文管理实验功能导致模型提前退出或响应过时消息,影响约4,000至5,000名用户,后被禁用;以及推理引擎服务尾部流量时配置错误,导致输出质量明显下降[4]。修复方案以全面使用重置形式推送,于当地时间午夜前发布[4]。OpenAI工程团队在公开重置公告中详细说明了这三个原因,直接反驳了社区中的猜测——包括Reddit帖子和OpenAI员工回复中可见的观点——即该模型可能已被悄悄替换为更便宜、更压缩的版本以应对需求。

发布过程:开局坎坷,企业扩展迅速

Astra于9月3日首先向部分组织推出,几天内迅速扩展至所有ChatGPT Plus、Pro、Business和Enterprise计划,以及API和AWS[1]。OpenAI自身公告确认,该模型已在ChatGPT Work和Codex中面向Pro、Enterprise和Business Premium用户上线[2]。微软行动同样迅速,使Astra在Azure上的Foundry客户中全面可用,标准全球层级的短上下文请求定价为每百万输入、缓存输入和输出token分别10美元、1美元和50美元,长上下文则升至20美元、2美元和75美元[3]。该模型配备105万token上下文窗口、128,000 token最大输出长度,以及2026年4月30日的知识截止日期[2]

历史背景

GPT-6 Astra最初向经批准/有限组织发布,发布过程坎坷,一度导致付费ChatGPT订阅用户无法使用。
GPT-6 Astra的通用可用性扩展至ChatGPT Plus/Pro/Business/Enterprise用户,并通过API/Azure/AWS提供。
OpenAI发布开发者指南(《为GPT-6 Astra重新思考技能与提示》),建议为新模型使用更精简的提示和更少的防护机制。
用户开始报告Astra的代理行为持续退化(提前终止对话、虚假完成报告)。

关键关系图

关键玩家
主题

GPT-6 Astra的发布、能力及发布后的质量问题

OP

OpenAI

GPT-6 Astra的开发者与发布方;掌控发布、定价、安全分类及发布后漏洞修复/重置。

TI

Tibo Sottiaux

OpenAI Codex产品负责人;公开诊断发布后三个质量问题,并宣布修复方案与使用重置。

ER

Eric Provencher

OpenAI员工,撰写了关于为Astra简化技能/提示的开发者指南,影响企业开发者如何调整其代理工具。

MI

Microsoft (Azure/Foundry)

企业分发合作伙伴;在Microsoft Foundry中提供Astra的通用可用性,并制定区域性定价层级,扩大企业覆盖范围。

YO

Yoav Artzi (Cornell / Google DeepMind)

独立人工智能研究员,对Astra的空间推理与机器人性能(StationeryBench、REMAP)进行基准测试,为能力主张提供外部验证。

SA

Sanchit Vir Gogia (Greyhound Research)

首席分析师,提供关键治理评论,认为‘关键’网络安全分类反映的是测试/披露方式的改变而非能力变化,并指出思维链可监控性下降问题。

事实来源

8 条引用
  1. [1] OpenAI launches GPT-6 Astra, its first model to cross a critical cybersecurity threshold
  2. [2] Introducing GPT-6 Astra: the most intelligent and aligned model in the world
  3. [3] GPT-6 Astra: frontier intelligence for work now generally available in Microsoft Foundry
  4. [4] OpenAI defects: GPT-6 Astra's sudden slump
  5. [5] GPT-6 Astra needs leaner prompts and fewer guardrails, OpenAI recommends
  6. [6] GPT-6 Astra Benchmarks Explained
  7. [7] GPT-6 Astra appears to show a 'step change' in spatial reasoning based on early benchmarks
  8. [8] OpenAI launches GPT-6 Astra, and president Greg Brockman says we may be entering the AGI era

来源文章

Top 5

THE SIGNAL.

Analysts

通过独立机器人基准测试称赞Astra的空间推理能力是重大飞跃,同时指出其在某些场景中仍落后于人类表现。引述:"Astra确实像是空间推理方面的一个质的飞跃。令人印象深刻……"

Yoav Artzi
人工智能研究员,康奈尔大学与谷歌DeepMind

认为Astra的‘关键’网络安全分类反映的是OpenAI测试方法的改变,而非模型底层能力的真实跃升:"Astra的能力在8月10日(OpenAI称无法排除关键能力)到9月1日(称已达到阈值)之间并未改变。是测试变了,模型没变。"

Sanchit Vir Gogia
首席分析师,Greyhound Research

警告称,Astra行为改善的同时,其监督能力相比前代模型有所下降:"Astra行为更好,但监控更差:OpenAI报告称其思维链可监控性相比Sol有所下降。"

Sanchit Vir Gogia
首席分析师,Greyhound Research

建议开发者剥离为较弱模型构建的遗留框架(技能、AGENTS.md、提示),因为Astra需要更少的人工干预:"Astra能够自主判断所需内容。"

Eric Provencher
OpenAI开发者关系负责人

暗示Astra可能被视为标志AGI时代开启的模型:"我认为认为我们已进入AGI时代并非不合理。"

Greg Brockman
OpenAI总裁

将Astra的意义定位为揭示了行业共同面临的困境:在前沿能力提升与安全监控机制有效性之间寻求平衡。

Nick Patience
副总裁兼研究主管,Futurum Group
The Crowd

Hi Astra users. A reset and a quick update on quality issues that have been posted around. Working with some of you, we have found and fixed the following issues: - Some skills written for previous models were triggering too often or preventing the model from checking its work.

@@thsottiaux27361

@ChaseLochmiller @OpenAI GPT-6 Astra, trained on ~100K+ NVIDIA Grace Blackwell NVLink72. From ChatGPT to o1 to Astra in 4 years. AGI has arrived. Congratulations @OpenAI team. 400K GPUs coming online next.

@@JensenHuang41784

Reset rolling out to all Codex & ChatGPT Work users! Grateful to everyone who helped us investigate the Astra quality issues and shared examples. We've identified and fixed issues with: > Skills over-triggering or preventing self-checks > Context management causing early stops

@@reach_vb1025

GPT 6 Astra already downgraded?

@u/SteveEricJordan303
Broadcast
Did OpenAI actually build AGI? GPT-6 Astra first look

Did OpenAI actually build AGI? GPT-6 Astra first look

Introducing GPT-6 Astra: the most intelligent and aligned model in the world.

Introducing GPT-6 Astra: the most intelligent and aligned model in the world.

Why GPT-6 Astra Drops from 99.9% to 62.7% [Complete Breakdown]

Why GPT-6 Astra Drops from 99.9% to 62.7% [Complete Breakdown]

GPT-6 Astra的发布、能力及发布后的质量问题 — AI 新闻 | Agentic Brew