9 月 3 日(周四),OpenAI 正式发布 GPT-6 Astra。Axios 的标题直接引了 OpenAI 高管的原话:“Welcome to the AGI era”。
但这条新闻真正的看点不是 AGI 话术,而是时间线:8 月 7 日,OpenAI 宣布因 Astra 可能触及网络安全的"Critical"能力阈值而放缓开发;27 天后,它带着一整套新的安全机制直接发布了。而且这不是孤立事件——9 月 1 日 Anthropic 发 Fable/Mythos 5.1,9 月 2 日 Google 发 Gemini 3.8 Flash/Cyber,9 月 3 日 OpenAI 发 Astra。三大厂,四天,四连发,每一发都把"安全"写进了卖点标题。
上次说"下次哪家再发受限版都不算新闻了"——没想到这么快就应验,而且这次连"AGI era"都搬出来了。当安全叙事本身成为发布会的核心卖点,这个行业的竞争维度已经换了。
懒人版:30 秒看完
| 关键问题 | 一句话回答 |
|---|---|
| 是什么 | GPT-6 Astra,OpenAI 称"世界最佳电脑操作模型",9/3 发布,先走 Daybreak Access 受限计划 |
| 核心叙事 | 电脑操作(computer use)+ 对齐数字,“能力越强、缰绳越紧” |
| 电脑操作 | OSWorld 2.0 得分 72.6%,单任务约 40 分钟(官方称较上代省约 47% 时间) |
| 职场自动化 | Bench 得分 41.4%(上代 18%);BenchCAD 95.9%;DeepSWE v1.1 得 74.1% |
| 对齐钩子 | 官方称未防护越权率从上代 48% 压到 0%,轨迹中途可叫停未授权动作,官方自报口径 |
| 数学战绩 | 官方称花费约 2000 美元算力解出 10 道十年未解的数学/理论计算难题,经机器形式化验证,待独立复核 |
| 短板 | 带工具的综合测试仍落后 Claude;职场自动化刚过四成 |
| 价格 | $10/$50(每百万输入/输出 token)——前沿级定价,是 Gemini 3.8 Flash 促销价的 13 倍 |
一、时间线:27 天,从"踩刹车"到"带着刹车上市"
| 时间 | 事件 |
|---|---|
| 2026-08-07 | OpenAI 宣布放缓 Astra 开发:内部评估发现其在智能体编码和网络安全上有重大提升,可能触及 Preparedness 框架的 Critical 阈值(TechCrunch/Axios 当日报道) |
| 2026-08-18 | 发布《Pacing model development》博客:自 8/7 起为所有推理流量增加监控要求,强化对齐与安全 |
| 2026-09-01 | Anthropic 发布 Fable 5.1 / Mythos 5.1(同模型双护栏) |
| 2026-09-02 | Google 发布 Gemini 3.8 Flash / Cyber + Fairwind 计划;同日OpenAI 发布《Path to Astra》安全白皮书,确认 Astra 是其首个达到 Critical 网络安全阈值的模型 |
| 2026-09-03 | GPT-6 Astra 正式发布,通过 Daybreak Access 计划向有限组织开放,随后数周扩大 |
这条时间线有两层读法。
第一层:OpenAI 用 27 天演示了"Critical 阈值触发之后的正确流程"——发现(8/7)→ 加监控(8/18)→ 发安全白皮书(9/2)→ 带着护栏发布(9/3)。减速不是取消,是把发布流程拉长了 27 天。对比《Path to Astra》里披露的一个细节:在同题评估里,GPT-5.6-Cyber 对高级网络请求的完成率是 95%,普通版 Sol 只有 1.5%——危险能力早就在墙里了,Astra 只是第一个被正式贴上 Critical 标签拿出来走流程的。
第二层:四天四连发不是巧合,是同一道题的三份答卷。Anthropic 的答案是"同一模型拆两版,受限版走 CVP/LSVP";Google 的答案是"同一模型,Cyber 版干脆不进价目表,走 Fairwind 逐案审批";OpenAI 的答案是"整体晚发 27 天,全模型走 Daybreak Access 有限开放"。路径不同,结论一致:高危能力=受限供给。这个范式在上周还是"两家跟风",现在是三家共识。
二、数字拆解:能信的和要打折的
口径一:外部基准,官方跑分
- OSWorld 2.0(真实桌面任务):72.6%,单任务约 40 分钟——上代约 75 分钟,提速近一半。这是全稿最扎实的数字:基准公开、结果可复跑。
- DeepSWE v1.1:74.1%(可对比 Gemini 3.8 Flash 官方口径"超越大多数更大的前沿模型"但未给数)。
- 带工具综合测试落后 Claude:来自发布信息,方向性可信,具体分差未披露。
口径二:官方叙事性数字
- 越权率 48%→0%:出自官方对齐披露。这是最"好看"也最需要打折的数字——测试集是什么、谁定义的"未授权"、多少条轨迹,都决定了 0% 的含金量。历史经验是:这类数字在独立红队手里很少保持 0%。信一半,另一半等第三方。
- 2000 美元算力解 10 道十年未解难题:数学上若经机器形式化验证则结果本身可靠(验证器不撒谎),但"十年未解"的定义和题目筛选是官方口径。目前已有第三方跟进报道,但完整解题记录的独立复核仍在进行中。
- “职场自动化 18%→41%”:先记住 41% 只是"刚过四成"——官方通稿不会替你做这个换算。
口径三:定价即表态
$10/$50每百万 token。对比 Gemini 3.8 Flash 促销价$0.75/$3.75,输入价差 13 倍。这个定价本身就是产品定位声明:Astra 不参与价格战。Google 用 Flash 线打"快消品 cadence + 优惠券",OpenAI 用 Astra 打"前沿溢价 + 受限供给"——两条路线的账本逻辑完全不同,前者赌你重试无限次,后者赌你只信最强。
三、真正的赌注:电脑操作是谁的下一代入口
首席研究官 Mark Chen 转发时只强调一件事:"电脑上你能干的活,Astra 都能替你干,而且快了近一倍。"这句话翻译成商业语言:如果下一代人机交互入口是"AI 替你操作电脑",那浏览器、操作系统、SaaS 的分发权都会重新洗牌。
这解释了为什么 Anthropic 的 computer use、Google 的 Antigravity 智能体工作流、OpenAI 的 Astra 全挤在同一个月发布。桌面自动化 41% 意味着还远没到终局,但三家都意识到:对话框时代的护城河(模型质量+聊天入口)在智能体时代不值钱了,谁能端到端干完一个完整项目,谁定义下一代计算。
而 OpenAI 敢把"鼠标键盘控制权"交出去的底气,官方归因于安全硬闸——越权率归零、轨迹中途可叫停。注意这里的叙事闭环:安全数字不再是合规成本,而是发布卖点的头版。8 月还要遮遮掩掩减速的模型,9 月把"Critical 阈值"写进宣传语——从风险叙事到能力证明的语义翻转,只用了 27 天。
四、所以呢:谁该关注什么
开发者:短期内用不上——Daybreak Access 是有限组织计划,API 全面开放"在未来数周"。真正该做的是评估自己的工作流哪些可被"电脑操作"模式覆盖,尤其是跨应用、多步骤的重复性流程。
选型决策者:不要被 AGI 话术带节奏。当前事实是——带工具综合测试落后 Claude、桌面自动化 41%、价格前沿级。Astra 是"潜力股发布",不是"即战力发布"。
观察者:盯三个后续信号——① 48%→0% 的越权率在独立红队/第三方评测下能否存活(这是全篇最脆弱的数字);② 10 道数学题的解题记录是否公开可验证;③ Daybreak Access 从"有限组织"扩到公开 API 需要几周——这个间隔本身就是 OpenAI 安全流程的实测速度。
所有竞品的公关团队:三家已经把"Critical 能力+受限发布"做成了模板,下次发布没有安全叙事,约等于发布了个寂寞。
数据来源与口径声明:发布事实、定价、Daybreak Access、Critical 阈值表述来自 OpenAI 官方博客(openai.com,2026-09-03 及 09-02《Path to Astra》)与 Axios、Wired 报道,为厂商自报口径。OSWorld 2.0 得分与任务用时经 DataCamp 发布评测核对;Bench/BenchCAD/DeepSWE 分数出自官方基准表(经第三方转引,部分页面存在上线后撤下的情况,以官方文档最终版为准)。8/7 减速与 8/18 监控强化时间线来自 OpenAI 官方博客及 TechCrunch、Axios 2026-08-07 报道交叉确认。GPT-5.6-Cyber 95% vs Sol 1.5% 完成率来自《Path to Astra》官方披露。48%→0% 越权率与 2000 美元解 10 题均为官方叙事