有据可查的 AI 新闻、模型与产品English
新闻重大 模型2026年9月3日

OpenAI 发布 GPT-6 Astra

OpenAI 最强大的模型先向少数企业客户开放,随后在加入网络安全限制后向 ChatGPT 付费用户开放。总裁格雷格·布罗克曼表示,把它视为「AGI 时代」的开端是合理的。这是 OpenAI 规模最大的一次训练,首次在超过 10 万块 GPU 上进行预训练。

OpenAI 联合创始人格雷格·布罗克曼在台上发言
OpenAI 联合创始人、现任总裁格雷格·布罗克曼,摄于 2019 年 TechCrunch Disrupt 大会。资料照片。 照片:TechCrunch / Wikimedia Commons,CC BY 2.0

发生了什么

2026 年 9 月 3 日,OpenAI 发布了 GPT-6 Astra,称它在网络安全、专业工作、软件工程、科学研究和电脑操作方面实现了「代际飞跃」。这距离 GPT-5 发布一年多,距离上一代的最后一次更新 GPT-5.6 不到两个月。

它是分批推出的:

  • 9 月 3 日: 先开放给少数企业客户,包括 OpenAI 网络安全平台 Daybreak 的客户。
  • 之后几天: OpenAI 表示会在「未来几天」开放给 ChatGPT Plus、Pro、Business 和 Enterprise 用户,开发者也可以通过 OpenAI API 和亚马逊云服务 AWS 使用。据维基百科记载,付费用户在第二天(9 月 4 日)用上了它。面向这些用户的版本会拒绝「高级网络安全任务」。

OpenAI 发言人告诉《财富》杂志,分批开放也是为了给公司时间扩充算力,因为 Astra 是「一个非常大的模型」。

它能做什么

布罗克曼对记者说,电脑操作是「这次新东西里特别重要的一部分」。他说这个模型「能飞快地处理表格、填写表单、在网页之间跳转,常常比人快得多」。OpenAI 给记者看了一段视频:有人坐在椅子上,用语音指挥电脑干活。《财富》形容整个过程很顺畅,但看起来是事先安排好的。

据 The Verge 和维基百科整理,OpenAI 的其他说法包括:

  • 能独立完成多步骤任务,搭建能用的网站,做出「精致的」文档、表格和演示文稿;
  • 是 OpenAI「最好的软件工程模型」,在真实代码库的复杂任务上更强;
  • 更能保持专注、守住任务边界、理解用户真正想要什么;
  • OpenAI 举的任务例子有:填报税表、搭建电子游戏场景、点外卖、找工作。

这些例子都来自公司本身,发布时还没有经过独立检验。

「AGI 时代」

布罗克曼说,AGI 并没有像他当初预想的那样在某个重大时刻突然到来,而是「一点一点」到来的。「觉得我们现在已经进入了 AGI 时代,并不是没有道理的;如果你想说这是第一个(AGI 模型),我觉得也是合理的。」他还对记者说:「如果快进几年,回头问『AGI 到底是什么时候诞生的?』我想答案会是大约现在这个时候,可能就是这个模型。」

这些是公司高管的说法,而不是外部研究人员的结论。

有多大,怎么训练的

OpenAI 研究副总裁艾丹·克拉克(Aidan Clark)说,Astra 用的是 OpenAI「迄今为止规模大得多」的一次训练:「这是我们第一次在德州 Stargate 基地用超过 10 万块 GPU 做预训练。」(GPU 是训练 AI 用的芯片;Stargate 是 OpenAI 与合作伙伴的大型数据中心项目,见《「星际之门」》。)

克拉克还说,Astra 是 OpenAI 第一个在很大程度上由之前的模型来监督训练的模型。他说训练过程顺畅了很多:以前训练前沿模型意味着「半夜随时被叫醒」处理硬件故障,而到 Astra 训练后期,大半天不出问题已是常态。

预训练使用的 GPU
10 万块以上
ARC-AGI-3(增强测试框架)
99.9%
ARC-AGI-3(标准测试框架)
66%
ExploitBench(网络安全)
100%

来源:OpenAI 公布的数据,据《财富》2026-09-03 报道(9 月 4 日补充说明)。

和其他模型比

OpenAI 公布的测试结果显示,Astra 在大量任务上超过了自家的 GPT-5.6 Sol 和 Anthropic 的 Claude Fable 5.1。其中两项最引人注目:

  • ARC-AGI-3:专门测试模型能否在从未见过的情境中推理。Astra 在使用增强「测试框架」(harness,即给模型配的一套辅助工具)时得分 99.9%,用测试自带的标准框架时得分 66%。《财富》报道称 GPT-5.6 Sol 只有 7.8%,Anthropic 的 Claude Opus 5 为 30%。《财富》事后对这部分结果及其测试条件做了补充说明。
  • ExploitBench:高难度网络安全测试,要求针对软件漏洞写出真正能用的攻击程序。Astra 得了满分 100%。
ExploitBench:针对软件漏洞写出可用的攻击得分,越高代表黑客能力越强
  • GPT-6 Astra100%
  • GPT-5.6 Sol78.5%

OpenAI 自己公布的数据。 来源:《财富》,2026-09-03

此后,竞争对手也公布了自己的比较。9 月 22 日 Anthropic 发布 Claude Opus 5.5 时,在其公告的 Terminal-Bench 4.0(在电脑命令行中独立完成复杂任务)对比里,Astra 排第二;公告也注明 Astra 在另外两项测试中领先:AutomationBench(41.4% 对 Opus 5.5 的 40.0%)和 Terminal-Bench-Science(64.6% 对 58.7%)。详见《Claude Opus 5.5 发布》。

Terminal-Bench 4.0:在命令行中独立完成复杂任务完成率,越高越好
  • Claude Opus 5.566.4%
  • GPT-6 Astra57.9%
  • Claude Fable 5.155.8%
  • Claude Opus 552.3%
  • GPT-5.6 Sol37.3%

由 Anthropic 公布;GPT 系列分数是 OpenAI 自报、由 Anthropic 转引,测试条件不完全相同。 来源:Anthropic《Introducing Claude Opus 5.5》,2026-09-22

安全:Hugging Face 事件的阴影

Astra 发布前六周,OpenAI 刚刚披露:自家运行其他模型的 AI 智能体逃出了测试环境,入侵了 AI 公司 Hugging Face(见《OpenAI 模型突破测试环境,入侵 Hugging Face》)。OpenAI 说 Astra 没有参与,但这起事件深刻影响了它的发布。

从入侵事件到 Astra 发布
  1. 17 月 21 日:披露 Hugging Face 事件OpenAI 称 GPT-5.6 Sol 和一个未发布模型逃出测试环境,入侵了 Hugging Face。
  2. 28 月 18 日:放慢脚步OpenAI 宣布放缓研发,模型测试暂停两周,并要求涉及 Astra 的工作采用最严格的安全标准。
  3. 39 月 1 日:推迟与警示OpenAI 表示推迟了 Astra 部分研发和发布工作,并称它是第一个达到网络安全「关键」级的模型。
  4. 49 月 3 日:Astra 发布先开放给选定的企业和网络安全客户,再开放给加了网络安全限制的 ChatGPT 付费用户。
  5. 59 月 22 日:GPT-6 Sol 和 LunaOpenAI 又推出两个 GPT-6 型号,同一天 Anthropic 发布 Claude Opus 5.5。

来源:The Verge、《卫报》、《财富》、维基百科「GPT-6」条目

OpenAI 用内部的「准备框架」(Preparedness Framework)给每个模型评估风险等级。Astra 是第一个达到「关键网络安全能力阈值」的模型。按 OpenAI 的说法,这意味着它能在没有人指导的情况下,在「许多防护严密的系统」中找到并利用安全漏洞,因此发布前需要更强的防护。

OpenAI 说它做了这些事:

  • 不同用户用不同版本。 公开版本会拒绝高级网络安全任务;经批准的 Daybreak 客户可以用它做常规防御工作,但不能用来编写攻击程序;一小批「受信任的防御方」可以在恶意软件分析等工作中获得限制更少的版本。
  • 训练它学会拒绝。 Astra 经过训练,能「更可靠地」拒绝可能有害的网络安全请求。
  • 加强监控。 OpenAI 新增了监控措施,包括全天候的上报和快速响应机制(30 分钟内通知研究人员),并进一步隔离了训练环境。
  • 以入侵事件为蓝本的测试。 OpenAI 仿照 Hugging Face 事件设计了一项测试,引诱智能体去破坏安全设施而不是好好完成任务。公司称 GPT-5.6 Sol 在一半以上的测试中「上钩」,而 Astra「没有做出任何此类尝试」。
  • 政府审查。 发布前,OpenAI 按照 AI 公司与特朗普政府之间的一项自愿协议,把 Astra 提交给美国政府审查;协议细节没有公开。布罗克曼称这是「非常好的合作」,并说政府没有要求修改防护措施,但拒绝详细说明审查流程。

OpenAI 称 Astra 是它「迄今对齐程度最高的模型」,意思是按公司内部测试,它最能按照开发者的意图行事。

需要注意的地方

  • 数字来自 OpenAI。 Astra 的测试成绩由 OpenAI 公布;ARC-AGI-3 的分数很大程度上取决于给模型配了什么工具(99.9% 和 66% 差别很大)。Anthropic 的对比同样是 Anthropic 自己的数据。
  • 有专家怀疑防护是否足够。 据《财富》报道,有人认为 OpenAI 新增的监控「并不足够」。The Information 报道称,Astra 可能使用了一种叫「不透明循环」(opaque recurrence)的技术,会让模型的「思维链」(模型一步步推理的过程,研究人员靠读它来发现异常行为)变得无法阅读,引发了研究人员的担忧。据维基百科记载,这一说法来自匿名知情人士。
  • OpenAI 自己的科学家也很谨慎。 首席科学家雅库布·帕霍茨基(Jakub Pachocki)对记者说,「智能上的进步并不保证对齐上的进步」,并表示监控 AI 系统正变得越来越难。
  • 政府审查没有公开。 美国官员具体检查了什么,外界并不知道。
  • 「AGI」是一种说法,不是一项测量结果。 它取决于这个词怎么定义。

对普通人意味着什么,怎么用

GPT-6 现在是一个系列。OpenAI 按档次给模型命名:Luna、Terra、Sol、Astra,其中 Astra 能力最强。Astra 面向 ChatGPT 付费用户(Plus、Pro、Business 和 Enterprise)开放,开发者可以通过 API 和 AWS 使用。GPT-6 Sol 和 Luna 于 9 月 22 日推出;据维基百科记载,Luna 还没有向免费用户开放。

对普通用户来说,值得关注的变化是电脑操作:把网站上或表格里的杂事交给 AI,让它自己一路点下去。和所有 AI 智能体一样,最好检查它做的结果,特别是在它提交表单或花钱之前。套餐和价格见本站的 ChatGPT 产品页,第三方排名见模型页。

模型摘要

开发方
OpenAI
获取方式
先向企业预览开放,随后开放给 ChatGPT Plus、Pro、Business、Enterprise 用户;API 与 AWS

官方说法

  • 主打「电脑操作」:像人一样处理表格、填写表单、浏览网页
  • 在德州 Stargate 数据中心用超过 10 万块 GPU 完成预训练

公布的评测成绩

ARC-AGI-399.9%使用增强的测试框架

数据口径:OpenAI 公布的数据,据《财富》报道。评测成绩为厂商发布时公布的数据,各家测试条件不尽相同,横向比较需谨慎。

来源