摘要:2026年9月3日至4日,OpenAI 正式发布新一代旗舰模型 GPT-6 Astra。公司总裁 Greg Brockman 在发布会上直言“我们已经到了 AGI”,并以“欢迎来到 AGI 时代”结束整场发布。GPT-6 Astra 被称为“世界上最智能、最对齐的模型”,多项基准测试接近满分,训练消耗超过十万块 GPU,并首次跨过 OpenAI 准备框架中的“关键级”网络安全能力门槛。本文将从性能表现、Agent 能力、安全争议、上线节奏与定价等维度,全面解读这款可能改变 AI 行业格局的新模型。
GPT-6 Astra 的发布,被 OpenAI 官方赋予了前所未有的战略意义。在发布前的媒体简报会上,OpenAI 总裁 Greg Brockman 直言“我们已经到了 AGI”,并宣布“欢迎来到 AGI 时代”。CEO Sam Altman 则表示,希望 GPT-6 Astra 能赋能新一代的创业、科学发现和建设,并称其是世界上最适合计算机使用、专业工作、科学、编程和网络安全等领域的最佳模型。
值得注意的是,Sam Altman 还透露,未来 OpenAI 的模型发布节奏将由安全考量而非能力提升来决定。这一表态也解释了 GPT-6 Astra 为何“多花了一些时间”才与用户见面。
这款模型早在一个多月前就已进入公众视野。今年8月初,《The Information》曾报道 Sam Altman 在华盛顿向政策制定者演示了代号 Astra 的新模型,它支持多个 Agent 长时间协作完成复杂任务,OpenAI 内部一度考虑将其直接命名为 GPT-6。
从公开的基准测试数据来看,GPT-6 Astra 的表现堪称“刷榜式”的碾压:
OpenAI 将 GPT-6 Astra 定位为面向复杂端到端任务的新一代旗舰模型,在电脑操作、浏览器使用、软件工程、网络安全、科学研究和专业工作等领域全面刷新了此前模型的能力,自称“全球最智能、最对齐的模型”。
OpenAI 还公布了两项与素数间隔有关的新数学研究成果,称 GPT-6 Astra 已参与解决一些长期悬而未决的数学问题。
据媒体报道,GPT-6 Astra 的训练消耗了超过十万块 GPU,规模之大在 OpenAI 历代模型中前所未有。此前有报道称,该模型可能引入了“循环深度”技术,让模型在输出下一个 Token 前完成更多内部计算,实现“少说、多想”。不过 OpenAI 在发布博客中并未提及 recurrent depth,也没有公布具体模型架构。
在 Agent 能力方面,GPT-6 Astra 的提升尤为显著。在测试 AI 使用真实软件完成复杂专业任务的 Agents’ Last Exam 中,GPT-6 Astra 得分 59.3%,超过 GPT-5.6 Sol 的 53.6% 和 Claude Opus 5 的 55.5%。在 OSWorld 2.0 模拟中,GPT-6 Astra 得分从 GPT-5.6 Sol 的 65.7% 提升到 72.6%,单任务完成时间从约 75 分钟缩短至 40 分钟,速度提升约 47%。
在最高分设置下,GPT-6 Astra 使用的输出 Token 比 Claude Opus 5 少约 65%,“更少的 Token、更短的时间,完成更复杂的任务”成为整场发布的主线。
真正让 GPT-6 Astra 在发布前就引发广泛争议的,是其网络安全能力。OpenAI 已确认 GPT-6 Astra 达到了准备框架的“关键级”网络安全能力门槛,成为公司首个跨过这一等级的模型,OpenAI 也因此一度放慢部分开发工作、加强安全措施。
完整的测试数据显示:在 ExploitBench 上 GPT-6 Astra 达到 100%;在仅包含 2026 年 6 月至 8 月最新漏洞的内部测试集中,其任意代码执行成功率达到 39%,远超 GPT-5.6 Sol 的 5.5%。更引人注目的是,测试过程中 GPT-6 Astra 发现并实际利用了两个此前未知的零日漏洞,OpenAI 正在向相关项目维护者披露。
不过,普通用户拿到的版本并不会直接开放这些最强能力。当前版本可用于安全代码审查和漏洞修复,但会拒绝创建漏洞 PoC 等高级漏洞利用任务。OpenAI 之后将通过 Daybreak 项目逐步开放限制更少的版本,用于漏洞验证、恶意软件分析和检测工程等防御场景。
同时,GPT-6 Astra 在行为上反而更加克制:在安全压力测试中,其不当行为率为 2.4%,而 GPT-5.6 Sol 为 22.0%;“能力幻觉率”也从 9.4% 降至 2.0%。
GPT-6 Astra 于 9 月 4 日首先向少量组织开放,未来几天逐步提供给 ChatGPT Plus、Pro、Business 和 Enterprise 用户,Pro、Business 和 Enterprise 用户还将获得性能更强的 GPT-6 Astra Pro 版本。
API 方面,模型名为 gpt-6-astra,同时上线 Amazon Bedrock。标准定价为输入 10 美元/百万 Token、输出 50 美元/百万 Token;Fast Mode 最高可达标准模式 2.5 倍的速度,价格为两倍。
不过,市场分析指出,GPT-6 Astra 虽然在端到端知识工作能力上显著提升,但高定价仍是其核心痛点。对于中小企业和个人开发者而言,能否承受这一价格门槛,将直接影响 GPT-6 Astra 的实际落地范围。
GPT-6 Astra 的发布无疑是 AI 发展史上的一个标志性事件:跑分逼近满分、十万 GPU 训练、首个关键级模型、总裁宣称 AGI 时代到来——这些标签叠加在一起,让“AGI”从一个遥远的愿景变成了 OpenAI 口中的现实。
但需要理性看待的是,OpenAI 官方也承认 GPT-6 Astra 的书面推理比 GPT-5.6 Sol 更难监控,可监控性的下降需要严肃对待。AGI 是否真正到来,业界尚无定论。可以确定的是,随着 GPT-6 Astra 的逐步开放,人机协作的方式、软件工程乃至科学研究的范式,都可能迎来新一轮的深刻变革。
文章来源:本文综合机器之心报道及腾讯新闻、网易科技、凤凰科技、搜狐科技等公开报道整理改写。