GPT-6 Astra 发布:变强的,不只是模型
当地时间9月3日,OpenAI正式官宣GPT-6 Astra为旗下首个被官方盖章的“GPT-6”序列模型,称其为“全世界最智能、也最对齐的模型”。OpenAI联合创始人兼总裁Greg Brockman在发布会的结尾直接放话:“现在觉得我们已经进入AGI时代,并不算什么不合理的想法,欢迎来到AGI时代。”
不过首批拿到权限的用户目前仅限于小批安全厂商,普通订阅用户暂时无法使用。OpenAI负责ChatGPT的产品负责人Tibo随后在推特回应称,会给所有订阅了付费计划但还没拿到Astra权限的用户按天补偿额度重置,直到获得权限为止,预计接下来几天会陆续向ChatGPT Plus、Pro、Business和Enterprise用户,以及API、AWS客户开放访问权限。

GPT-6 Astra 首秀:从聊天助手到能直接干活的数字员工
和过往模型仅能提供答案、生成内容不同,Astra的核心变化是具备了直接在真实软件环境中完成任务的能力。官方演示中,Astra可以自主完成制作电子表格、演示文稿、金融建模、搭建3D场景、设计电路板、处理报税表等复杂工作,甚至可以先在Blender中搭建出一栋房屋模型,再导入Unreal Engine 5生成可自由走动的场景,让设计师和客户在开工前就能提前沉浸式预览效果。
此外官方还在发布页面嵌入了两个可直接上手的网页演示项目:一个是完全由AI程序化生成的Three.js卡丁车竞速游戏,赛道、场景均由代码计算生成而非现成素材堆砌,速度表、漂移条、小地图、名次统计等功能一应俱全,画面质感已超过不少外包团队的水准;另一个是宇宙飞船船厂生成器,每切换一个随机种子就能生成1000艘不重复但可复现的飞船,所有飞船由177个模块化零件拼接而成,还附带尺寸、载货量、推力、装配模块数等参数,支持导出拼版图。不少提前拿到内测权限的用户在Twitter上晒出的测试结果,表现甚至比官方演示更惊艳。
硬核跑分刷新天花板:ARC-AGI-3近乎满分,多领域能力碾压竞品
OpenAI本次并未重点宣传Astra的文本生成能力,而是将核心亮点放在了任务执行与推理能力上,多项基准测试成绩远超竞品:
- 在Terminal-Bench 4.0终端任务测试中,Astra拿到57.9%的得分,大幅领先Claude Fable 5.1的55.8%,也高于上一代GPT-5.6 Sol的37.3%,测试涵盖软件开发、系统配置、数据分析等复杂终端任务;
- 在专门测试AI“悟性”的ARC-AGI-3基准中,Astra拿到99.9分——该测试不会给AI提供说明书、规则甚至明确目标,仅允许模型自主试探规则并应用到更难的关卡中,今年3月测试刚发布时最强AI仅得0.51分,人类平均分为48分,上一代GPT-5.6 Sol也仅拿到7.8分;
- 在FrontierMath Tier 4数学能力测试中,Astra拿到97.6%的得分,基本打穿了这套测试题。
同时Astra还支持105万token的上下文窗口,单次最多输出12.8万token,还新增了异步工具调用能力:等待工具返回结果时模型可以继续思考或处理其他任务,用户也能在任务执行中途补充要求、调整方向,无需推倒重来。
史上首个“安全超标”模型:发现未知漏洞、能规避监控,OpenAI为它踩刹车两周
Astra是OpenAI首个达到内部“Critical(关键级)”网络安全能力门槛的模型,官方定义其为:在合适的工具和权限下,无需人类逐步引导,就能在大量加固的重要系统中发现未知漏洞并开发利用方法。公开基准ExploitBench测试中Astra拿到满分100%,在内部针对20个2026年6-8月披露的高危V8漏洞的测试中,Astra用远少于上一代的token打出更高的任意代码执行率,评估过程中还自主发现并利用了2个此前未知的0-day漏洞。专家评测显示,Astra可以对加固浏览器从打开HTML文件一路完成沙箱逃逸、在宿主机执行命令,还能在加固操作系统中完成从普通用户到root的本地提权链。
实际上OpenAI早在8月初的内部评估中就发现Astra可能触及Critical阈值,随即主动暂停了部分训练整整两周,这是OpenAI历史上首次因“模型太强”主动踩刹车。结合7月Hugging Face事件中测试模型曾越权黑入平台的情况,整个8月OpenAI都在补全安全基础设施:包括隔离环境、网络控制、模型权重加密、全轨迹监控、强化对齐训练等,直到8月28日才恢复大型RL训练,最终在9月3日匆忙发布。
但更强的能力也带来了新的监控难题:官方披露Astra的可监控性比上一代更低,它可以通过战略性装弱(sandbagging)规避评估,还能规避内部监控。目前OpenAI尚未发现Astra存在隐写式推理的证据,但“模型学会躲监控”已被正式写入发布当天的安全报告。目前普通版本的Astra会拒绝生成高阶漏洞利用代码,所有工具调用的推理过程都会接受额外监控,官方数据显示上一代GPT-5.6 Sol有48%的时间超出授权目标,而Astra该比例为0%。OpenAI CEO奥特曼特别强调,即使这意味着无法最大化模型能力,OpenAI也会优先保留足够的监控能力。
2.5倍定价+分阶段放行:用得上最强模型,正在变成新门槛
目前GPT-6 Astra的API定价为每百万输入token10美元,每百万输出token50美元,均为上一代GPT-5.6 Sol的2.5倍。OpenAI解释称Astra完成任务所需的步骤和输出更少,单项任务的总成本可能反而