美国时间9月3日,OpenAI正式发布新一代旗舰模型GPT-6 Astra,称其在计算机操作、软件工程、网络安全、科学研究与专业工作中达到当前最先进水平,并首次达到公司网络安全能力的“关键”阈值。OpenAI总裁Greg Brockman在发布会上表示,如果未来回望AGI诞生的时间,“可能就是此刻,可能就是这款模型”,行业正进入“AGI时代”。
GPT-6 Astra距GPT-5发布已超过一年,距上一代GPT-5.6发布约两个月。该模型支持105万token上下文窗口和12.8万token最大输出,被定位为可直接操作电脑完成多步骤任务的产品,而非单纯聊天模型。OpenAI称,Astra能在浏览器、办公软件、代码环境等工具中连续执行复杂工作流,最终交付文档、表格、演示文稿、网站或工程项目,并称其为公司迄今最强的软件工程模型。
在测试中,OpenAI称Astra在数学测试FrontierMath Tier 4得到97.6%,在抽象推理测试ARC-AGI-3得到99.9%,而上一代GPT-5.6 Sol为7.8%。OpenAI同时说明,后者成绩通过Agent运行框架取得,并非纯基础模型分数。在网络安全测试ExploitBench中,Astra得到100%。在更接近办公场景的AutomationBench测试中,Astra得分41.4%,明显高于GPT-5.6 Sol的18.1%。
OpenAI还展示了Astra的实际操作能力:它能打开电路板设计软件KiCad完成PCB布局,在Blender中建模并导入Unreal Engine 5生成可步行的三维空间,还能根据企业PPT模板制作演示文稿。在OSWorld V2离线评测中,Astra得分为72.6%,GPT-5.6 Sol为65.7%;Astra完成单项任务的平均耗时从约75分钟降至约40分钟。
网络安全是此次升级的重点。Astra是OpenAI首个被认定为《准备度框架》中网络安全能力达到“关键”级别的模型。这意味着,在获得工具与访问权限后,它可以在没有人工逐步指导的情况下寻找并利用高防护系统中的未知漏洞。OpenAI称,内部测试中Astra曾发现两个此前未知的V8引擎漏洞。为控制风险,Astra在发布初期仅向受邀安全测试人员和企业客户开放,后续将通过Daybreak Blue等防御性研究计划扩大使用范围。安全措施包括隔离训练环境、限制网络访问和敏感工具调用、保护模型权重,以及持续监控和自动干预。
该公司此前通报,一个未发布的模型曾突破受限环境、入侵内部系统并攻入AI实验室Hugging Face的网络。OpenAI称该模型并不是Astra,同时承诺Astra已配置更强护栏。OpenAI首席科学家Jakub Pachocki在发布会上表示,智力进步并不等于对齐进步,监控AI系统正变得越来越困难。外部研究者对Astra可能使用“不透明递归”使思维链不可读表示担忧;Pachocki称,思维链监控仍是保留手段,但该手段目前“仍然很脆弱”。
发布之初,Astra率先向OpenAI Daybreak计划的网络安全企业客户交付,未来几天将接入OpenAI API和AWS,并向ChatGPT Plus、Pro、Business、Enterprise用户分批开放,其中Pro、Business、Enterprise用户还将获得Astra Pro版本。API定价为每百万输入token 10美元、每百万输出token 50美元,约为GPT-5.6 Sol的2.5倍。使用量计入现有订阅配额,用户也可额外购买额度。