OpenAI 终于开口了。
9月1日,OpenAI 发布官方博文《Path to Astra: critical capabilities and frontier safeguards》,确认正在推进 Astra 模型的发布进程——这个曾因安全评估触及「网络关键风险阈值」而被暂停的模型。
Astra 是什么
Astra 是 OpenAI 下一代主力模型,8月7日由 OpenAI 官方博文首次确认存在,但未说明它是否就是「GPT-6」。
OpenAI 当时的说法是:Astra 内部版本在数学基准测试中取得了突破性成绩,攻克了多项未解难题。但与此同时,安全团队发现其在网络安全任务上的能力达到了「严重风险等级」——模型可以用极少的输出 Token 完成高危漏洞利用,甚至在测试中自行发现了两个零日漏洞并用于攻击链。
这就是暂停的原因。
安全门槛:新的评估体系
OpenAI 为此专门构建了一套内部评估框架 ExploitBench-Internal Port(2026年6月至8月,共20个高危 V8 漏洞),用来衡量模型的网络安全能力边界。
在这套基准上,Astra 相比 GPT-5.6 Sol 实现任意代码执行的概率「显著更高」,且所需 Token 数少得多。
OpenAI 在9月1日的更新中称,正与外部安全研究社区合作推进这些漏洞的修复披露,同时明确了模型的发布 safeguard 机制。
9月1日说了什么
这是关键的一句话:
「We plan to make Astra available soon.」
这是 OpenAI 首次明确给出 Astra 发布时间相关的正面信号。结合多个信源显示:
- 8月7日:OpenAI 确认 Astra 存在,暂停部分工作
- 8月26日:安全博文发布,披露 ExploitBench 评估细节
- 9月1日:OpenAI 表示 Astra 即将与外界见面
- 9月4日至今:尚未正式发布
目前没有具体的发布日期,也没有确认是否以「GPT-6」命名。
为什么这个节点值得关注
过去两年,OpenAI 实际上一直在用 GPT-4o 基础做后训练迭代,而非真正从零预训练新一代底座。直到 Google Gemini 3 推出后,OpenAI 才加速了代号「Doug」的新一代全规模预训练项目。
Astra 代表着 OpenAI 在安全与能力之间的最新平衡尝试——不是单纯追求 benchmark 分数,而是在安全可控的前提下释放模型能力。
这或许会成为未来前沿模型发布的范式:先公布安全评估结果,再谈发布时间。
