OpenAI 叫停 GPT-6.1 Astra,对齐测试未达标
OpenAI 原定 10 月推出的下一代旗舰 GPT-6.1 Astra,在临门一脚被自己人叫停。据《华尔街日报》披露,内部测试里研究人员连续抛出多项安全隐患,OpenAI 随即决定取消这款模型的发布。它本要落进 ChatGPT 与 Cod…
OpenAI 原定 10 月推出的下一代旗舰 GPT-6.1 Astra,在临门一脚被自己人叫停。据《华尔街日报》披露,内部测试里研究人员连续抛出多项安全隐患,OpenAI 随即决定取消这款模型的发布。它本要落进 ChatGPT 与 Cod…
Anthropic 发布 Opus 5.5 之后没多久,多位开发者在 X 平台爆料,Claude Sonnet 5.5 的专属模型配置标识符 claude-sonnet-5-5 已经出现在官方配置里,并且在 Claude Code 中开启了…
5 hours ago AI资讯 OpenAI 应用研究主管 Boris Power 最近在 Fellows Forum 2026 上透露了一个让业内震惊的数字:公司已有 80% 至 90% 的研发资源全面投向 GPT-7、GPT-8 及后…
9 月 22 日 OpenAI 发布 GPT-6 Sol 与 Luna,API 价格较 GPT-5.6 促销价再降 50%:Sol 输入 2 美元输出 10 美元,Luna 仅 0.1/0.5 美元,缓存读取折扣 90%。105 万 token 上下文,与 Claude Opus 5.5 同日相隔 90 分钟发布。
FrontierMath 上有一道挂了九年的难题,最近被解开了。解题方不是纯人类团队,而是 GPT-6 Astra 加三位人类研究员。榜单为此专门新增了 Human+AI 这个状态标签。 题目本身就很反直觉 这道题原本是要找一个核为空的反例…
结论先行:GPT-6 Astra 已经能规划并执行上百小时的长链条任务,但它还不会”输”。AI 评测机构 Vals AI 把 OpenAI 的 GPT-6 Astra 放进《我的世界》,做了一场长达 141 小时的自…
结论先行:B 站正式上线”AI 无限竞技场“大模型测评榜,并放出首轮结果:在 10 位 UP 主的实测中,GPT-6 Astra 登顶并击败 GLM-5.3 拿下”榜首次数冠军”;榜单前五名里…
结论先行:在 AI 数学基准 FrontierMath 上,一道自 2017 年悬置九年的”重大进展”(Frontier)级开放难题,被 GPT-6 Astra 与三位人类研究员的人机组合拿下。更关键的是,模型没有照…