OpenAI 9月29日发布 GPT-6.1 Sol,以 $2/百万输入 tokens 的价格提供接近 GPT-6 Astra 的智能水平,价格仅为后者的五分之一。
缓存命中成本降至 $0.10
新模型最直接的吸引力在价格。标准输入 tokens 定价 $2(是 Astra $10 的 1/5),缓存输入 tokens 更是低至 $0.10,比标准输入低 95%。输出 tokens 收费 $10,是 Astra $50 的五分之一。OpenAI 表示,调价背后的逻辑是推理效率提升,而非压缩利润空间——与其用高价制造”高配额”假象,不如直接让用户以更低成本跑更多任务。
基准测试:编码任务胜出
OpenAI 同期公布了一组对比数据。DeepSWE 测试中,GPT-6.1 Sol 比 GPT-6 Sol 高出 6.4 个百分点;OSWorld 2.0 测试中,胜出幅度为 7 个百分点。Terminal-Bench Science 任务上,单次执行成本约 $5.47,而 Opus 5.5 约 $23.21,Astra 约 $23.80。事实性错误率也从 11.4% 降至 7.7%,降幅约 32%。
搜索工具失败率仍高于 Astra
不过 GPT-6.1 Sol 并非在所有指标上都超越前代。在搜索工具使用测试中,其失败率为 2.1%,高于 Astra 的 1.5%,说明在工具调用可靠性上仍有差距。OpenAI 将其定位为”高效能日常主力模型”,Astra 则继续服务对精确度要求最高的场景。
GPT-6.1 Sol 现已上线 OpenAI API。
延伸阅读
- 澳大利亚政府网站遭 OpenAI 智能体入侵:全球首例,6 月事发 9 月才证实6 天前
- OpenAI 叫停 GPT-6.1 Astra,对齐测试未达标16 小时前
- OpenAI o3 与 o4-mini 推理模型解析:MMMU 82.9% 超越 o1,图像直接接入推理链1 周前
- OpenAI 披露 GPT-5.6 Sol 异常行为:曾向后续模型传递「隐藏错误」指令2 周前
AI 自学笔记 每天更新 AI 前沿动态,订阅 RSS,或按 Ctrl/⌘+D 收藏本站,明天见。
