10 月 7 日到 8 日这两天,OpenAI 把 GPT-6 推给了全部 ChatGPT 用户,方式却不是单纯开放模型,而是给回答加了一层可以操作的界面。Intelligent UI 让 ChatGPT 按问题类型自动组合文字、图像、图表、按钮、表单和可运行的小工具,有些答案干脆就是一个能直接填数字的计算器或一个能在对话里玩的游戏。付费层跑 GPT-6 Sol,免费和 Go 层跑 GPT-6 Luna。
这个改动的时间点很巧。10 月 7 日 Anthropic 发布 Claude Haiku 5.5,几分钟后 OpenAI 就宣布了 GPT-6 全量开放。两家实验室在同一天落到了同一组价格数字上:Haiku 5.5 在 10 万 token 以内是输入每百万 0.10 美元、输出 0.50 美元,GPT-6 Luna 当天也定了同样的价。价格战的另一条线,是回答的形态本身开始成为竞争维度。
推送节奏与模型怎么分
10 月 7 日当天开始向全球 Plus、Pro、Business、Enterprise 用户推送,次日也就是 10 月 8 日起扩展到 Free 和 Go 用户。OpenAI 称目标是每周使用 ChatGPT 的 12 亿以上用户。付费层拿到 GPT-6 Sol,免费和 Go 拿到 GPT-6 Luna,官方说两者都针对日常对话做了调优。
几个边界要说清楚。这次更新只作用于 Chat 标签页,Work和 Codex 背后的模型不变;用户不需要改任何设置,模型和界面会随账号陆续到位;Enterprise 还要看企业管理器的设置。推理档位从 Instant 到 Extra High 都支持,唯独用 GPT-6 Astra 的 Pro 推理选项这次还用不了。
GPT-6 的 API 版本在 9 月 23 日就已经发布,当时 Sol 输入 2 美元、输出 10 美元,API 价格比上代砍了 50%。这次是模型本体进到 ChatGPT 消费端产品里,路径和当时那条线不同。
Intelligent UI 到底改变了什么
过去 ChatGPT 的输出单位是段落,现在的输出单位是界面。OpenAI 说他们训练 GPT-6 判断什么时候该给交互元素、什么时候文字就够了,以及给了之后怎么排布。这个「什么时候」是关键:如果判断错了,界面会变成多余的装饰。
官方给的几个例子能说明差别。问一辆七速自行车的设计,出来的不是一段文字描述,而是一张带交互按钮的自行车结构图,点某个部件就高亮对应说明。问怎么打麻将,出来的是一张张牌面图,按牌型分好类可以滚动着看。问分账,出来的是一个能在对话里直接填数字的账单分摊器。OpenAI 自己的表述是:用户拿到的不是操作建议,而是可以直接填写信息、调整输入、查看结果的东西,少了在对话和其它应用之间来回切换的步骤。
技术上的关键是一套原生可流式组件库和一个编译器,模型在生成回答的同时就在编译界面,所以界面是逐步长出来的,而不是等整段回答生成完才出现。OpenAI 也承认,模型在「什么时候该交互、怎么排版」这个判断上还有提升空间,官方给的对比示例是 GPT-6 Instant 与 GPT-5.6 Instant 的回答。
边思考边回答,等待时间降44%
另一项改动容易被忽略:模型允许在还在推理或还在调工具时就先开始作答,之后再补充新的发现,用户不用再问一次就能看到后续内容。
官方给出的数字有两个:涉及联网搜索的问题,GPT-6 Instant 平均比 GPT-5.6 Instant 早 44% 开始回答;在日常智能体任务的内部评测里,GPT-6 Extra High 开始回答的时间与 GPT-5.6 Medium 相当,但分数高于 GPT-5.6 Extra High。
安全方面的说法是:GPT-6 抵抗绕过安全训练攻击的能力强于 GPT-5.6 Sol,尤其是那种跨多轮自适应的攻击;同时被训练成不要对无害请求做不必要的拒绝。这些结论都写在已发布的系统卡里。
对做工具的团队意味着什么
这次更新的实质,是把回答的形态当成产品设计对象。模型能力差距在缩小的时候,交互层成了新的区分度——同样的知识,能不能组织成一个能直接上手用的界面,决定了用户要不要再切到别的应用去完成最后一步。
直接的冲击在轻量工具类 SaaS。能在对话里现场生成的这些东西:账单分摊器、储蓄计算器、简单的小游戏、兼容性检查工具,全都是过去单独售卖的功能型小工具。它们的技术门槛本来就不高,收费模式就是单一功能换订阅费。现在这类产品要重新想的问题是:用户为什么还要单独开一个应用。
社区里也有相反的声音。有人担心即兴生成的界面在多次调用之间是否稳定——同一个问题问两次,出来的组件结构会不会不一样。这在生产场景里比演示阶段重要得多。也有开发者指出,把整套界面编译交给模型,等于把一部分前端逻辑的正确性押在了概率上,出错时的排查成本会变高。
悬着的两个问题
一是 Sol 和 Luna 的实际能力差距。免费层拿到 Luna 之后体验会降到什么程度,目前没有第三方基准。OpenAI 自己也没有公布这两档的完整对比数据,只有「都为日常对话调优」这一句定性说法。
二是 Enterprise 的落地速度。企业版本还要过一遍管理员配置,实际能用上 Intelligent UI 的时间会比个人用户晚。
另外值得留意的是这次更新和「疯狂 28 天」计划的关系。GPT-6 提速 50%、Codex 负责人立军令状那件事还在进行中,这次全量开放是把产品推到用户面前,稳定性压力会同步转移过来。
相关阅读:GPT-6 Sol 与 Luna 正式发布:API 价格再砍 50%
相关阅读:GPT-6 Luna今起免费用:安全评分从0.927降至0.734,拒答率明显减少
相关阅读:GPT-6 智能 UI 全面开放:聊天框里长出可操作界面,Token 成本暗涨 25%
延伸阅读
- OpenAI 联手 AWS 推托管智能体:Pro 套餐 500 美元/月1 周前
- OpenAI给欧盟ChatGPT文本加水印:textGrain检出92%,改词后17%17 小时前
- B站 AI 无限竞技场上线首轮榜单:GPT-6 Astra 登顶,国产大模型前五占三席3 周前
- 加州AG向OpenAI发出调查传票:FTC+15州三线围剿,GPT-6.1 Astra被迫撤回6 天前
