Claude Opus 5.5 内测曝光:跳过 5.2 连升两级,输入 4 美元输出 20 美元,缓存读取降至 0.2 美元

先说结论:Anthropic 很可能不打算按期交出市场预期的 Opus 5.2。开发者社区最新流传的信息显示,下一代旗舰代号 claude-wafer-eap、版本号直接跳到 Claude Opus 5.5,目前已在内测,最快本周二就可能突然上线;随版本曝光的还有一份价格单——每百万 Token 输入 4 美元、输出 20 美元,缓存读取低至 0.2 美元。若属实,这是 Anthropic 把顶级模型从”奢侈品”推向”日用品”的一次明确降价动作,矛头直指 GPT-6。需要提醒的是,以上信息均来自开发者披露,尚未获 Anthropic 官方确认。

版本跳级:从 Opus 5 到 Opus 5.5 的反常节奏

按常规节奏,大模型的版本号是小步快跑式递进的,这次却不太一样。

时间线:三个月里的三次版本信号

  • 7 月 24 日:Claude Opus 5 正式发布,成为当时 Anthropic 的旗舰主力。
  • 此后不久:社区短暂捕捉到一个标记 5.2 的测试 checkpoint,外界据此判断下一代是 Opus 5.2。
  • 本轮曝光:开发者 Lyra 扒出代号 claude-wafer-eap 的内测条目,版本号变更为 5.5,等于一次跳过两个小版本。

这种”跨级命名”在模型行业里通常不是随手为之。版本号本身是一种对外预期管理的工具:当厂商选择跳过中间数字,往往意味着它在内部认定这次升级的幅度不能用小版本来表达。

为什么不是 5.2 而是 5.5

一个合理的解读是能力代差。参与内测的开发者 Harshith 的判断颇具代表性——他认为 5.5 的实际表现优于此前的 Fable 5.1 和 OpenAI 的 Astra 系列。当新模型在与竞品横向比较中被认为胜出时,厂商自然更倾向于用一个更大的版本数字来锚定认知。

价格单曝光:输入输出分别下降约 20%

比版本号更受关注的是钱。据披露的定价口径,Claude Opus 5.5 的输入价为每百万 Token 4 美元、输出价为 20 美元,而现役 Opus 5 的对应价格是输入 5 美元、输出 25 美元,降幅约 20%

缓存机制才是真正的杀招

真正让人侧目的是缓存成本的调整:缓存读取降至每百万 Token 0.2 美元,缓存写入为 5 美元。之所以关键,在于 Agent 类应用的工作方式与一次性问答完全不同——一个长时运行的自主 Agent 会在多轮推理中反复读取同一段上下文,缓存命中率极高。缓存读取单价降到 0.2 美元量级,意味着企业搭建长时间、长上下文的 Agent 系统时,边际开销会出现数量级意义上的收缩。

对比项 Claude Opus 5(现行) Claude Opus 5.5(曝光口径) 变化
输入(每百万 Token) 5 美元 4 美元 下降约 20%
输出(每百万 Token) 25 美元 20 美元 下降约 20%
缓存读取 0.2 美元 面向长上下文 Agent 大幅优化
缓存写入 5 美元 与所见口径一致
版本号 5 5.5(跳过 5.2) 跨两级

降价的另一面:Token 消耗量在暴涨

值得注意的是,单次任务的 Token 规模也在同步放大。内测披露的一组实际消耗显示:某次生成任务输入约 1.4k Token,输出却高达 532k Token,同时伴随 41.2M 的缓存读取和 1.7M 的缓存写入。换句话说,单价下降并不必然等于账单下降——单位任务的输出量在快速膨胀,真正的成本取决于二者的乘积。

开发者实测:从无人车模型到瓦力机器人控制台

Waymo 无人车 3D 模型

Harshith 让模型生成了一个 Waymo 无人车的 3D 模型,细节还原度相当高——捷豹车标、车顶的激光雷达传感器都被清晰建模出来,而他给出的成本描述是:仅为 Opus 5 的一半。

Three.js 网页端展示器与瓦力控制台

开发者 Veee 的两个测试更具工程参考价值:一个是基于 Three.js 的网页端 3D 汽车展示器,渲染质量与交互都被评价为”扎实”;另一个是直接生成一个 3D 交互式的瓦力机器人控制台,在 UI 布局、机械绑定和造型还原度上表现出较强的专业度。这两类任务共同指向一个结论——该版本在空间结构理解前端工程落地两个维度上都有明显提升,而非单纯的文本推理增强。

多位参与内测的开发者还提到,新 checkpoint 在解题直觉、深层代码重构和长程多步骤规划方面,与现款 Opus 5 之间已经拉开可感知的代差。

另一条线:Claude Fable 5.2 也已浮出水面

Opus 之外,同门产品线 Fable 也在推进。开发者 Pankaj Kumar 放出了 Fable 5.2 的尝鲜体验,按其说法官方似乎正在把 5.1 悄悄切换到 5.2。

3D 生成:追平甚至反超

  • 低提示词依赖:不需要详细 prompt 就能较准确理解需求,这在 3D 生成场景中意味着迭代轮次显著减少。
  • 材质与光影:测试中的”悬崖别墅”场景,在打光、材质反射和整体氛围感上都达到可用级别。
  • 一次成型的工程量:可直接用 Three.js 生成完整小游戏;另一项测试中,模型未使用任何素材、未开启外部插件,纯靠原生 JavaScript 写出一个”微缩世界”,几十种头部建模、面部微表情、动态效果与交互逻辑在一次生成中即可运行。

把 Opus 5.5 与 Fable 5.2 放在一起看,更像是同一轮防线的前后两道:一个打推理与编程的正面战场,一个打多模态内容生成的体验战场。

为什么是现在:GPT-6 压力与冲刺窗口

时间点耐人寻味。OpenAI 的 GPT-6 系列已放出 Astra 等成员,把科学推理的天花板抬高了一截;而 Anthropic 这边,Dario Amodei 此前刚公开呼吁行业放慢迭代节奏,如今却拿出跨两级的新版本和一份明显更激进的价格单。这个反差本身说明:竞争格局对节奏的影响,远大于公开表态。

在 OpenAI 开发者大会之前抢先出手,商业逻辑也很清晰——先把开发者的 API 预算份额锁定。对习惯按 Token 成本做架构选型的团队来说,0.2 美元的缓存读取是一个很难忽视的数字。

常见问题

Claude Opus 5.5 已经正式发布了吗?

还没有。目前社区掌握的信息是内测状态,代号 claude-wafer-eap,有开发者称最快本周二可能突然上线,但 Anthropic 尚未官宣。版本号、定价与上线时间都应以官方发布为准。

缓存读取降到 0.2 美元,对普通用户有影响吗?

影响主要体现在开发者和企业侧。缓存读取是长上下文、多轮调用场景的主要成本项,单价下降直接利好 Agent、代码助手、批量文档处理这类”反复读取同一段材料”的应用。日常聊天式调用的感受不会特别明显。

跳过 5.2 直接到 5.5,代表什么?

通常意味着厂商认为这次升级幅度超出小版本范畴。结合内测反馈中”与 Opus 5 存在代差”的描述,这更像一次较大幅度换代,而不仅是常规迭代。不过版本号策略本身也包含市场传播考量,最终仍要看官方基准测试。

小结

这一轮信息虽然未经官方确认,但指向足够清晰:版本号跳级 + 输出价格下调 20% + 缓存读取压到 0.2 美元的组合,是一套同时打能力和成本的双重动作。对开发者而言,真正值得跟踪的不是争议本身,而是两件事——一是官方上线后真实基准数据能否支撑”跨级”的说法,二是长上下文 Agent 的单位任务成本是否真的如账面数字那样下降。答案大概率在本周揭晓。