阶跃星辰把”同等智能、更低成本”这件事又往前推了一步。其新一代旗舰基座模型 Step5Preview 已发布,重点面向 AI 编程、软件工程、专业知识工作与金融等场景,在 Artificial Analysis(AA)综合智能指数中跻身全球开源模型前三,而单任务成本仅为 Claude Opus5 的 1/8,并计划于 10 月 15 日正式开源。
一、架构与规格:用稀疏 MoE 换性价比
| 规格 | Step5Preview |
|---|---|
| 架构 | 稀疏 MoE(混合专家) |
| 总参数 / 激活参数 | 600B / 27B |
| 上下文窗口 | 100 万 Token |
| 模态 | 原生支持文本与视觉输入 |
| 开源时间 | 计划 10 月 15 日 |
用 27B 的激活参数去撬动 600B 总参数的能力,是 Step5Preview 把成本压下来的核心杠杆:每次推理只唤醒相关专家,单位智能的花费随之下降。
二、成本数据为什么重要
在 Agentic(智能体)任务里,模型往往要多轮调用、反复试错,单任务成本会被调用次数放大。Step5Preview 把单任务成本压到 Claude Opus5 的 1/8,意味着同样一笔预算,能支撑更多轮次的真实世界任务——这对软件工程、金融分析这类”长链路、多步骤”的场景尤其友好。
三、它瞄准的场景
- AI 编程 / 软件工程:长上下文 + 多步骤推理,适配代码库级任务;
- 专业知识工作:面向报告、研究等需要稳定长程推理的场景;
- 金融:复杂任务与成本敏感并存的典型行业。
阶跃星辰将其定位为”可持续处理复杂任务的主力工作模型”,核心目标是在真实 Agentic 任务中实现能力与成本的长期平衡,并试图用”帕累托前沿”推动同等成本下的智能上限。
四、开源前的观察点
10 月 15 日开源后,真正的看点会是权重可复现性、推理部署成本与社区微调生态。已在 AA 综合智能指数进入开源前三,意味着它并非”PPT 模型”,但最终能否在开发者侧站稳,要看开源后的实际可用性与工具链成熟度。
常见问题(FAQ)
Step5Preview 什么时候开源?
计划于 10 月 15 日正式开源,采用稀疏 MoE 架构,总参数 600B、激活 27B。
它的成本优势有多大?
单任务成本仅为 Claude Opus5 的 1/8,在需要多轮调用的 Agentic 任务中成本优势会被进一步放大。
支持多长上下文?
原生支持 100 万 Token 上下文窗口,并原生支持文本与视觉输入,面向复杂工程与金融任务优化。
小结
Step5Preview 的看点不在”又一个大模型”,而在它用稀疏 MoE 把智能与成本的帕累托前沿又推高了一档:开源模型前三的智能,却是 Opus5 八分之一的单任务成本。10 月开源后,它很可能成为性价比党与 Agentic 应用开发者的重点关注对象。
消息来源:aibase — 阶跃星辰发布 Step5Preview,单任务成本仅为 Claude Opus5 的 1/8(数据以原报道为准)。
相关阅读
这条线上还有几篇站内文章可以接着看:
- StepAudio 3 系列发布:五款语音模型,Realtime 98.9 分登顶、ASR 词错率 1.7%
- 阶跃星辰 Step 3.7 Flash 发布:稀疏 MoE 视觉语言模型,SWE-Bench Pro 与 Terminal-Bench 2.1 双提升
- 小米 MiMo-V2-Pro 发布:1T 总参数 42B 激活、1M 上下文,API 定价约为同级竞品 1/5
延伸阅读
- 阿里千问首次开源 Max 级旗舰:Qwen3.8-2.4T-A95B 权重开放,2.4 万亿参数对标 Fable 51 月前
- 梁文锋突踩刹车:DeepSeek二轮融资突然暂停,710亿美元估值计划暂时搁置2 月前
- OpenClaw v2026.7.1 更新发布2 月前
- Claude 3.7 Sonnet 混合推理模型解析:输入 3 美元输出 15 美元,首次支持思考时长可调1 天前
