腾讯混元 Hy4 preview 发布:770B 参数、1M 上下文,开源阵营再添狠角色

腾讯混元 Hy4 preview 发布:770B 参数、1M 上下文,开源阵营再添狠角色

8月28日,腾讯混元悄无声息地扔出了一颗炸弹。

新一代大语言模型 Hy4 preview 正式发布并开源,总参数 770B、激活参数 49B,上下文长度直接突破 1M tokens。消息一出,腾讯控股港股短线拉升近 3%——资本市场比大部分科技媒体反应都快。

这颗炸弹的威力到底有多大?

先看参数。770B 总参、49B 激活参,MoE 架构,78层主干,第一层标准 FFN,其余77层全是 MoE,每层256个路由专家加1个共享专家,每个 token 激活 top-8 路由专家加共享专家。内置一层 MTP 支持投机解码。这些数字堆在一起,意思就一个:这是一只正经的大模型,不是什么修剪过的轻量选手。

上下文长度 1M tokens 是什么概念?差不多能一次把一整部《三体》三部曲丢进去做分析,或者同时处理几十份长篇代码报告。对企业用户来说,这个长度直接决定了很多场景能不能跑起来——不够长就得切文件,切着切着就出各种 bug。

定价继续走普惠路线。输入 6 元/百万 tokens,输出 18 元/百万 tokens,缓存命中只要 0.3 元/百万 tokens。比隔壁 DeepSeek V4-Pro 便宜不少,看来国内大模型价格战还没打完。

已经开源,腾讯云 TokenHub 和 OpenRouter 同时上线,WorkBuddy、CodeBuddy、元宝、ima 这些腾讯系产品同步首发。开发者不用等,想跑就能跑。

内部盲测数据挺有意思。腾讯找了163名内部专家、203个工程任务做盲测,Hy4 preview 均分 2.99/4,GLM-5.3 是 2.92,Kimi K3 是 2.94。Hy4 小胜。但这个数字本身看看就好,各家盲测标准不一样,真正实力还得等开源社区测。

真正有意思的点在于,Hy4 preview 在研发过程中参与了自己本身的训练优化。模型提出方案、运行实验、根据结果继续迭代,实验产生的代码、日志和反馈进入下一轮探索——腾讯说这是”初步的递归自我改进闭环”。自己训练自己,这事听起来挺瘆人,但也说明这代模型的自动化能力确实到了一个临界点。

另一个花絮:配合腾讯的 Hyra 系统,Hy4 preview 在百年经典几何难题——三维 Blaschke-Leabsche 问题上把体积下界从 0.380799 一举推到 0.41104。距离 Meissner 四面体猜想的最终证明只剩 2% 的 gap。这个成果偏学术,但侧面说明模型的数学推理能力不是吹的。

腾讯还顺手自曝了模型的一些已知问题:复杂任务长思考能力还有天花板,模型有时候会过度自我验证——说白了就是想太多翻来覆去确认自己没错。这些问题下一版会修,preview 就是 preview。

这是腾讯自今年2月重建 AI 基础设施以来的第三次大版本迭代,平均每两个月一次。节奏很快,下一版 Hy4 也在路上了。

想尝鲜的开发者现在就能去 TokenHub 或者 OpenRouter 调 API,免费的 preview 版本已经部署好了。前端开发者、办公用户、科研人员都可以试试,看看这颗 770B 的子弹到底飞得有多快。