小米开源 MiMo-V2.6 双模型 6 天 RL 训出 DeepSWE 72.57 与 65.68

小米 9 月 23 日把 MiMo-V2.6 系列的两个原生全模态模型同时开源,Pro 与 Flash 两条线一起放出。整套方案走的是 RSI 路径,也就是递归自我改进。具体训练周期上,官方公开的说法是约 6 天 Live RL 训练,其中…

1 days ago AI笔记

Jev 接入 MiniMax H3 提速 41.7%:但作者实测表里,固定 5% 比它更快

日本开发者把 TypeSafe 决策模型 Jev 接进 MiniMax H3 视频生成的逐层稀疏率决策,社区热传 6:07→3:34 提速 41.7%。但作者同条件对照表显示:固定 5% 跑 212.20 秒,Jev 自适应 219.15 秒,固定 1% 只要 200.71 秒。41.7% 来自 SLA 稀疏注意力与量化,不是 Jev 的动态调度。

2 days ago AI笔记