腾讯混元 Hy-MT2-1.8B 端侧翻译模型:Sherry 1.25-bit 量化压缩,33 语种支持离线实时翻译
腾讯混元正式推出端侧翻译模型 Hy-MT2-1.8B。这款模型最值得关注的不是参数规模,而是量化压缩——通过 2-bit 与自研 Sherry 1.25-bit 技术把原本 3.3GB 的模型做到极致压缩,同时保持翻译质量几乎无损,官方披露…
腾讯混元正式推出端侧翻译模型 Hy-MT2-1.8B。这款模型最值得关注的不是参数规模,而是量化压缩——通过 2-bit 与自研 Sherry 1.25-bit 技术把原本 3.3GB 的模型做到极致压缩,同时保持翻译质量几乎无损,官方披露…
结论先行:腾讯混元团队开源了投机解码框架 AngelSpec,覆盖从 drafter 训练、架构设计到线上部署的完整链路。同时开源的还有 Hy3-A21B 的 MTP 与 DFly drafter 权重及训练代码。实测数据相当亮眼:DFly…
结论先行:英伟达开源了文本嵌入模型系列 Nemotron 3 Embed,专为检索增强生成(RAG)与智能体检索设计。系列包含 8B 与 1B 两种参数规模,支持 32k 上下文窗口与 34 种语言。旗舰版 8B 模型在 RTEB 多语言检…
结论先行:阿里通义推出 GUI 智能体基座模型 Qwen-UI-Agent,覆盖手机、电脑、网页以及深度搜索四类场景。它的训练数据来自 100+ 台真机与 150+ 应用,在 MobileWorld、OSWorld、WebArena 等多项…
结论先行:微软推出升级版编程模型 MAI-Code-1.1-Flash,在代码能力、速度和价格三个维度同时做了大幅调整——Terminal-Bench 2.1 测试表现提升 22%,.NET 任务提升 15%,Token 生成速度提升 25…
结论先行:阿里通义把 Qwen-Audio-3.0 系列三款语音模型一次性推上千问 AI 平台,开发者可以通过 API 或 Token Plan 两种方式调用。这不是单模型的版本号刷新,而是把「听清—说话—实时对话」这条链路拆成了三款可以独…
结论先行:李飞飞旗下 World Labs 推出了 Atlas,官方定位为全球首个多模态世界模型。它采用多模态自回归扩散 Transformer 架构,支持像素级相机控制生成图像与视频、3D 场景重建以及时空模拟;据公布的信息,Atlas …
结论先行:阿里千问联合淘天集团开源了电商经营评测基准 E-Commerce Bench。它的设计思路很直接——给每个模型 10 万元本金,在真实市场数据里经营一家网店 365 天,覆盖选品、定价、供应商谈判、库存与促销全链路。据公布的信息,…
结论先行:商汤办公小浣熊移动端正式上线,iOS 与安卓版本同步发布。移动端不是桌面端的简化版,而是补上了”离开工位之后”这一环——手机发指令、电脑持续执行;离开工位也能随时查看、分享和接续成果;长按语音输入、松手即发…
结论先行:OpenAI 把实时语音模型 GPT-Live-1 放上了 API,核心变化是语音理解与语音输出被整合进同一个模型,并支持全双工对话——可以同时听和说,能处理打断、停顿与背景噪声。据 OpenAI 公布的信息,这一模型面向餐厅预订…