蚂蚁百灵 Ling-3.0-flash-Fin 金融增强模型:124B 参数仅激活 5.1B,主攻检索研究估值研报四大能力
通用大模型在金融场景里最常见的失败,不是算错数,而是「看起来很专业但经不起追问」:引用了过期的财务数据、把会计口径混用、在估值模型里悄悄改了假设。蚂蚁百灵给出的应对方式是做一个专门的金融增强模型 Ling-3.0-flash-Fin:延续 …
通用大模型在金融场景里最常见的失败,不是算错数,而是「看起来很专业但经不起追问」:引用了过期的财务数据、把会计口径混用、在估值模型里悄悄改了假设。蚂蚁百灵给出的应对方式是做一个专门的金融增强模型 Ling-3.0-flash-Fin:延续 …
字节跳动 Seed 团队推出原生音视频全双工大模型 SeedRealtime。它的核心主张可以用一句话概括:基于统一架构原生融合音频、视频与文本,实现「边看、边听、边说」的实时多模态交互。官方披露其具备音视频联合理解、主动交互与流畅对话节奏…
结论先行:腾讯混元团队开源了投机解码框架 AngelSpec,覆盖从 drafter 训练、架构设计到线上部署的完整链路。同时开源的还有 Hy3-A21B 的 MTP 与 DFly drafter 权重及训练代码。实测数据相当亮眼:DFly…
结论先行:英伟达开源了文本嵌入模型系列 Nemotron 3 Embed,专为检索增强生成(RAG)与智能体检索设计。系列包含 8B 与 1B 两种参数规模,支持 32k 上下文窗口与 34 种语言。旗舰版 8B 模型在 RTEB 多语言检…
结论先行:OpenAI 把实时语音模型 GPT-Live-1 放上了 API,核心变化是语音理解与语音输出被整合进同一个模型,并支持全双工对话——可以同时听和说,能处理打断、停顿与背景噪声。据 OpenAI 公布的信息,这一模型面向餐厅预订…
结论先行:国家超算互联网平台正在从”把算力卖给你”的资源池,转向”算力 + 智能体”一体化交付的服务平台。据曙光智算总裁何牧君在 2026 算力网发展大会上披露,平台注册用户已超 170 万,…
一句话结论:基元律动联合无问芯穹,以及清华、北大、港中文、阿里等单位,推出自研的 Agent-Native 模型 NeoHorse-1,提供 4B 与 9B 两个版本;其训练数据来自 Harness 结构化执行轨迹,官方内部评测称在多项 A…
结论先行:法国大模型公司 Mistral AI 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,这是欧洲科技企业迄今规模最大的一笔股权融资。本轮由三星电子领投,欧盟支持的 Scaleup Europe Fund 与老股东 …
结论先行:阶跃星辰把语音大模型从”单模型”拆成了”模型矩阵”。9 月 15 日,阶跃星辰推出 StepAudio 3 系列语音大模型,一次性发布 Realtime、ASR、TTS、Gen、Mu…
结论先行:上海人工智能实验室把”专业领域能力”做成了一个可插拔的模块,而不是一次性的全量微调。9 月 15 日,上海人工智能实验室开源基础大模型书生-S2。官方给出的定位有两层:通用能力处于开源第一梯队;在生物、材料…