大模型推荐排行榜 2026 秋季版,写代码、省钱、中文场景各选各的
后台隔三差五有人问,现在大模型这么多,到底该用哪个。这个问题没有标准答案,但可以有一个按场景的推荐顺序。下面这份榜单基于 9 月中旬的 LMArena 文本榜和各家公开价格,按使用场景拆开讲。 先看一眼分数盘 9月15日那期榜单,前四名被 …
后台隔三差五有人问,现在大模型这么多,到底该用哪个。这个问题没有标准答案,但可以有一个按场景的推荐顺序。下面这份榜单基于 9 月中旬的 LMArena 文本榜和各家公开价格,按使用场景拆开讲。 先看一眼分数盘 9月15日那期榜单,前四名被 …
翻 2026 年的模型发布会,你会看到一个规律,厂商报分的清单一直在换。三年前人手一个 MMLU,现在主流发布页上它几乎绝迹。原因不复杂,前沿模型在 MMLU 上全部冲到 92% 以上,HumanEval 也早就被打穿,这两位老将已经分不出…
9月15日,LMArena 更新了新一期文本榜。这次有个标志性变化,1500 分这条历史门槛,第一次被三个模型同时踩了过去。Claude Mythos 5 以 1531 排在第一,Claude Fable 5 拿到 1525,Claude …
核心结论:2026 年 6 月 9 日发布的 Gemini 3.5 Live Translate,是谷歌把实时语音翻译从”轮流式”推向”流式同步”的一次关键升级——它支持 70 多种语言自动识…
结论先行:Google 在 I/O 2026 上发布 Gemini 3.5 模型家族,首发版本 Gemini 3.5 Flash 主打“高智能 + 高速度 + 可规模化调用”。官方数据显示,它在多数基准测试中超过 Gemini 3.1 Pr…
结论先行:微软 AI 团队发布了第二代语音转写模型 MAI-Transcribe-2。它在 FLEURS 基准的 60 种语言上取得 5.2% 的平均词错误率(WER),位列第一;在 Artificial Analysis 的英文语音转写榜…
结论先行:雷神把”本地跑大模型”的门槛又往下压了一截。9 月 20 日,雷神宣布旗下首款 AI 移动工作站 AI Master M7000 将于 9 月 21 日 10:00 开售,号称能在端侧”驯服&#…
2026年6月1日,国内AI独角兽MiniMax正式发布新一代文本生成大模型MiniMax M3。这是国内首个同时具备“前沿 Coding 能力”、“百万上下文”和“原生多模态”三大核心能力的旗舰模型,被MiniMax形容为“第一个把完整前…
2026年3月,OpenAI正式发布GPT-5系列模型,包括GPT-5.3 Codex和具有扩展推理能力的GPT-5版本。该模型在视觉推理、代理编码和研究生级别…
2026年3月,AI领域迎来新一轮爆发!三大重磅消息值得关注:OpenAI GPT-5正式发布,Google Gemini 3.1 Pro性能翻倍刷新ARC-A…