大模型推荐排行榜 2026 秋季版,写代码、省钱、中文场景各选各的
后台隔三差五有人问,现在大模型这么多,到底该用哪个。这个问题没有标准答案,但可以有一个按场景的推荐顺序。下面这份榜单基于 9 月中旬的 LMArena 文本榜和各家公开价格,按使用场景拆开讲。 先看一眼分数盘 9月15日那期榜单,前四名被 …
后台隔三差五有人问,现在大模型这么多,到底该用哪个。这个问题没有标准答案,但可以有一个按场景的推荐顺序。下面这份榜单基于 9 月中旬的 LMArena 文本榜和各家公开价格,按使用场景拆开讲。 先看一眼分数盘 9月15日那期榜单,前四名被 …
翻 2026 年的模型发布会,你会看到一个规律,厂商报分的清单一直在换。三年前人手一个 MMLU,现在主流发布页上它几乎绝迹。原因不复杂,前沿模型在 MMLU 上全部冲到 92% 以上,HumanEval 也早就被打穿,这两位老将已经分不出…
9月15日,LMArena 更新了新一期文本榜。这次有个标志性变化,1500 分这条历史门槛,第一次被三个模型同时踩了过去。Claude Mythos 5 以 1531 排在第一,Claude Fable 5 拿到 1525,Claude …
7 月 6 日消息,据 IT之家报道,美团已将万亿参数大模型 LongCat-2.0 正式开源,并同步开放面向国产算力优化的推理代码。公开信息显示,LongCat-2.0 总参数规模 1.6T,平均激活参数约 48B,官方页面进一步给出每个…
8 月 12 日晚上,DeepSeek 的 API 文档悄悄更新了一行字,模型版本从 V4 Pro 预览版换成了 DeepSeek-V4-Pro-0813。没有发布会,没有预告海报,官方博客连更新日志都还没发,V4 Pro 正式版就这么上线…
7月的最后一天,DeepSeek 终于在更新日志里放出了重量级消息。官方于今日(2026年7月31日)正式发布 DeepSeek-V4-Flash 公开测试版(Public Beta),这标志着 V4-Flash 从今年4月24日发布的预览…
DeepSeek V4 的”预览版”标签即将成为历史。 DeepSeek 官方于 6 月 29 日向 API 用户发送邮件,正式宣布 DeepSeek V4 正式版计划于 2026 年 7 月中旬全面上线,届时当前以…
6月18日,DeepSeek向所有用户推送了网页版识图模式。此前几天还在灰度测试里的功能,现在几乎每个账号都能看到——输入框上方与”快速模式””专家模式”并列,多了一个蓝色的”识图…
它来了跳票了三个月的 DeepSeek V4,终于以「预览版」的形式,加入了 2026 年的大模型战场。这次不是 PPT 发布,不是论文先行,而是直接上线—— …
DeepSeek V4 发布时间定了——4月下旬。消息一出,国内各厂商似乎像是被按下了加速键:小米、腾讯、阿里、月之暗面、智谱、MiniMax……最近两周扎堆发…