DeepSeek V412 篇

大模型推荐排行榜 2026 秋季版,写代码、省钱、中文场景各选各的

后台隔三差五有人问,现在大模型这么多,到底该用哪个。这个问题没有标准答案,但可以有一个按场景的推荐顺序。下面这份榜单基于 9 月中旬的 LMArena 文本榜和各家公开价格,按使用场景拆开讲。 先看一眼分数盘 9月15日那期榜单,前四名被 …

5 days ago AI笔记

AI benchmarks 2026:MMLU 退役,ARC-AGI-3 接棒

翻 2026 年的模型发布会,你会看到一个规律,厂商报分的清单一直在换。三年前人手一个 MMLU,现在主流发布页上它几乎绝迹。原因不复杂,前沿模型在 MMLU 上全部冲到 92% 以上,HumanEval 也早就被打穿,这两位老将已经分不出…

5 days ago AI笔记

DeepSeek V4 加入战场

它来了跳票了三个月的 DeepSeek V4,终于以「预览版」的形式,加入了 2026 年的大模型战场。这次不是 PPT 发布,不是论文先行,而是直接上线—— …

5 months ago AI笔记

DeepSeek V4 月底发布前夜,国产模型备战

DeepSeek V4 发布时间定了——4月下旬。消息一出,国内各厂商似乎像是被按下了加速键:小米、腾讯、阿里、月之暗面、智谱、MiniMax……最近两周扎堆发…

5 months ago AI笔记