DeepSeek Harness 正式发布:一条命令跑起官方开源 Agent 框架
澄清DeepSeek Harness与Hermes Agent的区别,介绍DeepSeek官方开源Agent框架的发布信息、核心架构和插件生态。
澄清DeepSeek Harness与Hermes Agent的区别,介绍DeepSeek官方开源Agent框架的发布信息、核心架构和插件生态。
后台隔三差五有人问,现在大模型这么多,到底该用哪个。这个问题没有标准答案,但可以有一个按场景的推荐顺序。下面这份榜单基于 9 月中旬的 LMArena 文本榜和各家公开价格,按使用场景拆开讲。 先看一眼分数盘 9月15日那期榜单,前四名被 …
翻 2026 年的模型发布会,你会看到一个规律,厂商报分的清单一直在换。三年前人手一个 MMLU,现在主流发布页上它几乎绝迹。原因不复杂,前沿模型在 MMLU 上全部冲到 92% 以上,HumanEval 也早就被打穿,这两位老将已经分不出…
9月15日,LMArena 更新了新一期文本榜。这次有个标志性变化,1500 分这条历史门槛,第一次被三个模型同时踩了过去。Claude Mythos 5 以 1531 排在第一,Claude Fable 5 拿到 1525,Claude …
科大讯飞在 9 月 23 日正式发布了新一代语音识别大模型 Spark-ASR-2.0。落地节奏给得很明确,9 月 24 日起在讯飞输入法逐步上线,同时通过讯飞开放平台向开发者和企业客户开放 API,之后陆续铺到讯飞 AI 眼镜、智能办公本…
如果你最近觉得 Claude 写的东西越来越难读,那不是错觉。Anthropic 负责 Claude 微调的工程师杰克逊·克尼恩(Jackson Kernion)在 9 月 23 日公开回应了这件事。Opus 4.6 之后,模型的训练重心挪…
高通在年度骁龙峰会上发布骁龙 8 Elite Gen 6 与骁龙 8 Elite Extreme Gen 6 两款旗舰处理器,主打方向是端侧 AI 算力。最硬的一个数字是,Extreme 版本能在手机本地直接运行 300 亿参数的混合专家模…
华为云把 CodeArts 代码智能体往鸿蒙开发者面前推了一大步。这次一次性上线三样东西,鸿蒙编码大模型、码道鸿蒙智能体、鸿蒙开发者实践中心。官方给它的定位是全球首个也是目前唯一一个专为鸿蒙生态打造的 AI 编码智能体,覆盖从想法到上架的整…
结论先说:人工智能的竞技场正在从云端评测榜扩展到近地轨道。据《日经亚洲》报道,日本计划最早于 2027 年在国际空间站举办一场人工智能机器人竞赛,参赛团队需要自行开发 AI 模型来控制空间站内部的机器人,目标之一是培养下一代太空工程师。需要…
结论先说:AI 长剧真正跨过的一道门槛不是画质,而是卫视播出。8 月 31 日,神话题材季播剧《后西游记》第一季花果山篇在湖南卫视与芒果 TV 双平台开播,这是 AI 长剧历史上第一次登上卫星电视,也是广电 21 条发布后首部采用边审边播模…