智谱发布 GLM-5.3:基座没换只炼后训,编程提升 50% 登顶开源
8月14日,智谱正式发布 GLM-5.3。这个版本有个很反直觉的地方,基座模型和 GLM-5.2 完全一样,7430 亿参数的底座动都没动,所有的提升全部来自后训练。 智谱把这套打法叫后训练 Scaling。数十倍规模的长程任务环境、更丰富…
8月14日,智谱正式发布 GLM-5.3。这个版本有个很反直觉的地方,基座模型和 GLM-5.2 完全一样,7430 亿参数的底座动都没动,所有的提升全部来自后训练。 智谱把这套打法叫后训练 Scaling。数十倍规模的长程任务环境、更丰富…
8月13日,Google 又发新模型了,Gemini 3.7 Flash。距离上一个 Flash 发布才过去三周,这个节奏在模型圈里算得上激进。 Google 给它的定位是「最聪明的打工人模型」,主打编程、Agent 和复杂工作流。相比 3…
8月13日晚上,DeepSeek 一口气干了三件事。先是公布 API 调价方案,几个小时后,V4 Pro 正式版悄悄上线,再晚一点,Harness 团队顶着那只黑鲸头像发了第一条推文,宣布 DeepSeek Harness 开发者预览版开放…
8 月 13 日,DeepSeek 把涨价这件事正式敲定了。一周前官方只是挂了个预告,说计划近期整体上调 API 定价、涨幅可能比较大,具体方案等通知。现在通知来了,新价格从 8 月 17 日零时起生效,部分模型涨幅超过三倍。 涨价幅度最大…
8 月 13 日早上,阿里千问大模型团队把 Qwen3.8-2.4T-A95B 的模型权重挂上了 Hugging Face 和魔搭社区。十天前 Qwen3.8-Max 发布时承诺的开放权重,说到做到了。这也是千问家族第一次把 Max 级别的…
8 月 12 日这天很有意思,凌晨 DeepSeek 把 V4 Pro 正式版端上桌,晚上马斯克的 Grok 4.6 也来了。两个旗舰同一天上线,一个在杭州,一个在旧金山,隔着太平洋打的是同一场仗。 Grok 4.6 距离上一代 4.5 发…
8 月 12 日晚上,DeepSeek 的 API 文档悄悄更新了一行字,模型版本从 V4 Pro 预览版换成了 DeepSeek-V4-Pro-0813。没有发布会,没有预告海报,官方博客连更新日志都还没发,V4 Pro 正式版就这么上线…
8 月 11 日,Manus 官网挂出一封《致 Manus 用户的一封信》,信的开头就写得很明白,Manus 即将恢复以独立公司形式运营。这封信用几百字把过去八个月里那桩 20 亿美元收购案的最后悬念揭开了。 故事要从 2025 年 12 …
# OpenAI发布GPT-5.6-Cyber:周五叫停Astra,周一上线拒绝更少的黑客模型 OpenAI 在周一放出了一个专门给网络安全人士用的新模型,GPT-5.6-Cyber。它基于 GPT-5.6 Sol 微调,训练目标很直接,就…
8月10日,Meta Superintelligence Labs 正式发布并开源了 Muse Glimmer——一个约 30B 参数(精确约 29.6B)的开源智能体模型,专为“始终在线的本地代理工作流”(always-on local …