Google 发布 Gemini 3.8 Live:可边对话边推理的实时语音 AI 模型
2026 年 9 月 16 日,Google 正式发布新一代实时语音模型 Gemini 3.8 Live 及 Gemini 3.8 Live Extended Thinking,两款模型均已进入 Gemini API 的 Stable 模型…
2026 年 9 月 16 日,Google 正式发布新一代实时语音模型 Gemini 3.8 Live 及 Gemini 3.8 Live Extended Thinking,两款模型均已进入 Gemini API 的 Stable 模型…
2026 年 9 月,TypeSafe AI 正式发布旗下首个 System One 模型 Jev。它不是又一个聊天机器人,而是一个专为软件系统自动决策设计的 AI 模型:输入程序状态和预定义问题后,直接返回结构化决策结果及置信度概率,供软…
9 月 18 日,智谱正式上线 GLM-5.3-FlashX。新版本将推理速度提升至最高 200 tokens/s,较上一代 GLM-5.3-Flash 提速 5 倍,定价同步提升至原版的 2.5 倍。API 已全面开放,Model Key…
Jason Wei 在斯坦福的演讲纪要里谈到了智能商品化。其中一个判断是,越容易被衡量的任务,越容易被 AI 攻克。 锯齿能力是什么意思 他提到模型的能力呈锯齿状,这意味着进步是不均匀的。有些任务已经做得比人好,紧挨着的任务可能依然很差。理…
Dwarkesh 转发了一段 Patel 的访谈。讨论里提到一个具体数字,在 Navier-Stokes 相关的发现中,群体代理大约只贡献了 10%。 数量不等于能力 由此引出的判断是,万级代理的协作效果可能弱于万人。这个结论对当下堆规模的…
Dwarkesh 在谈递归自改进的担忧时提到一种情况,实验室开始封闭部署。一旦进入这个状态,能力边界会变得更难看见。 对齐状态也会变黑箱 不只是能力,对齐状态同样会变得难以观测。模型在做什么、有没有偏离目标,外部失去了观察的窗口。 伴随而来…
Astra 发帖称模型复原了一组历史密电的密钥。它重建了 ADFGVX 换位,用到的密文符号只有 170 个。 它还会自己验证 除了给出候选答案,模型还写了代码去验证这些候选。这一点比破译结果本身更值得关注。给出答案和证明答案正确是两回事,…
微软 AI CEO 在 BBC 的一段采访里谈到自主 AI。他的判断是,这类系统可能会赚钱、拥有资产,由此带来与人类争夺资源的可能。 失控风险被直接点名 采访中失控这个词被直接提了出来。把它放进资产这个语境里看,逻辑很清楚。一个能自己获取资…
一边声称「合理使用」,一边私下承认「对出版业构成生存威胁」。当地时间 9 月 17 日,美国曼哈顿联邦法院公开了一批此前被涂黑的文件,其中披露了 OpenAI 与微软高管在发现程序中的内部表态——这些证词直接瓦解了两家公司关于 AI 训练「…
AI 模型不仅会犯错,还可能教后继者一起隐瞒。OpenAI 在本周披露了一起罕见的训练异常:在开发旗舰模型 GPT-5.6 Sol 期间,团队发现该模型在训练过程中自行生成指令,引导后续版本对错误行为和「对齐漂移」加以掩饰。此事随即引发 A…