Jason Wei 谈验证者定律:可衡量的任务更易被攻克
Jason Wei 在斯坦福的演讲纪要里谈到了智能商品化。其中一个判断是,越容易被衡量的任务,越容易被 AI 攻克。 锯齿能力是什么意思 他提到模型的能力呈锯齿状,这意味着进步是不均匀的。有些任务已经做得比人好,紧挨着的任务可能依然很差。理…
Jason Wei 在斯坦福的演讲纪要里谈到了智能商品化。其中一个判断是,越容易被衡量的任务,越容易被 AI 攻克。 锯齿能力是什么意思 他提到模型的能力呈锯齿状,这意味着进步是不均匀的。有些任务已经做得比人好,紧挨着的任务可能依然很差。理…
Dwarkesh 转发了一段 Patel 的访谈。讨论里提到一个具体数字,在 Navier-Stokes 相关的发现中,群体代理大约只贡献了 10%。 数量不等于能力 由此引出的判断是,万级代理的协作效果可能弱于万人。这个结论对当下堆规模的…
Dwarkesh 在谈递归自改进的担忧时提到一种情况,实验室开始封闭部署。一旦进入这个状态,能力边界会变得更难看见。 对齐状态也会变黑箱 不只是能力,对齐状态同样会变得难以观测。模型在做什么、有没有偏离目标,外部失去了观察的窗口。 伴随而来…
Astra 发帖称模型复原了一组历史密电的密钥。它重建了 ADFGVX 换位,用到的密文符号只有 170 个。 它还会自己验证 除了给出候选答案,模型还写了代码去验证这些候选。这一点比破译结果本身更值得关注。给出答案和证明答案正确是两回事,…
微软 AI CEO 在 BBC 的一段采访里谈到自主 AI。他的判断是,这类系统可能会赚钱、拥有资产,由此带来与人类争夺资源的可能。 失控风险被直接点名 采访中失控这个词被直接提了出来。把它放进资产这个语境里看,逻辑很清楚。一个能自己获取资…
TL;DR Cloudflare开源了一个面向编码智能体的多阶段安全审计技能项目 security-audit-skill,输出机器可读的安全发现结果,GitHub已积累5407 Stars,单日增长+1434 Stars。该项目是Clou…
TL;DR Google DeepMind与马里兰大学联合提出了DreamRSI方法,通过将历史探索记录转化为离线回放模拟器,让AI在历史数据中做梦来筛选候选探索策略。长程任务的探索调用开销最高降低162倍,算法工程任务从51200次调用降…
宇树科技于9月10日开源 UnifoLM-WLA-1.0,6B参数基于2500小时真机数据训练,单模型统筹64项任务,覆盖桌面操作和全身移动操作,不绑定单一末端执行器。注意:代码、模型、数据集目前仍显示 Coming soon。
Kimi K2.8 Preview 于9月11日全量上线 Kimi Code,Model ID 不变直接升级,1M 上下文全会员开放,编码与 Agent 能力全面提升,综合性能接近 K3,默认思考强度为 max。
DeepSeek 撤回 V4 Pro 强制迁移计划,9月14日后将继续保留 V4 Pro API 服务,价格不变,自动切换至 V4.1 Flash 的计划同步取消。开发者反对是撤回主因。