InterTrack 让人形机器人看懂地形再迈步:交互成功率 81.3%,达最优基线 4.3 倍
InterTrack 把人形机器人的全身控制从「模仿一套固定动作」推进到「理解地形后自行决定全身怎么动」:在地形交互类任务上它取得 81.3% 的成功率,是当前表现最好的已评估基线的 4.3 倍,跌倒后的恢复成功率达到 99.3%。论文同时…
InterTrack 把人形机器人的全身控制从「模仿一套固定动作」推进到「理解地形后自行决定全身怎么动」:在地形交互类任务上它取得 81.3% 的成功率,是当前表现最好的已评估基线的 4.3 倍,跌倒后的恢复成功率达到 99.3%。论文同时…
一篇新论文把 Ken Thompson 1984 年的经典攻击搬到今天的 AI 编码代理上,并给出了肯定答案:攻击者只要向自修改编码代理的「自我评估—自我改进」环节投喂被污染的基准,就能诱使其在后续的干净任务中主动写出带漏洞的代码。研究者在…
Claude Code Projects 的云端线程已进入 Beta:同一个对话可以派生出多条彼此隔离的云端线程,每条线程各自持有一份独立的仓库副本和上下文环境,目前只面向部分 Pro 与 Max 订阅用户开放并行。它真正改写的不是「AI …
OpenAI 发布了面向法律垂直领域的 Astra for Law,目标客户是律师与法务软件公司。它在通用网页检索之外接入了 CourtListener 判例库,该库覆盖 99.9% 以上已公开的美国判例法。效果体现在一道简单的对比上:私有…
Anthropic 重构了 Claude Code Projects:一个目标可以拆成多条云端分支并行推进,跑完各自产出可直接合并的 PR。同步披露的内部数据更值得留意——公司内部每天运行约 3 万个 AI Agent,AI 承担的研发任务…
阿里千问上线全模态模型 Qwen3.8-Omni-Flash,把音频输入的调用成本压到原来的约 2%(降幅超过 98%),同时把上下文窗口拉到 1M(100 万 Token),并在 30 项公开评测上取得平均超过 26% 的提升。三个数字指…
OpenAI 在 2026 年 9 月 9 日交出了一份图像模型的「双线答卷」:消费端的 ChatGPT Images 2.5 全面开放,开发端则一次性放出 GPT-Image-2.5 Flare 与 GPT-Image-2.5 Sunbu…
2026 年 8 月 26 日,阿里通义千问团队正式发布全新多模态 MoE 模型 Qwen3.8-Flash:主模型参数量 125B,额外配备 51B N-gram Embedding,每 Token 仅激活 6B 参数,原生支持 262,…
2026 年 9 月 2 日,腾讯 WorkBuddy 正式上线开放平台,面向智能硬件、行业应用和开发者开放底层 Agent 能力,首批已有超过 100 家生态伙伴参与共创。这标志着 WorkBuddy 从面向个人用户的桌面 AI 办公智能…
2026 年 9 月,科大讯飞推出全新 AI 产品 AStudio,官方定位为「新一代全场景 AI 生产力工作台」。与聊天助手给出文字回答不同,AStudio 强调完整闭环:用户提出目标,AI 负责任务规划、工具调用、实际执行,直到交付可直…