OpenAI 数学与 AI 咨询小组解析:9 名数学家首批加入,纳维-斯托克斯难题争议后的学术评估机制
结论先放在前面:OpenAI 给自家数学研究装上了一个外部评估层,但这个层只有话语权,没有刹车权。据 OpenAI 公布的安排,公司已成立”数学与人工智能咨询小组”,由普林斯顿高等研究院提供支持,首批成员为 9 名数…
结论先放在前面:OpenAI 给自家数学研究装上了一个外部评估层,但这个层只有话语权,没有刹车权。据 OpenAI 公布的安排,公司已成立”数学与人工智能咨询小组”,由普林斯顿高等研究院提供支持,首批成员为 9 名数…
结论先说:AI 长剧真正跨过的一道门槛不是画质,而是卫视播出。8 月 31 日,神话题材季播剧《后西游记》第一季花果山篇在湖南卫视与芒果 TV 双平台开播,这是 AI 长剧历史上第一次登上卫星电视,也是广电 21 条发布后首部采用边审边播模…
鸟鸣也有方言。锤头鹀在不同地区的鸣声存在差异,而这种差异是可以被模型稳定利用的信号。 研究是怎么做的 研究者的做法分两步。先用鸟类鸣声分类器提取 embeddings,再在这层之上训练一个细分类模型,把锤头鹀的方言差异专门当成一个难任务来处…
英伟达 NVlabs 开源了一个叫 SoL-Pi 的智能体框架。它不改模型权重,只在 harness 这一层动手,就把长时程任务的 token 流量压掉约 49%,分数保留约 94%。如果你在用 agent 跑长任务,账单能省下来的比例大概…
PhAI Labs 联合多所高校发布了一个共享预测核心,同一套方法覆盖了七类系统,包括癌细胞、分子、天气与行星轨道。名字叫 JEPA-Anything,野心写在名字里。 一个能自己找出规律的细节 模型没有被告知开普勒定律,却从轨迹数据里拟合…
FrontierMath 上有一道挂了九年的难题,最近被解开了。解题方不是纯人类团队,而是 GPT-6 Astra 加三位人类研究员。榜单为此专门新增了 Human+AI 这个状态标签。 题目本身就很反直觉 这道题原本是要找一个核为空的反例…
Anthropic 把外部评估的活交给了埃森哲。埃森哲的 Faculty 团队会进场做模型评测、红队测试、对齐评估与防护测试,双方计划五年各投入至少 10 亿美元建设 AI 安全能力。 争议点在钱从哪来 评估费用由 Anthropic 自己…
据央视新闻报道,上海警方日前破获一起利用 AI 生成不实文章敲诈科技企业的案件:犯罪嫌疑人王某某针对一家刚宣布获得融资的科技企业,连续发布十余篇由 AI 生成的抹黑文章,先索要 30 万元“撤稿费”,再索要 200 万元所谓“咨询合作费”,…
结论先行:阿里通义团队开源的 LHM,把 3D 数字人的制作门槛压到了前所未有的低度——只需一张正面照片,数秒内端到端生成完整且可直接驱动的 3D 数字人,无需多角度拍摄、无需标注数据、无需后处理。它基于多模态 Transformer 与高…
结论先行:2025 年 7 月 28 日,阿里巴巴通义实验室正式开源了视频生成模型 Wan2.2。它的差异化不在”画质又好了一些”,而在把混合专家(MoE)架构引入注意力模型,用来理解并还原电影镜头语言——光影、色彩…