Claude 自主发现新型酶 ART:950 个智能体跑 21 小时

Anthropic 在 9 月 23 日宣布成立生命科学研究团队和自己的分子生物学实验室,同时放出第一个成果:在人类科学家只给了宏观方向的前提下,Claude 自主发现了一种此前没有被表征过的酶系统,命名为阵列关联逆转录酶(Array-associated Reverse Transcriptases,ART)。同一天发布的预印本论文还没经过同行评审,但张锋已经看过并给出正面评价。

950 个智能体跑 21 小时干了什么

团队给 Claude 的任务是在一个庞大的 DNA 序列数据库里搜索新型逆转录酶。人类科学家的参与被压缩到两处,一是最初的提示词设计,二是后续的实验室验证,中间的分析过程全部交给约 950 个 Claude 智能体并行完成。

这批智能体在 21 小时内消耗约 2.1 亿个词元,从超过 20 万个逆转录酶里筛出约 3500 个新候选系统,再收窄到 20 个最值得深挖的候选,并逐个生成人类可读的分析报告。

关键的那一击来自其中一个智能体。它在处理一段噬菌体 DNA 序列时,注意到一个不寻常的逆转录酶基因旁边跟着一串串联重复阵列,于是去计算重复序列的长度和间距、比对已知逆转录酶系统的结构、检索文献确认有没有人报道过。这套动作听起来很朴素,但正是基因组挖掘里人类研究员要做的那套流程。

环节 数据
并行智能体数量 约 950 个
总耗时 21 小时
词元消耗 约 2.1 亿
初筛范围 20 万+ 逆转录酶
新候选系统 约 3500 个
深入分析候选 20 个
重复阵列拷贝数 3 至 21 个

ART 到底是什么,还不确定

按 Anthropic 的描述,ART 由三部分组成:一个逆转录酶、它旁边的伴侣基因,以及一长串间隔均匀的非编码 DNA 重复序列。这个重复阵列在结构上和 CRISPR 阵列相似,论文显示它包含 3 到 21 个短重复序列拷贝,初步实验表明它能表达成一组不同的短 RNA,具有生物学活性。

但到这里就得踩一脚刹车。ART 的确切功能目前并不清楚,从发现到验证它能不能稳定、可控地用于基因编辑,中间还隔着大量实验。这部分我不想说得太满,预印本未经同行评审,属于早期结果。

CRISPR 基因编辑先驱、MIT 与 Broad 研究所教授张锋审阅预印本后表示,这是 AI 智能体推动生物学发现的一个令人兴奋的案例,识别 RNA 重复阵列极其引人关注,完全值得进一步深入研究。Anthropic CEO 达里奥·阿莫代伊在 X 上则说得更保守,他承认这一发现建立在他人此前的工作之上,斯坦福一个团队曾描述过在某些方面相似的体系,同时强调该发现大部分但并非全部由 Claude 完成,系统的确切功能与生物技术实用性目前尚不清楚。

实验室边界怎么划

生物安全是这类工作绕不开的问题。Anthropic 给出的边界是实验室只处理生物安全一级和二级(BSL-1 和 BSL-2)研究,不涉及可感染人类的病原体,所有湿实验由人类科学家执行,Claude 只负责数据挖掘、假说生成和数据分析。

这条分工线的意义在于,AI 目前做的是读和想,动手的部分仍然在人手里。Anthropic 判断,这类基因组挖掘如果能规模化,有望把专家通常需要数周乃至数月的分析压缩到几小时,并表示愿意与科学家合作,把方法扩展到基因组学和其他领域。

这不是 Anthropic 第一次往生命科学方向走。之前站里写过 AI 制药赛道升温时 Anthropic 自建湿实验室并收购 Coefficient Bio 的消息,这次的自有实验室加首个成果算是把那条线往前推了一步。配套的还有 Claude Science 科研工作台,资助 50 个项目、最高 3 万美元额度,方向是一致的。

和其他 AI 做科学的进展放一起看

近期 AI 在科研上的进展密集,路线差别挺大。GPT-6 Astra 与人类合作攻克了 FrontierMath 上一道悬置九年的题目,属于数学方向;OpenAI 组建数学与 AI 咨询小组,走的是学术评估机制;这次 Anthropic 落在湿实验与生物学发现上。

区别在于验证链条的长度。数学题对完答案就知道对错,生物发现要回到实验台反复验证,ART 从被发现到被证明有用,中间的时间尺度完全不一样。这也是为什么阿莫代伊的表态比张锋的赞赏要谨慎得多。

常见问题

ART 是 Claude 独立发现的吗

不完全是。人类科学家提供了最初的提示词设计并完成了后续实验室验证,中间的分析由约 950 个智能体并行完成。阿莫代伊的表述是大部分但并非全部由 Claude 完成,而且这一发现建立在斯坦福团队此前描述的相似体系之上。

这个发现现在有什么用

暂时还没有直接用途。ART 的确切功能不明确,初步实验只证明重复阵列能表达为一组短 RNA 并具有生物学活性,能否稳定可控地用于基因编辑还需要大量后续实验,论文也尚未经过同行评审。

Anthropic 自己做的湿实验吗

所有湿实验由人类科学家执行,Claude 负责数据挖掘、假说生成与数据分析。实验室只做 BSL-1 和 BSL-2 级别研究,不碰可感染人类的病原体。

小结

值得记住的是过程而不是结论。950 个智能体、21 小时、2.1 亿词元,把原本需要几周甚至几个月的基因组挖掘压到一天之内,这个效率数字比 ART 本身更硬。至于这个酶系统最终能不能变成工具,我倾向于再等同行评审和后续实验,现在下判断太早。能确定的是,Anthropic 已经把 Claude 模型能力往科学发现的场景里押了不小的一注。


相关阅读