
DeepMind 的校友长期处于 AI 的前沿,但一家新的英国实验室正在引起轰动,其声称可能重新定义该领域。Inherent 由前 DeepMind 研究人员创立,推出了 Faraday,一款 AI 代理,该公司称其在复现科学研究方面超越了 Anthropic 和 OpenAI 的产品。这一成就不仅仅是花招——它可能彻底改变 AI 如何融入科学流程。
Faraday 的出名之处在于其能够接收科学论文、复现其实验,并以最少的人工输入产生可比较的结果。据 Inherent 称,这使得 Faraday 在复现任务方面领先于 Anthropic 的最新模型,甚至 OpenAI 的推理引擎。该公司认为,这一能力能够通过自动化验证和复现的繁琐工作来加速研究周期,让科学家专注于突破而非验证。
但在我们宣布 Faraday 为新霸主之前,让我们先冷静一下。复现研究是一项关键功能,但它不等同于产生新颖见解。Faraday 的表现在真空中令人印象深刻,但真正的考验是它是否能发现新发现或简化协作,从而推动科学进步。迄今为止,Inherent 尚未发布同行评审的数据或独立基准来证实其声称——只有内部测试和精心挑选的案例。这在一个供应商基准因夸大能力而臭名昭著的行业中,是一个危险信号。
更广泛的意义在于 AI 代理在科学中的作用。如果 Faraday(或其竞争对手)能够可靠地复现和验证研究,它可能会让高质量科学更易获取、减少欺诈,甚至帮助非专业人士验证主张。但另一方面,过度依赖 AI 生成的复现也存在风险,可能会抑制创造性问题解决,或在底层模型存在缺陷时引入系统性偏见。毕竟,AI 无法复现它不理解的内容——而理解正是科学中魔力(和混乱)的核心所在。
Inherent 的团队凭借其 DeepMind 的血统带来了可信度。但可信度不等于能力。Faraday 若想真正脱颖而出,它需要证明自己不仅能模仿过去的研究——它需要推动可能性的边界。在此之前,它只是一个引人入胜的实验,而非一场革命。在 AI 代理的世界中,这仍然是一个相当大的成就。
真正的竞争不仅仅是复现研究,而是谁能用 AI 来拓展研究。Faraday 今天可能领先,但终点线是一个移动的目标。
图片:Franck V. / Unsplash (https://unsplash.com/@possessedphotography)
Google’s new AI-tuned Discover feed lets users customize content via chatbot, but raises questions about data retention and manipulation.

Google’s new AI study tools for Search and Gemini aim to outpace OpenAI, but are they more than just flashy promos for struggling students?

评论