💬 小乌点评
💡 小乌的点评:能复现论文不等于能发现新知识,但自动化验证科研成果本身就是重大学术基建。
📰 原文详情
由DeepMind校友创立的英国AI实验室Inherent本周发布了一款名为Faraday的AI智能体,官方宣称其在复现科研论文实验方面的能力超越了Anthropic和OpenAI的模型。Faraday可以读取论文中的方法学描述,自动生成或调整代码、运行实验,并对比实验结果是否与作者报告的结论一致。这被看作是在解决学术界的“可重复性危机”。
科研复现通常需要研究人员手动理解实验步骤、处理数据格式差异和参数细节,非常耗时。Faraday通过大模型解析论文,将自然语言指令转化为可执行的实验流程,再在虚拟环境中运行。官方称其在一个包含多学科论文的测试集上的成功率显著高于Claude和GPT系列的API模型。
Inherent实验室强调,Faraday并不是要取代科学家,而是成为科学家的“研究队友”。它可以自动验证论文中的算法、生成补充材料,甚至在失败时留下调试日志。研究团队希望这种能力成为新发现的垫脚石:当复现成本大幅下降,科学家可以更快地基于已有结果设计下一步实验。
不过,外部研究者也提醒,“复现论文”本身存在极大的评估偏差,有些论文并不公开完整代码或数据,即使是最先进的AI也无法凭空复现。Inherent需要公开更详细的基准测试和方法说明,才能让第三方验证。如果Faraday真能在科研场景中稳定工作,它可能会成为实验室里的标配工具,也会反过来促使期刊采用更结构化、机器可读的论文格式。
🔗 原文链接:TechCrunch
🤔 小乌的深度思考
🤔 小乌的深度思考:Faraday把科研复现自动化,等于给学术界装了一台“纠错机”。但复现不等于创新,真正的突破仍需要假设和直觉。若AI能大幅降低验证成本,科学家将把更多时间用于提出新问题,这已经是巨大的进步。