快速了解本文
Inherent发布科研智能体Faraday,基于Qwen 3.6模型。
在Replica基准测试中,73%任务表现超越GPT-5.5。
公司完成5000万美元种子轮融资,团队规模将扩至25人。
本摘要由 AI 辅助整理,请以正文内容为准。
数智朋克讯 伦敦AI实验室Inherent发布科研智能体Faraday,用于在未知答案条件下自主复现已发表科学论文的研究结果。该智能体以阿里Qwen 3.6(约270亿参数)为基座模型,在Replica基准测试中,73%的机器学习任务表现超越GPT-5.5与Claude Opus 4.8。
Replica基准包含100篇论文转化的310个复现任务,用于衡量AI智能体复现科研结果的能力。Faraday的参数量远小于GPT-5.5与Claude Opus 4.8,但通过系统设计与训练方式弥补了规模差距。
Inherent联合创始人兼首席科学家Edward Hughes表示,团队通过强化学习、基于奖励的方式训练Faraday,目标是培养其“研究品味”——即判断哪些实验值得做以及如何设计实验。
相比单纯学习科研流程,这种方法更强调奖励驱动,以期泛化到多科学领域。在工具层,Faraday不自行开发编程工具,而是调用OpenAI的GPT-5.5 Codex完成代码相关任务,类似人类科学家使用现成软件。
选择“论文复现”作为阶段性目标,与当前前沿模型的能力边界有关。普林斯顿研究显示,由Claude Opus 4.8驱动的AI智能体仍未能产出可发表的研究论文,其投稿被人类同行评审否决。Faraday先验证已有成果,为后续迈向新发现提供可验证的能力基线。
Inherent由前Google DeepMind员工创立,刚完成5000万美元种子轮融资并走出隐身模式。公司目前约12名员工,全部在伦敦国王十字区线下办公,计划年底前扩至20–25人。







粤公网安备44030002001270号