导读部分 返回列表
来自伦敦的AI初创公司Inherent近日宣布,其研发的AI智能体Faraday在科学论文复现任务中展现出超越Anthropic和OpenAI前沿模型的实力。这家由Google DeepMind校友创...
正文内容
来自伦敦的AI初创公司Inherent近日宣布,其研发的AI智能体Faraday在科学论文复现任务中展现出超越Anthropic和OpenAI前沿模型的实力。这家由Google DeepMind校友创立的实验室,刚刚以5000万美元的种子轮融资从隐身模式中走出,立刻引发业界关注。
在测试中,Faraday需要独立复现已发表科学论文的实验结论,且事先不会被告知答案。结果显示,Faraday成功完成了多个领域的论文复现,成功率显著高于Anthropic的Claude Opus 4.8和OpenAI的GPT-5.5。更令人惊讶的是,Faraday运行的底层模型是Qwen 3.6,参数量仅有270亿,远小于对比模型,体现了极高的计算效率。

Inherent联合创始人兼首席科学家Edward Hughes表示:“论文复现是许多博士生入门的标准训练方式。我们更看重的不是战胜其他AI系统,而是如何构建这样的系统。”他强调,Faraday不仅追求结果准确,还试图模仿人类的“研究品味”——即判断哪些实验方向值得探索。这种能力对于未来AI驱动科学发现至关重要。
值得注意的是,Inherent并非唯一押注AI科研助手方向的团队。从学术文献自动综述到实验方案生成,AI正在加速介入科研流程。此前也有相关项目尝试用大语言模型辅助论文复现,但通常在成本控制和复杂推理上面临瓶颈。Inherent的成果证明,小型化模型通过精心训练同样能在科研任务上达到领先水平。
业界分析认为,Faraday的成功可能改变AI科研工具的竞争格局。对比动辄上千亿参数的巨型模型,270亿参数的Faraday在部署成本和推理速度上都具有明显优势。未来,科研机构或能以更低成本使用AI助手重复验证研究成果,从而提升科学发现的可靠性。该实验室计划下一步将Faraday开放给部分合作机构测试,并持续优化其在生物、物理等学科的表现。详细内容可参考我们此前的报道:OpenAI支持加州强化AI安全法案:从反对到支持的立场转变。
本文出自 AI一族,原文链接:https://www.aiyizu.cn/?p=5014
转发请注明出处,禁止未经允许用于任何商业用途。