AI智能体Faraday论文复现能力胜过GPT-5.5,DeepMind校友团队获突破

导读部分 返回列表

来自伦敦的AI初创公司Inherent近日宣布,其研发的AI智能体Faraday在科学论文复现任务中展现出超越Anthropic和OpenAI前沿模型的实力。这家由Google DeepMind校友创...

正文内容

来自伦敦的AI初创公司Inherent近日宣布,其研发的AI智能体Faraday在科学论文复现任务中展现出超越Anthropic和OpenAI前沿模型的实力。这家由Google DeepMind校友创立的实验室,刚刚以5000万美元的种子轮融资从隐身模式中走出,立刻引发业界关注。

在测试中,Faraday需要独立复现已发表科学论文的实验结论,且事先不会被告知答案。结果显示,Faraday成功完成了多个领域的论文复现,成功率显著高于Anthropic的Claude Opus 4.8和OpenAI的GPT-5.5。更令人惊讶的是,Faraday运行的底层模型是Qwen 3.6,参数量仅有270亿,远小于对比模型,体现了极高的计算效率。

AI智能体Faraday论文复现能力超越前沿模型

Inherent联合创始人兼首席科学家Edward Hughes表示:“论文复现是许多博士生入门的标准训练方式。我们更看重的不是战胜其他AI系统,而是如何构建这样的系统。”他强调,Faraday不仅追求结果准确,还试图模仿人类的“研究品味”——即判断哪些实验方向值得探索。这种能力对于未来AI驱动科学发现至关重要。

值得注意的是,Inherent并非唯一押注AI科研助手方向的团队。从学术文献自动综述到实验方案生成,AI正在加速介入科研流程。此前也有相关项目尝试用大语言模型辅助论文复现,但通常在成本控制复杂推理上面临瓶颈。Inherent的成果证明,小型化模型通过精心训练同样能在科研任务上达到领先水平。

业界分析认为,Faraday的成功可能改变AI科研工具的竞争格局。对比动辄上千亿参数的巨型模型,270亿参数的Faraday在部署成本和推理速度上都具有明显优势。未来,科研机构或能以更低成本使用AI助手重复验证研究成果,从而提升科学发现的可靠性。该实验室计划下一步将Faraday开放给部分合作机构测试,并持续优化其在生物、物理等学科的表现。详细内容可参考我们此前的报道:OpenAI支持加州强化AI安全法案:从反对到支持的立场转变

本文出自 AI一族,原文链接:https://www.aiyizu.cn/?p=5014

转发请注明出处,禁止未经允许用于任何商业用途。

文章评分

这篇文章对您有帮助吗?

🤖 随时召唤ZUZU陪你一起探索AI世界
ZUZU 伴学
登录享无限次提问 · 答案仅供参考
ZUZU答:
亲爱的小伙伴您好,我是ZUZU,有什么可以帮您的?😃

分享到

微信
朋友圈
QQ
QQ空间
微博
抖音
小红书
复制
二维码

实用功能

夜间模式
小字
大字
收藏
目录
笔记
朗读
相关
搜索
我的笔记
文章内搜索
相关文章推荐
正在加载相关文章...

反馈建议

您需要登录后才能填写意见反馈信息

分享二维码

使用手机扫描二维码

操作成功