产品更新 · TechCrunch AI
Inherent发布AI代理Faraday,声称在复现科研任务上超越Anthropic与OpenAI
由DeepMind校友创立的英国AI实验室Inherent发布了一款名为Faraday的AI代理,该代理旨在自动复现科学论文中的实验与结果。Inherent声称,在科研复现任务上,Faraday的表现超越了Anthropic和OpenAI的模型。这一成果被视为可能加速科研创新的重要一步,但相关细节尚未公开,其性能声明仍需独立验证。
原文:TechCrunch AI原文发布:2026/8/22 19:00:00中文发布:2026/8/22 19:03:10
近日,英国AI实验室Inherent宣布推出其首款AI代理产品“Faraday”,该产品专为科研场景设计,能够阅读科学论文并复现其中的实验流程与结论。Inherent由多位DeepMind前研究员创立,团队背景使其在生成式AI与科学计算领域备受关注。
据Inherent官网介绍,Faraday在内部基准测试中,针对多项科研任务的表现已超越Anthropic的Claude和OpenAI的GPT系列模型。然而,该公司并未公布具体的测试数据集、评估方法或对比细节,也未提供任何第三方验证报告。因此,这一“超越”目前仍是单方面声明,业界需保持审慎态度。
科研复现是学术界长期存在的痛点。一篇论文的结果往往需要数月时间才能被其他团队验证,而Faraday试图通过AI代理自动化这一过程。如果其能力属实,将极大提升研究效率,帮助科研人员快速判断哪些成果值得深入探索,甚至可能催生新的发现。但值得注意的是,科研复现涉及对实验条件、数据处理的深度理解,AI代理目前可能仅能处理标准化程度较高的任务,其泛化能力仍有待观察。
Inherent的这一动作也折射出AI竞赛的新维度:从通用对话助手转向专业领域的垂直应用。当头部公司在通用模型上激烈竞争时,初创公司开始瞄准细分场景,以更轻量的Agent方案切入科研、工程、法律等门槛较高的领域。Faraday的发布或许只是一个开始,类似的“科研Agent”或将成为AI应用的新风口。
不过,技术上的突破往往需要时间验证。Inherent声称的“优异性”能否在开放基准上重现,以及Faraday是否具备实际部署的稳定性,都是未来需要关注的焦点。此次发布也引发了对AI安全与误用的担忧:如果AI能够快速复现研究,那么它也可能被用于生成大量低级或误导性内容。因此,在拥抱这一工具的同时,我们也需要建立相应的评估与监管框架。
综上所述,Faraday的发布是AI向科研纵深渗透的一个信号,但其真实性能与行业影响,仍有待真实世界的检验。
#AI#科研#Inherent#Faraday#DeepMind#Anthropic#OpenAI
查看原始信息来源