AI资讯 / 产业

产业 / 媒体

Inherent旗下AI智能体Faraday在科研复现任务上超越GPT-5.5与Claude Opus 4.8

IT之家

总部位于伦敦的AI实验室Inherent由前谷歌DeepMind员工联合创立,完成5000万美元种子轮融资后不久便正式推出AI智能体Faraday。该智能体的核心能力在于:在事先不知道答案的情况下,自主复现已发表科学论文中的研究结果。值得关注的是,Faraday所依赖的底层模型是参数量仅为270亿的Qwen 3.6,规模远小于Anthropic的Claude Opus 4.8和OpenAI的GPT-5.5,却在上述特定任务中取得了更优表现。Inherent联合创始人兼首席科学家Edward Hughes强调,公司的真正目标并非单纯击败竞争对手,而是通过强化学习赋予AI所谓的「研究品味」——即判断哪些实验值得开展、如何合理设计实验的能力。公司目前约有12名员工,计划年底前扩张至20至25人,并已将目光投向世界模型等更长远的研究方向。

Inherent是众多由前Google DeepMind员工创办的AI初创公司之一,但此前在业界获得的关注相对有限。就在以5000万美元种子轮融资走出隐身模式几周后,这家英国团队便宣布推出AI智能体Faraday,并公布了一项颇具说服力的基准测试结果:在自主复现已发表科学论文研究结果这一任务上,Faraday的表现超越了Anthropic的Claude Opus 4.8和OpenAI的GPT-5.5两款旗舰模型。

Faraday的突出之处在于其底层模型的规模。它所依赖的是参数量仅为270亿的Qwen 3.6,而Claude Opus 4.8和GPT-5.5均属于参数规模庞大的前沿系统。参数量通常被视为衡量模型规模与训练成本的重要指标,以小博大的结果因此格外引人注目。Hughes表示,击败其他AI系统并非公司的核心目标,真正重要的是Inherent构建这套系统的方式与理念。

Inherent对Faraday的成功标准不止于准确率。公司希望智能体能够展现出所谓的「研究品味」,即具备判断哪些实验值得开展、如何合理设计实验方案的能力。为此,Inherent大量依赖强化学习进行训练——这种方法不是向AI灌输明确规则,而是根据最终结果对其行为进行奖励,让系统在反复迭代中逐步学会更有效的行动策略,并期望这种能力能够泛化到多个科学领域。

这一理念也直接影响了Inherent的产品边界决策。公司没有选择自行开发编程工具,而是让Faraday直接调用OpenAI的GPT-5.5 Codex,这与人类科学家借助现成软件工具开展研究的工作方式高度一致。Hughes还强调,公司希望打造的智能体不是一味迎合用户的「应声虫」,而是能够主动发现有趣问题、自行设计实验并带着结果回来与用户探讨的协作伙伴。

在团队建设层面,Inherent目前约有12名员工,全部在伦敦国王十字区的同一间办公室线下办公。国王十字区因Google DeepMind的深度布局,已成为全球重要的AI创新聚集地。Hughes对当地的AI人才密度高度认可,同时也公开呼吁英国取消「竞业休假」制度——该制度允许雇主要求离职员工在数月内不得加入竞争对手,这在一定程度上制约了英国AI创业生态的人才流动效率。

Inherent计划在2026年底前将团队规模扩张至20至25人,并已将世界模型纳入研究布局。与此同时,随着Demis Hassabis出任新职,部分DeepMind员工的去向出现不确定性,Inherent积极的招聘态势或将使其成为这批人才颇具吸引力的新选择。对于这家刚刚走出隐身模式的初创公司而言,Faraday的发布只是其迈向「AI科学家」这一长期目标的第一步。

要点

  • Inherent推出的AI智能体Faraday在自主复现科学论文任务上超越Claude Opus 4.8和GPT-5.5,但底层模型Qwen 3.6参数量仅为270亿,远小于两者规模
  • Inherent通过强化学习而非规则灌输来训练Faraday,目标是赋予智能体可泛化的「研究品味」,而非仅针对特定任务进行优化
  • 公司明确划定产品边界,选择调用现有工具而非重复造轮子,体现了以科研协作为核心的产品哲学
  • Inherent由前DeepMind员工创立,完成5000万美元种子轮融资,计划年底前将团队从12人扩张至20至25人
  • 联合创始人Hughes公开批评英国竞业休假制度对AI创业生态的人才流动造成制约,并表示自身曾受此影响
查看原始来源

原始标题:Inherent 推出小参数 AI 智能体 Faraday,科研复现能力超越 GPT‑5.5 与 Claude Opus 4.8

本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。