原文标题:Inherent, founded by DeepMind alumni, says its AI ‘teammate’ just outperformed Anthropic and OpenAI at replicating research
这两个系统都规模大得多,前沿规模的系统——法拉第运行在一个名为 Qwen 3.6 的相对较小的模型上,该模型只有 270 亿个参数。 (粗略地说,“参数”代表模型的大小,通常也代表模型的训练成本。)Inherent 的成功标准也高于简单的准确性。除了复制结果之外,它还希望法拉第展示出“研究品味”——对哪些实验值得进行以及如何设计好实验的本能。
教授像味觉这样无形的东西是很困难的,这就是强化学习的用武之地。它是一种训练方法,奖励人工智能系统取得良好的结果,而不是制定要遵循的规则。 Inherent 并没有主要针对科学本身如何进行的研究来训练其智能体,而是依靠这种基于奖励的方法,并押注它将更好地推广到能够在许多科学领域做出贡献的智能体的长期目标。
休斯说:“我们始终以构建人工智能科学家代理并赋予我们的代理品味为北极星的指引。”这种关注也决定了 Inherent 选择不构建什么。据该公司称,它没有开发自己的编码工具,而是使用 OpenAI 的 GPT-5.5 Codex,就像人类科学家依靠现有软件而不是自己构建一切一样。
Inherent 还试图避免构建只告诉用户他们想听什么的代理。相反,休斯说,这个目标是以他最喜欢的队友为蓝本的——那种回来后说:“我对此感到好奇,然后我就去做了这些实验。你觉得这些结果怎么样?”
这种协作本能延伸到了 Inherent 作为一家公司的运作方式。该公司的十几名员工都在国王十字车站的一间办公室里亲自工作。国王十字车站曾经是一个破败的伦敦街区,谷歌 DeepMind 的出现帮助它变成了世界顶级的人工智能中心之一。 “我们相信伦敦是一个值得去的地方,”休斯说。
休斯看好伦敦人工智能人才的密度,但他也呼吁结束“花园休假”——这种做法在英国很常见,即禁止离职员工在辞职后几个月内加入或创办竞争对手公司。美国研究人员通常不会面临这种限制,这让美国初创公司在招聘离职人才方面占据了先机。 “这是个人观点,而不是公司观点,但我受到了花园假问题的影响,”他告诉 TechCrunch。
Hughes 最终绕过了这个限制,与另外两名 DeepMind 校友和第四位联合创始人一起创立了 Inherent。启动速度也没有放缓。该公司计划到今年年底将员工人数增加到“约 20 至 25 人”。考虑到其在世界模型方面的雄心,以及 Demis Hassabis 的新角色让一些 DeepMind 员工感到不安,Inherent 的招聘力度可能会使其成为 DeepMind 员工考虑采取行动的一个有吸引力的落脚点。
图片从左到右:Inherent 联合创始人 Louis Kirsch、Kaloyan Aleksiev、Tantum Collins 和 Edward Hughes。