产业 / 媒体
Sakana AI 发布 Fugu Ultra v1.1,声称性能超越 Fable 5
Sakana AI 近日发布了 AI 模型路由器 Fugu Ultra 的 1.1 版本更新。该路由器的核心机制是将用户查询分发至多个顶级公开模型组成的候选池中,由系统自动选择最优模型作答。Sakana 官方声称,v1.1 在多项基准测试上较 v1.0 提升最高达 7.9 分,其中 ProgramBench 和 TerminalBench 2.1 两项测试的进步最为显著。更引人注目的是,Fugu Ultra v1.1 据称在大多数基准测试中超越了 Anthropic 的 Fable 5,而 Fable 5 本身并不在 Fugu 的模型候选池之内。不过,上述所有数据均来自 Sakana 自身,目前尚无任何独立机构对其进行核实。此次更新还新增了兼容 Claude Code 的接口端点,方便开发者直接从终端调用 Fugu。定价方面维持不变,输入为每百万 token 5 美元,输出为每百万 token 30 美元。值得注意的是,该服务目前仍不对欧盟及欧洲经济区用户开放。
Sakana AI 于近日推出 Fugu Ultra v1.1,这是其 AI 模型路由器产品的最新迭代版本。Fugu 的工作原理是将每一条用户查询智能分发至由多个顶级公开模型构成的候选池,再从中选取最合适的模型进行响应。Sakana 表示,新版本在多项基准测试上相较 v1.0 实现了最高 7.9 分的性能提升,其中编程能力测试 ProgramBench 和终端操作测试 TerminalBench 2.1 的进步尤为突出。
此次更新中最受关注的说法,是 Fugu Ultra v1.1 在大多数基准测试中超越了 Anthropic 的 Fable 5。这一结论之所以引人注目,在于 Fable 5 本身并不在 Fugu 的模型候选池之内——换言之,路由器在不直接调用 Fable 5 的情况下,通过组合其他模型的能力实现了对其的超越。然而,所有这些性能数据目前均来源于 Sakana 官方,尚无任何第三方机构对此进行独立验证。
在功能层面,v1.1 新增了兼容 Claude Code 的接口端点,开发者可以直接从命令行终端调用 Fugu,进一步降低了集成门槛。自首次发布以来,Fugu 已陆续登陆 OpenRouter 和 Vercel 等主流平台。Sakana 还透露,每当有新的顶级模型需要纳入候选池时,大约需要两周时间完成训练与评估流程,以确保新模型能够稳定融入路由体系。
定价策略方面,Sakana 维持了原有标准:输入 token 费率为每百万 5 美元,输出 token 费率为每百万 30 美元。不过,Fugu 的首个版本上线时曾遭遇外界的冷淡反应,批评者指出其存在 token 消耗量偏高、响应速度较慢以及实际效果不尽如人意等问题。v1.1 能否真正解决这些痛点,仍有待市场和用户的实际检验。
地区可用性方面,Sakana AI 目前仍未向欧盟及欧洲经济区用户开放 Fugu 服务,官方将原因归结为 GDPR 合规要求及欧盟特定监管规定带来的挑战。这意味着欧洲地区的开发者和企业用户暂时无法体验该产品,何时能够进入欧洲市场目前也尚无明确时间表。
要点
- Fugu Ultra v1.1 声称在多项基准测试上较上一版本提升最高 7.9 分,但所有数据均来自 Sakana 官方,缺乏独立第三方验证
- 路由器在不将 Fable 5 纳入候选池的前提下,据称仍在大多数基准测试中超越了该模型,展示了多模型组合路由的潜力
- 新增兼容 Claude Code 的接口端点,开发者可直接从终端调用 Fugu,提升了产品的开发者友好度
- 定价维持每百万输入 token 5 美元、输出 30 美元不变,但首版产品曾因 token 消耗高和速度慢受到批评
- 服务目前仍不对欧盟及欧洲经济区开放,GDPR 合规问题是主要障碍
原始标题:Sakana claims its AI model router Fugu Ultra v1.1 now beats Fable 5 without even including it in the pool
本文由 DataHub 基于公开来源整理,用于信息发现与摘要阅读;具体事实、数据和后续更新以原始来源为准。