
Sakana 升级“模型战队”:Ultra v2 冲性能,Max 压成本
日本 AI 公司 Sakana AI 发布 Fugu Max 和 Fugu Ultra v2。
两者本质上都是“模型调度器”:先分析任务,再选择合适的模型分工、相互检查,最后合成答案。
第一代 Fugu 便采用了这一方法,让 GPT、Claude、Gemini 等模型组队,达到接近甚至部分超过当时更强的 Fable 5 的效果。
此次产品线分为两条:
Fugu Max 主打降低成本。其模型池加入了更多开放权重模型和专业模型,并优先选择性能够用但价格更低的模型。官方称,在接近顶级模型性能的情况下,成本约为同类方案的 1/2 至 1/6。
Fugu Ultra v2 则专注于最高性能,在 8 项评测中有 5 项取得第一或并列第一。不过,其 Agent 池中并未加入 Fable 5、Fable 5.1 和 GPT-6 Astra。
多模型之间频繁切换,可能降低上下文缓存复用率,并额外产生编排 token。Sakana 尚未公布 Fugu Max 的缓存命中率和单任务总 token 成本。初代 Fugu 也曾被用户指出响应较慢、额度消耗较快等问题。
© 版权声明
文章版权归作者所有,未经允许请勿转载。
THE END










暂无评论内容