官方撤回了 Cyber 单价,本站也撤回了
核对日志列出变了、过期了和没变的一线事实。相信 7 月截图之前先读这一页。
指南库更新
核对日志列出变了、过期了和没变的一线事实。相信 7 月截图之前先读这一页。
产品名称、endpoint、model ID、费率和公开分数都对照 Sakana AI 第一方页面。我们不声称拥有未公开权限,也不编造没有证据的“亲自实测”。下文 Benchmark 若没有单独标注独立来源,均指 Sakana AI 公布结果。
一分钟速览
可以把 Fugu 想成藏在一个 model name 后面的项目负责人。请求可能直接回答,也可能被拆给小团队,再合成一份响应。它的编排策略通过训练得到,不是由你维护一张固定工作流。
Fugu、OpenRouter 和自建 LangGraph 不是同一种取舍。OpenRouter 重点是模型入口,自建 graph 重点是显式路由;Fugu 用更少的编排维护成本,换取对学习式路由更少的可见性。
模型选择
起点由任务形态决定,不是名字越强就越适合。
适合交互式编程、聊天和常规任务,尤其是响应时间不能太长的场景。
适合质量优先于速度的难题,但要用你自己的复杂任务验证提升是否值得。
面向经授权的防御性安全分析、漏洞研究和威胁调查。
普通任务先用 Fugu;在 Fugu 容易漏关键细节的任务上,与 Ultra 成对测试。只有在经过授权的防御安全场景、且准入确认后,再考虑 Cyber。
使用透明规则的模型选择器当前公开费率
下表按每 100 万 token 计价,最后核验于 2026 年 8 月 17 日。Fugu Cyber 已不再公布公开单价。
| 模型 | 输入 | 输出 | 缓存输入 | 上下文超过 272K |
|---|---|---|---|---|
| Fugu | 浮动:按底层模型,或参与模型中的最高档费率 | 取决于实际路由 | ||
| Fugu Ultra | $5.00 | $30.00 | $0.50 | $10 / $45 / $1.00 |
| Fugu Cyber | 截至 2026 年 8 月 17 日,官方定价页不再公布单价。获准入后请联系 Sakana AI 销售。 | |||
Ultra 和 Cyber 除了用户输入与最终输出,还会返回编排输入、编排缓存输入和编排输出。Sakana AI 明确说这些字段代表真实使用量,并按相同类别费率计费。多 agent 长任务若忽略这些字段,估算会明显偏低。
Standard 为 $20/月,Pro 为 $100,Max 为 $200。公开页面只说 Pro 是 Standard 用量的 10 倍、Max 是 20 倍,没有提供能覆盖所有路由的统一 token 数。所以方案价格只能当预算参照,不能假装成确定 token 等价物。
来源:Sakana AI Console Pricing。订阅第二个月免费的活动只写到 2026 年 7 月 31 日,过期后请重新核对。
接入路径
Sakana AI 支持 Responses、Chat Completions 和 Models API。官方更推荐 Responses API,以获得更好的工具、多模态、reasoning 和函数调用行为。
import os
from openai import OpenAI
api_key = os.environ["FUGU_API_KEY"]
base_url = os.environ["FUGU_BASE_URL"].rstrip("/")
if not base_url.endswith("/v1"):
base_url += "/v1"
client = OpenAI(api_key=api_key, base_url=base_url)
response = client.responses.create(
model="fugu",
input="审查这个函数,先列正确性风险。",
)
print(response.output_text)
使用 fugu、fugu-ultra 或 fugu-cyber。官方目前也保留一个带日期的 Ultra alias。
部分 sampling 参数虽然被接受,却不会改变行为。不要默认 temperature、top_p 或 penalty 字段有效。
设置有限 timeout 和少量重试。多 agent 请求可能很久,但无限重试可能重复执行昂贵任务。
保留完整 usage 对象用于核账。只存最终输入和输出,无法覆盖全部编排成本。
证据,不是装饰
公开表格能说明产品在厂商测试设置中的表现,但不能证明 Ultra 在你的代码库、prompt、工具、延迟预算和故障模式上一定胜出。
公平评估要给 Fugu、Ultra 和现有 baseline 相同 prompt、工具、timeout、评分规则与重复次数。记录失败和成本,不能只挑最好看的回答。
深度指南
每篇只解决一个具体决策,所有会过期的产品事实都链接到第一方来源。
选择 model ID、校验配置、流式响应、识别无效参数,并把网络重试限制在明确边界内。
核对 usage 对象,计算 Ultra 费用,不再捏造 Fugu 固定费率或已撤回的 Cyber 单价。
把厂商分数变成盲测、可重复、与你团队真实任务有关的对比。
把 401、模型缺失、欧盟不可用和 Ultra 账单异常变成下一步检查。
仅按量、官方申请、不再公布的单价,以及授权使用边界。
何时该买学习到的模型池,何时仍需要能看见每一跳的编排。
决策清单
覆盖日常、困难、模糊和容易失败的任务,不能只挑最适合多智能体发挥的题。
每个候选模型使用同一 prompt、工具、timeout、输出限制和重试规则。
评分者不知道答案来自哪个模型,只看正确性、证据、完整度和多余断言。
保存耗时、失败、重试和完整 usage,尤其是编排 token 明细。
Fugu 胜出的场景用 Fugu;质量提升值得成本时才升级 Ultra;两者都不值就保留现有工具。
核验记录
fugu-ultra 现在默认 fugu-ultra-v1.1。常见问题
当前价格页没有永久免费层。订阅从 $20/月起,也支持按量计费。第二个月免费活动宣传至 2026 年 7 月 31 日,本站不再把它当作现行活动。
常规和交互任务先用 Fugu;在少量真正困难的任务上测试 Ultra 是否带来值得付费的提升。Cyber 只用于经授权的防御安全任务,并需先确认访问权限。
不能把它简化为一个可靠固定费率。Fugu 按实际底层模型或参与模型中的最高档计费。Ultra 仍有固定公开价格,所以计算器只覆盖 Ultra。Cyber 公开单价已撤回。
表格由 Sakana AI 发布,部分 baseline 值来自各模型厂商。它应被当作厂商证据。本站不会假装做过未公开实验,而是提供一套能在你自己任务上复现的评估流程。
不是。SakanaFugu.com 是独立编辑指南,与 Sakana AI 没有关联、背书或赞助关系。
发现错误可发邮件到 support@sakanafugu.com,最好附上第一方来源。