Anthropic 模型系列

Claude API 模型:Sonnet、Opus、Fable 与 Haiku 怎么选

理解 Claude API 型号体系,并根据编码、Agent、长文档、延迟与成本选择 Sonnet、Opus、Fable 或 Haiku。

核心规格规格复核于 2026 年 9 月 1 日
claude-fable-5Active · 不早于 2027-06-09 · 分组与路由
claude-opus-5Active · 不早于 2027-07-24 · 分组与路由
claude-sonnet-5Active · 不早于 2027-06-30 · 分组与路由
claude-haiku-4-5-20251001Active · 不早于 2026-10-15 · 分组与路由

可选模型

从系列进入具体模型页

Anthropic 具体型号

Claude Sonnet 5

Anthropic 面向生产的高能力快速模型,适合编码、Agent、文档处理与工具型应用。

1M context · $2 input / $10 output
02

按决策阅读

01

Claude API 型号怎么选

先选择最有可能满足任务的最小型号,再用同一批任务与一个更高能力候选比较,最后根据通过结果质量、延迟、可靠性和总成本决定。

  • Fable 5 面向最复杂、持续时间最长的 Agent 任务。
  • Opus 5 适合复杂 Agent 编码和企业工作流。
  • Sonnet 5 在能力与速度间取平衡;Haiku 4.5 更适合低延迟任务。
02

Claude API 支持哪些能力

  • Fable 5、Opus 5 与 Sonnet 5 公开提供 1M 上下文和 128K 最大输出。
  • Haiku 4.5 公开提供 200K 上下文和 64K 最大输出。
  • 当前高阶型号使用 adaptive thinking;Haiku 提供 extended thinking。
  • Claude 尤其适合编码、文档分析与多步工具工作流。
03

Claude 价格与上下文应该怎么看

不要只比较输入单价。还应计入输出、缓存读写、长上下文档位、推理 Token、工具调用、重试,以及每轮重复发送的历史内容。

  • 把模型生命周期作为部署依赖跟踪;即使代码没变,退役 ID 也会调用失败。
  • Claude Code 应使用控制台生成的 Anthropic 风格环境配置。
  • 将 Anthropic 官方凭据与网关凭据分开,并在长任务前核对请求目的地。
04

Claude 适合哪些工作负载

  • Agent 式软件开发与仓库维护。
  • 政策、合同和研究文档分析。
  • 带显式检查点的长时间工具循环。
  • 使用 Haiku 承担延迟敏感的分类与客服流程。
05

Claude API 限制与迁移风险

  • 生命周期日期是运维截止时间,不是可忽略的更新说明。
  • OpenAI 兼容示例不能直接套用于 Claude Code 或 Anthropic 原生客户端。
  • 必须在准确的 LLMFly AI 路由上验证工具 Schema、流事件和思考参数。
06

从型号研究进入实际调用

先打开上方具体型号页查看厂商模型 ID,再到模型广场确认当前 API Key 可用的模型 ID。把 ID 保存在配置中,方便审查、测试和回滚,而不必重写应用。

常见问题

Claude API 应该选哪个型号?

先选择公开能力符合任务的最小候选,再用真实测试集与一个更强型号比较。

Claude API 价格是多少?

价格属于具体型号和路由。请进入准确型号页查看厂商价,再到模型广场确认 LLMFly AI 路由费率。

Claude 的上下文窗口多大?

上下文限制取决于准确型号,不能根据系列名称推断。请查看具体型号页和实时目录。

Claude 可以使用兼容 OpenAI 的客户端吗?

模型广场标记为兼容的路由可以使用,但必须测试应用需要的 Endpoint、流式输出、工具、结构化输出与错误行为。

为什么要把模型 ID 放在配置中?

这样可以测试、回滚和切换路由,避免厂商 ID 散落在代码各处。

选择一个 Claude 模型

打开模型广场,确认模型 ID、API Key 权限、可用状态和当前价格。

打开模型广场