价格说明

先分清你看到的是哪一种价格

这里至少有三种不同的数字:模型厂商公开价、LLMFly AI 当前价格或计费倍率,以及用量记录中的实际扣费。把它们混在一起,预算就会失真。

预算公式输入成本 + 输出成本 + 重试最终以真实请求用量记录为准
01

模型费率

从 3 个分组、24 个模型中筛选。所有金额均为每 100 万 Token 的美元价格。

查看实时模型广场 ↗
模型分组

当前显示 6 个模型

openai

ChatGPT(Codex)

70% 优惠 · 计费倍率 0.3x

6 / 6 个模型
模型 / 计费层级LLMFly AI官方价格比官方节省 / 1M
codex-auto-review≤272K / >272K · 整个请求
≤272K
输入$0.06输出$0.36缓存写入$0.075缓存读取$0.006
>272K
输入$0.12输出$0.54缓存写入$0.15缓存读取$0.012
≤272K
输入$0.2输出$1.2缓存写入$0.25缓存读取$0.02
>272K
输入$0.4输出$1.8缓存写入$0.5缓存读取$0.04
70% OFF
≤272K输入 $0.14输出 $0.84写入 $0.175读取 $0.014
>272K输入 $0.28输出 $1.26写入 $0.35读取 $0.028
gpt-5.4标准
输入$0.75输出$4.5缓存写入缓存读取$0.075
输入$2.5输出$15缓存写入缓存读取$0.25
70% OFF
输入 $1.75输出 $10.5读取 $0.175
gpt-5.4-mini标准
输入$0.225输出$1.35缓存写入缓存读取$0.0225
输入$0.75输出$4.5缓存写入缓存读取$0.075
70% OFF
输入 $0.525输出 $3.15读取 $0.0525
gpt-5.5标准
输入$1.5输出$9缓存写入缓存读取$0.15
输入$5输出$30缓存写入缓存读取$0.5
70% OFF
输入 $3.5输出 $21读取 $0.35
gpt-5.6-sol≤272K / >272K · 整个请求
≤272K
输入$1.5输出$9缓存写入$1.875缓存读取$0.15
>272K
输入$3输出$13.5缓存写入$3.75缓存读取$0.3
≤272K
输入$5输出$30缓存写入$6.25缓存读取$0.5
>272K
输入$10输出$45缓存写入$12.5缓存读取$1
70% OFF
≤272K输入 $3.5输出 $21写入 $4.375读取 $0.35
>272K输入 $7输出 $31.5写入 $8.75读取 $0.7
gpt-5.6-terra≤272K / >272K · 整个请求
≤272K
输入$0.6输出$3.6缓存写入$0.75缓存读取$0.06
>272K
输入$1.2输出$5.4缓存写入$1.5缓存读取$0.12
≤272K
输入$2输出$12缓存写入$2.5缓存读取$0.2
>272K
输入$4输出$18缓存写入$5缓存读取$0.4
70% OFF
≤272K输入 $1.4输出 $8.4写入 $1.75读取 $0.14
>272K输入 $2.8输出 $12.6写入 $3.5读取 $0.28
02

不要只比较 Token 单价

购买余额时真正要看的数字

购买 LLMFly AI 余额时,以模型广场显示的当前价格为准,而不是上面的厂商参考价。随后发送一个小请求,在估算月度费用前核对用量记录。

可用的月成本公式

request.example可复制示例
月成本 =
  输入 Token / 1,000,000 × 输入费率 +
  输出 Token / 1,000,000 × 输出费率 +
  缓存与工具费用 + 重试费用

团队经常漏算的成本

  • 每轮重复发送的对话历史。
  • 按输出计费的推理 Token。
  • Agent 工具循环与验证调用。
  • 429 或临时上游故障后的重试。
  • 模型支持时的缓存写入、读取与存储。

常见问题

厂商公开价等于 LLMFly AI 扣费吗?

不等于。厂商价只是参考,实际费用以模型广场和用量记录为准。

为什么按完整任务估算?

便宜的 Token 如果需要更多重试、更长上下文或人工修正,最终结果可能更贵。

当前模型价格在哪里?

打开模型广场,查看当前 API Key 可用模型的价格和计费倍率。

查看模型当前价格

先在模型广场查看价格,再用一条请求核对用量记录。

打开模型广场