业务场景
数学推理在生产应用中的实际场景
价格服务需要解释订阅按比例调整金额。应用代码先计算结果;模型接收公式、已经验证的中间值、币种规则和客户上下文,再生成简洁解释。
对于开放式定量分析,模型可以提出计算器或代码工具调用,但最终数值始终在模型之外重新计算并核对。
生产使用场景
价格服务需要解释订阅按比例调整金额。应用代码先计算结果;模型接收公式、已经验证的中间值、币种规则和客户上下文,再生成简洁解释。

生产方案
| 生产选择 | 推荐配置 | 原因 |
|---|---|---|
| API | POST /v1/chat/completions | 从服务端发送 OpenAI 兼容请求 |
| 主模型 | gpt-5.6-terra | Terra 适合作为定量推理和面向客户清晰解释的默认模型。 |
| 备用模型 | gpt-5.4 | 所有数值已预计算时,公式解释可使用 gpt-5.4。真正困难的推导升级到 Sol,但仍需确定性验证。 |
| 升级模型 | gpt-5.6-sol | 只有主路由越过已定义的质量或复杂度边界时才使用 |
| 输出契约 | 场景专用文本或补丁 | 简洁解释,其中金额、单位和舍入与独立计算结果完全一致。 |
价格服务需要解释订阅按比例调整金额。应用代码先计算结果;模型接收公式、已经验证的中间值、币种规则和客户上下文,再生成简洁解释。
对于开放式定量分析,模型可以提出计算器或代码工具调用,但最终数值始终在模型之外重新计算并核对。
请求应从服务端发送。请将示例内容和占位工具 Schema 替换为应用中的真实数据与工具。
curl https://app.llmfly.ai/v1/chat/completions \
-H "Authorization: Bearer $LLMFLY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-terra",
"messages": [
{"role": "system", "content": "Explain the verified calculation using the supplied formula and values. Preserve currency, units, and rounding rules. Do not change any verified numeric input."},
{"role": "user", "content": "Explain this prorated subscription adjustment to the customer in three short steps."}
]
}'Terra 适合作为定量推理和面向客户清晰解释的默认模型。
所有数值已预计算时,公式解释可使用 gpt-5.4。真正困难的推导升级到 Sol,但仍需确定性验证。
| 指标 | 通过条件 |
|---|---|
| 验证后答案准确率 | 在目标题集中,最终答案与独立复核结果一致 |
| 单位与精度遵循 | 单位、舍入、有效数字和不确定性符合任务约定 |
| 等价提示词一致性 | 等价表述在允许误差内产生相同答案 |
| 每个已验证解答的成本 | 模型调用、工具、重试和检查总成本不超过解题预算 |
简洁解释,其中金额、单位和舍入与独立计算结果完全一致。
每次生产运行都应记录模型 ID、Request ID、Token 用量、重试、验证结果和最终处理状态。
评估最终答案和简洁、可核对的解释,不要依赖隐藏推理。
当算术、符号运算或模拟需要验证时,使用确定性工具。
按每个已验证解答比较成本,包括工具、重试和验证。
让主模型和备用模型使用相同请求、工具和验证规则。