业务场景
代码生成在生产应用中的实际场景
产品团队收到一个小型功能需求:为现有报表页增加 CSV 导出,同时保持公共 API 不变。模型获得需求、仓库规范、受影响文件和测试命令,返回统一 Diff 以及证明功能有效的测试。
LLMFly AI 只负责生成。应用仍需在一次性 Worktree 中检查补丁、运行 Lint 和测试,并把失败结果作为新消息返回。第一次响应不会直接合并。
生产使用场景
产品团队收到一个小型功能需求:为现有报表页增加 CSV 导出,同时保持公共 API 不变。模型获得需求、仓库规范、受影响文件和测试命令,返回统一 Diff 以及证明功能有效的测试。

生产方案
| 生产选择 | 推荐配置 | 原因 |
|---|---|---|
| API | POST /v1/chat/completions | 从服务端发送 OpenAI 兼容请求 |
| 主模型 | gpt-5.6-terra | Terra 作为默认模型,因为该流程需要理解仓库并生成可用补丁,但不是每个需求都需要 Sol 级推理。 |
| 备用模型 | gpt-5.4 | 小型隔离修改可降级到 gpt-5.4;修改跨越架构边界,或 Terra 连续两次未通过同一验收测试时升级到 Sol。 |
| 升级模型 | gpt-5.6-sol | 只有主路由越过已定义的质量或复杂度边界时才使用 |
| 输出契约 | 场景专用文本或补丁 | 可干净应用的统一 Diff,以及覆盖每条验收标准的测试。 |
产品团队收到一个小型功能需求:为现有报表页增加 CSV 导出,同时保持公共 API 不变。模型获得需求、仓库规范、受影响文件和测试命令,返回统一 Diff 以及证明功能有效的测试。
LLMFly AI 只负责生成。应用仍需在一次性 Worktree 中检查补丁、运行 Lint 和测试,并把失败结果作为新消息返回。第一次响应不会直接合并。
请求应从服务端发送。请将示例内容和占位工具 Schema 替换为应用中的真实数据与工具。
curl https://app.llmfly.ai/v1/chat/completions \
-H "Authorization: Bearer $LLMFLY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-5.6-terra",
"messages": [
{"role": "system", "content": "You are editing an existing repository. Return only a unified diff. Preserve public APIs, follow the supplied conventions, and include tests for every acceptance criterion."},
{"role": "user", "content": "Add CSV export to the report page. Files and acceptance criteria follow below."}
]
}'Terra 作为默认模型,因为该流程需要理解仓库并生成可用补丁,但不是每个需求都需要 Sol 级推理。
小型隔离修改可降级到 gpt-5.4;修改跨越架构边界,或 Terra 连续两次未通过同一验收测试时升级到 Sol。
| 指标 | 通过条件 |
|---|---|
| 构建与测试通过率 | 补丁能在隔离环境构建,且所有受影响测试通过 |
| 需求覆盖率 | 每条验收标准都能对应到修改文件或测试 |
| 不必要的文件修改 | 没有未经说明的无关文件、依赖或公共接口修改 |
| 每个可接受补丁的成本 | 生成、重试、测试和审查总成本不超过团队单次修改预算 |
可干净应用的统一 Diff,以及覆盖每条验收标准的测试。
每次生产运行都应记录模型 ID、Request ID、Token 用量、重试、验证结果和最终处理状态。
使用来自真实仓库的任务,并固定需求、测试命令和审查标准。
应把它视为不受信任的补丁,在隔离环境构建和测试,再按风险审查。
不够。应比较计入重试、测试、审查和修复后的每个可接受补丁成本。
让主模型和备用模型使用相同请求、工具和验证规则。