一个 API,多种模型

LLMFly AI一个 API,调用主流大模型。

继续用你熟悉的 OpenAI SDK,接入 GPT、Claude、Gemini 等模型。

不知道怎么接入?快速开始

少维护几套接口

换模型,不用重写调用层。

保留一套接入方式,再按任务选择模型。

01

每个应用或环境单独用 Key

开发和生产分开管理。某个 Key 泄露时,可以单独撤销,不影响其他应用。

02

继续使用 OpenAI 客户端

设置 LLMFly AI Base URL,再从目录复制模型 ID。用到厂商特有能力时,上线前单独测试。

03

调用前先看费率

目录列出输入、输出和适用的缓存费率;用量记录可以查到每次请求的消耗。

Quickstart

发起第一次请求。

准备一个 Key、LLMFly AI Base URL,以及目录中的模型 ID。

  1. 1
    创建 API Key

    每个应用或环境使用单独的 Key。

  2. 2
    设置 Base URL

    让服务端的 OpenAI 客户端连接 LLMFly AI。

  3. 3
    选择模型

    复制目录中的准确 ID,先发送一个小请求。

适用于

编辑器和后端,都用同一套 API。

连接常用编码工具、自动化脚本和服务端应用,不必为每个模型单独维护调用代码。

Claude CodeCodexCursorOpenAI SDKAnthropic SDK后端 API

FAQ

第一次调用前,通常会问这些。

LLMFly AI 是什么?

LLMFly AI 用一个兼容 OpenAI 的 API,调用模型目录中列出的模型。

还能继续用 OpenAI SDK 吗?

兼容的模型可以。修改 Base URL、API Key 和模型 ID,并测试应用实际依赖的功能。

目前有哪些模型?

请查看模型目录。模型和可用状态可能变化,以目录为准。

费用怎么计算?

不同模型分别设置输入、输出和适用的缓存费率。每次请求的消耗可以在用量记录中查看。

会保存提示词和响应吗?

正式隐私政策会写清记录内容和保留时间。在生产配置验证前,我们不会宣称零保留。