Skip to content

API 调用

认证

OpenAI 和 Anthropic 兼容接口推荐使用 Bearer Token:

http
Authorization: Bearer YOUR_API_KEY

Gemini 原生客户端也可使用 x-goog-api-key。不要把密钥放在浏览器前端、公开仓库或可下载的客户端包中。

常用接口

协议或用途方法与路径
查询模型GET /v1/models
OpenAI ResponsesPOST /v1/responses
Responses 输入 Token 预检POST /v1/responses/input_tokens
Responses 上下文压缩POST /v1/responses/compact
OpenAI Chat CompletionsPOST /v1/chat/completions
Anthropic MessagesPOST /v1/messages
Anthropic Token 计数POST /v1/messages/count_tokens
EmbeddingsPOST /v1/embeddings
图片生成POST /v1/images/generations
图片编辑POST /v1/images/edits
视频创建与查询POST /v1/videosGET /v1/videos/{request_id}
Grok Web / X 搜索POST /v1/web_searchPOST /v1/x_search
Grok 语音合成 / 识别POST /v1/ttsPOST /v1/stt
Grok 自定义语音/v1/custom-voices 及其 {voice_id} 子路径
Grok RealtimeGET /v1/realtime(WebSocket)
Gemini 模型列表GET /v1beta/models
Gemini 内容生成POST /v1beta/models/{model}:generateContent
Gemini 流式生成POST /v1beta/models/{model}:streamGenerateContent?alt=sse

并非所有分组或模型都支持表中全部接口。/v1/responses/input_tokens/v1/responses/compact 仅在对应上游和账号能力可用时生效。视频、搜索、语音和 Realtime 还取决于分组平台、上游账号能力及管理员是否完成对应价格和功能配置;当前实现中的 Grok 搜索与语音路由只对 Grok 分组开放。请先查询模型,并根据客户端和模型选择对应协议。

复合分组可按模型把 Chat Completions、Responses、Anthropic Messages、Token 计数和部分媒体请求路由到不同平台。当前网关也支持把 Kimi、智谱和 DeepSeek 账号接入兼容协议;具体能否使用 Chat Completions、Anthropic Messages 或 Responses,取决于管理员为该账号选择的原生或自适应协议,其中原生 Responses 目前只适用于 DeepSeek。终端用户不应根据供应商名称猜测协议,仍应以 /v1/models、密钥分组和实际请求结果为准。

视频任务还可通过 /v1/videos/generations/v1/videos/edits/v1/videos/extensions 创建,并用对应的 {request_id} 状态或 content 子路径查询。异步媒体请求应保留创建接口返回的请求 ID,轮询到完成状态后再下载结果。

OpenAI SDK

地区限制

本站不向来自中国大陆的用户提供任何 OpenAI 相关服务。

Python

python
from openai import OpenAI

client = OpenAI(
    api_key="YOUR_API_KEY",
    base_url="https://sub.fastapi.cool/v1",
)

response = client.responses.create(
    model="MODEL_ID",
    input="Hello",
)
print(response.output_text)

Node.js

javascript
import OpenAI from "openai";

const client = new OpenAI({
  apiKey: process.env.FAST_API_KEY,
  baseURL: "https://sub.fastapi.cool/v1",
});

const response = await client.responses.create({
  model: "MODEL_ID",
  input: "Hello",
});
console.log(response.output_text);

Anthropic Messages

bash
curl https://sub.fastapi.cool/v1/messages \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "anthropic-version: 2023-06-01" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "MODEL_ID",
    "max_tokens": 512,
    "messages": [{"role": "user", "content": "Hello"}]
  }'

Gemini 原生接口

bash
curl "https://sub.fastapi.cool/v1beta/models/MODEL_ID:generateContent" \
  -H "x-goog-api-key: YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"contents":[{"parts":[{"text":"Hello"}]}]}'

流式输出与重试

支持流式输出的接口可设置 "stream": true,Gemini 使用 streamGenerateContent?alt=sse。客户端应设置合理的连接和读取超时;只对可安全重试的请求采用指数退避,并避免因重复提交产生重复计费。

OpenAI Responses 路径可使用 HTTP/SSE 或 WebSocket,具体由账号、客户端和管理员网关设置决定。客户端传入的 prompt_cache_key、Codex/Claude Code 会话标识、模型范围与工具参数会尽量在路由切换和故障转移时保持;不要依赖自行伪造的会话头跨用户共享粘性。请求 service_tier 时只使用接口支持的值,未知值可能被过滤或拒绝;实际结算层级可在使用记录中核对。

错误排查

状态码常见含义
400参数、模型或协议不正确
401API Key 缺失、错误或已失效
403分组、模型、IP 或权限限制
402余额或订阅额度不足
429速率、并发或上游配额限制
5xx网关或上游暂时异常

具体原因以响应体和控制台使用记录为准。响应头或响应体提供请求 ID 时请一并保存;运营错误详情中的模型配置错误可能不计入渠道 SLA,因此“渠道状态正常”不代表任意模型名都有效。