请求格式

三种请求格式覆盖整个模型目录。同一个 ChinaAPI 的 API Key 和同一个 Base URL 通用于全部格式,客户端原本支持哪种格式,就直接用哪种发送。

OpenAI

/v1/chat/completions

适用于 OpenAI SDK、Cherry Studio、Cline、Open WebUI 以及大多数工具类客户端。

Claude

/v1/messages

转发 Claude 风格的消息请求体,同时沿用同一个网关 API Key 和同一套额度控制。

OpenAI

/v1/responses

适用于 Codex 以及其他基于 Responses API 构建的客户端。控制台会标明哪些模型支持这种格式。

仅限 Gemini 模型 原生 Gemini 请求发往 POST /v1beta/models/{model}:generateContent。只有 gemini-* 模型提供这一格式,而且并非全部都提供——每个模型在模型广场中的条目都会列出它接受的格式。其余模型都使用上面三种格式之一。
超时与计费 只对真正送达客户端的输出计费。如果客户端在非流式响应返回之前断开连接或超时,该请求不计费。流式请求按输入和流结束时已送达的输出计费;如果没有送达任何输出,则不计费。请求若在送达任何内容之前就耗尽了时间预算,会以 504 错误结束,同样不计费。如需告诉我们客户端会等待多久,请发送以秒为单位的 X-Request-Timeout 请求头;OpenAI 和 Anthropic 的官方 SDK 已经会发送各自的超时时间。

多轮 Responses 对话通过 previous_response_id 指向之前的回复。如果后续请求返回 previous_response_not_found,之前的回复并没有丢失:请等待 10 到 20 秒后重新发送同一个请求,而不要从头重建对话。