API 概览
模驿API 直接透传各厂商模型的原生协议:将官方 SDK 的 Base URL 指向 模驿API 即可,无需修改业务代码。Base URL 为 https://api.moyiapi.cn(国际站 https://api.moyiapi.com);用量与账单接口在这个域名和站点域名 https://moyiapi.cn 下都可访问。
请求
请求格式
按模型选择协议,端点与请求体格式与对应的官方 API 一致:
| 协议 | 端点 | 适用模型 |
|---|---|---|
| Anthropic 原生 | POST /v1/messages |
Claude 全系列(唯一推荐入口) |
| OpenAI 兼容 | POST /v1/chat/completions |
GPT、Gemini(Claude 不建议) |
| OpenAI Responses | POST /v1/responses |
仅 GPT 系列 |
| Gemini 原生 | POST /v1beta/models/{model}:generateContent |
仅 Gemini |
| 图像 | POST /v1/images/generations、POST /v1/images/edits |
gpt-image-2 |
以 OpenAI 兼容格式调用 Claude 会丢失 prompt cache、thinking 等能力;以 Responses API 调用 Claude 或 Gemini 会返回 400。请求体为 JSON,content-type: application/json。
请求头
鉴权请求头有三种(Authorization: Bearer、x-api-key、x-goog-api-key),适用范围见鉴权。Anthropic 格式的 anthropic-version 可省略。
响应
完成原因
各协议以各自的字段表示生成停止的原因:
| 协议 | 字段 | 常见取值 |
|---|---|---|
| Anthropic | stop_reason |
end_turn、tool_use |
| OpenAI | choices[].finish_reason |
stop、tool_calls |
| Gemini | candidates[].finishReason |
STOP |
查询消耗与用量
每个响应都包含 token 用量:Anthropic 在 usage,OpenAI 在 usage,Gemini 在 usageMetadata,字段名随协议而异。每次调用的响应头还包含 x-request-id,可用于在查询单次请求用量里查到这次请求的最终费用;按时间范围汇总见查询 Token 用量与查询账单汇总。