参考

模型目录

你可以作为 model 字段传入的每个公开别名。价格以每 100 万 token 的美元计价,与 OpenAI、Anthropic 和 Google 在其价格页发布的单位一致。中转计费按 token 粒度计量,界面金额以美元显示,钱包按美元分扣款。

165 个模型在线。 你也可以在开发者控制台中浏览此列表。

ali-deepseek

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
ali-deepseek-r1💬 Text$0.140$0.280✓ eligible
ali-deepseek-v4-flash💬 Text$0.010$0.010✓ eligible
ali-deepseek-v4-pro💬 Text$0.140$0.280✓ eligible

ali-kimi

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
ali-kimi-k2.5💬 Text$0.030$0.030✓ eligible
ali-kimi-k2.6💬 Text$0.140$0.280✓ eligible
ali-kimi-k2.7-code💬 Text$0.280$0.560✓ eligible

ali-minimax

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
ali-minimax-m2.5💬 Text$0.280$0.830✓ eligible
ali-minimax-m2.7💬 Text$0.690$2.08✓ eligible
ali-minimax-m3💬 Text$2.08$8.33✓ eligible

ali-qwen

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
ali-qwen-flash💬 Text$0.020$0.210✓ eligible
ali-qwen-long💬 Text$0.070$0.280✓ eligible
ali-qwen-math-plus💬 Text$0.560$1.67✓ eligible
ali-qwen-max💬 Text$0.330$1.33✓ eligible
ali-qwen-mt-flash💬 Text$0.100$0.270✓ eligible
ali-qwen-mt-lite💬 Text$0.080$0.220✓ eligible
ali-qwen-mt-plus💬 Text$0.250$0.750✓ eligible
ali-qwen-mt-turbo💬 Text$0.100$0.270✓ eligible
ali-qwen-vl-ocr💬 Text$0.040$0.070✓ eligible
ali-qwen3-coder-flash💬 Text$0.140$0.560✓ eligible
ali-qwen3-vl-plus💬 Text$0.140$1.39✓ eligible
ali-qwen3.5-122b-a10b💬 Text$0.110$0.890✓ eligible
ali-qwen3.5-27b💬 Text$0.080$0.670✓ eligible
ali-qwen3.5-35b-a3b💬 Text$0.060$0.440✓ eligible
ali-qwen3.5-397b-a17b💬 Text$0.170$1.00✓ eligible
ali-qwen3.5-flash💬 Text$0.030$0.280✓ eligible
ali-qwen3.5-ocr💬 Text$0.070$0.280✓ eligible
ali-qwen3.5-plus💬 Text$0.110$0.670✓ eligible
ali-qwen3.6-27b💬 Text$0.420$2.50✓ eligible
ali-qwen3.6-35b-a3b💬 Text$0.250$1.50✓ eligible
ali-qwen3.6-flash💬 Text$0.170$1.00✓ eligible
ali-qwen3.6-plus💬 Text$0.280$1.67✓ eligible
ali-qwen3.7-flash💬 Text$0.030$0.130✓ eligible
ali-qwen3.7-max💬 Text$1.67$5.00✓ eligible
ali-qwen3.7-plus💬 Text$0.280$1.11✓ eligible
ali-qwen3.8-max💬 Text$2.00$6.00✓ eligible

codex-auto

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
codex-auto-review💬 Text$5.00$30.00✓ eligible

deepseek-v

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
deepseek-v4-flash💬 Text$0.440$1.32✓ eligibleds-v4-flash
deepseek-v4-pro💬 Text$1.32$3.96✓ eligibleds-v4-pro

doubao

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
doubao-1.5-lite-32k💬 Text$0.040$0.080✓ eligible
doubao-1.5-pro-32k💬 Text$0.110$0.280✓ eligible
doubao-1.5-pro-32k-character💬 Text$0.110$0.280✓ eligible
doubao-1.5-vision-pro💬 Text$0.420$1.25✓ eligible

doubao-seed

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
doubao-seed-1.6💬 Text$0.110$1.11✓ eligible
doubao-seed-1.6-flash💬 Text$0.020$0.210✓ eligible
doubao-seed-1.6-vision💬 Text$0.110$1.11✓ eligible
doubao-seed-1.8💬 Text$0.110$1.11✓ eligible
doubao-seed-2.0-code💬 Text$0.440$2.22✓ eligible
doubao-seed-2.0-lite💬 Text$0.080$0.500✓ eligible
doubao-seed-2.0-mini💬 Text$0.030$0.280✓ eligible
doubao-seed-2.0-pro💬 Text$0.440$2.22✓ eligible
doubao-seed-2.1-pro💬 Text$0.830$4.17✓ eligible
doubao-seed-2.1-turbo💬 Text$0.420$2.08✓ eligible
doubao-seed-character💬 Text$0.110$0.280✓ eligible
doubao-seed-code💬 Text$0.170$1.11✓ eligible
doubao-seed-evolving💬 Text$0.830$4.17✓ eligible
doubao-seed-translation💬 Text$0.170$0.500✓ eligible

gpt

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
gpt-5.3-codex-spark💬 Text✓ eligible
gpt-5.4💬 Text$2.50$15.00✓ eligiblegpt5-flagship
gpt-5.4-mini💬 Text$0.700$4.20✓ eligible
gpt-5.4-openai-compact💬 Text$2.50$15.00✓ eligible
gpt-5.5💬 Text$5.00$30.00✓ eligiblegpt5-flagship
gpt-5.5-openai-compact💬 Text$5.00$30.00✓ eligible
gpt-5.6-luna💬 Text$1.00$6.00✓ eligible
gpt-5.6-sol💬 Text$5.00$30.00✓ eligible
gpt-5.6-terra💬 Text$2.50$15.00✓ eligible

kimi-k

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
kimi-k2.6💬 Text$0.900$3.75✓ eligible
kimi-k2.7-code💬 Text$0.900$3.75✓ eligible
kimi-k2.7-code-highspeed💬 Text$1.81$7.50✓ eligible
kimi-k3💬 Text$2.78$13.89✓ eligible

minimax-m

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
minimax-m2💬 Text$0.290$1.17✓ eligible
minimax-m2.1💬 Text$0.290$1.17✓ eligible
minimax-m2.1-highspeed💬 Text$0.580$2.33✓ eligible
minimax-m2.5💬 Text$0.290$1.17✓ eligible
minimax-m2.5-highspeed💬 Text$0.580$2.33✓ eligible
minimax-m2.7💬 Text$0.290$1.17✓ eligible
minimax-m2.7-highspeed💬 Text$0.580$2.33✓ eligible
minimax-m3💬 Text$0.290$1.17✓ eligible

sf-deepseek

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-deepseek-ocr💬 Text✓ eligible
sf-deepseek-r1💬 Text$0.560$2.22✓ eligible
sf-deepseek-r1-qwen3-8b💬 Text✓ eligible
sf-deepseek-v3💬 Text$0.280$1.11✓ eligible
sf-deepseek-v3.1-terminus💬 Text$0.560$1.67✓ eligible
sf-deepseek-v3.2💬 Text$0.280$0.420✓ eligible
sf-deepseek-v4-flash💬 Text$0.140$0.280✓ eligible
sf-deepseek-v4-pro💬 Text$1.67$3.33✓ eligible

sf-glm

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-glm-4-32b💬 Text$0.260$0.260✓ eligible
sf-glm-4-9b💬 Text✓ eligible
sf-glm-4.5-air💬 Text$0.140$0.830✓ eligible
sf-glm-4.5v💬 Text$0.140$0.830✓ eligible
sf-glm-5.1💬 Text$0.830$3.89✓ eligible
sf-glm-5.2💬 Text$0.830$3.89✓ eligible
sf-glm-z1-9b💬 Text✓ eligible

sf-hunyuan

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-hunyuan-a13b💬 Text$0.140$0.560✓ eligible
sf-hunyuan-mt-7b💬 Text✓ eligible

sf-kimi

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-kimi-k2.6💬 Text$0.900$3.75✓ eligible
sf-kimi-k2.7-code💬 Text$0.900$3.75✓ eligible

sf-ling

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-ling-flash-2.0💬 Text$0.140$0.560✓ eligible
sf-ling-mini-2.0💬 Text$0.070$0.280✓ eligible

sf-longcat

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-longcat-2.0💬 Text$0.690$2.78✓ eligible

sf-minimax

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-minimax-m2.5💬 Text$0.290$1.17✓ eligible

sf-nex

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-nex-n2-pro💬 Text$0.240$0.970✓ eligible

sf-paddleocr

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-paddleocr-vl💬 Text✓ eligible

sf-pro

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-pro-qwen2.5-7b💬 Text$0.050$0.050✓ eligible

sf-qwen

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-qwen2.5-14b💬 Text$0.100$0.100✓ eligible
sf-qwen2.5-32b💬 Text$0.180$0.180✓ eligible
sf-qwen2.5-72b💬 Text$0.570$0.570✓ eligible
sf-qwen2.5-72b-128k💬 Text$0.570$0.570✓ eligible
sf-qwen2.5-7b💬 Text✓ eligible
sf-qwen3-14b💬 Text$0.070$0.280✓ eligible
sf-qwen3-30b-a3b💬 Text$0.100$0.390✓ eligible
sf-qwen3-32b💬 Text$0.140$0.560✓ eligible
sf-qwen3-8b💬 Text✓ eligible
sf-qwen3-coder-30b-a3b💬 Text$0.100$0.390✓ eligible
sf-qwen3-omni-30b-a3b-captioner💬 Text$0.100$0.390✓ eligible
sf-qwen3-omni-30b-a3b-instruct💬 Text$0.100$0.390✓ eligible
sf-qwen3-omni-30b-a3b-thinking💬 Text$0.100$0.390✓ eligible
sf-qwen3-vl-30b-a3b-instruct💬 Text$0.100$0.390✓ eligible
sf-qwen3-vl-30b-a3b-thinking💬 Text$0.100$0.390✓ eligible
sf-qwen3-vl-32b-instruct💬 Text$0.140$0.560✓ eligible
sf-qwen3-vl-32b-thinking💬 Text$0.140$1.39✓ eligible
sf-qwen3-vl-8b-instruct💬 Text$0.070$0.280✓ eligible
sf-qwen3-vl-8b-thinking💬 Text$0.070$0.690✓ eligible
sf-qwen3.5-122b-a10b💬 Text$0.280$2.22✓ eligible
sf-qwen3.5-27b💬 Text$0.250$2.00✓ eligible
sf-qwen3.5-35b-a3b💬 Text$0.220$1.78✓ eligible
sf-qwen3.5-397b-a17b💬 Text$0.280$0.170✓ eligible
sf-qwen3.5-4b💬 Text✓ eligible
sf-qwen3.5-9b💬 Text$0.210$1.67✓ eligible
sf-qwen3.6-27b💬 Text$0.250$2.00✓ eligible
sf-qwen3.6-35b-a3b💬 Text$0.220$1.78✓ eligible

sf-seed

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-seed-oss-36b💬 Text$0.210$0.560✓ eligible

sf-step

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
sf-step-3.5-flash💬 Text$0.100$0.290✓ eligible

volc-deepseek

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
volc-deepseek-v3.2💬 Text$0.280$0.420✓ eligible
volc-deepseek-v4-flash💬 Text$0.420$1.25✓ eligibleds-v4-flash
volc-deepseek-v4-pro💬 Text$1.67$3.33✓ eligibleds-v4-pro

volc-glm

别名模态输入 / 每 100 万($)输出 / 每 100 万($)AutoGroup
volc-glm-4.7💬 Text$0.420$1.94✓ eligible
volc-glm-5.2💬 Text$1.11$3.89✓ eligible

Interchangeable model groups

Aliases in the same group are automatic substitutes when every route of the requested model is down (unless you send allow_substitution: false).

ds-v4-flash: deepseek-v4-flash ⇄ volc-deepseek-v4-flash

ds-v4-pro: deepseek-v4-pro ⇄ volc-deepseek-v4-pro

gpt5-flagship: gpt-5.4 ⇄ gpt-5.5

路由与故障转移

你始终传平台别名(例如 gpt-5.2),而不是上游特定的 id(例如 openai/gpt-5.2)。在幕后:

  1. 每个别名映射到一个或多个按优先级排序的上游路由
  2. 每个路由从按提供方划分的凭证池中取用凭证。如果某个凭证被反复拒绝,它会被冷却 60 秒,下一个请求改用同组的其他凭证。
  3. 单个可重试的上游错误(5xx、401/403 token 问题、429 速率限制)会触发中转自动重试下一个候选——你的客户端只会看到最终结果。
  4. 如果每个候选都耗尽,你会得到一个明确的 503 和清晰的消息,而不是一个卡住的请求。

关于每个状态码的含义及如何应对,参见常见错误

Automatic model routing (auto)

Send model: "auto" and the platform picks a concrete model for you, balancing cost and latency. Three intent variants steer the choice: auto:cheap (lowest price), auto:fast (lowest latency) and auto:quality (highest quality tier).

curl https://chinzy.com/v1/chat/completions \
  -H "Authorization: Bearer tsk_..." \
  -H "Content-Type: application/json" \
  -d '{
    "model": "auto:cheap",
    "messages": [{"role": "user", "content": "Say hi in one sentence"}]
  }'
  • Server switch required. Auto routing is a server-side feature flag (AUTO_ROUTING_ENABLED). When it is off, auto requests fail with 400 auto_routing_disabled — fall back to a concrete alias.
  • Text chat only. Requests with images or tool definitions must name a concrete model; auto returns 400 for them.
  • The billed model is always reported. Check the model field of the response, and the autobadge next to each call in the console usage page's recent-calls list.
  • Candidate set = the Auto column above. A model marked ✓ eligible can be picked by the auto router (text + enabled + priced + at least one active route).

Cross-model failover & allow_substitution

When every route of the model you asked for is down, the platform automatically substitutes an equivalent model from the same interchangeable group (see the groups listed above). The response and your usage page always report the alias actually billed, with the original request preserved as the source annotation.

allow_substitution is a platform-reserved request field: it defaults to true, and only an explicit false opts out of substitution. The field is stripped before the request is forwarded, so it never leaks to the upstream provider. It can be sent at the top level of the request body on both the OpenAI and the Anthropic protocol.

Protocol matrix

CapabilityOpenAI (/v1/chat/completions)Anthropic (/anthropic/v1/messages)
Concrete alias / streaming✓ / ✓✓ / ✓
model: "auto" + intents
allow_substitution opt-out
Response reports billed alias✓ (model)✓ (message.model)