模型列表
以下全部模型通过同一个 OpenAI 兼容端点、同一个 API Key 调用。单价为美元/百万 token;控制台展示逐请求生效的实时价。清单随厂商接入持续更新。
Anthropic (Claude)13 个模型
| 模型代码 | 输入 · 美元/百万 token | 输出 · 美元/百万 token | 缓存读 · 美元/百万 token |
|---|---|---|---|
claude-opus-4-7-fast | $28.5 | $142.5 | $2.85 |
claude-fable-5 | $9.5 | $47.5 | $0.95 |
claude-opus-4-8-fast | $9.5 | $47.5 | $0.95 |
claude-opus-5-fast | $9.5 | $47.5 | $0.95 |
claude-opus-4.8 | $5.7 | $28.5 | $0.57 |
claude-opus-4.5 | $4.75 | $23.75 | $0.475 |
claude-opus-4.6 | $4.75 | $23.75 | $0.475 |
claude-opus-4.7 | $4.75 | $23.75 | $0.475 |
claude-opus-5 详情 | $4.75 | $23.75 | $0.475 |
claude-sonnet-4.5 | $2.85 | $14.25 | $0.285 |
claude-sonnet-4.6 | $2.85 | $14.25 | $0.285 |
claude-sonnet-5 详情 | $1.9 | $9.5 | $0.19 |
claude-haiku-4.5 详情 | $0.95 | $4.75 | $0.095 |
OpenAI (GPT)6 个模型
| 模型代码 | 输入 · 美元/百万 token | 输出 · 美元/百万 token | 缓存读 · 美元/百万 token |
|---|---|---|---|
gpt-5.5 | $4.75 | $28.5 | $0.475 |
gpt-5.6-sol | $4.75 | $28.5 | $0.475 |
gpt-5.4 详情 | $2.375 | $14.25 | $0.2375 |
gpt-5.6-terra | $2.375 | $14.25 | $0.2375 |
gpt-5.6-luna | $0.95 | $5.7 | $0.095 |
gpt-5.4-mini | $0.7125 | $4.275 | $0.07125 |
Google (Gemini)10 个模型
| 模型代码 | 输入 · 美元/百万 token | 输出 · 美元/百万 token | 缓存读 · 美元/百万 token |
|---|---|---|---|
gemini-3.1-pro | $2 | $12 | $0.2 |
gemini-3.1-pro-preview | $1.9 | $11.4 | $0.19 |
nano-banana-pro | $1.9 | $11.4 | $0.19 |
gemini-3-6-flash | $1.5 | $7.5 | $0.15 |
gemini-3-5-flash | $1.425 | $8.55 | $0.1425 |
gemini-3-flash-preview | $0.475 | $2.85 | $0.0475 |
nano-banana-2 | $0.475 | $2.85 | $0.0475 |
gemini-2.5-flash | $0.285 | $2.375 | $0.0285 |
gemini-3-5-flash-lite | $0.285 | $2.375 | $0.0285 |
gemini-3.1-flash-lite | $0.2375 | $1.425 | $0.02375 |
DeepSeek2 个模型
GLM (Zhipu)4 个模型
| 模型代码 | 输入 · 美元/百万 token | 输出 · 美元/百万 token | 缓存读 · 美元/百万 token |
|---|---|---|---|
glm-5.2 详情 | $1.045 | $3.284286 | $0.1045 |
glm-5 | $0.9025 | $2.4225 | $0.09025 |
glm-4.5 | $0.57 | $2.09 | $0.057 |
glm-4.6 | $0.475 | $1.9 | $0.0475 |
xAI (Grok)1 个模型
| 模型代码 | 输入 · 美元/百万 token | 输出 · 美元/百万 token | 缓存读 · 美元/百万 token |
|---|---|---|---|
grok-4.5 | $1.9 | $5.7 | $0.19 |
Kimi (Moonshot)3 个模型
| 模型代码 | 输入 · 美元/百万 token | 输出 · 美元/百万 token | 缓存读 · 美元/百万 token |
|---|---|---|---|
kimi-k2.6 | $0.9025 | $3.8 | $0.152 |
kimi-k2.7-code 详情 | $0.9025 | $3.8 | $0.1805 |
kimi-k2.5 | $0.57 | $2.85 | $0.095 |
MiniMax2 个模型
| 模型代码 | 输入 · 美元/百万 token | 输出 · 美元/百万 token | 缓存读 · 美元/百万 token |
|---|---|---|---|
minimax-m3 | $0.3 | $1.2 | $0.06 |
minimax-m2.7 详情 | $0.228 | $0.912 | $0.0228 |
Qwen (Alibaba)8 个模型
| 模型代码 | 输入 · 美元/百万 token | 输出 · 美元/百万 token | 缓存读 · 美元/百万 token |
|---|---|---|---|
qwen3.7-max | $2.5 | $7.5 | $0.5 |
qwen3-coder-plus 详情 ≤120K | $1.8 | $9 | $0.36 |
qwen3.5-397b | $0.6 | $3.6 | $0.12 |
qwen3-coder-flash ≤120K | $0.5 | $2.5 | $0.1 |
qwen3.5-plus | $0.5 | $3 | $0.1 |
qwen3.7-plus ≤240K | $0.4 | $1.6 | $0.08 |
qwen3.5-flash | $0.1 | $0.4 | $0.02 |
qwen3.7-flash ≤240K | $0.1 | $0.4 | $0.02 |
价格为当前公示价,以控制台逐请求实时价为准。缓存命中的输入按缓存读价计费(输入价的 10%);缓存写入不单独收费,按普通输入价计。
上下文上限:标注 ≤120K / ≤240K 的模型接受不超过该长度的输入,一口价对应阿里云官方同用量档的价格;超长请求在扣费前即返回 context_length_exceeded。需要 1M 超长上下文可使用 qwen3.7-max(官方单一价,无上限标注)。
带「详情」链接的模型有独立页面——价格、可直接跑的调用样例,以及价位最接近的替代款。这些页面按模型逐批上线;表内所有模型现在都可以调用,不受影响。
更新日期:2026-07-29