自带密钥 BYOK 上线——每月 1,000,000 次免费 BYOK 请求,无需充值 了解详情 →

模型列表

以下全部模型通过同一个 OpenAI 兼容端点、同一个 API Key 调用。单价为美元/百万 token;控制台展示逐请求生效的实时价。清单随厂商接入持续更新。

Anthropic (Claude)13 个模型

模型代码输入 · 美元/百万 token输出 · 美元/百万 token缓存读 · 美元/百万 token
claude-opus-4-7-fast$28.5$142.5$2.85
claude-fable-5$9.5$47.5$0.95
claude-opus-4-8-fast$9.5$47.5$0.95
claude-opus-5-fast$9.5$47.5$0.95
claude-opus-4.8$5.7$28.5$0.57
claude-opus-4.5$4.75$23.75$0.475
claude-opus-4.6$4.75$23.75$0.475
claude-opus-4.7$4.75$23.75$0.475
claude-opus-5 详情$4.75$23.75$0.475
claude-sonnet-4.5$2.85$14.25$0.285
claude-sonnet-4.6$2.85$14.25$0.285
claude-sonnet-5 详情$1.9$9.5$0.19
claude-haiku-4.5 详情$0.95$4.75$0.095

OpenAI (GPT)6 个模型

模型代码输入 · 美元/百万 token输出 · 美元/百万 token缓存读 · 美元/百万 token
gpt-5.5$4.75$28.5$0.475
gpt-5.6-sol$4.75$28.5$0.475
gpt-5.4 详情$2.375$14.25$0.2375
gpt-5.6-terra$2.375$14.25$0.2375
gpt-5.6-luna$0.95$5.7$0.095
gpt-5.4-mini$0.7125$4.275$0.07125

Google (Gemini)10 个模型

模型代码输入 · 美元/百万 token输出 · 美元/百万 token缓存读 · 美元/百万 token
gemini-3.1-pro$2$12$0.2
gemini-3.1-pro-preview$1.9$11.4$0.19
nano-banana-pro$1.9$11.4$0.19
gemini-3-6-flash$1.5$7.5$0.15
gemini-3-5-flash$1.425$8.55$0.1425
gemini-3-flash-preview$0.475$2.85$0.0475
nano-banana-2$0.475$2.85$0.0475
gemini-2.5-flash$0.285$2.375$0.0285
gemini-3-5-flash-lite$0.285$2.375$0.0285
gemini-3.1-flash-lite$0.2375$1.425$0.02375

DeepSeek2 个模型

模型代码输入 · 美元/百万 token输出 · 美元/百万 token缓存读 · 美元/百万 token
deepseek-v4-pro 详情$0.41325$0.8265$0.041325
deepseek-v4-flash 详情$0.133$0.266$0.0133

GLM (Zhipu)4 个模型

模型代码输入 · 美元/百万 token输出 · 美元/百万 token缓存读 · 美元/百万 token
glm-5.2 详情$1.045$3.284286$0.1045
glm-5$0.9025$2.4225$0.09025
glm-4.5$0.57$2.09$0.057
glm-4.6$0.475$1.9$0.0475

xAI (Grok)1 个模型

模型代码输入 · 美元/百万 token输出 · 美元/百万 token缓存读 · 美元/百万 token
grok-4.5$1.9$5.7$0.19

Kimi (Moonshot)3 个模型

模型代码输入 · 美元/百万 token输出 · 美元/百万 token缓存读 · 美元/百万 token
kimi-k2.6$0.9025$3.8$0.152
kimi-k2.7-code 详情$0.9025$3.8$0.1805
kimi-k2.5$0.57$2.85$0.095

MiniMax2 个模型

模型代码输入 · 美元/百万 token输出 · 美元/百万 token缓存读 · 美元/百万 token
minimax-m3$0.3$1.2$0.06
minimax-m2.7 详情$0.228$0.912$0.0228

Qwen (Alibaba)8 个模型

模型代码输入 · 美元/百万 token输出 · 美元/百万 token缓存读 · 美元/百万 token
qwen3.7-max$2.5$7.5$0.5
qwen3-coder-plus 详情 ≤120K$1.8$9$0.36
qwen3.5-397b$0.6$3.6$0.12
qwen3-coder-flash ≤120K$0.5$2.5$0.1
qwen3.5-plus$0.5$3$0.1
qwen3.7-plus ≤240K$0.4$1.6$0.08
qwen3.5-flash$0.1$0.4$0.02
qwen3.7-flash ≤240K$0.1$0.4$0.02

价格为当前公示价,以控制台逐请求实时价为准。缓存命中的输入按缓存读价计费(输入价的 10%);缓存写入不单独收费,按普通输入价计。

上下文上限:标注 ≤120K / ≤240K 的模型接受不超过该长度的输入,一口价对应阿里云官方同用量档的价格;超长请求在扣费前即返回 context_length_exceeded。需要 1M 超长上下文可使用 qwen3.7-max(官方单一价,无上限标注)。

带「详情」链接的模型有独立页面——价格、可直接跑的调用样例,以及价位最接近的替代款。这些页面按模型逐批上线;表内所有模型现在都可以调用,不受影响。

成本计算

获取 API Key 登录控制台查看定价

更新日期:2026-07-29