PRICING ── 对照表

大模型 API 价格对照表

国内外 11 家 · 29 款模型 · 逐条人工核对于 2026 年 7 月 22 日

按性价比大致分三档:极致省钱——DeepSeek v4-flash、豆包 seed-2.0-mini、GPT-5.4-nano;均衡主力——MiniMax-M3、Gemini Flash 系、Qwen3.7-plus、Claude Haiku 4.5;旗舰能力——Claude Fable 5、GPT-5.6-sol、Kimi k3、GLM-5.2。同一负载最贵与最便宜差约 90 倍,先想清楚任务需不需要旗舰。

订阅价格变动提醒找官方入口 → 模型直达

INTL · 17

国际模型(USD / 每百万 token)

价格区间表示按输入长度分段/分档计价;缓存价为「读取/命中」价,写入与存储另计的已在备注标明。

厂商模型输入 $/M输出 $/M缓存读Context备注
OpenAIgpt-5.6-sol$5$30$0.5旗舰档;Batch 全系 5 折
OpenAIgpt-5.6-terra$2.5$15$0.25
OpenAIgpt-5.6-luna$1$6$0.1
OpenAIgpt-5.5-pro$30$180高阶推理档,无缓存价
OpenAIgpt-5.4-mini$0.75$4.5$0.075
OpenAIgpt-5.4-nano$0.2$1.25$0.02低价档
AnthropicClaude Fable 5$10$50$11MBatch 5 折;1M 长上下文不加价
AnthropicClaude Opus 4.8$5$25$0.51MBatch 价 $2.50/$12.50
AnthropicClaude Sonnet 5$2$10$0.21M介绍价至 8/31,之后 $3/$15
AnthropicClaude Haiku 4.5$1$5$0.1200KBatch 价 $0.50/$2.50
GoogleGemini 3.1 Pro (Preview)$2–4$12–18$0.2–0.4≤200K/>200K 分档;缓存另收存储费;Batch 5 折;AI Studio 有免费层
GoogleGemini 3.6 Flash$1.5$7.5$0.15缓存另收存储费;有免费层
GoogleGemini 3.5 Flash-Lite$0.3$2.5$0.03最低价 GA 档;缓存另收存储费
xAIGrok 4.5$2–4$6–12$0.3–0.6500K按输入长度分段计价(<200K/≥200K)
xAIGrok 4.3$1.25–2.5$2.5–5$0.2–0.41M按输入长度分段计价
MistralMistral Medium 3.5$1.5$7.5未公布缓存价
MistralMistral Large 3$0.5$1.5官网营销页残留旧价 $2/$6,以 API 定价表为准

CN · 12

国内模型(人民币 元 / 每百万 token)

国内计价规则普遍更复杂:按输入长度分档、限时/「永久」折扣、快照版不参与优惠——变动细节以变更日志为准。

厂商模型输入 ¥/M输出 ¥/M缓存读Context备注
DeepSeekdeepseek-v4-flash¥1¥2¥0.021MR 系列已并入 V4 思考模式;旧名 deepseek-chat/reasoner 已于 7/24 弃用
DeepSeekdeepseek-v4-pro¥3¥6¥0.0251M
阿里 Qwenqwen3.7-max¥6¥181M限时 5 折(原价 ¥12/¥36);缓存命中按输入价 10%;Batch 半价;快照版无折扣
阿里 Qwenqwen3.7-plus¥2–6¥8–241M按输入长度分档(≤256K/>256K);缓存命中按输入价 10%
阿里 Qwenqwen3.6-flash¥1.2–4.8¥7.2–28.81M按输入长度分档;缓存命中按输入价 10%
Moonshot Kimikimi-k3¥20¥100¥21M始终推理,effort 可调
Moonshot Kimikimi-k2.7-code¥6.5¥27¥1.3256K编程款;highspeed 版价格翻倍
智谱 GLMGLM-5.2¥8¥28¥21M缓存存储限时免费
智谱 GLMGLM-5¥4–6¥18–22¥1–1.5按输入长度分档(<32K/≥32K)
字节豆包doubao-seed-2.1-pro¥6¥30¥1.2256K缓存存储另计 ¥0.017/1M/小时
字节豆包doubao-seed-2.0-mini¥0.2–0.8¥3–12¥0.04–0.16256K低价款,按输入长度三档计价
MiniMaxMiniMax-M3¥2.1¥8.4¥0.421M「永久五折」价(原价 ¥4.2 输入);≤512K 档;原生多模态;priority 层 1.5 倍

EXAMPLE · 月成本

同一负载,各家一个月多少钱

假设月 3 亿输入 + 3000 万输出 token(约日均 1000 万入/100 万出),不计缓存与 Batch 折扣,人民币按 1 USD ≈ ¥7.2 折算,由上表价格直接算得:

模型月成本(USD)
deepseek-v4-flash$50
gpt-5.4-nano$98
MiniMax-M3$123
Gemini 3.5 Flash-Lite$165
qwen3.7-max$325
GLM-5.2$450
Claude Haiku 4.5$450
kimi-k3$1,250
gpt-5.6-sol$2,400
Claude Fable 5$4,500

最贵与最便宜相差约 90 倍。用好缓存(命中价普遍为输入价的 2%–10%)与 Batch(多家 5 折),还能在此基础上再砍一个量级。

CHANGELOG · 6

价格变更日志

这张表最大的问题是「今天准,下个月不一定」——所以每次复核观察到的改价、折扣、弃用都记录在案,只追加、不改写。

FAQ

常见问题

2026 年哪家大模型 API 最便宜?

按官方定价页核对:DeepSeek v4-flash 输入 ¥1/输出 ¥2(每百万 token),缓存命中输入仅 ¥0.02,是当前最低价的主力档;其次是字节豆包 seed-2.0-mini(¥0.2 起)与 OpenAI gpt-5.4-nano($0.20/$1.25)。

同样的工作负载,不同模型能差多少钱?

以月 3 亿输入 + 3000 万输出 token 估算(不含缓存与 Batch 折扣):最贵的旗舰约 $4,500/月,最便宜的约 $50/月,相差约 90 倍。选型前先确认任务是否真的需要旗舰能力。

缓存和 Batch 能省多少?

缓存命中价普遍是输入价的 2%–10%(DeepSeek 低至 ¥0.02/1M);OpenAI、Anthropic、Google、Qwen 等提供 Batch 约 5 折。两者可叠加,重复上下文多的负载还能再降一个量级。

数据来源均为各家官方定价页(核对日期 2026 年 7 月 22 日):OpenAI · Anthropic · Google · xAI · Mistral · DeepSeek · 阿里云百炼 · Moonshot Kimi · 智谱 · 字节豆包 · MiniMax。价格变动频繁,请以官网实时为准;发现错误欢迎指正。想按主题看背景知识,见《API 价格与算力成本》指南