PRICING ── 对照表
大模型 API 价格对照表
国内外 11 家 · 29 款模型 · 逐条人工核对于 2026 年 7 月 22 日
按性价比大致分三档:极致省钱——DeepSeek v4-flash、豆包 seed-2.0-mini、GPT-5.4-nano;均衡主力——MiniMax-M3、Gemini Flash 系、Qwen3.7-plus、Claude Haiku 4.5;旗舰能力——Claude Fable 5、GPT-5.6-sol、Kimi k3、GLM-5.2。同一负载最贵与最便宜差约 90 倍,先想清楚任务需不需要旗舰。
INTL · 17
国际模型(USD / 每百万 token)
价格区间表示按输入长度分段/分档计价;缓存价为「读取/命中」价,写入与存储另计的已在备注标明。
| 厂商 | 模型 | 输入 $/M | 输出 $/M | 缓存读 | Context | 备注 |
|---|---|---|---|---|---|---|
| OpenAI | gpt-5.6-sol | $5 | $30 | $0.5 | — | 旗舰档;Batch 全系 5 折 |
| OpenAI | gpt-5.6-terra | $2.5 | $15 | $0.25 | — | |
| OpenAI | gpt-5.6-luna | $1 | $6 | $0.1 | — | |
| OpenAI | gpt-5.5-pro | $30 | $180 | — | — | 高阶推理档,无缓存价 |
| OpenAI | gpt-5.4-mini | $0.75 | $4.5 | $0.075 | — | |
| OpenAI | gpt-5.4-nano | $0.2 | $1.25 | $0.02 | — | 低价档 |
| Anthropic | Claude Fable 5 | $10 | $50 | $1 | 1M | Batch 5 折;1M 长上下文不加价 |
| Anthropic | Claude Opus 4.8 | $5 | $25 | $0.5 | 1M | Batch 价 $2.50/$12.50 |
| Anthropic | Claude Sonnet 5 | $2 | $10 | $0.2 | 1M | 介绍价至 8/31,之后 $3/$15 |
| Anthropic | Claude Haiku 4.5 | $1 | $5 | $0.1 | 200K | Batch 价 $0.50/$2.50 |
| Gemini 3.1 Pro (Preview) | $2–4 | $12–18 | $0.2–0.4 | — | ≤200K/>200K 分档;缓存另收存储费;Batch 5 折;AI Studio 有免费层 | |
| Gemini 3.6 Flash | $1.5 | $7.5 | $0.15 | — | 缓存另收存储费;有免费层 | |
| Gemini 3.5 Flash-Lite | $0.3 | $2.5 | $0.03 | — | 最低价 GA 档;缓存另收存储费 | |
| xAI | Grok 4.5 | $2–4 | $6–12 | $0.3–0.6 | 500K | 按输入长度分段计价(<200K/≥200K) |
| xAI | Grok 4.3 | $1.25–2.5 | $2.5–5 | $0.2–0.4 | 1M | 按输入长度分段计价 |
| Mistral | Mistral Medium 3.5 | $1.5 | $7.5 | — | — | 未公布缓存价 |
| Mistral | Mistral Large 3 | $0.5 | $1.5 | — | — | 官网营销页残留旧价 $2/$6,以 API 定价表为准 |
CN · 12
国内模型(人民币 元 / 每百万 token)
国内计价规则普遍更复杂:按输入长度分档、限时/「永久」折扣、快照版不参与优惠——变动细节以变更日志为准。
| 厂商 | 模型 | 输入 ¥/M | 输出 ¥/M | 缓存读 | Context | 备注 |
|---|---|---|---|---|---|---|
| DeepSeek | deepseek-v4-flash | ¥1 | ¥2 | ¥0.02 | 1M | R 系列已并入 V4 思考模式;旧名 deepseek-chat/reasoner 已于 7/24 弃用 |
| DeepSeek | deepseek-v4-pro | ¥3 | ¥6 | ¥0.025 | 1M | |
| 阿里 Qwen | qwen3.7-max | ¥6 | ¥18 | — | 1M | 限时 5 折(原价 ¥12/¥36);缓存命中按输入价 10%;Batch 半价;快照版无折扣 |
| 阿里 Qwen | qwen3.7-plus | ¥2–6 | ¥8–24 | — | 1M | 按输入长度分档(≤256K/>256K);缓存命中按输入价 10% |
| 阿里 Qwen | qwen3.6-flash | ¥1.2–4.8 | ¥7.2–28.8 | — | 1M | 按输入长度分档;缓存命中按输入价 10% |
| Moonshot Kimi | kimi-k3 | ¥20 | ¥100 | ¥2 | 1M | 始终推理,effort 可调 |
| Moonshot Kimi | kimi-k2.7-code | ¥6.5 | ¥27 | ¥1.3 | 256K | 编程款;highspeed 版价格翻倍 |
| 智谱 GLM | GLM-5.2 | ¥8 | ¥28 | ¥2 | 1M | 缓存存储限时免费 |
| 智谱 GLM | GLM-5 | ¥4–6 | ¥18–22 | ¥1–1.5 | — | 按输入长度分档(<32K/≥32K) |
| 字节豆包 | doubao-seed-2.1-pro | ¥6 | ¥30 | ¥1.2 | 256K | 缓存存储另计 ¥0.017/1M/小时 |
| 字节豆包 | doubao-seed-2.0-mini | ¥0.2–0.8 | ¥3–12 | ¥0.04–0.16 | 256K | 低价款,按输入长度三档计价 |
| MiniMax | MiniMax-M3 | ¥2.1 | ¥8.4 | ¥0.42 | 1M | 「永久五折」价(原价 ¥4.2 输入);≤512K 档;原生多模态;priority 层 1.5 倍 |
EXAMPLE · 月成本
同一负载,各家一个月多少钱
假设月 3 亿输入 + 3000 万输出 token(约日均 1000 万入/100 万出),不计缓存与 Batch 折扣,人民币按 1 USD ≈ ¥7.2 折算,由上表价格直接算得:
| 模型 | 月成本(USD) |
|---|---|
| deepseek-v4-flash | $50 |
| gpt-5.4-nano | $98 |
| MiniMax-M3 | $123 |
| Gemini 3.5 Flash-Lite | $165 |
| qwen3.7-max | $325 |
| GLM-5.2 | $450 |
| Claude Haiku 4.5 | $450 |
| kimi-k3 | $1,250 |
| gpt-5.6-sol | $2,400 |
| Claude Fable 5 | $4,500 |
最贵与最便宜相差约 90 倍。用好缓存(命中价普遍为输入价的 2%–10%)与 Batch(多家 5 折),还能在此基础上再砍一个量级。
CHANGELOG · 6
价格变更日志
这张表最大的问题是「今天准,下个月不一定」——所以每次复核观察到的改价、折扣、弃用都记录在案,只追加、不改写。
- 2026-07-24DeepSeek旧模型名 deepseek-chat 与 deepseek-reasoner 正式弃用;R 系列不再独立在售,推理能力并入 V4 的思考模式。
- 2026-07-22阿里 Qwenqwen3.7-max 挂出限时 5 折:输入 ¥12→¥6、输出 ¥36→¥18;快照版不参与折扣。
- 2026-07-22MiniMaxMiniMax-M3 标注「永久五折」:输入 ¥4.2→¥2.1、输出 ¥8.4(≤512K 档)。
- 2026-07-22AnthropicClaude Sonnet 5 介绍价 $2/$10 持续至 8/31,之后恢复 $3/$15。
- 2026-07-22Mistral官网两处定价互相矛盾:营销页 Large 仍挂旧价 $2/$6,API 定价表为 $0.5/$1.5。以 API 表为准。
- 2026-07-22全部基线建立:29 款模型、11 家厂商,逐条按官方定价页人工核对。
FAQ
常见问题
2026 年哪家大模型 API 最便宜?
按官方定价页核对:DeepSeek v4-flash 输入 ¥1/输出 ¥2(每百万 token),缓存命中输入仅 ¥0.02,是当前最低价的主力档;其次是字节豆包 seed-2.0-mini(¥0.2 起)与 OpenAI gpt-5.4-nano($0.20/$1.25)。
同样的工作负载,不同模型能差多少钱?
以月 3 亿输入 + 3000 万输出 token 估算(不含缓存与 Batch 折扣):最贵的旗舰约 $4,500/月,最便宜的约 $50/月,相差约 90 倍。选型前先确认任务是否真的需要旗舰能力。
缓存和 Batch 能省多少?
缓存命中价普遍是输入价的 2%–10%(DeepSeek 低至 ¥0.02/1M);OpenAI、Anthropic、Google、Qwen 等提供 Batch 约 5 折。两者可叠加,重复上下文多的负载还能再降一个量级。
数据来源均为各家官方定价页(核对日期 2026 年 7 月 22 日):OpenAI · Anthropic · Google · xAI · Mistral · DeepSeek · 阿里云百炼 · Moonshot Kimi · 智谱 · 字节豆包 · MiniMax。价格变动频繁,请以官网实时为准;发现错误欢迎指正。想按主题看背景知识,见《API 价格与算力成本》指南。