PRICING ── 对照表
大模型 API 价格对照表
国内外 11 家 · 31 款模型 · 逐条人工核对于 2026 年 8 月 7 日
按性价比大致分三档:极致省钱——DeepSeek v4-flash、豆包 seed-2.0-mini、GPT-5.4-nano、刚降价 80% 的 GPT-5.6-luna;均衡主力——MiniMax-M3、Gemini Flash 系、Qwen3.7-plus、Claude Haiku 4.5;旗舰能力——Claude Fable 5、GPT-5.6-sol、Kimi k3、GLM-5.2。同一负载最贵与最便宜差约 90 倍,先想清楚任务需不需要旗舰。
INTL · 18
国际模型(USD / 每百万 token)
价格区间表示按输入长度分段/分档计价;缓存价为「读取/命中」价,写入与存储另计的已在备注标明。
| 厂商 | 模型 | 输入 $/M | 输出 $/M | 缓存读 | Context | 备注 |
|---|---|---|---|---|---|---|
| OpenAI | gpt-5.6-sol | $5 | $30 | $0.5 | — | 旗舰档;Batch 全系 5 折 |
| OpenAI | gpt-5.6-terra | $2 | $12 | $0.2 | — | 7/30 降价约 20%(原 $2.50/$15) |
| OpenAI | gpt-5.6-luna | $0.2 | $1.2 | $0.02 | — | 表内为 Standard 档。官方另有 Flex/Batch $0.10/$0.60 与 Fast $0.40/$2.40,>272K 长上下文再跳档(输入翻倍、输出 $1.80);同日 Azure 仍收旧价 $1/$6。7/30 较原价 $1/$6 下调 |
| OpenAI | gpt-5.5-pro | $30 | $180 | — | — | 高阶推理档,无缓存价 |
| OpenAI | gpt-5.4-mini | $0.75 | $4.5 | $0.075 | — | |
| OpenAI | gpt-5.4-nano | $0.2 | $1.25 | $0.02 | — | 低价档 |
| Anthropic | Claude Fable 5 | $10 | $50 | $1 | 1M | Batch 5 折;1M 长上下文不加价 |
| Anthropic | Claude Opus 5 | $5 | $25 | $0.5 | 1M | 7/24 上架;Batch $2.50/$12.50 |
| Anthropic | Claude Opus 4.8 | $5 | $25 | $0.5 | 1M | Batch 价 $2.50/$12.50 |
| Anthropic | Claude Sonnet 5 | $2 | $10 | $0.2 | 1M | 介绍价至 8/31,之后 $3/$15 |
| Anthropic | Claude Haiku 4.5 | $1 | $5 | $0.1 | 200K | Batch 价 $0.50/$2.50 |
| Gemini 3.1 Pro (Preview) | $2–4 | $12–18 | $0.2–0.4 | — | ≤200K/>200K 分档;缓存另收存储费;Batch 5 折;AI Studio 有免费层 | |
| Gemini 3.6 Flash | $1.5 | $7.5 | $0.15 | — | 缓存另收存储费;有免费层 | |
| Gemini 3.5 Flash-Lite | $0.3 | $2.5 | $0.03 | — | 最低价 GA 档;缓存另收存储费 | |
| xAI | Grok 4.5 | $2–4 | $6–12 | $0.3–0.6 | 500K | 按输入长度分段计价(<200K/≥200K) |
| xAI | Grok 4.3 | $1.25–2.5 | $2.5–5 | $0.2–0.4 | 1M | 按输入长度分段计价 |
| Mistral | Mistral Medium 3.5 | $1.5 | $7.5 | — | — | 未公布缓存价 |
| Mistral | Mistral Large 3 | $0.5 | $1.5 | — | — | 官网营销页残留旧价 $2/$6,以 API 定价表为准 |
CN · 13
国内模型(人民币 元 / 每百万 token)
国内计价规则普遍更复杂:按输入长度分档、限时/「永久」折扣、快照版不参与优惠——变动细节以变更日志为准。
| 厂商 | 模型 | 输入 ¥/M | 输出 ¥/M | 缓存读 | Context | 备注 |
|---|---|---|---|---|---|---|
| DeepSeek | deepseek-v4-flash | ¥1 | ¥2 | ¥0.02 | 1M | ⚠️ 官方定价页 8/6 挂出涨价预告「预计涨幅较大」,价格数字尚未变动;同日撤下 7/31 起挂着的「高峰时段 2 倍」预告(该预告从未生效);R 系列已并入 V4 思考模式,旧名 deepseek-chat/reasoner 于 7/24 弃用 |
| DeepSeek | deepseek-v4-pro | ¥3 | ¥6 | ¥0.025 | 1M | ⚠️ 同受 8/6 涨价预告覆盖,方案与生效时间以官方正式通知为准 |
| 阿里 Qwen | qwen3.7-max | ¥6 | ¥18 | — | 1M | 限时 5 折(原价 ¥12/¥36);缓存命中按输入价 10%;Batch 半价;快照版无折扣 |
| 阿里 Qwen | qwen3.7-plus | ¥1.6–4.8 | ¥6.4–19.2 | — | 1M | 8/6 新增限时 8 折(原价 ¥2/¥6 输入、¥8/¥24 输出);按输入长度分档(≤256K/>256K);缓存命中按输入价 10% |
| 阿里 Qwen | qwen3.8-max | ¥12 | ¥36 | — | 1M | 新旗舰,无折扣;已取代 qwen3.7-max 成为活动页主推(后者的 5 折疑为清仓期) |
| 阿里 Qwen | qwen3.6-flash | ¥1.2–4.8 | ¥7.2–28.8 | — | 1M | 按输入长度分档;缓存命中按输入价 10% |
| Moonshot Kimi | kimi-k3 | ¥20 | ¥100 | ¥2 | 1M | 始终推理,effort 可调 |
| Moonshot Kimi | kimi-k2.7-code | ¥6.5 | ¥27 | ¥1.3 | 256K | 编程款;highspeed 版价格翻倍 |
| 智谱 GLM | GLM-5.2 | ¥8 | ¥28 | ¥2 | 1M | 缓存存储限时免费 |
| 智谱 GLM | GLM-5 | ¥4–6 | ¥18–22 | ¥1–1.5 | — | 按输入长度分档(<32K/≥32K) |
| 字节豆包 | doubao-seed-2.1-pro | ¥6 | ¥30 | ¥1.2 | 256K | 缓存存储另计 ¥0.017/1M/小时 |
| 字节豆包 | doubao-seed-2.0-mini | ¥0.2–0.8 | ¥2–8 | ¥0.04–0.16 | 256K | 低价款,按输入长度三档计价;输出价 8/6 更正(本表 7/22 误抄成「输入(音频)」列的 ¥3/6/12) |
| MiniMax | MiniMax-M3 | ¥2.1 | ¥8.4 | ¥0.42 | 1M | 「永久五折」价(原价 ¥4.2 输入);≤512K 档;原生多模态;priority 层 1.5 倍 |
EXAMPLE · 月成本
同一负载,各家一个月多少钱
假设月 3 亿输入 + 3000 万输出 token(约日均 1000 万入/100 万出),不计缓存与 Batch 折扣,人民币按 1 USD ≈ ¥7.2 折算,由上表价格直接算得:
| 模型 | 月成本(USD) |
|---|---|
| deepseek-v4-flash | $50 |
| gpt-5.6-luna | $96 |
| gpt-5.4-nano | $98 |
| MiniMax-M3 | $123 |
| Gemini 3.5 Flash-Lite | $165 |
| qwen3.7-max | $325 |
| GLM-5.2 | $450 |
| Claude Haiku 4.5 | $450 |
| kimi-k3 | $1,250 |
| gpt-5.6-sol | $2,400 |
| Claude Fable 5 | $4,500 |
最贵与最便宜相差约 90 倍。用好缓存(命中价普遍为输入价的 2%–10%)与 Batch(多家 5 折),还能在此基础上再砍一个量级。
CHANGELOG · 15
价格变更日志
这张表最大的问题是「今天准,下个月不一定」——所以每次复核观察到的改价、折扣、弃用都记录在案,只追加、不改写。
- 2026-08-07OpenAI更正并补全我们自己 8/6 的说法:「gpt-5.6-luna 降价 80%」只说对了一档。官方定价页实际有三个 service tier——Flex/Batch $0.10/$0.60、Standard $0.20/$1.20、Fast $0.40/$2.40(档间 4 倍差),另有 >272K 长上下文跳档(Standard 变 $0.40/$1.80,输入翻倍)。本表列 Standard 档并已补注其余档位。
- 2026-08-07OpenAI同一个 luna,今天在不同渠道/档位上有 8 个报价,最高与最低差 22 倍(实测于 8/7 上午)。OpenRouter 当前对 OpenAI 三个档位额外挂 50% 促销(endpoints API 里 "discount": 0.5,与官方牌价精确对半):flex 实付 $0.05/$0.30、standard $0.10/$0.60、priority $0.20/$1.20。Amazon Bedrock $0.22/$1.32、无折扣。而 Azure 仍是 $1.00/$6.00、Azure EU $1.10/$6.60,discount 为 0——降价一周后仍未同步。也就是说:走 OpenRouter flex 是 $0.05,走 Azure EU 是 $1.10。注意 OpenRouter 那 50% 是促销,随时可能撤。
- 2026-08-06DeepSeek官方定价页新增预告:「计划近期整体上调 DeepSeek API 服务的定价,预计涨幅较大,请合理安排您的使用。具体方案以正式通知为准。」——注意:页面上的价格数字当日仍未变动(v4-flash 仍 ¥1/¥2、v4-pro 仍 ¥3/¥6),涨幅与生效时间均未公布。
- 2026-08-06DeepSeek「高峰时段 2 倍」峰谷定价的完整来龙去脉(存档逐帧比对):该说明确实上过官方定价页,但**从头到尾都是预告,且今天已被撤下**。时间线——7/31 上午 10:20 的存档还只有一条脚注;同日下午(随 V4-Flash-0731 正式版上线)新增脚注:「DeepSeek API 服务即将采用峰谷定价策略,高峰时段价格为平时价格 2 倍,适用所有计费项,具体时间以正式通知为准。【高峰时段定义:北京时间每日 9:00~12:00 和 14:00~18:00】」;8/2–8/6 上午一字未改;8/6 该脚注被整条替换成本次的涨价预告。两个被广泛传错的细节:官方写的是「每日」,「工作日高峰、周末不涨」是网上加的;官方只定义了高峰时段,从未定义低谷时段。旁证:六家转售平台(阿里云百炼、火山方舟、腾讯云、百度千帆、硅基流动、OpenRouter)今日定价页全部是单一价格,无一标示分时计费。结论:**别按 2 倍算账单,它没生效过**。
- 2026-08-06OpenAIgpt-5.6-luna 降价 80%:输入 $1→$0.20、输出 $6→$1.20、缓存读 $0.10→$0.02。同批 gpt-5.6-terra 降约 20%:$2.50/$15→$2.00/$12(缓存读 $0.25→$0.20)。旗舰 gpt-5.6-sol 不变。厂商公告日 7/30,本表 8/6 复核时确认。
- 2026-08-06AnthropicClaude Opus 5 于 7/24 上架,$5/$25(缓存读 $0.50、Batch $2.50/$12.50),已入表。另:官方定价页载明 Claude 4.7 及之后的模型(含 Fable 5、Opus 4.8、Sonnet 5)改用新分词器,同样文本的 token 数约多 30%——比单价本身更影响实际账单,跨代对比时务必换算。
- 2026-08-06阿里 Qwenqwen3.7-plus 新增限时 8 折:输入 ¥2/¥6→¥1.6/¥4.8、输出 ¥8/¥24→¥6.4/¥19.2(按输入长度分档)。qwen3.7-max 的限时 5 折仍在(官方页与活动页均未标截止日)。同时新旗舰 qwen3.8-max 已上架并接替活动页主推位,列价 ¥12/¥36 无折扣——3.7-max 的 5 折疑为清仓期,建议加密监控。
- 2026-08-06字节豆包更正(我们的错,非厂商改价):doubao-seed-2.0-mini 的输出价应为 ¥2/¥4/¥8 三档,本表 7/22 误抄成官方表「输入(音频)」列的 ¥3/¥6/¥12。已按 8/6 官方页更正。输入 ¥0.2/¥0.4/¥0.8、缓存命中 ¥0.04–0.16 原本无误。
- 2026-08-06全部全表复核(11 家、31 款)。倒计时提醒:Claude Sonnet 5 的介绍价 $2/$10 在 8/31 到期,9/1 起恢复 $3/$15(Batch 同步 $1/$5→$1.50/$7.50)——官方页字句未改,剩 25 天。
- 2026-07-24DeepSeek旧模型名 deepseek-chat 与 deepseek-reasoner 正式弃用;R 系列不再独立在售,推理能力并入 V4 的思考模式。
- 2026-07-22阿里 Qwenqwen3.7-max 挂出限时 5 折:输入 ¥12→¥6、输出 ¥36→¥18;快照版不参与折扣。
- 2026-07-22MiniMaxMiniMax-M3 标注「永久五折」:输入 ¥4.2→¥2.1、输出 ¥8.4(≤512K 档)。
- 2026-07-22AnthropicClaude Sonnet 5 介绍价 $2/$10 持续至 8/31,之后恢复 $3/$15。
- 2026-07-22Mistral官网两处定价互相矛盾:营销页 Large 仍挂旧价 $2/$6,API 定价表为 $0.5/$1.5。以 API 表为准。
- 2026-07-22全部基线建立:29 款模型、11 家厂商,逐条按官方定价页人工核对。
FAQ
常见问题
2026 年哪家大模型 API 最便宜?
按官方定价页核对:DeepSeek v4-flash 输入 ¥1/输出 ¥2(每百万 token),缓存命中输入仅 ¥0.02,是当前最低价的主力档;其次是字节豆包 seed-2.0-mini(¥0.2 起)与 OpenAI gpt-5.4-nano($0.20/$1.25)。
同样的工作负载,不同模型能差多少钱?
以月 3 亿输入 + 3000 万输出 token 估算(不含缓存与 Batch 折扣):最贵的旗舰约 $4,500/月,最便宜的约 $50/月,相差约 90 倍。选型前先确认任务是否真的需要旗舰能力。
缓存和 Batch 能省多少?
缓存命中价普遍是输入价的 2%–10%(DeepSeek 低至 ¥0.02/1M);OpenAI、Anthropic、Google、Qwen 等提供 Batch 约 5 折。两者可叠加,重复上下文多的负载还能再降一个量级。
数据来源均为各家官方定价页(核对日期 2026 年 8 月 7 日):OpenAI · Anthropic · Google · xAI · Mistral · DeepSeek · 阿里云百炼 · Moonshot Kimi · 智谱 · 字节豆包 · MiniMax。价格变动频繁,请以官网实时为准;发现错误欢迎指正。想按主题看背景知识,见《API 价格与算力成本》指南。