LIVE
阿里云百炼 (Qwen) qwen-audio-chat · 已下架阿里云百炼 (Qwen) qwen2-audio-instruct · 已下架阿里云百炼 (Qwen) qwen3.5-omni-flash-realtime · 已下架阿里云百炼 (Qwen) qwen3.5-omni-plus-realtime · 已下架阿里云百炼 (Qwen) qwen3.5-omni-flash · 已下架阿里云百炼 (Qwen) qwen3.5-omni-plus · 已下架阿里云百炼 (Qwen) qwen-long-2025-01-25 · 已下架阿里云百炼 (Qwen) qwen-tts-realtime-2025-07-15 · 备注 变更阿里云百炼 (Qwen) qwen-tts-realtime-latest · 备注 变更阿里云百炼 (Qwen) qwen-tts-realtime · 备注 变更

LLM PRICE WATCH

每小时更新

大模型 API
价格看板

把 11 家主流厂商的公开价格、变动与公告放进同一张可比较的账本。支持人民币折算,时间统一为北京时间;实际价格以各厂商官网为准。

最近更新 · 北京时间
2026-09-01 12:37
覆盖厂商
11 家
在列模型
711 个
变动记录
103 条
实时汇率
1 USD ≈ ¥6.72
汇率来源
frankfurter.dev

LOWEST BY PROVIDER

各厂商最新 4 条中的最低价

价格 = 输入价 + 输出价

每根柱代表一家厂商 · 从左到右按合计价由低到高 · 统一折算人民币

¥1.8
智谱 (GLM)
GLM-5.3-Flash
¥2.69
Mistral
Ministral 3 14B
¥6
DeepSeek
deepseek-v4-flash空闲
¥10.5
MiniMax
MiniMax-M3标准·≤512K
¥18
火山方舟 (豆包)
doubao-seed-2.1-turbo0–256K
¥24
阿里云百炼 (Qwen)
qwen3.7-max
¥30.24
Google Gemini
Gemini 3.6 Flash批量
¥33.5
月之暗面 (Kimi)
kimi-k2.7-code
¥40.32
Anthropic (Claude)
Claude Haiku 4.5
¥53.76
xAI (Grok)
grok-4.6
¥94.08
OpenAI
gpt-5.6-terra标准·短

横轴为厂商,柱高按合计价线性比较;每家仅在官网价格页最前的 4 条记录中选择;同名模型沿用价格速览中的档位摘要。缺少输入价或输出价时,以已有单项价格参与比较 · USD 按 1 USD ≈ ¥6.72 折算。

价格速览 · 每家最新的 4 个模型

输入输出统一折算人民币
Anthropic (Claude)国际
Claude Fable 5
¥67.2
¥335.98
Claude Opus 5
¥33.6
¥167.99
Claude Sonnet 5
¥13.44
¥67.2
Claude Haiku 4.5
¥6.72
¥33.6
OpenAI国际
gpt-5.6-sol标准·短
¥26.88
¥134.39
gpt-5.6-sol标准·长
¥53.76
¥201.59
gpt-5.6-terra标准·短
¥13.44
¥80.64
gpt-5.6-terra标准·长
¥26.88
¥120.95
Google Gemini国际
Gemini 3.6 Flash标准
¥10.08
¥50.4
Gemini 3.6 Flash批量
¥5.04
¥25.2
Gemini 3.6 FlashFlex
¥5.04
¥25.2
Gemini 3.6 Flash优先
¥18.14
¥90.72
xAI (Grok)国际
grok-4.6
¥13.44
¥40.32
Mistral国际
Mistral Large 3
¥3.36
¥10.08
Mistral Medium 3.5
¥10.08
¥50.4
Mistral Small 4
¥1.01
¥4.03
Ministral 3 14B
¥1.34
¥1.34
DeepSeek国内
deepseek-v4-flash空闲
¥1.5
¥4.5
deepseek-v4-flash高峰
¥3
¥9
deepseek-v4-pro空闲
¥4.5
¥13.5
deepseek-v4-pro高峰
¥9
¥27
阿里云百炼 (Qwen)国内
qwen3.8-max-prime
¥24
¥72
qwen3.8-max
¥12
¥36
qwen3.7-max
¥6
¥18
qwen3.7-max-2026-06-08
¥12
¥36
火山方舟 (豆包)国内
doubao-seed-evolving
¥6
¥30
doubao-seed-2.1-pro0–256K
¥6
¥30
doubao-seed-2.1-turbo0–256K
¥3
¥15
doubao-seed-2.0-pro0–32K
¥3.2
¥16
智谱 (GLM)国内
GLM-5.3
¥8
¥28
GLM-5.3-Flash
¥0.4
¥1.4
GLM-5.2
¥8
¥28
GLM-5.10–32K
¥6
¥24
月之暗面 (Kimi)国内
kimi-k3
¥20
¥100
kimi-k2.7-code
¥6.5
¥27
kimi-k2.7-code-highspeed
¥13
¥54
kimi-k2.6
¥6.5
¥27
MiniMax国内
MiniMax-M3标准·≤512K
¥2.1
¥8.4
MiniMax-M3标准·>512K
¥4.2
¥16.8
MiniMax-M3优先·≤512K
¥3.15
¥12.6
MiniMax-M3优先·>512K
¥6.3
¥25.2

线性刻度下价格差异直观, 但低价模型会被压扁; 对数刻度完整但压缩差异 —— 右上角可切换 · USD 按 1 USD ≈ ¥6.72 折算 · 每家取官网价格页最前的 4 个模型(即最新), 同名模型后的标签说明价格档位差异; 完整价格与备注见下方明细表。

02 / PRICES

完整价格账本

按厂商分组 · 单位:每百万 tokens
USD 按 1 USD ≈ ¥6.72 折算(标注 ≈)

Anthropic (Claude)

国际
4 模型更新于 09-01 12:33展开价格收起价格

活动Batch API requests are 50% off; prompt cache reads cost 10% of the base input price.

模型输入 / 百万tokens输出 / 百万tokens缓存输入备注
Claude Fable 5$10≈¥67.2$50≈¥335.98$1≈¥6.72
Claude Opus 5$5≈¥33.6$25≈¥167.99$0.5≈¥3.36
Claude Sonnet 5$2≈¥13.44$10≈¥67.2$0.2≈¥1.34
Claude Haiku 4.5$1≈¥6.72$5≈¥33.6$0.1≈¥0.67

OpenAI

国际页面无变化
207 模型更新于 08-31 18:12展开价格收起价格

活动GPT-5.6 Sol’s promotional pricing is available at least through November 21, 2026.

模型输入 / 百万tokens输出 / 百万tokens缓存输入备注
gpt-5.6-sol$4≈¥26.88$20≈¥134.39$0.4≈¥2.69Standard,短上下文;促销价格至少持续至 2026-11-21,原价未注明
gpt-5.6-sol$8≈¥53.76$30≈¥201.59$0.8≈¥5.38Standard,长上下文;促销价格至少持续至 2026-11-21,原价未注明
gpt-5.6-terra$2≈¥13.44$12≈¥80.64$0.2≈¥1.34Standard,短上下文
gpt-5.6-terra$4≈¥26.88$18≈¥120.95$0.4≈¥2.69Standard,长上下文
gpt-5.6-luna$0.2≈¥1.34$1.2≈¥8.06$0.02≈¥0.13Standard,短上下文
gpt-5.6-luna$0.4≈¥2.69$1.8≈¥12.1$0.04≈¥0.27Standard,长上下文
gpt-5.5 (<272K context length)$5≈¥33.6$30≈¥201.59$0.5≈¥3.36Standard,短上下文
gpt-5.5 (<272K context length)$10≈¥67.2$45≈¥302.39$1≈¥6.72Standard,长上下文
gpt-5.5-pro (<272K context length)$30≈¥201.59$180≈¥1209.55Standard,短上下文
gpt-5.5-pro (<272K context length)$60≈¥403.18$270≈¥1814.32Standard,长上下文
gpt-5.4 (<272K context length)$2.5≈¥16.8$15≈¥100.8$0.25≈¥1.68Standard,短上下文
gpt-5.4 (<272K context length)$5≈¥33.6$22.5≈¥151.19$0.5≈¥3.36Standard,长上下文
gpt-5.4-mini$0.75≈¥5.04$4.5≈¥30.24$0.075≈¥0.5Standard,短上下文
gpt-5.4-nano$0.2≈¥1.34$1.25≈¥8.4$0.02≈¥0.13Standard,短上下文
gpt-5.4-pro (<272K context length)$30≈¥201.59$180≈¥1209.55Standard,短上下文
gpt-5.4-pro (<272K context length)$60≈¥403.18$270≈¥1814.32Standard,长上下文
gpt-5.2$1.75≈¥11.76$14≈¥94.08$0.175≈¥1.18Standard
gpt-5.2-pro$21≈¥141.11$168≈¥1128.91Standard
gpt-5.1$1.25≈¥8.4$10≈¥67.2$0.125≈¥0.84Standard
gpt-5$1.25≈¥8.4$10≈¥67.2$0.125≈¥0.84Standard
gpt-5-mini$0.25≈¥1.68$2≈¥13.44$0.025≈¥0.17Standard
gpt-5-nano$0.05≈¥0.34$0.4≈¥2.69$0.005≈¥0.03Standard
gpt-5-pro$15≈¥100.8$120≈¥806.36Standard
gpt-4.1$2≈¥13.44$8≈¥53.76$0.5≈¥3.36Standard
gpt-4.1-mini$0.4≈¥2.69$1.6≈¥10.75$0.1≈¥0.67Standard
gpt-4.1-nano$0.1≈¥0.67$0.4≈¥2.69$0.025≈¥0.17Standard
gpt-4o$2.5≈¥16.8$10≈¥67.2$1.25≈¥8.4Standard
gpt-4o-2024-05-13$5≈¥33.6$15≈¥100.8Standard
gpt-4o-mini$0.15≈¥1.01$0.6≈¥4.03$0.075≈¥0.5Standard
o1$15≈¥100.8$60≈¥403.18$7.5≈¥50.4Standard
o1-pro$150≈¥1007.95$600≈¥4031.82Standard
o3-pro$20≈¥134.39$80≈¥537.58Standard
o3$2≈¥13.44$8≈¥53.76$0.5≈¥3.36Standard
o4-mini$1.1≈¥7.39$4.4≈¥29.57$0.275≈¥1.85Standard
o3-mini$1.1≈¥7.39$4.4≈¥29.57$0.55≈¥3.7Standard
gpt-4-turbo-2024-04-09$10≈¥67.2$30≈¥201.59Standard
gpt-4-0613$30≈¥201.59$60≈¥403.18Standard
gpt-3.5-turbo$0.5≈¥3.36$1.5≈¥10.08Standard
gpt-3.5-turbo-0125$0.5≈¥3.36$1.5≈¥10.08Standard
gpt-3.5-turbo-1106$1≈¥6.72$2≈¥13.44Standard
gpt-3.5-turbo-instruct$1.5≈¥10.08$2≈¥13.44Standard
davinci-002$2≈¥13.44$2≈¥13.44Standard
babbage-002$0.4≈¥2.69$0.4≈¥2.69Standard
gpt-5.6-sol$2≈¥13.44$10≈¥67.2$0.2≈¥1.34Batch,短上下文;促销价格至少持续至 2026-11-21,原价未注明
gpt-5.6-sol$4≈¥26.88$15≈¥100.8$0.4≈¥2.69Batch,长上下文;促销价格至少持续至 2026-11-21,原价未注明
gpt-5.6-terra$1≈¥6.72$6≈¥40.32$0.1≈¥0.67Batch,短上下文
gpt-5.6-terra$2≈¥13.44$9≈¥60.48$0.2≈¥1.34Batch,长上下文
gpt-5.6-luna$0.1≈¥0.67$0.6≈¥4.03$0.01≈¥0.07Batch,短上下文
gpt-5.6-luna$0.2≈¥1.34$0.9≈¥6.05$0.02≈¥0.13Batch,长上下文
gpt-5.5 (<272K context length)$2.5≈¥16.8$15≈¥100.8$0.25≈¥1.68Batch,短上下文
gpt-5.5 (<272K context length)$5≈¥33.6$22.5≈¥151.19$0.5≈¥3.36Batch,长上下文
gpt-5.5-pro (<272K context length)$15≈¥100.8$90≈¥604.77Batch,短上下文
gpt-5.4 (<272K context length)$1.25≈¥8.4$7.5≈¥50.4$0.13≈¥0.87Batch,短上下文
gpt-5.4 (<272K context length)$2.5≈¥16.8$11.25≈¥75.6$0.25≈¥1.68Batch,长上下文
gpt-5.4-mini$0.375≈¥2.52$2.25≈¥15.12$0.037≈¥0.25Batch
gpt-5.4-nano$0.1≈¥0.67$0.625≈¥4.2$0.01≈¥0.07Batch
gpt-5.4-pro (<272K context length)$15≈¥100.8$90≈¥604.77Batch,短上下文
gpt-5.4-pro (<272K context length)$30≈¥201.59$135≈¥907.16Batch,长上下文
gpt-5.2$0.875≈¥5.88$7≈¥47.04$0.087≈¥0.59Batch
gpt-5.2-pro$10.5≈¥70.56$84≈¥564.45Batch
gpt-5.1$0.625≈¥4.2$5≈¥33.6$0.062≈¥0.42Batch
gpt-5$0.625≈¥4.2$5≈¥33.6$0.062≈¥0.42Batch
gpt-5-mini$0.125≈¥0.84$1≈¥6.72$0.013≈¥0.08Batch
gpt-5-nano$0.025≈¥0.17$0.2≈¥1.34$0.003≈¥0.02Batch
gpt-5-pro$7.5≈¥50.4$60≈¥403.18Batch
gpt-4.1$1≈¥6.72$4≈¥26.88Batch
gpt-4.1-mini$0.2≈¥1.34$0.8≈¥5.38Batch
gpt-4.1-nano$0.05≈¥0.34$0.2≈¥1.34Batch
gpt-4o$1.25≈¥8.4$5≈¥33.6Batch
gpt-4o-2024-05-13$2.5≈¥16.8$7.5≈¥50.4Batch
gpt-4o-mini$0.075≈¥0.5$0.3≈¥2.02Batch
o1$7.5≈¥50.4$30≈¥201.59Batch
o1-pro$75≈¥503.98$300≈¥2015.91Batch
o3-pro$10≈¥67.2$40≈¥268.79Batch
o3$1≈¥6.72$4≈¥26.88Batch
o4-mini$0.55≈¥3.7$2.2≈¥14.78Batch
o3-mini$0.55≈¥3.7$2.2≈¥14.78Batch
gpt-4-turbo-2024-04-09$5≈¥33.6$15≈¥100.8Batch
gpt-4-0613$15≈¥100.8$30≈¥201.59Batch
gpt-3.5-turbo-0125$0.25≈¥1.68$0.75≈¥5.04Batch
gpt-3.5-turbo-1106$1≈¥6.72$2≈¥13.44Batch
davinci-002$1≈¥6.72$1≈¥6.72Batch
babbage-002$0.2≈¥1.34$0.2≈¥1.34Batch
gpt-5.6-sol$2≈¥13.44$10≈¥67.2$0.2≈¥1.34Flex,短上下文;促销价格至少持续至 2026-11-21,原价未注明
gpt-5.6-sol$4≈¥26.88$15≈¥100.8$0.4≈¥2.69Flex,长上下文;促销价格至少持续至 2026-11-21,原价未注明
gpt-5.6-terra$1≈¥6.72$6≈¥40.32$0.1≈¥0.67Flex,短上下文
gpt-5.6-terra$2≈¥13.44$9≈¥60.48$0.2≈¥1.34Flex,长上下文
gpt-5.6-luna$0.1≈¥0.67$0.6≈¥4.03$0.01≈¥0.07Flex,短上下文
gpt-5.6-luna$0.2≈¥1.34$0.9≈¥6.05$0.02≈¥0.13Flex,长上下文
gpt-5.5 (<272K context length)$2.5≈¥16.8$15≈¥100.8$0.25≈¥1.68Flex,短上下文
gpt-5.5 (<272K context length)$5≈¥33.6$22.5≈¥151.19$0.5≈¥3.36Flex,长上下文
gpt-5.5-pro (<272K context length)$15≈¥100.8$90≈¥604.77Flex,短上下文
gpt-5.4 (<272K context length)$1.25≈¥8.4$7.5≈¥50.4$0.13≈¥0.87Flex,短上下文
gpt-5.4 (<272K context length)$2.5≈¥16.8$11.25≈¥75.6$0.25≈¥1.68Flex,长上下文
gpt-5.4-mini$0.375≈¥2.52$2.25≈¥15.12$0.037≈¥0.25Flex
gpt-5.4-nano$0.1≈¥0.67$0.625≈¥4.2$0.01≈¥0.07Flex
gpt-5.4-pro (<272K context length)$15≈¥100.8$90≈¥604.77Flex,短上下文
gpt-5.4-pro (<272K context length)$30≈¥201.59$135≈¥907.16Flex,长上下文
gpt-5.2$0.875≈¥5.88$7≈¥47.04$0.087≈¥0.59Flex
gpt-5.1$0.625≈¥4.2$5≈¥33.6$0.062≈¥0.42Flex
gpt-5$0.625≈¥4.2$5≈¥33.6$0.062≈¥0.42Flex
gpt-5-mini$0.125≈¥0.84$1≈¥6.72$0.013≈¥0.08Flex
gpt-5-nano$0.025≈¥0.17$0.2≈¥1.34$0.003≈¥0.02Flex
o3$1≈¥6.72$4≈¥26.88$0.25≈¥1.68Flex
o4-mini$0.55≈¥3.7$2.2≈¥14.78$0.138≈¥0.93Flex
gpt-5.6-sol$8≈¥53.76$40≈¥268.79$0.8≈¥5.38Fast mode,短上下文;促销价格至少持续至 2026-11-21,原价未注明
gpt-5.6-sol$16≈¥107.52$60≈¥403.18$1.6≈¥10.75Fast mode,长上下文;促销价格至少持续至 2026-11-21,原价未注明
gpt-5.6-terra$4≈¥26.88$24≈¥161.27$0.4≈¥2.69Fast mode,短上下文
gpt-5.6-terra$8≈¥53.76$36≈¥241.91$0.8≈¥5.38Fast mode,长上下文
gpt-5.6-luna$0.4≈¥2.69$2.4≈¥16.13$0.04≈¥0.27Fast mode,短上下文
gpt-5.6-luna$0.8≈¥5.38$3.6≈¥24.19$0.08≈¥0.54Fast mode,长上下文
gpt-5.5 (<272K context length)$12.5≈¥84$75≈¥503.98$1.25≈¥8.4Fast mode,短上下文
gpt-5.4 (<272K context length)$5≈¥33.6$30≈¥201.59$0.5≈¥3.36Fast mode,短上下文
gpt-5.4-mini$1.5≈¥10.08$9≈¥60.48$0.15≈¥1.01Fast mode
gpt-5.2$3.5≈¥23.52$28≈¥188.15$0.35≈¥2.35Fast mode
gpt-5.1$2.5≈¥16.8$20≈¥134.39$0.25≈¥1.68Fast mode
gpt-5$2.5≈¥16.8$20≈¥134.39$0.25≈¥1.68Fast mode
gpt-5-mini$0.45≈¥3.02$3.6≈¥24.19$0.045≈¥0.3Fast mode
gpt-4.1$3.5≈¥23.52$14≈¥94.08$0.875≈¥5.88Fast mode
gpt-4.1-mini$0.7≈¥4.7$2.8≈¥18.82$0.175≈¥1.18Fast mode
gpt-4.1-nano$0.2≈¥1.34$0.8≈¥5.38$0.05≈¥0.34Fast mode
gpt-4o$4.25≈¥28.56$17≈¥114.23$2.125≈¥14.28Fast mode
gpt-4o-2024-05-13$8.75≈¥58.8$26.25≈¥176.39Fast mode
gpt-4o-mini$0.25≈¥1.68$1≈¥6.72$0.125≈¥0.84Fast mode
o3$3.5≈¥23.52$14≈¥94.08$0.875≈¥5.88Fast mode
o4-mini$2≈¥13.44$8≈¥53.76$0.5≈¥3.36Fast mode
gpt-5.6-sol$4≈¥26.88$20≈¥134.39$0.4≈¥2.69Cyber models,短上下文;gpt-daybreak-blue-latest 当前别名;促销价格至少持续至 2026-11-21
gpt-5.6-sol$8≈¥53.76$30≈¥201.59$0.8≈¥5.38Cyber models,长上下文;gpt-daybreak-blue-latest 当前别名;促销价格至少持续至 2026-11-21
gpt-5.6-cyber$12.5≈¥84$75≈¥503.98$1.25≈¥8.4Cyber models,短上下文;gpt-daybreak-red-latest 当前别名
gpt-5.5-cyber$12.5≈¥84$75≈¥503.98$1.25≈¥8.4Cyber models,短上下文
gpt-realtime-2.1$32≈¥215.03$64≈¥430.06$0.4≈¥2.69Realtime,Audio tokens
gpt-realtime-2.1$4≈¥26.88$24≈¥161.27$0.4≈¥2.69Realtime,Text tokens
gpt-realtime-2.1$5≈¥33.6$0.5≈¥3.36Realtime,Image tokens
gpt-realtime-2.1-mini$10≈¥67.2$20≈¥134.39$0.3≈¥2.02Realtime,Audio tokens
gpt-realtime-2.1-mini$0.6≈¥4.03$2.4≈¥16.13$0.06≈¥0.4Realtime,Text tokens
gpt-realtime-2.1-mini$0.8≈¥5.38$0.08≈¥0.54Realtime,Image tokens
gpt-realtime-2$32≈¥215.03$64≈¥430.06$0.4≈¥2.69Realtime,Audio tokens
gpt-realtime-2$4≈¥26.88$24≈¥161.27$0.4≈¥2.69Realtime,Text tokens
gpt-realtime-2$5≈¥33.6$0.5≈¥3.36Realtime,Image tokens
gpt-realtime-1.5$32≈¥215.03$64≈¥430.06$0.4≈¥2.69Realtime,Audio tokens
gpt-realtime-1.5$4≈¥26.88$16≈¥107.52$0.4≈¥2.69Realtime,Text tokens
gpt-realtime-1.5$5≈¥33.6$0.5≈¥3.36Realtime,Image tokens
gpt-realtime-mini$10≈¥67.2$20≈¥134.39$0.3≈¥2.02Realtime,Audio tokens
gpt-realtime-mini$0.6≈¥4.03$2.4≈¥16.13$0.06≈¥0.4Realtime,Text tokens
gpt-realtime-mini$0.8≈¥5.38$0.08≈¥0.54Realtime,Image tokens
gpt-realtime$32≈¥215.03$64≈¥430.06$0.4≈¥2.69Realtime,Audio tokens
gpt-realtime$4≈¥26.88$16≈¥107.52$0.4≈¥2.69Realtime,Text tokens
gpt-realtime$5≈¥33.6$0.5≈¥3.36Realtime,Image tokens
gpt-audio-1.5$32≈¥215.03$64≈¥430.06Audio tokens
gpt-audio-1.5$2.5≈¥16.8$10≈¥67.2Text tokens
gpt-audio-mini$10≈¥67.2$20≈¥134.39Audio tokens
gpt-audio-mini$0.6≈¥4.03$2.4≈¥16.13Text tokens
gpt-audio$32≈¥215.03$64≈¥430.06Audio tokens
gpt-audio$2.5≈¥16.8$10≈¥67.2Text tokens
gpt-4o-mini-tts$12≈¥80.64Audio output tokens
gpt-4o-mini-tts$0.6≈¥4.03Text input tokens
gpt-image-2$8≈¥53.76$30≈¥201.59$2≈¥13.44图像生成,Standard,Image tokens
gpt-image-2$5≈¥33.6$1.25≈¥8.4图像生成,Standard,Text tokens
gpt-image-1.5$8≈¥53.76$32≈¥215.03$2≈¥13.44图像生成,Standard,Image tokens
gpt-image-1.5$5≈¥33.6$10≈¥67.2$1.25≈¥8.4图像生成,Standard,Text tokens
gpt-image-1-mini$2.5≈¥16.8$8≈¥53.76$0.25≈¥1.68图像生成,Standard,Image tokens
gpt-image-1-mini$2≈¥13.44$0.2≈¥1.34图像生成,Standard,Text tokens
gpt-image-1$10≈¥67.2$40≈¥268.79$2.5≈¥16.8图像生成,Standard,Image tokens
gpt-image-1$5≈¥33.6$1.25≈¥8.4图像生成,Standard,Text tokens
chatgpt-image-latest$8≈¥53.76$32≈¥215.03$2≈¥13.44图像生成,Standard,Image tokens
chatgpt-image-latest$5≈¥33.6$10≈¥67.2$1.25≈¥8.4图像生成,Standard,Text tokens
gpt-image-2$4≈¥26.88$15≈¥100.8$1≈¥6.72图像生成,Batch,Image tokens
gpt-image-2$2.5≈¥16.8$0.625≈¥4.2图像生成,Batch,Text tokens
gpt-image-1.5$4≈¥26.88$16≈¥107.52$1≈¥6.72图像生成,Batch,Image tokens
gpt-image-1.5$2.5≈¥16.8$5≈¥33.6$0.63≈¥4.23图像生成,Batch,Text tokens
gpt-image-1-mini$1.25≈¥8.4$4≈¥26.88$0.13≈¥0.87图像生成,Batch,Image tokens
gpt-image-1-mini$1≈¥6.72$0.1≈¥0.67图像生成,Batch,Text tokens
gpt-image-1$5≈¥33.6$20≈¥134.39$1.25≈¥8.4图像生成,Batch,Image tokens
gpt-image-1$2.5≈¥16.8$0.63≈¥4.23图像生成,Batch,Text tokens
chatgpt-image-latest$4≈¥26.88$16≈¥107.52$1≈¥6.72图像生成,Batch,Image tokens
chatgpt-image-latest$2.5≈¥16.8$5≈¥33.6$0.63≈¥4.23图像生成,Batch,Text tokens
gpt-4o-transcribe$2.5≈¥16.8$10≈¥67.2转录模型;另列估算成本 $0.006/分钟
gpt-4o-mini-transcribe$1.25≈¥8.4$5≈¥33.6转录模型;另列估算成本 $0.003/分钟
gpt-4o-transcribe-diarize$2.5≈¥16.8$10≈¥67.2转录+说话人分离;另列估算成本 $0.006/分钟
chat-latest$5≈¥33.6$30≈¥201.59$0.5≈¥3.36Specialized,ChatGPT,Standard
gpt-5.3-codex$1.75≈¥11.76$14≈¥94.08$0.175≈¥1.18Specialized,Codex,Standard
gpt-5-search-api$1.25≈¥8.4$10≈¥67.2$0.125≈¥0.84Specialized,Search,Standard
text-embedding-3-small$0.02≈¥0.13embedding,Standard
text-embedding-3-large$0.13≈¥0.87embedding,Standard
text-embedding-ada-002$0.1≈¥0.67embedding,Standard
omni-moderation-latest$0≈¥0Moderation;限时免费
gpt-5.3-codex$3.5≈¥23.52$28≈¥188.15$0.35≈¥2.35Specialized,Codex,Fast mode
o4-mini-2025-04-16$4≈¥26.88$16≈¥107.52$1≈¥6.72微调模型推理,Standard;训练 $100/小时,不计入 token 字段
o4-mini-2025-04-16 (data sharing)$2≈¥13.44$8≈¥53.76$0.5≈¥3.36微调模型推理,Standard,启用数据共享折扣;训练 $100/小时
gpt-4.1-2025-04-14$3≈¥20.16$12≈¥80.64$0.75≈¥5.04微调模型推理,Standard
gpt-4.1-mini-2025-04-14$0.8≈¥5.38$3.2≈¥21.5$0.2≈¥1.34微调模型推理,Standard
gpt-4.1-nano-2025-04-14$0.2≈¥1.34$0.8≈¥5.38$0.05≈¥0.34微调模型推理,Standard
gpt-4o-2024-08-06$3.75≈¥25.2$15≈¥100.8$1.875≈¥12.6微调模型推理,Standard
gpt-4o-mini-2024-07-18$0.3≈¥2.02$1.2≈¥8.06$0.15≈¥1.01微调模型推理,Standard
gpt-3.5-turbo (legacy)$3≈¥20.16$6≈¥40.32微调模型推理,Standard,legacy
davinci-002 (legacy)$12≈¥80.64$12≈¥80.64微调模型推理,Standard,legacy
babbage-002 (legacy)$1.6≈¥10.75$1.6≈¥10.75微调模型推理,Standard,legacy
o4-mini-2025-04-16$2≈¥13.44$8≈¥53.76$0.5≈¥3.36微调模型推理,Batch;训练 $100/小时,不计入 token 字段
o4-mini-2025-04-16 (data sharing)$1≈¥6.72$4≈¥26.88$0.25≈¥1.68微调模型推理,Batch,启用数据共享折扣;训练 $100/小时
gpt-4.1-2025-04-14$1.5≈¥10.08$6≈¥40.32$0.5≈¥3.36微调模型推理,Batch
gpt-4.1-mini-2025-04-14$0.4≈¥2.69$1.6≈¥10.75$0.1≈¥0.67微调模型推理,Batch
gpt-4.1-nano-2025-04-14$0.1≈¥0.67$0.4≈¥2.69$0.025≈¥0.17微调模型推理,Batch
gpt-4o-2024-08-06$2.225≈¥14.95$12.5≈¥84$0.9≈¥6.05微调模型推理,Batch
gpt-4o-mini-2024-07-18$0.15≈¥1.01$0.6≈¥4.03$0.075≈¥0.5微调模型推理,Batch
gpt-3.5-turbo (legacy)$1.5≈¥10.08$3≈¥20.16微调模型推理,Batch,legacy
davinci-002 (legacy)$6≈¥40.32$6≈¥40.32微调模型推理,Batch,legacy
babbage-002 (legacy)$0.8≈¥5.38$0.9≈¥6.05微调模型推理,Batch,legacy

Google Gemini

国际页面无变化
122 模型更新于 08-31 18:14展开价格收起价格
模型输入 / 百万tokens输出 / 百万tokens缓存输入备注
Gemini 3.6 Flash$1.5≈¥10.08$7.5≈¥50.4$0.15≈¥1.01标准;输出价格包括思考 token
Gemini 3.6 Flash$0.75≈¥5.04$3.75≈¥25.2$0.075≈¥0.5批量;输出价格包括思考 token
Gemini 3.6 Flash$0.75≈¥5.04$3.75≈¥25.2$0.075≈¥0.5Flex;输出价格包括思考 token
Gemini 3.6 Flash$2.7≈¥18.14$13.5≈¥90.72$0.27≈¥1.81优先级;输出价格包括思考 token
Gemini 3.5 Flash$1.5≈¥10.08$9≈¥60.48$0.15≈¥1.01标准;输出价格包括思考 token
Gemini 3.5 Flash$0.75≈¥5.04$4.5≈¥30.24$0.075≈¥0.5批量;输出价格包括思考 token
Gemini 3.5 Flash$0.75≈¥5.04$4.5≈¥30.24$0.08≈¥0.54Flex;输出价格包括思考 token
Gemini 3.5 Flash$2.7≈¥18.14$16.2≈¥108.86$0.27≈¥1.81优先级;输出价格包括思考 token
Gemini 3.5 实时翻译$3.5≈¥23.52$21≈¥141.11标准;音频;低延迟实时语音翻译模型;输出价格包括思考 token
Gemini 3.5 Flash-Lite$0.3≈¥2.02$2.5≈¥16.8$0.03≈¥0.2标准;文本/图片/视频/音频输入;输出价格包括思考 token
Gemini 3.5 Flash-Lite$0.15≈¥1.01$1.25≈¥8.4$0.02≈¥0.13批量;文本/图片/视频/音频输入;输出价格包括思考 token
Gemini 3.5 Flash-Lite$0.15≈¥1.01$1.25≈¥8.4$0.02≈¥0.13Flex;文本/图片/视频/音频输入;输出价格包括思考 token
Gemini 3.5 Flash-Lite$0.54≈¥3.63$4.5≈¥30.24$0.05≈¥0.34优先级;文本/图片/视频/音频输入;输出价格包括思考 token
Gemini 3.1 Flash-Lite$0.25≈¥1.68$1.5≈¥10.08$0.025≈¥0.17标准;文本/图片/视频输入;输出价格包括思考 token
Gemini 3.1 Flash-Lite$0.5≈¥3.36$1.5≈¥10.08$0.05≈¥0.34标准;音频输入;输出价格包括思考 token
Gemini 3.1 Flash-Lite$0.125≈¥0.84$0.75≈¥5.04$0.013≈¥0.08批量;文本/图片/视频输入;输出价格包括思考 token
Gemini 3.1 Flash-Lite$0.25≈¥1.68$0.75≈¥5.04$0.025≈¥0.17批量;音频输入;输出价格包括思考 token
Gemini 3.1 Flash-Lite$0.125≈¥0.84$0.75≈¥5.04$0.013≈¥0.08Flex;文本/图片/视频输入;输出价格包括思考 token
Gemini 3.1 Flash-Lite$0.25≈¥1.68$0.75≈¥5.04$0.025≈¥0.17Flex;音频输入;输出价格包括思考 token
Gemini 3.1 Flash-Lite$0.45≈¥3.02$2.7≈¥18.14$0.045≈¥0.3优先级;文本/图片/视频输入;输出价格包括思考 token
Gemini 3.1 Flash-Lite$0.9≈¥6.05$2.7≈¥18.14$0.09≈¥0.6优先级;音频输入;输出价格包括思考 token
Gemini Omni Flash 预览版$1.5≈¥10.08$9≈¥60.48标准;文本输出;输入支持文本/图片/视频/音频;输出价格包括思考 token
Gemini Omni Flash 预览版$1.5≈¥10.08$17.5≈¥117.59标准;视频输出;输入支持文本/图片/视频/音频;输出价格包括思考 token
Gemini 3 Pro 预览版$2≈¥13.44$12≈¥80.64$0.2≈¥1.34标准;提示 <= 20 万个 token;输出价格包括思考 token
Gemini 3 Pro 预览版$4≈¥26.88$18≈¥120.95$0.4≈¥2.69标准;提示 > 20 万个 token;输出价格包括思考 token
Gemini 3 Pro 预览版$1≈¥6.72$6≈¥40.32$0.2≈¥1.34批量;提示 <= 20 万个 token;输出价格包括思考 token
Gemini 3 Pro 预览版$2≈¥13.44$9≈¥60.48$0.4≈¥2.69批量;提示 > 20 万个 token;输出价格包括思考 token
Gemini 3 Pro 预览版$1≈¥6.72$6≈¥40.32$0.2≈¥1.34Flex;提示 <= 20 万个 token;输出价格包括思考 token
Gemini 3 Pro 预览版$2≈¥13.44$9≈¥60.48$0.4≈¥2.69Flex;提示 > 20 万个 token;输出价格包括思考 token
Gemini 3 Pro 预览版$3.6≈¥24.19$21.6≈¥145.15$0.36≈¥2.42优先级;提示 <= 20 万个 token;输出价格包括思考 token
Gemini 3 Pro 预览版$7.2≈¥48.38$32.4≈¥217.72$0.72≈¥4.84优先级;提示 > 20 万个 token;输出价格包括思考 token
Gemini 3.1 Flash Live 预览版$0.75≈¥5.04$4.5≈¥30.24文本输入/输出;输出价格包括思考 token
Gemini 3.1 Flash Live 预览版$3≈¥20.16$12≈¥80.64音频输入/输出;输出价格包括思考 token
Gemini 3.1 Flash Live 预览版$1≈¥6.72图片/视频输入
Gemini 3.1 Flash Image (Nano Banana 2) 🍌$0.5≈¥3.36$3≈¥20.16标准;文本/图片输入,文本和思考输出;图片生成模型
Gemini 3.1 Flash Image (Nano Banana 2) 🍌$0.5≈¥3.36$60≈¥403.18标准;文本/图片输入,图片输出;图片生成模型
Gemini 3.1 Flash Image (Nano Banana 2) 🍌$0.25≈¥1.68$1.5≈¥10.08批量;文本/图片输入,文本和思考输出;图片生成模型
Gemini 3.1 Flash Image (Nano Banana 2) 🍌$0.25≈¥1.68$30≈¥201.59批量;文本/图片输入,图片输出;图片生成模型
Gemini 3.1 Flash Lite Image (Nano Banana 2 Lite) 🍌$0.25≈¥1.68$1.5≈¥10.08标准;文本/图片/视频输入,文本和思考输出;图片生成模型
Gemini 3.1 Flash Lite Image (Nano Banana 2 Lite) 🍌$0.25≈¥1.68$30≈¥201.59标准;文本/图片/视频输入,图片输出;图片生成模型
Gemini 3.1 Flash Lite Image (Nano Banana 2 Lite) 🍌$0.125≈¥0.84$0.75≈¥5.04批量;文本/图片/视频输入,文本和思考输出;图片生成模型
Gemini 3.1 Flash Lite Image (Nano Banana 2 Lite) 🍌$0.125≈¥0.84$15≈¥100.8批量;文本/图片/视频输入,图片输出;图片生成模型
Gemini 3.1 Flash TTS 预览版$1≈¥6.72$20≈¥134.39标准;文本输入、音频输出;TTS
Gemini 3.1 Flash TTS 预览版$0.5≈¥3.36$10≈¥67.2批量;文本输入、音频输出;TTS
Gemini 3 Flash 预览版$0.5≈¥3.36$3≈¥20.16$0.05≈¥0.34标准;文本/图片/视频输入;输出价格包括思考 token
Gemini 3 Flash 预览版$1≈¥6.72$3≈¥20.16$0.1≈¥0.67标准;音频输入;输出价格包括思考 token
Gemini 3 Flash 预览版$0.25≈¥1.68$1.5≈¥10.08$0.05≈¥0.34批量;文本/图片/视频输入;输出价格包括思考 token
Gemini 3 Flash 预览版$0.5≈¥3.36$1.5≈¥10.08$0.1≈¥0.67批量;音频输入;输出价格包括思考 token
Gemini 3 Flash 预览版$0.25≈¥1.68$1.5≈¥10.08$0.05≈¥0.34Flex;文本/图片/视频输入;输出价格包括思考 token
Gemini 3 Flash 预览版$0.5≈¥3.36$1.5≈¥10.08$0.1≈¥0.67Flex;音频输入;输出价格包括思考 token
Gemini 3 Flash 预览版$0.9≈¥6.05$5.4≈¥36.29$0.09≈¥0.6优先级;文本/图片/视频输入;输出价格包括思考 token
Gemini 3 Flash 预览版$1.8≈¥12.1$5.4≈¥36.29$0.18≈¥1.21优先级;音频输入;输出价格包括思考 token
Gemini 3 Pro Image (Nano Banana Pro) 🍌$2≈¥13.44$12≈¥80.64标准;文本/图片输入,文本和思考输出;图片生成模型
Gemini 3 Pro Image (Nano Banana Pro) 🍌$2≈¥13.44$120≈¥806.36标准;文本/图片输入,图片输出;图片生成模型
Gemini 3 Pro Image (Nano Banana Pro) 🍌$1≈¥6.72$6≈¥40.32批量;文本输入,文本和思考输出;图片输入和图片输出仅给出按张价格,未填入 token 字段
Gemini 3 Pro Image (Nano Banana Pro) 🍌$1≈¥6.72$6≈¥40.32Flex;文本输入,文本和思考输出;图片输入和图片输出仅给出按张价格,未填入 token 字段
Gemini 3 Pro Image (Nano Banana Pro) 🍌$3.6≈¥24.19$21.6≈¥145.15优先级;文本/图片输入,文本和思考输出;图片生成模型
Gemini 3 Pro Image (Nano Banana Pro) 🍌$3.6≈¥24.19$216≈¥1451.46优先级;文本/图片输入,图片输出;图片生成模型
Gemini 2.5 Pro$1.25≈¥8.4$10≈¥67.2$0.125≈¥0.84标准;提示 <= 20 万个 token;输出价格包括思考 token
Gemini 2.5 Pro$2.5≈¥16.8$15≈¥100.8$0.25≈¥1.68标准;提示 > 20 万个 token;输出价格包括思考 token
Gemini 2.5 Pro$0.625≈¥4.2$5≈¥33.6$0.125≈¥0.84批量;提示 <= 20 万个 token;输出价格包括思考 token
Gemini 2.5 Pro$1.25≈¥8.4$7.5≈¥50.4$0.25≈¥1.68批量;提示 > 20 万个 token;输出价格包括思考 token
Gemini 2.5 Pro$0.625≈¥4.2$5≈¥33.6$0.125≈¥0.84Flex;提示 <= 20 万个 token;输出价格包括思考 token
Gemini 2.5 Pro$1.25≈¥8.4$7.5≈¥50.4$0.25≈¥1.68Flex;提示 > 20 万个 token;输出价格包括思考 token
Gemini 2.5 Pro$2.25≈¥15.12$18≈¥120.95$0.225≈¥1.51优先级;提示 <= 20 万个 token;输出价格包括思考 token
Gemini 2.5 Pro$4.5≈¥30.24$27≈¥181.43$0.45≈¥3.02优先级;提示 > 20 万个 token;输出价格包括思考 token
Gemini 2.5 Flash$0.3≈¥2.02$2.5≈¥16.8$0.03≈¥0.2标准;文本/图片/视频输入;输出价格包括思考 token
Gemini 2.5 Flash$1≈¥6.72$2.5≈¥16.8$0.1≈¥0.67标准;音频输入;输出价格包括思考 token
Gemini 2.5 Flash$0.15≈¥1.01$1.25≈¥8.4$0.03≈¥0.2批量;文本/图片/视频输入;输出价格包括思考 token
Gemini 2.5 Flash$0.5≈¥3.36$1.25≈¥8.4$0.1≈¥0.67批量;音频输入;输出价格包括思考 token
Gemini 2.5 Flash$0.15≈¥1.01$1.25≈¥8.4$0.03≈¥0.2Flex;文本/图片/视频输入;输出价格包括思考 token
Gemini 2.5 Flash$0.5≈¥3.36$1.25≈¥8.4$0.1≈¥0.67Flex;音频输入;输出价格包括思考 token
Gemini 2.5 Flash$0.54≈¥3.63$4.5≈¥30.24$0.054≈¥0.36优先级;文本/图片/视频输入;输出价格包括思考 token
Gemini 2.5 Flash$1.8≈¥12.1$4.5≈¥30.24$0.18≈¥1.21优先级;音频输入;输出价格包括思考 token
Gemini 2.5 Flash-Lite$0.1≈¥0.67$0.4≈¥2.69$0.01≈¥0.07标准;文本/图片/视频输入;输出价格包括思考 token
Gemini 2.5 Flash-Lite$0.3≈¥2.02$0.4≈¥2.69$0.03≈¥0.2标准;音频输入;输出价格包括思考 token
Gemini 2.5 Flash-Lite$0.05≈¥0.34$0.2≈¥1.34$0.01≈¥0.07批量;文本/图片/视频输入;输出价格包括思考 token
Gemini 2.5 Flash-Lite$0.15≈¥1.01$0.2≈¥1.34$0.03≈¥0.2批量;音频输入;输出价格包括思考 token
Gemini 2.5 Flash-Lite$0.05≈¥0.34$0.2≈¥1.34$0.01≈¥0.07Flex;文本/图片/视频输入;输出价格包括思考 token
Gemini 2.5 Flash-Lite$0.15≈¥1.01$0.2≈¥1.34$0.03≈¥0.2Flex;音频输入;输出价格包括思考 token
Gemini 2.5 Flash-Lite$0.18≈¥1.21$0.72≈¥4.84$0.018≈¥0.12优先级;文本/图片/视频输入;输出价格包括思考 token
Gemini 2.5 Flash-Lite$0.54≈¥3.63$0.72≈¥4.84$0.054≈¥0.36优先级;音频输入;输出价格包括思考 token
Gemini 2.5 Flash-Lite 预览版$0.1≈¥0.67$0.4≈¥2.69$0.01≈¥0.07标准;文本/图片/视频输入;输出价格包括思考 token
Gemini 2.5 Flash-Lite 预览版$0.3≈¥2.02$0.4≈¥2.69$0.03≈¥0.2标准;音频输入;输出价格包括思考 token
Gemini 2.5 Flash-Lite 预览版$0.05≈¥0.34$0.2≈¥1.34$0.01≈¥0.07批量;文本/图片/视频输入;输出价格包括思考 token
Gemini 2.5 Flash-Lite 预览版$0.15≈¥1.01$0.2≈¥1.34$0.03≈¥0.2批量;音频输入;输出价格包括思考 token
Gemini 2.5 Flash Native Audio (Live API)$0.5≈¥3.36$2≈¥13.44文本输入/输出;原生音频 Live API 模型
Gemini 2.5 Flash Native Audio (Live API)$3≈¥20.16$12≈¥80.64音频输入/输出;视频输入同价;原生音频 Live API 模型
Gemini 2.5 Flash Image (Nano Banana) 🍌$0.3≈¥2.02$30≈¥201.59标准;文本/图片输入,图片输出;图片生成模型;输出 token 价格见页面脚注
Gemini 2.5 Flash Image (Nano Banana) 🍌$0.15≈¥1.01批量;文本/图片输入;输出仅给出每张图片价格
Gemini 2.5 Flash Image (Nano Banana) 🍌$0.15≈¥1.01Flex;文本/图片输入;输出仅给出每张图片价格
Gemini 2.5 Flash Image (Nano Banana) 🍌$0.54≈¥3.63优先级;文本/图片输入;输出仅给出每张图片价格
Gemini 2.5 Flash 预览版 TTS$0.5≈¥3.36$10≈¥67.2标准;文本输入、音频输出;TTS
Gemini 2.5 Flash 预览版 TTS$0.25≈¥1.68$5≈¥33.6批量;文本输入、音频输出;TTS
Gemini 2.5 Pro 预览版 TTS$1≈¥6.72$20≈¥134.39标准;文本输入、音频输出;TTS
Gemini 2.5 Pro 预览版 TTS$0.5≈¥3.36$10≈¥67.2批量;文本输入、音频输出;TTS
Gemini 2.0 Flash$0.1≈¥0.67$0.4≈¥2.69$0.025≈¥0.17标准;文本/图片/视频输入;已弃用并于 2026 年 6 月 1 日关停
Gemini 2.0 Flash$0.7≈¥4.7$0.4≈¥2.69$0.175≈¥1.18标准;音频输入;已弃用并于 2026 年 6 月 1 日关停
Gemini 2.0 Flash$0.05≈¥0.34$0.2≈¥1.34$0.025≈¥0.17批量;文本/图片/视频输入;已弃用并于 2026 年 6 月 1 日关停
Gemini 2.0 Flash$0.35≈¥2.35$0.2≈¥1.34$0.175≈¥1.18批量;音频输入;已弃用并于 2026 年 6 月 1 日关停
Gemini 2.0 Flash-Lite$0.075≈¥0.5$0.3≈¥2.02标准;已弃用并于 2026 年 6 月 1 日关停
Gemini 2.0 Flash-Lite$0.037≈¥0.25$0.15≈¥1.01批量;已弃用并于 2026 年 6 月 1 日关停
Gemini Embedding 2$0.2≈¥1.34标准;文本输入;embedding
Gemini Embedding 2$0.45≈¥3.02标准;图片输入;embedding
Gemini Embedding 2$6.5≈¥43.68标准;音频输入;embedding
Gemini Embedding 2$12≈¥80.64标准;视频输入;embedding
Gemini Embedding 2$0.1≈¥0.67批量;文本输入;embedding
Gemini Embedding 2$0.225≈¥1.51批量;图片输入;embedding
Gemini Embedding 2$3.25≈¥21.84批量;音频输入;embedding
Gemini Embedding 2$6≈¥40.32批量;视频输入;embedding
Gemini Embedding$0.15≈¥1.01标准;纯文本 embedding
Gemini Embedding$0.075≈¥0.5批量;纯文本 embedding
Gemini Robotics ER 2 预览版$2≈¥13.44$10≈¥67.2$0.2≈¥1.34标准;机器人视觉语言模型;文本/图片/视频/音频输入;输出价格包括思考 token
Gemini Robotics ER 2 预览版$1≈¥6.72$5≈¥33.6$0.1≈¥0.67批量;机器人视觉语言模型;文本/图片/视频/音频输入;输出价格包括思考 token
Gemini Robotics ER 2 流式预览版$2≈¥13.44$10≈¥67.2标准;机器人流式视觉语言模型;文本/图片/视频/音频输入
Gemini Robotics ER 1.6 预览版$1≈¥6.72$5≈¥33.6标准;机器人思考模型;文本/图片/视频输入;输出价格包括思考 token
Gemini Robotics ER 1.6 预览版$2≈¥13.44$5≈¥33.6标准;机器人思考模型;音频输入;输出价格包括思考 token
Gemini Robotics ER 1.6 预览版$0.5≈¥3.36$2.5≈¥16.8批量;机器人思考模型;文本/图片/视频输入;输出价格包括思考 token
Gemini Robotics ER 1.6 预览版$1≈¥6.72$2.5≈¥16.8批量;机器人思考模型;音频输入;输出价格包括思考 token
Gemini 2.5 Computer Use 预览版$1.25≈¥8.4$10≈¥67.2提示 <= 20 万个 token;Computer Use 模型
Gemini 2.5 Computer Use 预览版$2.5≈¥16.8$15≈¥100.8提示 > 20 万个 token;Computer Use 模型
Gemma 4$0≈¥0$0≈¥0$0≈¥0免费层级;付费层级不可用

xAI (Grok)

国际页面无变化
1 模型更新于 08-31 19:39展开价格收起价格
模型输入 / 百万tokens输出 / 百万tokens缓存输入备注
grok-4.6$2≈¥13.44$6≈¥40.32

Mistral

国际页面无变化
11 模型更新于 08-31 19:40展开价格收起价格
模型输入 / 百万tokens输出 / 百万tokens缓存输入备注
Mistral Large 3$0.5≈¥3.36$1.5≈¥10.08$0.05≈¥0.34
Mistral Medium 3.5$1.5≈¥10.08$7.5≈¥50.4$0.15≈¥1.01
Mistral Small 4$0.15≈¥1.01$0.6≈¥4.03$0.015≈¥0.1
Ministral 3 14B$0.2≈¥1.34$0.2≈¥1.34$0.02≈¥0.13
Ministral 3 8B$0.15≈¥1.01$0.15≈¥1.01$0.015≈¥0.1
Ministral 3 3B$0.1≈¥0.67$0.1≈¥0.67$0.01≈¥0.07
Mistral Moderation 2$0≈¥0$0≈¥0$0≈¥0免费
Z.ai GLM 5.2$1.4≈¥9.41$4.4≈¥29.57$0.14≈¥0.94第三方托管模型
Codestral$0.3≈¥2.02$0.9≈¥6.05$0.03≈¥0.2代码模型
Codestral Embed$0.15≈¥1.01$0.015≈¥0.1embedding 模型
Leanstral 1.5$0≈¥0$0≈¥0$0≈¥0免费;Labs 研究预览/实验版本

DeepSeek

国内页面无变化
6 模型更新于 08-31 18:08展开价格收起价格
模型输入 / 百万tokens输出 / 百万tokens缓存输入备注
deepseek-v4-flash¥1.5¥4.5¥0.05空闲时段:北京时间周一至周五 9:00-12:00、14:00-18:00 以外的时段;价格为高峰时段的一半
deepseek-v4-flash¥3¥9¥0.1高峰时段:北京时间周一至周五 9:00-12:00、14:00-18:00
deepseek-v4-pro¥4.5¥13.5¥0.15空闲时段:北京时间周一至周五 9:00-12:00、14:00-18:00 以外的时段;价格为高峰时段的一半
deepseek-v4-pro¥9¥27¥0.3高峰时段:北京时间周一至周五 9:00-12:00、14:00-18:00
deepseek-v4-flash-vision-exp¥1.5¥4.5¥0.05空闲时段:北京时间周一至周五 9:00-12:00、14:00-18:00 以外的时段;价格为高峰时段的一半。多模态视觉模型,图片按尺寸换算成 token,与文本 token 一并计费
deepseek-v4-flash-vision-exp¥3¥9¥0.1高峰时段:北京时间周一至周五 9:00-12:00、14:00-18:00。多模态视觉模型,图片按尺寸换算成 token,与文本 token 一并计费

阿里云百炼 (Qwen)

国内
165 模型更新于 09-01 12:33展开价格收起价格

活动本文仅展示模型调用原价,请前往百炼控制台查看活动优惠。 qwen3.7-max:输入原价12元(限时5折),输出原价36元(限时5折)。 qwen3.7-plus:0<Token≤256K时输入原价2元(限时8折)、输出原价8元(限时8折);256K<Token≤1M时输入原价6元(限时8折)、输出原价24元(限时8折)。 deepseek-r1-distill-qwen-1.5b:限时免费。

模型输入 / 百万tokens输出 / 百万tokens缓存输入备注
qwen3.8-max-prime¥24¥72华北2(北京);0<Token≤1M;非思考和思考模式
qwen3.8-max¥12¥36华北2(北京);0<Token≤1M;非思考和思考模式;上下文缓存价格未在本页列出
qwen3.7-max¥6¥18华北2(北京);0<Token≤1M;限时5折,输入原价12元/百万、输出原价36元/百万
qwen3.7-max-2026-06-08¥12¥36华北2(北京);0<Token≤1M
qwen3.7-max-2026-05-20¥12¥36华北2(北京);0<Token≤1M
qwen3.7-max-preview¥12¥36华北2(北京);0<Token≤1M;仅思考模式
qwen3.7-max-2026-05-17¥12¥36华北2(北京);0<Token≤1M;仅思考模式
qwen3.6-max-preview¥9¥54华北2(北京);0<Token≤128K
qwen3.6-max-preview¥15¥90华北2(北京);128K<Token≤256K
qwen3-max¥2.5¥10华北2(北京);0<Token≤32K
qwen3-max¥4¥16华北2(北京);32K<Token≤128K
qwen3-max¥7¥28华北2(北京);128K<Token≤256K
qwen3-max-2026-01-23¥2.5¥10华北2(北京);0<Token≤32K
qwen3-max-2026-01-23¥4¥16华北2(北京);32K<Token≤128K
qwen3-max-2026-01-23¥7¥28华北2(北京);128K<Token≤256K
qwen3-max-2025-09-23¥6¥24华北2(北京);0<Token≤32K;仅非思考模式
qwen3-max-2025-09-23¥10¥40华北2(北京);32K<Token≤128K;仅非思考模式
qwen3-max-2025-09-23¥15¥60华北2(北京);128K<Token≤256K;仅非思考模式
qwen-max¥2.4¥9.6华北2(北京);无阶梯计价;仅非思考模式
qwen3.7-plus¥1.6¥6.4华北2(北京);0<Token≤256K;限时8折,输入原价2元/百万、输出原价8元/百万;非思考和思考输出同价
qwen3.7-plus¥4.8¥19.2华北2(北京);256K<Token≤1M;限时8折,输入原价6元/百万、输出原价24元/百万;非思考和思考输出同价
qwen3.7-plus-2026-05-26¥2¥8华北2(北京);0<Token≤256K
qwen3.7-plus-2026-05-26¥6¥24华北2(北京);256K<Token≤1M
qwen3.6-plus¥2¥12华北2(北京);0<Token≤256K
qwen3.6-plus¥8¥48华北2(北京);256K<Token≤1M
qwen3.5-plus¥0.8¥4.8华北2(北京);0<Token≤128K
qwen3.5-plus¥2¥12华北2(北京);128K<Token≤256K
qwen3.5-plus¥4¥24华北2(北京);256K<Token≤1M
qwen-plus¥0.8¥2华北2(北京);0<Token≤128K;非思考模式
qwen-plus¥0.8¥8华北2(北京);0<Token≤128K;思考模式
qwen-plus¥2.4¥20华北2(北京);128K<Token≤256K;非思考模式
qwen-plus¥2.4¥24华北2(北京);128K<Token≤256K;思考模式
qwen-plus¥4.8¥48华北2(北京);256K<Token≤1M;非思考模式
qwen-plus¥4.8¥64华北2(北京);256K<Token≤1M;思考模式
qwen3.8-flash¥0.8¥2.7华北2(北京);0<Token≤1M
qwen3.7-flash¥0.2¥0.8华北2(北京);0<Token≤32K
qwen3.7-flash¥0.6¥2.4华北2(北京);32K<Token≤256K
qwen3.7-flash¥1.2¥4.8华北2(北京);256K<Token≤1M
qwen3.6-flash¥1.2¥7.2华北2(北京);0<Token≤256K
qwen3.6-flash¥4.8¥28.8华北2(北京);256K<Token≤1M
qwen3.5-flash¥0.2¥2华北2(北京);0<Token≤128K
qwen3.5-flash¥0.8¥8华北2(北京);128K<Token≤256K
qwen3.5-flash¥1.2¥12华北2(北京);256K<Token≤1M
qwen-flash¥0.15¥1.5华北2(北京);0<Token≤128K
qwen-flash¥0.6¥6华北2(北京);128K<Token≤256K
qwen-flash¥1.2¥12华北2(北京);256K<Token≤1M
qwen-turbo¥0.3¥0.6华北2(北京);非思考模式
qwen-turbo¥0.3¥3华北2(北京);思考模式
qwq-plus¥1.6¥4华北2(北京);仅思考模式
qwen-long¥0.5¥2华北2(北京)
qwen-long-latest¥0.5¥2华北2(北京)
qvq-max¥8¥32华北2(北京);视觉推理模型
qvq-plus¥2¥5华北2(北京);视觉推理模型
qwen3-vl-plus¥1¥10华北2(北京);多模态;0<Token≤32K
qwen3-vl-plus¥1.5¥15华北2(北京);多模态;32K<Token≤128K
qwen3-vl-plus¥3¥30华北2(北京);多模态;128K<Token≤256K
qwen3-vl-flash¥0.15¥1.5华北2(北京);多模态;0<Token≤32K
qwen3-vl-flash¥0.3¥3华北2(北京);多模态;32K<Token≤128K
qwen3-vl-flash¥0.6¥6华北2(北京);多模态;128K<Token≤256K
qwen-vl-max¥1.6¥4华北2(北京);多模态;无阶梯计价
qwen-vl-plus¥0.8¥2华北2(北京);多模态;无阶梯计价
qwen3.5-ocr¥0.5¥2华北2(北京);OCR模型
qwen-vl-ocr¥0.3¥0.5华北2(北京);OCR模型
qwen-vl-ocr-latest¥0.3¥0.5华北2(北京);OCR模型
qwen-audio-turbo¥0¥0华北2(北京);音频模型;目前仅供免费体验,免费额度用完后不可调用
qwen-audio-turbo-latest¥0¥0华北2(北京);音频模型;目前仅供免费体验,免费额度用完后不可调用
qwen-math-plus¥4¥12华北2(北京);数学模型
qwen-math-turbo¥2¥6华北2(北京);数学模型
qwen3-coder-plus¥4¥16华北2(北京);代码模型;0<Token≤32K
qwen3-coder-plus¥6¥24华北2(北京);代码模型;32K<Token≤128K
qwen3-coder-plus¥10¥40华北2(北京);代码模型;128K<Token≤256K
qwen3-coder-plus¥20¥200华北2(北京);代码模型;256K<Token≤1M
qwen3-coder-flash¥1¥4华北2(北京);代码模型;0<Token≤32K
qwen3-coder-flash¥1.5¥6华北2(北京);代码模型;32K<Token≤128K
qwen3-coder-flash¥2.5¥10华北2(北京);代码模型;128K<Token≤256K
qwen3-coder-flash¥5¥25华北2(北京);代码模型;256K<Token≤1M
qwen-coder-plus¥3.5¥7华北2(北京);代码模型;无阶梯计价
qwen-coder-turbo¥2¥6华北2(北京);代码模型;无阶梯计价
qwen-mt-plus¥1.8¥5.4华北2(北京);翻译模型
qwen-mt-flash¥0.7¥1.95华北2(北京);翻译模型
qwen-mt-lite¥0.6¥1.6华北2(北京);翻译模型
qwen-mt-turbo¥0.7¥1.95华北2(北京);翻译模型
qwen-doc-turbo¥0.6¥1华北2(北京);数据挖掘模型
qwen-deep-research¥54¥163华北2(北京);深入研究模型
qwen-deep-research-2025-12-15¥79¥236华北2(北京);深入研究模型
tongyi-xiaomi-analysis-flash¥0.2¥0.4华北2(北京);对话分析模型
tongyi-xiaomi-analysis-pro¥1¥2.7华北2(北京);对话分析模型
qwen3.8-2.4t-a95b¥12¥36华北2(北京);开源版;0<Token≤1M
qwen3.8-27b¥3¥12华北2(北京);开源版;0<Token≤1M
qwen3.6-35b-a3b¥1.8¥10.8华北2(北京);开源版;0<Token≤256K
qwen3.6-27b¥3¥18华北2(北京);开源版;0<Token≤256K
qwen3.5-397b-a17b¥1.2¥7.2华北2(北京);开源版;0<Token≤128K
qwen3.5-397b-a17b¥3¥18华北2(北京);开源版;128K<Token≤256K
qwen3.5-122b-a10b¥0.8¥6.4华北2(北京);开源版;0<Token≤128K
qwen3.5-122b-a10b¥2¥16华北2(北京);开源版;128K<Token≤256K
qwen3.5-27b¥0.6¥4.8华北2(北京);开源版;0<Token≤128K
qwen3.5-27b¥1.8¥14.4华北2(北京);开源版;128K<Token≤256K
qwen3.5-35b-a3b¥0.4¥3.2华北2(北京);开源版;0<Token≤128K
qwen3.5-35b-a3b¥1.6¥12.8华北2(北京);开源版;128K<Token≤256K
qwen3-next-80b-a3b-thinking¥1¥10华北2(北京);开源版;仅思考模式
qwen3-next-80b-a3b-instruct¥1¥4华北2(北京);开源版;仅非思考模式
qwen3-235b-a22b-thinking-2507¥2¥20华北2(北京);开源版;仅思考模式
qwen3-235b-a22b-instruct-2507¥2¥8华北2(北京);开源版;仅非思考模式
qwen3-30b-a3b-thinking-2507¥0.75¥7.5华北2(北京);开源版;仅思考模式
qwen3-30b-a3b-instruct-2507¥0.75¥3华北2(北京);开源版;仅非思考模式
qwen3-235b-a22b¥2¥8华北2(北京);开源版;非思考模式
qwen3-235b-a22b¥2¥20华北2(北京);开源版;思考模式
qwen3-32b¥2¥8华北2(北京);开源版;非思考模式
qwen3-32b¥2¥20华北2(北京);开源版;思考模式
qwen3-30b-a3b¥0.75¥3华北2(北京);开源版;非思考模式
qwen3-30b-a3b¥0.75¥7.5华北2(北京);开源版;思考模式
qwen3-14b¥1¥4华北2(北京);开源版;非思考模式
qwen3-14b¥1¥10华北2(北京);开源版;思考模式
qwen3-8b¥0.5¥2华北2(北京);开源版;非思考模式
qwen3-8b¥0.5¥5华北2(北京);开源版;思考模式
qwen3-coder-next¥1¥4华北2(北京);开源代码模型;0<Token≤32K
qwen3-coder-next¥1.5¥6华北2(北京);开源代码模型;32K<Token≤128K
qwen3-coder-next¥2.5¥10华北2(北京);开源代码模型;128K<Token≤256K
qwen3-coder-480b-a35b-instruct¥6¥24华北2(北京);开源代码模型;0<Token≤32K
qwen3-coder-480b-a35b-instruct¥9¥36华北2(北京);开源代码模型;32K<Token≤128K
qwen3-coder-480b-a35b-instruct¥15¥60华北2(北京);开源代码模型;128K<Token≤200K
qwen3-coder-30b-a3b-instruct¥1.5¥6华北2(北京);开源代码模型;0<Token≤32K
qwen3-coder-30b-a3b-instruct¥2.25¥9华北2(北京);开源代码模型;32K<Token≤128K
qwen3-coder-30b-a3b-instruct¥3.75¥15华北2(北京);开源代码模型;128K<Token≤200K
deepseek-v4-pro¥12¥24华北2(北京);第三方模型
deepseek-v4-pro-0813¥9¥27华北2(北京);忙时
deepseek-v4-pro-0813¥4.5¥13.5华北2(北京);闲时
deepseek-v4-flash-0731¥3¥9华北2(北京);忙时;自2026-08-17 00:00起为峰谷定价
deepseek-v4-flash-0731¥1.5¥4.5华北2(北京);闲时;自2026-08-17 00:00起为峰谷定价
deepseek-v4-flash¥1¥2华北2(北京);第三方模型
deepseek-v3.2¥2¥3华北2(北京);第三方模型
deepseek-v3.1¥4¥12华北2(北京);第三方模型
deepseek-r1¥4¥16华北2(北京);推理模型
deepseek-v3¥2¥8华北2(北京);第三方模型
deepseek-r1-distill-qwen-1.5b¥0¥0华北2(北京);限时免费
deepseek-r1-distill-qwen-7b¥0.5¥1华北2(北京);蒸馏推理模型
deepseek-r1-distill-qwen-14b¥1¥3华北2(北京);蒸馏推理模型
deepseek-r1-distill-qwen-32b¥2¥6华北2(北京);蒸馏推理模型
kimi-k3¥20¥100华北2(北京);仅思考模式
kimi-k2.7-code¥6.5¥27华北2(北京);仅思考模式;代码模型
kimi-k2.6¥6.5¥27华北2(北京);非思考和思考模式
kimi-k2.5¥4¥21华北2(北京);非思考和思考模式
glm-5.2¥8¥28华北2(北京);不区分阶梯
glm-5.2-fast-preview¥16¥56华北2(北京);不区分阶梯
glm-5.1¥6¥24华北2(北京);0<Token≤32K
glm-5.1¥8¥28华北2(北京);32K<Token≤200K
glm-5¥4¥18华北2(北京);0<Token≤32K
glm-5¥6¥22华北2(北京);32K<Token≤198K
glm-4.7¥3¥14华北2(北京);0<Token≤32K
glm-4.7¥4¥16华北2(北京);32K<Token≤166K
glm-4.5-air¥0.8¥6华北2(北京);0<Token≤32K
glm-4.5-air¥1.2¥8华北2(北京);32K<Token≤96K
MiniMax-M2.5¥2.1¥8.4华北2(北京);仅思考模式
MiniMax-M2.1¥2.1¥8.4华北2(北京);仅思考模式
xiaomi/mimo-v2.5-pro¥7¥21华北2(北京);0<Token≤256K
xiaomi/mimo-v2.5-pro¥14¥42华北2(北京);256K<Token≤1M
stepfun/step-3.7-flash¥1.35¥8.1华北2(北京);第三方模型
unisound/unisound-u2¥1¥2华北2(北京);第三方模型
qwen-tts-flash¥1.6¥10华北2(北京);TTS模型,按Token计费
qwen-tts-latest¥1.6¥10华北2(北京);TTS模型,按Token计费
qwen-tts-2025-05-22¥1.6¥10华北2(北京);TTS模型,按Token计费
qwen-tts-2025-04-10¥1.6¥10华北2(北京);TTS模型,按Token计费
qwen-tts-realtime¥2.4¥12华北2(北京);实时TTS模型,按Token计费
qwen-tts-realtime-latest¥2.4¥12华北2(北京);实时TTS模型,按Token计费
qwen-tts-realtime-2025-07-15¥2.4¥12华北2(北京);实时TTS模型,按Token计费

火山方舟 (豆包)

国内页面无变化
142 模型更新于 08-31 18:25展开价格收起价格

活动限时优惠 Seedance 2.5:北京时间(UTC+8)2026 年 8 月 14 日 14:00 至 9 月 17 日 14:00 期间,1080p 分辨率按刊例价 72 折计费(480p、720p 不参与折扣),最低降至约 2.7 元/秒。 Seedance 2.0 mini:北京时间(UTC+8)2026 年 8 月 7 日 14:00 至 9 月 7 日 14:00 期间,480p、720p 分辨率均按刊例价 4 折计费,以 …

模型输入 / 百万tokens输出 / 百万tokens缓存输入备注
doubao-seed-evolving¥6¥30¥1.2在线推理(常规);输入长度 [0, 1024] 千 tokens
doubao-seed-2.1-pro¥6¥30¥1.2在线推理(常规);输入长度 [0, 256] 千 tokens
doubao-seed-2.1-turbo¥3¥15¥0.6在线推理(常规);输入长度 [0, 256] 千 tokens
doubao-seed-2.0-pro¥3.2¥16¥0.64在线推理(常规);输入长度 [0, 32] 千 tokens
doubao-seed-2.0-pro¥4.8¥24¥0.96在线推理(常规);输入长度 (32, 128] 千 tokens
doubao-seed-2.0-pro¥9.6¥48¥1.92在线推理(常规);输入长度 (128, 256] 千 tokens
doubao-seed-2.0-lite¥0.6¥3.6¥0.12在线推理(常规);输入长度 [0, 32] 千 tokens;音频输入 ¥9/百万,音频缓存命中 ¥1.8/百万
doubao-seed-2.0-lite¥0.9¥5.4¥0.18在线推理(常规);输入长度 (32, 128] 千 tokens;音频输入 ¥13.5/百万,音频缓存命中 ¥2.7/百万
doubao-seed-2.0-lite¥1.8¥10.8¥0.36在线推理(常规);输入长度 (128, 256] 千 tokens;音频输入 ¥27/百万,音频缓存命中 ¥5.4/百万
doubao-seed-2.0-mini¥0.2¥2¥0.04在线推理(常规);输入长度 [0, 32] 千 tokens;音频输入 ¥3/百万,音频缓存命中 ¥0.6/百万
doubao-seed-2.0-mini¥0.4¥4¥0.08在线推理(常规);输入长度 (32, 128] 千 tokens;音频输入 ¥6/百万,音频缓存命中 ¥1.2/百万
doubao-seed-2.0-mini¥0.8¥8¥0.16在线推理(常规);输入长度 (128, 256] 千 tokens;音频输入 ¥12/百万,音频缓存命中 ¥2.4/百万
doubao-seed-2.0-code¥3.2¥16¥0.64在线推理(常规);输入长度 [0, 32] 千 tokens
doubao-seed-2.0-code¥4.8¥24¥0.96在线推理(常规);输入长度 (32, 128] 千 tokens
doubao-seed-2.0-code¥9.6¥48¥1.92在线推理(常规);输入长度 (128, 256] 千 tokens
doubao-seed-1.8¥0.8¥2¥0.16在线推理(常规);输入长度 [0, 32] 千且输出长度 [0, 0.2] 千 tokens
doubao-seed-1.8¥0.8¥8¥0.16在线推理(常规);输入长度 [0, 32] 千且输出长度 (0.2,+∞) 千 tokens
doubao-seed-1.8¥1.2¥16¥0.16在线推理(常规);输入长度 (32, 128] 千 tokens
doubao-seed-1.8¥2.4¥24¥0.16在线推理(常规);输入长度 (128, 256] 千 tokens
doubao-seed-character¥0.8¥2¥0.16在线推理(常规);输入长度 [0, 32] 千 tokens
doubao-seed-character¥1.2¥6¥0.16在线推理(常规);输入长度 (32, 128] 千 tokens
doubao-seed-code¥1.2¥8¥0.24在线推理(常规);输入长度 [0, 32] 千 tokens
doubao-seed-code¥1.4¥12¥0.24在线推理(常规);输入长度 (32, 128] 千 tokens
doubao-seed-code¥2.8¥16¥0.24在线推理(常规);输入长度 (128, 256] 千 tokens
doubao-seed-1.6¥0.8¥2¥0.16在线推理(常规);输入长度 [0, 32] 千且输出长度 [0, 0.2] 千 tokens
doubao-seed-1.6¥0.8¥8¥0.16在线推理(常规);输入长度 [0, 32] 千且输出长度 (0.2,+∞) 千 tokens
doubao-seed-1.6¥1.2¥16¥0.16在线推理(常规);输入长度 (32, 128] 千 tokens
doubao-seed-1.6¥2.4¥24¥0.16在线推理(常规);输入长度 (128, 256] 千 tokens
doubao-seed-1.6-lite¥0.3¥0.6¥0.06在线推理(常规);输入长度 [0, 32] 千且输出长度 [0, 0.2] 千 tokens
doubao-seed-1.6-lite¥0.3¥2.4¥0.06在线推理(常规);输入长度 [0, 32] 千且输出长度 (0.2,+∞) 千 tokens
doubao-seed-1.6-lite¥0.6¥4¥0.06在线推理(常规);输入长度 (32, 128] 千 tokens
doubao-seed-1.6-lite¥1.2¥12¥0.06在线推理(常规);输入长度 (128, 256] 千 tokens
doubao-seed-1.6-flash¥0.15¥1.5¥0.03在线推理(常规);输入长度 [0, 32] 千 tokens
doubao-seed-1.6-flash¥0.3¥3¥0.03在线推理(常规);输入长度 (32, 128] 千 tokens
doubao-seed-1.6-flash¥0.6¥6¥0.03在线推理(常规);输入长度 (128, 256] 千 tokens
doubao-seed-1.6-vision¥0.8¥8¥0.16在线推理(常规);输入长度 [0, 32] 千 tokens;多模态模型
doubao-seed-1.6-vision¥1.2¥16¥0.16在线推理(常规);输入长度 (32, 128] 千 tokens;多模态模型
doubao-seed-1.6-vision¥2.4¥24¥0.16在线推理(常规);输入长度 (128, 256] 千 tokens;多模态模型
doubao-seed-translation¥1.2¥3.6在线推理(常规);翻译模型
doubao-1.5-pro-32k¥0.8¥2¥0.16在线推理(常规)
doubao-1.5-lite-32k¥0.3¥0.6¥0.06在线推理(常规)
doubao-1.5-vision-pro¥3¥9在线推理(常规);多模态模型
glm-5.2¥8¥28¥2在线推理(常规)
glm-4.7¥2¥8¥0.4在线推理(常规);输入长度 [0, 32] 千且输出长度 [0, 0.2] 千 tokens
glm-4.7¥3¥14¥0.6在线推理(常规);输入长度 [0, 32] 千且输出长度 (0.2,+∞) 千 tokens
glm-4.7¥4¥16¥0.8在线推理(常规);输入长度 (32, 200] 千 tokens
deepseek-v4-pro正式版¥9¥27¥0.3在线推理(常规)
deepseek-v4-flash正式版¥3¥9¥0.1在线推理(常规)
deepseek-v4-pro预览版¥9¥27¥0.3在线推理(常规);2026-08-28 完成价格上调后的当前价格
deepseek-v4-flash预览版¥3¥9¥0.1在线推理(常规);2026-08-28 完成价格上调后的当前价格
doubao-seed-2.1-turbo¥6¥30¥1.2在线推理(低延迟);输入长度 [0, 256] 千 tokens
doubao-seed-2.0-pro¥9.6¥48¥1.92在线推理(低延迟);输入长度 [0, 32] 千 tokens
doubao-seed-2.0-pro¥14.4¥72¥2.88在线推理(低延迟);输入长度 (32, 128] 千 tokens
doubao-seed-2.0-pro¥28.8¥144¥5.76在线推理(低延迟);输入长度 (128, 256] 千 tokens
doubao-seed-2.0-lite¥1.2¥7.2¥0.24在线推理(低延迟);输入长度 [0, 32] 千 tokens;音频输入 ¥18/百万,音频缓存命中 ¥3.6/百万
doubao-seed-2.0-lite¥1.8¥10.8¥0.36在线推理(低延迟);输入长度 (32, 128] 千 tokens;音频输入 ¥27/百万,音频缓存命中 ¥5.4/百万
doubao-seed-2.0-lite¥3.6¥21.6¥0.72在线推理(低延迟);输入长度 (128, 256] 千 tokens;音频输入 ¥54/百万,音频缓存命中 ¥10.8/百万
doubao-seed-2.0-mini¥0.4¥4¥0.08在线推理(低延迟);输入长度 [0, 32] 千 tokens;音频输入 ¥6/百万,音频缓存命中 ¥1.2/百万
doubao-seed-2.0-mini¥0.8¥8¥0.16在线推理(低延迟);输入长度 (32, 128] 千 tokens;音频输入 ¥12/百万,音频缓存命中 ¥2.4/百万
doubao-seed-2.0-mini¥1.6¥16¥0.32在线推理(低延迟);输入长度 (128, 256] 千 tokens;音频输入 ¥24/百万,音频缓存命中 ¥4.8/百万
doubao-seed-2.1-pro¥3¥15¥1.2批量推理;输入长度 [0, 256] 千 tokens
doubao-seed-2.1-turbo¥1.5¥7.5¥0.6批量推理;输入长度 [0, 256] 千 tokens
doubao-seed-2.0-pro¥1.6¥8¥0.64批量推理;输入长度 [0, 32] 千 tokens
doubao-seed-2.0-pro¥2.4¥12¥0.96批量推理;输入长度 (32, 128] 千 tokens
doubao-seed-2.0-pro¥4.8¥24¥1.92批量推理;输入长度 (128, 256] 千 tokens
doubao-seed-2.0-lite¥0.3¥1.8¥0.12批量推理;输入长度 [0, 32] 千 tokens;音频输入 ¥4.5/百万,音频缓存命中 ¥1.8/百万
doubao-seed-2.0-lite¥0.45¥2.7¥0.18批量推理;输入长度 (32, 128] 千 tokens;音频输入 ¥6.75/百万,音频缓存命中 ¥2.7/百万
doubao-seed-2.0-lite¥0.9¥5.4¥0.36批量推理;输入长度 (128, 256] 千 tokens;音频输入 ¥13.5/百万,音频缓存命中 ¥5.4/百万
doubao-seed-2.0-mini¥0.1¥1¥0.04批量推理;输入长度 [0, 32] 千 tokens;音频输入 ¥1.5/百万,音频缓存命中 ¥0.6/百万
doubao-seed-2.0-mini¥0.2¥2¥0.08批量推理;输入长度 (32, 128] 千 tokens;音频输入 ¥3/百万,音频缓存命中 ¥1.2/百万
doubao-seed-2.0-mini¥0.4¥4¥0.16批量推理;输入长度 (128, 256] 千 tokens;音频输入 ¥6/百万,音频缓存命中 ¥2.4/百万
doubao-seed-2.0-code¥1.6¥8¥0.64批量推理;输入长度 [0, 32] 千 tokens
doubao-seed-2.0-code¥2.4¥12¥0.96批量推理;输入长度 (32, 128] 千 tokens
doubao-seed-2.0-code¥4.8¥24¥1.92批量推理;输入长度 (128, 256] 千 tokens
doubao-seed-1.8¥0.4¥1¥0.16批量推理;输入长度 [0, 32] 千且输出长度 [0, 0.2] 千 tokens
doubao-seed-1.8¥0.4¥4¥0.16批量推理;输入长度 [0, 32] 千且输出长度 (0.2,+∞) 千 tokens
doubao-seed-1.8¥0.6¥8¥0.16批量推理;输入长度 (32, 128] 千 tokens
doubao-seed-1.8¥1.2¥12¥0.16批量推理;输入长度 (128, 256] 千 tokens
doubao-seed-1.6-vision¥0.4¥4¥0.16批量推理;输入长度 [0, 32] 千 tokens;多模态模型
doubao-seed-1.6-vision¥0.6¥8¥0.16批量推理;输入长度 (32, 128] 千 tokens;多模态模型
doubao-seed-1.6-vision¥1.2¥12¥0.16批量推理;输入长度 (128, 256] 千 tokens;多模态模型
doubao-seed-1.6-lite¥0.15¥0.3¥0.06批量推理;输入长度 [0, 32] 千且输出长度 [0, 0.2] 千 tokens
doubao-seed-1.6-lite¥0.15¥1.2¥0.06批量推理;输入长度 [0, 32] 千且输出长度 (0.2,+∞) 千 tokens
doubao-seed-1.6-lite¥0.3¥2¥0.06批量推理;输入长度 (32, 128] 千 tokens
doubao-seed-1.6-lite¥0.6¥6¥0.06批量推理;输入长度 (128, 256] 千 tokens
doubao-seed-1.6¥0.4¥1¥0.16批量推理;输入长度 [0, 32] 千且输出长度 [0, 0.2] 千 tokens
doubao-seed-1.6¥0.4¥4¥0.16批量推理;输入长度 [0, 32] 千且输出长度 (0.2,+∞) 千 tokens
doubao-seed-1.6¥0.6¥8¥0.16批量推理;输入长度 (32, 128] 千 tokens
doubao-seed-1.6¥1.2¥12¥0.16批量推理;输入长度 (128, 256] 千 tokens
doubao-seed-1.6-flash¥0.075¥0.75¥0.03批量推理;输入长度 [0, 32] 千 tokens
doubao-seed-1.6-flash¥0.15¥1.5¥0.03批量推理;输入长度 (32, 128] 千 tokens
doubao-seed-1.6-flash¥0.3¥3¥0.03批量推理;输入长度 (128, 256] 千 tokens
doubao-seed-translation¥0.6¥1.8¥0.24批量推理;翻译模型
doubao-1.5-pro-32k¥0.4¥1¥0.16批量推理
doubao-1.5-lite-32k¥0.15¥0.3¥0.06批量推理
doubao-pro-32k¥0.8¥2¥0.16批量推理
glm-4.7¥1¥4¥0.4批量推理;输入长度 [0, 32] 千且输出长度 [0, 0.2] 千 tokens
glm-4.7¥1.5¥7¥0.6批量推理;输入长度 [0, 32] 千且输出长度 (0.2,+∞) 千 tokens
glm-4.7¥2¥8¥0.8批量推理;输入长度 (32, 200] 千 tokens
deepseek-v4-pro正式版¥4.5¥13.5¥0.3批量推理
deepseek-v4-flash正式版¥1.5¥4.5¥0.1批量推理
deepseek-v4-pro预览版¥4.5¥13.5¥0.3批量推理;2026-08-28 完成价格上调后的当前价格
deepseek-v4-flash预览版¥1.5¥4.5¥0.1批量推理;2026-08-28 完成价格上调后的当前价格
doubao-seedance-2.5¥70视频生成模型;在线推理;480p/720p;输入不含视频
doubao-seedance-2.5¥42视频生成模型;在线推理;480p/720p;输入包含视频
doubao-seedance-2.5¥55.44视频生成模型;在线推理;1080p;输入不含视频;限时72折,原价 ¥77/百万 tokens;活动时间:北京时间(UTC+8)2026年8月14日14:00至9月17日14:00
doubao-seedance-2.5¥33.12视频生成模型;在线推理;1080p;输入包含视频;限时72折,原价 ¥46/百万 tokens;活动时间:北京时间(UTC+8)2026年8月14日14:00至9月17日14:00
doubao-seedance-2.0¥46视频生成模型;在线推理;480p/720p;输入不含视频
doubao-seedance-2.0¥28视频生成模型;在线推理;480p/720p;输入包含视频
doubao-seedance-2.0¥51视频生成模型;在线推理;1080p;输入不含视频
doubao-seedance-2.0¥31视频生成模型;在线推理;1080p;输入包含视频
doubao-seedance-2.0¥26视频生成模型;在线推理;4k;输入不含视频
doubao-seedance-2.0¥16视频生成模型;在线推理;4k;输入包含视频
doubao-seedance-2.0-fast¥27.75视频生成模型;在线推理;480p/720p;输入不含视频;限时75折,原价 ¥37/百万 tokens;活动时间:北京时间(UTC+8)2026年8月7日14:00至9月7日14:00
doubao-seedance-2.0-fast¥16.5视频生成模型;在线推理;480p/720p;输入包含视频;限时75折,原价 ¥22/百万 tokens;活动时间:北京时间(UTC+8)2026年8月7日14:00至9月7日14:00
doubao-seedance-2.0-mini¥9.2视频生成模型;在线推理;480p/720p;输入不含视频;限时4折,原价 ¥23/百万 tokens;活动时间:北京时间(UTC+8)2026年8月7日14:00至9月7日14:00
doubao-seedance-2.0-mini¥5.6视频生成模型;在线推理;480p/720p;输入包含视频;限时4折,原价 ¥14/百万 tokens;活动时间:北京时间(UTC+8)2026年8月7日14:00至9月7日14:00
doubao-seedance-1.5-pro¥16视频生成模型;在线推理;有声视频
doubao-seedance-1.5-pro¥8视频生成模型;在线推理;无声视频
doubao-seedance-1.5-pro¥8视频生成模型;离线推理;有声视频
doubao-seedance-1.5-pro¥4视频生成模型;离线推理;无声视频
doubao-seedance-1.0-pro¥15视频生成模型;在线推理
doubao-seedance-1.0-pro¥7.5视频生成模型;离线推理
doubao-seedance-1.0-pro-fast¥4.2视频生成模型;在线推理
doubao-seedance-1.0-pro-fast¥2.1视频生成模型;离线推理
doubao-embedding-vision¥0.7embedding;文本输入
doubao-embedding-vision¥1.8embedding;图片输入
doubao-seed-2.0-lite¥1.2¥7.2精调模型推理-在线推理;输入长度 [0, 32] 千 tokens;音频输入 ¥18/百万
doubao-seed-2.0-lite¥1.8¥10.8精调模型推理-在线推理;输入长度 (32, 128] 千 tokens;音频输入 ¥27/百万
doubao-seed-2.0-lite¥3.6¥21.6精调模型推理-在线推理;输入长度 (128, 256] 千 tokens;音频输入 ¥54/百万
doubao-seed-2.0-mini¥0.4¥4精调模型推理-在线推理;输入长度 [0, 32] 千 tokens;音频输入 ¥6/百万
doubao-seed-2.0-mini¥0.8¥8精调模型推理-在线推理;输入长度 (32, 128] 千 tokens;音频输入 ¥12/百万
doubao-seed-2.0-mini¥1.6¥16精调模型推理-在线推理;输入长度 (128, 256] 千 tokens;音频输入 ¥24/百万
doubao-seed-2.0-lite¥1.2¥7.2¥0.24精调模型推理-批量推理;输入长度 [0, 32] 千 tokens;音频输入 ¥18/百万,音频缓存命中 ¥3.6/百万
doubao-seed-2.0-lite¥1.8¥10.8¥0.36精调模型推理-批量推理;输入长度 (32, 128] 千 tokens;音频输入 ¥27/百万,音频缓存命中 ¥5.4/百万
doubao-seed-2.0-lite¥3.6¥21.6¥0.72精调模型推理-批量推理;输入长度 (128, 256] 千 tokens;音频输入 ¥54/百万,音频缓存命中 ¥10.8/百万
doubao-seed-2.0-mini¥0.4¥4¥0.08精调模型推理-批量推理;输入长度 [0, 32] 千 tokens;音频输入 ¥6/百万,音频缓存命中 ¥1.2/百万
doubao-seed-2.0-mini¥0.8¥8¥0.16精调模型推理-批量推理;输入长度 (32, 128] 千 tokens;音频输入 ¥12/百万,音频缓存命中 ¥2.4/百万
doubao-seed-2.0-mini¥1.6¥16¥0.32精调模型推理-批量推理;输入长度 (128, 256] 千 tokens;音频输入 ¥24/百万,音频缓存命中 ¥4.8/百万
doubao-1.5-pro-32k¥0.4¥1¥0.16精调模型推理-批量推理
doubao-1.5-lite-32k¥0.15¥0.3¥0.06精调模型推理-批量推理
doubao-pro-32k¥0.8¥2¥0.16精调模型推理-批量推理

智谱 (GLM)

国内页面无变化
37 模型更新于 08-31 18:27展开价格收起价格

活动GLM-5.3-Flash:5折限时两周。缓存存储:限时免费。新品上线限时抢4折体验包,立享优惠。

模型输入 / 百万tokens输出 / 百万tokens缓存输入备注
GLM-5.3¥8¥28¥2上下文 1M;缓存存储限时免费
GLM-5.3-Flash¥0.4¥1.4¥0.1155折限时两周;原价输入 ¥0.8/百万、输出 ¥2.8/百万、缓存命中 ¥0.23/百万;缓存存储限时免费;上下文 1M
GLM-5.2¥8¥28¥2上下文 1M;缓存存储限时免费
GLM-5.1¥6¥24¥1.3输入长度 [0, 32);缓存存储限时免费
GLM-5.1¥8¥28¥2输入长度 [32+);缓存存储限时免费
GLM-5V-Turbo¥5¥22¥1.2输入长度 [0, 32);多模态(图片、视频、文件、文本);缓存存储限时免费
GLM-5V-Turbo¥7¥26¥1.8输入长度 [32+);多模态(图片、视频、文件、文本);缓存存储限时免费
GLM-5-Turbo¥5¥22¥1.2输入长度 [0, 32);缓存存储限时免费
GLM-5-Turbo¥7¥26¥1.8输入长度 [32+);缓存存储限时免费
GLM-5¥4¥18¥1输入长度 [0, 32);缓存存储限时免费
GLM-5¥6¥22¥1.5输入长度 [32+);缓存存储限时免费
GLM-4.7¥2¥8¥0.4输入长度 [0, 32),输出长度 [0, 0.2);缓存存储限时免费
GLM-4.7¥3¥14¥0.6输入长度 [0, 32),输出长度 [0.2+);缓存存储限时免费
GLM-4.7¥4¥16¥0.8输入长度 [32, 200);缓存存储限时免费
GLM-4.6V¥1¥3¥0.2输入长度 [0, 32);多模态(图片、视频、文件、文本);缓存存储限时免费
GLM-4.6V¥2¥6¥0.4输入长度 [32, 128);多模态(图片、视频、文件、文本);缓存存储限时免费
GLM-4.5-Air¥0.8¥2¥0.16输入长度 [0, 32),输出长度 [0, 0.2);缓存存储限时免费
GLM-4.5-Air¥0.8¥6¥0.16输入长度 [0, 32),输出长度 [0.2+);缓存存储限时免费
GLM-4.5-Air¥1.2¥8¥0.24输入长度 [32, 128);缓存存储限时免费
GLM-4.7-FlashX¥0.5¥3¥0.1上下文 200K;缓存存储限时免费
GLM-4.7-Flash¥0¥0¥0上下文 200K;限时免费(含缓存存储)
GLM-4.6V-FlashX¥0.15¥1.5¥0.03输入长度 [0, 32);多模态(图片、视频、文件、文本);缓存存储限时免费
GLM-4.6V-FlashX¥0.3¥3¥0.03输入长度 [32, 128);多模态(图片、视频、文件、文本);缓存存储限时免费
GLM-4.6V-Flash¥0¥0¥0多模态(图片、视频、文件、文本);限时免费(含缓存存储)
GLM-4.5V¥2¥6¥0.4输入长度 [0, 32);多模态(图片、视频、文件、文本);缓存存储限时免费
GLM-4.5V¥4¥12¥0.8输入长度 [32, 64);多模态(图片、视频、文件、文本);缓存存储限时免费
GLM-4-Plus¥5文本模型;上下文 128K;页面仅列单价,未区分输入/输出;Batch API ¥2.5/百万 Tokens
GLM-4-Air-250414¥0.5文本模型;上下文 128K;页面仅列单价,未区分输入/输出;Batch API ¥0.25/百万 Tokens
GLM-4-AirX¥10文本模型;上下文 8K;页面仅列单价,未区分输入/输出
GLM-4-Long¥1文本模型;上下文 1M;页面仅列单价,未区分输入/输出;Batch API ¥0.5/百万 Tokens
GLM-4-Assistant¥5文本模型;上下文 128K;页面仅列单价,未区分输入/输出
GLM-Z1-Air¥0.5文本模型;上下文 128K;页面仅列单价,未区分输入/输出
GLM-Z1-AirX¥5文本模型;上下文 32K;页面仅列单价,未区分输入/输出
GLM-Z1-FlashX¥0.1文本模型;上下文 128K;页面仅列单价,未区分输入/输出
GLM-4-FlashX-250414¥0.1文本模型;上下文 128K;页面仅列单价,未区分输入/输出;Batch API ¥0.05/百万 Tokens
GLM-4-Flash-250414¥0文本模型;上下文 128K;限时免费;页面仅列单价,未区分输入/输出
GLM-Z1-Flash¥0推理模型;上下文 128K;限时免费;页面仅列单价,未区分输入/输出

月之暗面 (Kimi)

国内页面无变化
4 模型更新于 08-31 18:21展开价格收起价格

活动文件相关接口(文件内容抽取/文件存储)接口**限时免费**,即您只上传并抽取文档,这个API本身不会产生费用。

模型输入 / 百万tokens输出 / 百万tokens缓存输入备注
kimi-k3¥20¥100¥2上下文窗口:1,048,576 tokens
kimi-k2.7-code¥6.5¥27¥1.3Coding 多模态模型;上下文窗口:262,144 tokens
kimi-k2.7-code-highspeed¥13¥54¥2.6Coding 多模态模型高速版;上下文窗口:262,144 tokens
kimi-k2.6¥6.5¥27¥1.1多模态模型;上下文窗口:262,144 tokens

MiniMax

国内页面无变化
12 模型更新于 08-31 18:21展开价格收起价格

活动永久五折

模型输入 / 百万tokens输出 / 百万tokens缓存输入备注
MiniMax-M3¥2.1¥8.4¥0.42标准服务;≤ 512k 输入 tokens;永久五折,原价:输入 ¥4.20/百万 tokens,输出 ¥16.80/百万 tokens,缓存读取 ¥0.84/百万 tokens
MiniMax-M3¥4.2¥16.8¥0.84标准服务;> 512k 输入 tokens;永久五折,原价:输入 ¥8.40/百万 tokens,输出 ¥33.60/百万 tokens,缓存读取 ¥1.68/百万 tokens
MiniMax-M3¥3.15¥12.6¥0.63优先服务;≤ 512k 输入 tokens;永久五折,原价:输入 ¥6.30/百万 tokens,输出 ¥25.20/百万 tokens,缓存读取 ¥1.26/百万 tokens。调用时将 service_tier 设为 priority
MiniMax-M3¥6.3¥25.2¥1.26优先服务;> 512k 输入 tokens;永久五折,原价:输入 ¥12.60/百万 tokens,输出 ¥50.40/百万 tokens,缓存读取 ¥2.52/百万 tokens。调用时将 service_tier 设为 priority
MiniMax-M2.7¥2.1¥8.4¥0.42缓存写入 ¥2.625/百万 tokens
MiniMax-M2.7-highspeed¥4.2¥16.8¥0.42缓存写入 ¥2.625/百万 tokens
MiniMax-M2.5¥2.1¥8.4¥0.21历史模型;缓存写入 ¥2.625/百万 tokens
MiniMax-M2.5-highspeed¥4.2¥16.8¥0.21历史模型;缓存写入 ¥2.625/百万 tokens
MiniMax-M2.1¥2.1¥8.4¥0.21历史模型;缓存写入 ¥2.625/百万 tokens
MiniMax-M2.1-highspeed¥4.2¥16.8¥0.21历史模型;缓存写入 ¥2.625/百万 tokens
MiniMax-M2¥2.1¥8.4¥0.21历史模型;缓存写入 ¥2.625/百万 tokens
MiniMax-H3-Context-IR¥5.8¥23H3-Context-IR 任务

03 / CHANGES

价格变动流水

官网价格页变化时自动留痕,新记录在前
红 = 涨价 / 新增,绿 = 降价

  • 09-01 12:33阿里云百炼 (Qwen)qwen-audio-chat · 已从官网价格页移除
  • 09-01 12:33阿里云百炼 (Qwen)qwen2-audio-instruct · 已从官网价格页移除
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.5-omni-flash-realtime · 已从官网价格页移除
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.5-omni-plus-realtime · 已从官网价格页移除
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.5-omni-flash · 已从官网价格页移除
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.5-omni-plus · 已从官网价格页移除
  • 09-01 12:33阿里云百炼 (Qwen)qwen-long-2025-01-25 · 已从官网价格页移除
  • 09-01 12:33阿里云百炼 (Qwen)qwen-tts-realtime-2025-07-15 · 备注 华北2(北京);实时文本转语音模型华北2(北京);实时TTS模型,按Token计费
  • 09-01 12:33阿里云百炼 (Qwen)qwen-tts-realtime-latest · 备注 华北2(北京);实时文本转语音模型华北2(北京);实时TTS模型,按Token计费
  • 09-01 12:33阿里云百炼 (Qwen)qwen-tts-realtime · 备注 华北2(北京);实时文本转语音模型华北2(北京);实时TTS模型,按Token计费
  • 09-01 12:33阿里云百炼 (Qwen)qwen-tts-2025-04-10 · 新模型 · 输入价 1.6 · 输出价 10
  • 09-01 12:33阿里云百炼 (Qwen)qwen-tts-2025-05-22 · 新模型 · 输入价 1.6 · 输出价 10
  • 09-01 12:33阿里云百炼 (Qwen)qwen-tts-latest · 新模型 · 输入价 1.6 · 输出价 10
  • 09-01 12:33阿里云百炼 (Qwen)qwen-tts-flash · 备注 华北2(北京);文本转语音模型华北2(北京);TTS模型,按Token计费
  • 09-01 12:33阿里云百炼 (Qwen)unisound/unisound-u2 · 新模型 · 输入价 1 · 输出价 2
  • 09-01 12:33阿里云百炼 (Qwen)stepfun/step-3.7-flash · 新模型 · 输入价 1.35 · 输出价 8.1
  • 09-01 12:33阿里云百炼 (Qwen)xiaomi/mimo-v2.5-pro · 新模型 · 输入价 14 · 输出价 42
  • 09-01 12:33阿里云百炼 (Qwen)MiniMax-M2.1 · 新模型 · 输入价 2.1 · 输出价 8.4
  • 09-01 12:33阿里云百炼 (Qwen)MiniMax-M2.5 · 新模型 · 输入价 2.1 · 输出价 8.4
  • 09-01 12:33阿里云百炼 (Qwen)glm-4.5-air · 新模型 · 输入价 1.2 · 输出价 8
  • 09-01 12:33阿里云百炼 (Qwen)glm-4.7 · 新模型 · 输入价 4 · 输出价 16
  • 09-01 12:33阿里云百炼 (Qwen)glm-5 · 新模型 · 输入价 6 · 输出价 22
  • 09-01 12:33阿里云百炼 (Qwen)glm-5.1 · 新模型 · 输入价 8 · 输出价 28
  • 09-01 12:33阿里云百炼 (Qwen)glm-5.2-fast-preview · 新模型 · 输入价 16 · 输出价 56
  • 09-01 12:33阿里云百炼 (Qwen)glm-5.2 · 新模型 · 输入价 8 · 输出价 28
  • 09-01 12:33阿里云百炼 (Qwen)kimi-k2.5 · 新模型 · 输入价 4 · 输出价 21
  • 09-01 12:33阿里云百炼 (Qwen)kimi-k2.6 · 新模型 · 输入价 6.5 · 输出价 27
  • 09-01 12:33阿里云百炼 (Qwen)kimi-k2.7-code · 新模型 · 输入价 6.5 · 输出价 27
  • 09-01 12:33阿里云百炼 (Qwen)kimi-k3 · 新模型 · 输入价 20 · 输出价 100
  • 09-01 12:33阿里云百炼 (Qwen)deepseek-r1-distill-qwen-32b · 新模型 · 输入价 2 · 输出价 6
  • 09-01 12:33阿里云百炼 (Qwen)deepseek-r1-distill-qwen-14b · 新模型 · 输入价 1 · 输出价 3
  • 09-01 12:33阿里云百炼 (Qwen)deepseek-r1-distill-qwen-7b · 新模型 · 输入价 0.5 · 输出价 1
  • 09-01 12:33阿里云百炼 (Qwen)deepseek-r1-distill-qwen-1.5b · 新模型 · 输入价 0 · 输出价 0
  • 09-01 12:33阿里云百炼 (Qwen)deepseek-v3 · 新模型 · 输入价 2 · 输出价 8
  • 09-01 12:33阿里云百炼 (Qwen)deepseek-r1 · 新模型 · 输入价 4 · 输出价 16
  • 09-01 12:33阿里云百炼 (Qwen)deepseek-v3.1 · 新模型 · 输入价 4 · 输出价 12
  • 09-01 12:33阿里云百炼 (Qwen)deepseek-v3.2 · 新模型 · 输入价 2 · 输出价 3
  • 09-01 12:33阿里云百炼 (Qwen)deepseek-v4-flash · 新模型 · 输入价 1 · 输出价 2
  • 09-01 12:33阿里云百炼 (Qwen)deepseek-v4-flash-0731 · 新模型 · 输入价 1.5 · 输出价 4.5
  • 09-01 12:33阿里云百炼 (Qwen)deepseek-v4-pro-0813 · 新模型 · 输入价 4.5 · 输出价 13.5
  • 09-01 12:33阿里云百炼 (Qwen)deepseek-v4-pro · 新模型 · 输入价 12 · 输出价 24
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-coder-30b-a3b-instruct · 新模型 · 输入价 3.75 · 输出价 15
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-coder-480b-a35b-instruct · 新模型 · 输入价 15 · 输出价 60
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-coder-next · 新模型 · 输入价 2.5 · 输出价 10
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-8b · 新模型 · 输入价 0.5 · 输出价 5
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-14b · 新模型 · 输入价 1 · 输出价 10
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-30b-a3b · 新模型 · 输入价 0.75 · 输出价 7.5
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-32b · 新模型 · 输入价 2 · 输出价 20
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-235b-a22b · 新模型 · 输入价 2 · 输出价 20
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-30b-a3b-instruct-2507 · 新模型 · 输入价 0.75 · 输出价 3
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-30b-a3b-thinking-2507 · 新模型 · 输入价 0.75 · 输出价 7.5
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-235b-a22b-instruct-2507 · 新模型 · 输入价 2 · 输出价 8
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-235b-a22b-thinking-2507 · 新模型 · 输入价 2 · 输出价 20
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-next-80b-a3b-instruct · 新模型 · 输入价 1 · 输出价 4
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-next-80b-a3b-thinking · 新模型 · 输入价 1 · 输出价 10
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.5-35b-a3b · 新模型 · 输入价 1.6 · 输出价 12.8
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.5-27b · 新模型 · 输入价 1.8 · 输出价 14.4
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.5-122b-a10b · 新模型 · 输入价 2 · 输出价 16
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.5-397b-a17b · 新模型 · 输入价 3 · 输出价 18
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.6-27b · 新模型 · 输入价 3 · 输出价 18
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.6-35b-a3b · 新模型 · 输入价 1.8 · 输出价 10.8
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.8-27b · 新模型 · 输入价 3 · 输出价 12
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.8-2.4t-a95b · 新模型 · 输入价 12 · 输出价 36
  • 09-01 12:33阿里云百炼 (Qwen)tongyi-xiaomi-analysis-pro · 新模型 · 输入价 1 · 输出价 2.7
  • 09-01 12:33阿里云百炼 (Qwen)tongyi-xiaomi-analysis-flash · 新模型 · 输入价 0.2 · 输出价 0.4
  • 09-01 12:33阿里云百炼 (Qwen)qwen-coder-turbo · 新模型 · 输入价 2 · 输出价 6
  • 09-01 12:33阿里云百炼 (Qwen)qwen-coder-plus · 新模型 · 输入价 3.5 · 输出价 7
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-coder-flash · 新模型 · 输入价 5 · 输出价 25
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-coder-plus · 新模型 · 输入价 20 · 输出价 200
  • 09-01 12:33阿里云百炼 (Qwen)qwen-vl-ocr-latest · 新模型 · 输入价 0.3 · 输出价 0.5
  • 09-01 12:33阿里云百炼 (Qwen)qwen-vl-ocr · 备注 华北2(北京);OCR模型;当前能力等同于qwen-vl-ocr-2025-11-20华北2(北京);OCR模型
  • 09-01 12:33阿里云百炼 (Qwen)qwen-vl-plus · 备注 华北2(北京);视觉语言模型;无阶梯计价华北2(北京);多模态;无阶梯计价
  • 09-01 12:33阿里云百炼 (Qwen)qwen-vl-max · 备注 华北2(北京);视觉语言模型;无阶梯计价华北2(北京);多模态;无阶梯计价
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-vl-flash · 备注 华北2(北京);视觉语言模型;128K<Token≤256K;非思考和思考模式华北2(北京);多模态;128K<Token≤256K
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-vl-plus · 备注 华北2(北京);视觉语言模型;128K<Token≤256K;非思考和思考模式华北2(北京);多模态;128K<Token≤256K
  • 09-01 12:33阿里云百炼 (Qwen)qwen-turbo · 备注 华北2(北京);思考模式(思维链+回答)华北2(北京);思考模式
  • 09-01 12:33阿里云百炼 (Qwen)qwen-flash · 备注 华北2(北京);256K<Token≤1M;非思考和思考模式;当前能力等同于qwen-flash-2025-07-28华北2(北京);256K<Token≤1M
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.5-flash · 备注 华北2(北京);256K<Token≤1M;非思考和思考模式;当前能力等同于qwen3.5-flash-2026-02-23华北2(北京);256K<Token≤1M
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.6-flash · 备注 华北2(北京);256K<Token≤1M;非思考和思考模式;当前能力等同于qwen3.6-flash-2026-04-16华北2(北京);256K<Token≤1M
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.7-flash · 备注 华北2(北京);256K<Token≤1M;非思考和思考模式;当前能力等同于qwen3.7-flash-2026-07-15华北2(北京);256K<Token≤1M
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.8-flash · 备注 华北2(北京);0<Token≤1M;非思考和思考模式;支持Batch调用半价及上下文缓存折扣华北2(北京);0<Token≤1M
  • 09-01 12:33阿里云百炼 (Qwen)qwen-plus · 备注 华北2(北京);256K<Token≤1M;思考模式(思维链+回答);当前能力等同于qwen-plus-2025-12-01华北2(北京);256K<Token≤1M;思考模式
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.5-plus · 备注 华北2(北京);256K<Token≤1M;非思考和思考模式;当前能力等同于qwen3.5-plus-2026-02-15华北2(北京);256K<Token≤1M
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.6-plus · 备注 华北2(北京);256K<Token≤1M;非思考和思考模式;当前能力等同于qwen3.6-plus-2026-04-02华北2(北京);256K<Token≤1M
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.7-plus-2026-05-26 · 备注 华北2(北京);256K<Token≤1M;非思考和思考模式华北2(北京);256K<Token≤1M
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.7-plus · 备注 华北2(北京);256K<Token≤1M;非思考和思考模式;限时8折,原价输入6元/百万、输出24元/百万;当前能力等同于qwen3.7-plus-2026-华北2(北京);256K<Token≤1M;限时8折,输入原价6元/百万、输出原价24元/百万;非思考和思考输出同价
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-max-2025-09-23 · 新模型 · 输入价 15 · 输出价 60
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-max-2026-01-23 · 新模型 · 输入价 7 · 输出价 28
  • 09-01 12:33阿里云百炼 (Qwen)qwen3-max · 备注 华北2(北京);128K<Token≤256K;非思考和思考模式;当前能力等同于qwen3-max-2026-01-23华北2(北京);128K<Token≤256K
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.6-max-preview · 备注 华北2(北京);128K<Token≤256K;非思考和思考模式;支持上下文缓存折扣华北2(北京);128K<Token≤256K
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.7-max-preview · 备注 华北2(北京);0<Token≤1M;仅思考模式;当前能力等同于qwen3.7-max-2026-05-17华北2(北京);0<Token≤1M;仅思考模式
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.7-max-2026-05-20 · 备注 华北2(北京);0<Token≤1M;非思考和思考模式华北2(北京);0<Token≤1M
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.7-max-2026-06-08 · 备注 华北2(北京);0<Token≤1M;非思考和思考模式华北2(北京);0<Token≤1M
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.7-max · 备注 华北2(北京);0<Token≤1M;非思考和思考模式;限时5折,原价输入12元/百万、输出36元/百万;当前能力等同于qwen3.7-max-2026-05-华北2(北京);0<Token≤1M;限时5折,输入原价12元/百万、输出原价36元/百万
  • 09-01 12:33阿里云百炼 (Qwen)qwen3.8-max · 备注 华北2(北京);0<Token≤1M;非思考和思考模式;支持Batch调用半价及上下文缓存折扣华北2(北京);0<Token≤1M;非思考和思考模式;上下文缓存价格未在本页列出
  • 09-01 12:33Anthropic (Claude)Claude Haiku 4.5 · 备注 基础价格;Prompt cache reads 为基础输入价格的 10%;Batch API requests 享 50% 折扣
  • 09-01 12:33Anthropic (Claude)Claude Sonnet 5 · 备注 基础价格;Prompt cache reads 为基础输入价格的 10%;Batch API requests 享 50% 折扣
  • 09-01 12:33Anthropic (Claude)Claude Opus 5 · 备注 基础价格;Prompt cache reads 为基础输入价格的 10%;Batch API requests 享 50% 折扣
  • 09-01 12:33Anthropic (Claude)Claude Fable 5 · 备注 基础价格;Prompt cache reads 为基础输入价格的 10%;Batch API requests 享 50% 折扣
  • 08-31 15:10DeepSeekdeepseek-v4-flash-vision-exp · 新模型 · 输入价 3 · 输出价 9
  • 08-31 15:10火山方舟 (豆包)doubao-seed-2.1-turbo · 新模型 · 输入价 3 · 输出价 15
  • 08-31 15:10火山方舟 (豆包)doubao-seed-2.1-pro · 新模型 · 输入价 6 · 输出价 30
  • 08-31 15:10火山方舟 (豆包)deepseek-v4-pro · 输入价 4.59 ▲100.0%;输出价 13.527 ▲100.0%

04 / NOTICES

官方公告雷达

来自各厂商官网公告 / changelog 页面
每小时抓取新条目

Anthropic (Claude)公告页 ↗

OpenAI公告页 ↗

Google Gemini公告页 ↗

  • 2026 年 7 月 21 日Gemini 3.6 Flash 和 Gemini 3.5 Flash-Lite 正式发布 (GA)

    两款3.x Flash稳定版发布,分别侧重高效推理与低成本自动化。

  • 2026 年 7 月 21 日已弃用的参数

    抽样参数 temperature、top_p 和 top_k 现已弃用。

  • 2026 年 7 月 6 日为 Interactions API 提供开发者日志支持

    AI Studio 信息中心现可查看受支持的 Interactions API 调用日志。

  • 2026 年 6 月 30 日Gemini Omni Flash 公开预览版

    推出多模态视频模型,可生成并以对话方式编辑720p短视频。

  • 2026 年 6 月 30 日发布了 gemini-3.1-flash-lite-image (Nano Banana 2 Lite)

    低延迟、低成本的图片生成与编辑模型正式发布。

  • 2026 年 6 月 24 日电脑使用

    Gemini 3.5 Flash 公开预览电脑使用工具及增强安全能力。

Mistral公告页 ↗

  • August 11, 2026In-region inference, open models, and new European infrastructure for sovereign AI.

    整合区域内推理、开放模型与欧洲基础设施,推进主权AI。

  • August 20, 2026Agentic Search. More accurate and efficient results from your AI systems.

    推出智能体搜索检索层,提升复杂文档信息读取与验证效率。

  • August 4, 2026Introducing Shieldstral.

    发布Shieldstral产品。

  • July 9, 2026Your Prompts and Skills need a system of record.

    Studio为提示词和技能提供版本化、可追溯的记录系统。

  • July 8, 2026Introducing Robostral Navigate

    推出首个面向具身导航的Robostral Navigate模型。

  • July 2, 2026Leanstral 1.5: Proof Abundance for All

    发布Leanstral 1.5。

DeepSeek公告页 ↗

  • 2026-08-21DeepSeek-V4-Flash-Vision-Exp 发布

    实验性多模态视觉模型上线 API,视觉 Agent 能力大幅提升。

  • 2026-08-13DeepSeek-V4-Pro 更新

    V4-Pro 正式上线,增强 Agent、支持 Responses API 并调整定价。

  • 2026-07-31DeepSeek-V4-Flash 更新

    V4-Flash 正式版 API 公测,增强 Agent 并支持 Responses API。

  • 2026-04-24DeepSeek-V4

    API 新增 V4-Pro 与 V4-Flash,旧模型名将于三个月后停用。

  • 2025-12-01DeepSeek-V3.2

    聊天与推理模型升级至 V3.2,并限时提供 V3.2-Speciale。

  • 2025-09-29DeepSeek-V3.2-Exp

    聊天与推理接口均升级为 DeepSeek-V3.2-Exp。

阿里云百炼 (Qwen)公告页 ↗

智谱 (GLM)公告页 ↗

  • 2026-08-26GLM-5.3-Flash 原生多模态模型上线

    原生视觉模型,采用高效混合架构,强化代码、浏览器及办公工作流。

  • 2026-8-19GLM-5.3 新一代旗舰模型上线

    新旗舰模型显著提升编程与网络安全能力,达到开源模型先进水平。

  • 2026-06-16GLM-5.2 新一代旗舰模型上线

    支持百万无损上下文,增强复杂工程、长程任务与多端开发能力。

  • 2026-05-29GLM Coding Plan 团队版上线

    面向企业团队提供席位、权限、预算、账单和数据安全统一管理。

  • 2026-04-07GLM-5.1 新一代旗舰模型上线

    增强编程和长程任务能力,可持续工作八小时并完成复杂任务闭环。

  • 2026-04-02GLM-5V-Turbo 多模态 Coding 基座模型上线

    增强视觉理解、空间推理及多模态工具调用,优化GUI与编程智能体。

月之暗面 (Kimi)公告页 ↗

  • 2025-03-03Muon 优化器的首次大规模训练实践

    月之暗面发布Moonlight模型及高效分布式Muon实现,验证其大规模训练效率。

MiniMax公告页 ↗

  • 2026 年 7 月 31 日MiniMax H3

    新一代开放通用多模态视频模型,支持文本、图像、视频与声音统一理解和生成。

  • 2026 年 7 月 16 日Music-3.0

    发布全新音乐生成能力。

  • 2026 年 6 月 1 日MiniMax M3

    发布面向Agent推理、工具调用、代码和长上下文任务的全新语言模型。

  • 2026 年 4 月Music-2.6

    发布Music-2.6音乐模型,强化翻唱和器乐表现。

  • 2026 年 3 月 18 日MiniMax M2.7

    发布MiniMax-M2.7及高速系列,开启模型自我迭代。

  • 2026 年 3 月Music-2.5+

    发布最新音乐模型,支持纯音乐创作并突破风格边界。