上一篇按 Agent 场景把花费折算完了,这篇看「裸价」:官方刊例的输入单价、输出单价、缓存命中单价,三个榜全部从高到低排,共 109 款全量(缓存榜 70 款,只含有缓存报价的模型)。单价榜不掺任何模拟,就是官网标价,方便你按自己的真实用量去套。
价格为 2026 年 8 月官网刊例(元/百万 tokens),阶梯/分段计费取基础档,峰谷计价分别列出。
输入单价榜(节选 Top 20)
输入单价直接决定 Agent 的成本大头。破 10 元的几乎都和语音/多模态有关:
| # | 模型(厂商) | 输入 | 输出 | 缓存 |
|---|---|---|---|---|
| 1 | Baichuan4(2024 定价)(百川) | ¥100 | 100 | — |
| 2 | tencent-yuanqi(腾讯) | ¥100 | 100 | — |
| 3 | step-1o-audio(语音)(阶跃) | ¥25 | 60 | 5 |
| 4 | qwen3.8-max-prime(阿里) | ¥24 | 72 | 2.4 |
| 5 | Baichuan3-Turbo-128k(百川) | ¥24 | 24 | — |
| 6 | Baichuan2-53B 峰时(百川) | ¥20 | 20 | — |
| 7 | kimi-k3(Moonshot) | ¥20 | 100 | 2 |
| 8 | Baichuan4-Turbo(百川) | ¥15 | 15 | — |
| 9 | kimi-k2.7-code 高速版(Moonshot) | ¥13 | 54 | 2.6 |
| 10 | qwen3.8-max(阿里) | ¥12 | 36 | 1.2 |
| 11 | Baichuan3-Turbo(百川) | ¥12 | 12 | — |
| 12 | Baichuan-M3 / M2-Plus(百川) | ¥10 | 30 | — |
| 13 | stepaudio 2.5 / 2 系列(语音)(阶跃) | ¥10 | 25~105 | 2 |
| 14 | GLM-4-AirX(智谱) | ¥10 | 10 | — |
| 15 | deepseek-v4-pro-peak(DeepSeek) | ¥9 | 27 | 0.3 |
| 16 | GLM-5.3 / GLM-5.2(智谱) | ¥8 | 28 | 2 |
| 17 | Baichuan2-Turbo(百川) | ¥8 | 8 | — |
| 18 | kimi-k2.7-code(Moonshot) | ¥6.5 | 27 | 1.3 |
| 19 | doubao-seed-2.1-pro 基础档(字节) | ¥6 | 30 | 1.2 |
| 20 | qwen3.7-max 5 折(阿里) | ¥6 | 18 | 0.6 |
输出单价榜(节选 Top 15)
输出贵的全是"长输出"型选手:语音转录、代码模型、旗舰推理。
| # | 模型(厂商) | 输出 |
|---|---|---|
| 1 | Baichuan4 / tencent-yuanqi(2024 定价/平台价) | ¥100 |
| 2 | kimi-k3(Moonshot) | ¥100 |
| 3 | step-audio-r1.5(语音)(阶跃) | ¥105 |
| 4 | step-1o-audio(语音)(阶跃) | ¥60 |
| 5 | qwen3.8-max-prime(阿里) | ¥72 |
| 6 | kimi-k2.7-code 高速版(Moonshot) | ¥54 |
| 7 | Baichuan-M3 / M2-Plus(百川) | ¥30 |
| 8 | doubao-seed-2.1-pro / evolving(字节) | ¥30 |
| 9 | qwen3.8-max(阿里) | ¥36 |
| 10 | kimi-k2.7-code / k2.6(Moonshot) | ¥27 |
| 11 | deepseek-v4-pro-peak(DeepSeek) | ¥27 |
| 12 | GLM-5.3 / GLM-5.2(智谱) | ¥28 |
| 13 | Baichuan2-53B 峰时(百川) | ¥20 |
| 14 | minimax-m3-priority-gt512k 5 折(MiniMax) | ¥25.2 |
| 15 | stepaudio 系列(语音)(阶跃) | ¥70 |
缓存命中价榜(70 款有缓存报价,节选 Top 15)
缓存命中价是 Agent 场景的命门——它和输入原价的比值决定了重复上下文能省多少:
| # | 模型(厂商) | 缓存命中 | 占输入原价 |
|---|---|---|---|
| 1 | step-1o-audio(语音)(阶跃) | ¥5 | 20% |
| 2 | qwen3.8-max-prime(阿里) | ¥2.4 | 10% |
| 3 | kimi-k2.7-code 高速版(Moonshot) | ¥2.6 | 20% |
| 4 | kimi-k3(Moonshot) | ¥2 | 10% |
| 5 | stepaudio 系列(语音)(阶跃) | ¥2 | 20% |
| 6 | GLM-5.3 / GLM-5.2(智谱) | ¥2 | 25% |
| 7 | GLM-5.1(智谱) | ¥1.3 | 22% |
| 8 | kimi-k2.7-code(Moonshot) | ¥1.3 | 20% |
| 9 | qwen3.8-max(阿里) | ¥1.2 | 10% |
| 10 | doubao-seed-2.1-pro(字节) | ¥1.2 | 20% |
| 11 | kimi-k2.6(Moonshot) | ¥1.1 | 17% |
| 12 | GLM-5V-Turbo / GLM-5-Turbo(智谱) | ¥1.2 | 24% |
| 13 | GLM-5(智谱) | ¥1 | 25% |
| 14 | deepseek-v4-pro-peak(DeepSeek) | ¥0.3 | 3.3% |
| 15 | hy4-preview(腾讯) | ¥0.3 | 5% |
注意 DeepSeek 和小米 MiMo 这两个异类:缓存命中价只有原价的 1~3%(deepseek 0.3/9、mimo 0.025/3),重上下文场景下成本优势是数量级的。
三榜完整长图
输入单价榜(1/6~3/6 节选头部)



输出单价榜(节选头部)


缓存命中单价榜(节选头部)


怎么用这三张表
- 按自己的用量套:你的场景输入输出比是多少、有没有重复前缀,直接拿裸价乘就行,比看任何模拟榜都准
- Agent 选型先看缓存比:缓存命中价 ÷ 输入价越小,长上下文 Agent 越省钱
- 峰谷价能薅:DeepSeek 谷时(offpeak)输入只有峰时一半,跑批量任务把时间挪到谷时就是半价
同系列:第 1 篇 Agent 场景算账总榜 · 第 3 篇厂商内部分榜