<!-- Lazu · 大模型 API 价格对比：Claude、GPT、Gemini、DeepSeek 怎么选 · https://lazu.ai/zh/blog/llm-api-price-comparison -->

# 大模型 API 价格对比：Claude、GPT、Gemini、DeepSeek 怎么选

2026-09-30 · Lazu 团队

先说结论：选模型先看任务，再看价格。难题和长链路 Agent 用 Claude Opus 或 GPT-6 Sol；日常写代码、写文档用 Claude Sonnet；量大、对延迟敏感的用 Gemini Flash 或 DeepSeek。下面每张价格表都直接读取 Lazu 的线上目录，价格一变这里就跟着变，不用担心是旧数据。

## 怎么看下面的价格表

- 价格单位是**美元 / 每百万 token**，输入和输出分开计。
- 第一行是模型厂商的**官方价**，下面是 Lazu 的**稳定线路**（走官方 API）和**优惠线路**（如果有）。
- 优惠线路是逆向渠道，不是官方 API，只建议在对应的 Agent 工具里用：Claude 配 Claude Code，GPT 配 Codex，Gemini 配 Antigravity。自己写的程序请看稳定线路的价格。

## 旗舰：处理难题和长任务


### [claude-opus-5-5](https://lazu.ai/zh/models/anthropic/claude-opus-5-5)

美元 / 百万 token

| 线路 | 输入 | 输出 | 缓存读 | 缓存写 5m |
| --- | --- | --- | --- | --- |
| Anthropic 官方价 | $4.00 | $20.00 | $0.20 | $5.00 |
| Lazu 稳定 · 同官方 | $4.00 | $20.00 | $0.20 | $5.00 |
| Lazu 优惠 · −57% | $1.72 | $8.60 | $0.086 | $2.15 |

— 表示未记录该项价格，不代表免费；实际费用以请求回执为准。


### [gpt-6-sol](https://lazu.ai/zh/models/openai/gpt-6-sol)

美元 / 百万 token

| 线路 | 输入 | 输出 | 缓存读 | 缓存写 5m |
| --- | --- | --- | --- | --- |
| OpenAI 官方价 | $2.00 | $10.00 | $0.20 | $2.50 |
| 输入超过 272k | $4.00 | $15.00 | $0.40 | $5.00 |
| Lazu 稳定 · 同官方 | $2.00 | $10.00 | $0.20 | $2.50 |
| Lazu 优惠 · −82% | $0.36 | $1.80 | $0.036 | $0.45 |

输入（含缓存）超过阈值的请求，整单按长上下文价计费。

— 表示未记录该项价格，不代表免费；实际费用以请求回执为准。

旗舰模型贵在输出。Agent 场景一次任务动辄几十万 token，其中大部分是重复发送的上下文，所以要把**缓存读取价**一起算进去：缓存命中的输入通常只收原价的一小部分。

## 主力：日常写代码和文档


### [claude-sonnet-5-5](https://lazu.ai/zh/models/anthropic/claude-sonnet-5-5)

美元 / 百万 token

| 线路 | 输入 | 输出 | 缓存读 | 缓存写 5m |
| --- | --- | --- | --- | --- |
| Anthropic 官方价 | $2.00 | $10.00 | $0.20 | $2.50 |
| Lazu 稳定 · 同官方 | $2.00 | $10.00 | $0.20 | $2.50 |
| Lazu 优惠 · −57% | $0.86 | $4.30 | $0.086 | $1.07 |

— 表示未记录该项价格，不代表免费；实际费用以请求回执为准。

### [claude-opus-5-5](https://lazu.ai/zh/models/anthropic/claude-opus-5-5)

美元 / 百万 token

| 线路 | 输入 | 输出 | 缓存读 | 缓存写 5m |
| --- | --- | --- | --- | --- |
| Anthropic 官方价 | $4.00 | $20.00 | $0.20 | $5.00 |
| Lazu 稳定 · 同官方 | $4.00 | $20.00 | $0.20 | $5.00 |
| Lazu 优惠 · −57% | $1.72 | $8.60 | $0.086 | $2.15 |

— 表示未记录该项价格，不代表免费；实际费用以请求回执为准。

很多日常编码任务用 Sonnet 就够了，价格比 Opus 低不少。上表同时列出了 Opus，方便直接对比。

## 高性价比：量大、要快


### [gemini-3.8-flash](https://lazu.ai/zh/models/google/gemini-3.8-flash)

美元 / 百万 token

| 线路 | 输入 | 输出 | 缓存读 | 缓存写 5m |
| --- | --- | --- | --- | --- |
| Google 官方价 | $0.75 | $3.75 | $0.075 | — |
| Lazu 稳定 · 同官方 | $0.75 | $3.75 | $0.075 | — |
| Lazu 优惠 · −75% | $0.1875 | $0.9375 | $0.01875 | — |

— 表示未记录该项价格，不代表免费；实际费用以请求回执为准。


### [deepseek-v4-pro](https://lazu.ai/zh/models/deepseek/deepseek-v4-pro)

美元 / 百万 token

| 线路 | 输入 | 输出 | 缓存读 | 缓存写 5m |
| --- | --- | --- | --- | --- |
| DeepSeek 官方价 | $0.66 | $1.98 | $0.00363 | — |
| Lazu 稳定 | $0.825 | $2.48 | $0.0275 | — |

— 表示未记录该项价格，不代表免费；实际费用以请求回执为准。


### [deepseek-v4-flash](https://lazu.ai/zh/models/deepseek/deepseek-v4-flash)

美元 / 百万 token

| 线路 | 输入 | 输出 | 缓存读 | 缓存写 5m |
| --- | --- | --- | --- | --- |
| DeepSeek 官方价 | $0.15 | $0.60 | $0.003 | — |
| Lazu 稳定 | $0.1875 | $0.75 | $0.00375 | — |

— 表示未记录该项价格，不代表免费；实际费用以请求回执为准。

DeepSeek 有分时价格：高峰时段价格翻倍，模型页上会标出具体时段。批量任务尽量放到非高峰时段跑。

## 算一笔账

假设每天 2000 次请求，每次输入 3000 token、输出 500 token：

- 每天输入 600 万 token，输出 100 万 token；
- 每天费用 = 6 × 输入单价 + 1 × 输出单价；
- 把上面表格里的单价代进去，就能得到每个模型的日成本。输出单价往往是输入的 4–8 倍，所以输出长的任务差距会被放大。

## 省钱的几个办法

1. **开缓存**：系统提示和长文档放在前面、保持不变，命中缓存的部分按缓存价计费。
2. **按任务分模型**：同一个 Key 可以调所有模型，简单的分类、摘要交给 Flash 级模型。
3. **Agent 工具走优惠线路**：在 Claude Code、Codex 里可以把对应模型切到优惠线路，自己的程序继续用稳定线路。
4. **看账单调**：控制台「用量与日志」按模型拆开了费用，先找出最贵的那一类请求再优化。

完整的模型和价格见 [模型目录](/zh/models)，价格实时更新。

