大模型 API 价格对比:Claude、GPT、Gemini、DeepSeek 怎么选

Compare 大模型 API 价格对比 claude-opus-5-5gpt-6-sol Lazu

先说结论:选模型先看任务,再看价格。难题和长链路 Agent 用 Claude Opus 或 GPT-6 Sol;日常写代码、写文档用 Claude Sonnet;量大、对延迟敏感的用 Gemini Flash 或 DeepSeek。下面每张价格表都直接读取 Lazu 的线上目录,价格一变这里就跟着变,不用担心是旧数据。

怎么看下面的价格表

  • 价格单位是美元 / 每百万 token,输入和输出分开计。
  • 第一行是模型厂商的官方价,下面是 Lazu 的稳定线路(走官方 API)和优惠线路(如果有)。
  • 优惠线路是逆向渠道,不是官方 API,只建议在对应的 Agent 工具里用:Claude 配 Claude Code,GPT 配 Codex,Gemini 配 Antigravity。自己写的程序请看稳定线路的价格。

旗舰:处理难题和长任务

claude-opus-5-5Anthropic · 1M · 稳定 $4.00 / $20.00 · 优惠 $1.72 / $8.60查看模型页 →

美元 / 百万 token

线路输入输出缓存读缓存写 5m
Anthropic 官方价$4.00$20.00$0.20$5.00
Lazu 稳定 · 同官方$4.00$20.00$0.20$5.00
Lazu 优惠 · −57%$1.72$8.60$0.086$2.15

— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。

gpt-6-solOpenAI · 1.05M · 稳定 $2.00 / $10.00 · 优惠 $0.36 / $1.80查看模型页 →

美元 / 百万 token

线路输入输出缓存读缓存写 5m
OpenAI 官方价$2.00$10.00$0.20$2.50
输入超过 272k$4.00$15.00$0.40$5.00
Lazu 稳定 · 同官方$2.00$10.00$0.20$2.50
Lazu 优惠 · −82%$0.36$1.80$0.036$0.45

输入(含缓存)超过阈值的请求,整单按长上下文价计费。

— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。

旗舰模型贵在输出。Agent 场景一次任务动辄几十万 token,其中大部分是重复发送的上下文,所以要把缓存读取价一起算进去:缓存命中的输入通常只收原价的一小部分。

主力:日常写代码和文档

claude-sonnet-5-5Anthropic · 1M · 稳定 $2.00 / $10.00 · 优惠 $0.86 / $4.30查看模型页 →

美元 / 百万 token

线路输入输出缓存读缓存写 5m
Anthropic 官方价$2.00$10.00$0.20$2.50
Lazu 稳定 · 同官方$2.00$10.00$0.20$2.50
Lazu 优惠 · −57%$0.86$4.30$0.086$1.07

— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。

claude-opus-5-5(上一代)

claude-opus-5-5Anthropic · 1M · 稳定 $4.00 / $20.00 · 优惠 $1.72 / $8.60查看模型页 →

美元 / 百万 token

线路输入输出缓存读缓存写 5m
Anthropic 官方价$4.00$20.00$0.20$5.00
Lazu 稳定 · 同官方$4.00$20.00$0.20$5.00
Lazu 优惠 · −57%$1.72$8.60$0.086$2.15

— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。

很多日常编码任务用 Sonnet 就够了,价格比 Opus 低不少。上表同时列出了 Opus,方便直接对比。

高性价比:量大、要快

gemini-3.8-flashGoogle · 1M · 稳定 $0.75 / $3.75 · 优惠 $0.1875 / $0.9375查看模型页 →

美元 / 百万 token

线路输入输出缓存读缓存写 5m
Google 官方价$0.75$3.75$0.075—
Lazu 稳定 · 同官方$0.75$3.75$0.075—
Lazu 优惠 · −75%$0.1875$0.9375$0.01875—

— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。

deepseek-v4-proDeepSeek · 1M · 稳定 $0.825 / $2.48查看模型页 →

美元 / 百万 token

线路输入输出缓存读缓存写 5m
DeepSeek 官方价$0.66$1.98$0.00363—
Lazu 稳定$0.825$2.48$0.0275—

— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。

deepseek-v4-flashDeepSeek · 1M · 稳定 $0.1875 / $0.75查看模型页 →

美元 / 百万 token

线路输入输出缓存读缓存写 5m
DeepSeek 官方价$0.15$0.60$0.003—
Lazu 稳定$0.1875$0.75$0.00375—

— 表示未记录该项价格,不代表免费;实际费用以请求回执为准。

DeepSeek 有分时价格:高峰时段价格翻倍,模型页上会标出具体时段。批量任务尽量放到非高峰时段跑。

算一笔账

假设每天 2000 次请求,每次输入 3000 token、输出 500 token:

  • 每天输入 600 万 token,输出 100 万 token;
  • 每天费用 = 6 × 输入单价 + 1 × 输出单价;
  • 把上面表格里的单价代进去,就能得到每个模型的日成本。输出单价往往是输入的 4–8 倍,所以输出长的任务差距会被放大。

省钱的几个办法

  1. 开缓存:系统提示和长文档放在前面、保持不变,命中缓存的部分按缓存价计费。
  2. 按任务分模型:同一个 Key 可以调所有模型,简单的分类、摘要交给 Flash 级模型。
  3. Agent 工具走优惠线路:在 Claude Code、Codex 里可以把对应模型切到优惠线路,自己的程序继续用稳定线路。
  4. 看账单调:控制台「用量与日志」按模型拆开了费用,先找出最贵的那一类请求再优化。

完整的模型和价格见 模型目录,价格实时更新。

相关文章
2026-10-01便宜的 Claude API 为什么一句 hi 算 6477 token?逆向和官方 API 的区别

拿一个 Key 试试

免费开始