DeepSeek · Released 2026-09-10

DeepSeek Flash

可用
deepseek-flash

在 Lazu 上调用 deepseek-flash:$0.1875 / 百万输入 token、$0.75 / 百万输出 token。1M 上下文,最长输出 384k,支持工具调用、图像理解、推理、结构化输出。

DeepSeek V4.1 Flash,支持原生图像理解、推理、工具调用与上下文缓存。

获取 API Key
复制页面
Context1M
Max output384k
Knowledge cutoff2025-05
Input文本 · 图像
Output文本
Endpoints/v1/chat/completions · /v1/responses

价格与线路

单位:美元 / 百万 token。可用率为近 7 天,每格 2 小时。

线路 输入输出缓存读缓存写 5m 7 天可用率
DeepSeek 官方价 $0.15 $0.60$0.003— —
稳定 $0.1875 $0.75$0.00375— 99.0%

价格读取于 2026-10-03 16:49 UTC · 怎么选线路 · deepseek-flash.json · deepseek-flash.md

能力

工具调用图像理解推理结构化输出提示缓存
思考深度
low · high · max

调用示例

POST /v1/chat/completions
curl -X POST https://api.lazu.ai/v1/chat/completions \
  -H "Authorization: Bearer $LAZU_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek-flash",
    "messages": [{ "role": "user", "content": "Hello from Lazu" }]
  }'

也可以用 OpenAI SDK 调用:把 base_url 换成 https://api.lazu.ai/v1。 完整接入文档

常见问题

稳定线路和优惠线路有什么区别?

稳定线路走各家官方 API,按标价计费,可用率最高,适合所有场景。优惠线路是逆向渠道:由第三方供应商通过官方客户端接入,不是官方 API。价格低很多,但可用率会有波动,失败时不会自动切到稳定线路,上游也可能附带自己的系统提示,所以只建议在对应的 Agent 工具里使用:Claude 模型配 Claude Code,GPT 模型配 Codex,Gemini 模型配 Antigravity。自己写的程序或需要精确控制输出的场景,请用稳定线路。两条线路用同一个 Key,可以在每把 Key 上按模型选线路。

用 OpenAI 的 SDK 能调用 deepseek-flash 吗?

可以。把 SDK 的 base URL 设为 https://api.lazu.ai/v1,模型名填 deepseek-flash。

怎么计费?

按实际用掉的输入、输出和缓存 token 计费,从钱包余额里扣,没有月费。每次请求都能在用量页看到明细。

同系列模型

拿一个 Key,现在就调用

免费开始 读文档