DeepSeek · Released 2026-09-10
deepseek-flash
在 Lazu 上调用 deepseek-flash:$0.1875 / 百万输入 token、$0.75 / 百万输出 token。1M 上下文,最长输出 384k,支持工具调用、图像理解、推理、结构化输出。
DeepSeek V4.1 Flash,支持原生图像理解、推理、工具调用与上下文缓存。
Context1M
Max output384k
Knowledge cutoff2025-05
Input文本 · 图像
Output文本
Endpoints/v1/chat/completions · /v1/responses
价格与线路
单位:美元 / 百万 token。可用率为近 7 天,每格 2 小时。
线路
输入输出缓存读缓存写 5m
7 天可用率
DeepSeek 官方价
$0.15
$0.60$0.003—
—
稳定
$0.1875
$0.75$0.00375—
99.0%
价格读取于 2026-10-03 16:49 UTC · 怎么选线路 · deepseek-flash.json · deepseek-flash.md
能力
工具调用图像理解推理结构化输出提示缓存
- 思考深度
- low · high · max
调用示例
curl -X POST https://api.lazu.ai/v1/chat/completions \
-H "Authorization: Bearer $LAZU_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek-flash",
"messages": [{ "role": "user", "content": "Hello from Lazu" }]
}'
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.lazu.ai/v1",
api_key=os.getenv("LAZU_API_KEY"),
)
resp = client.chat.completions.create(
model="deepseek-flash",
messages=[{"role": "user", "content": "Hello from Lazu"}],
)
print(resp.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.lazu.ai/v1",
apiKey: process.env.LAZU_API_KEY,
});
const resp = await client.chat.completions.create({
model: "deepseek-flash",
messages: [{ role: "user", content: "Hello from Lazu" }],
});
console.log(resp.choices[0].message.content);
也可以用 OpenAI SDK 调用:把 base_url 换成 https://api.lazu.ai/v1。 完整接入文档
常见问题
稳定线路和优惠线路有什么区别?
稳定线路走各家官方 API,按标价计费,可用率最高,适合所有场景。优惠线路是逆向渠道:由第三方供应商通过官方客户端接入,不是官方 API。价格低很多,但可用率会有波动,失败时不会自动切到稳定线路,上游也可能附带自己的系统提示,所以只建议在对应的 Agent 工具里使用:Claude 模型配 Claude Code,GPT 模型配 Codex,Gemini 模型配 Antigravity。自己写的程序或需要精确控制输出的场景,请用稳定线路。两条线路用同一个 Key,可以在每把 Key 上按模型选线路。
用 OpenAI 的 SDK 能调用 deepseek-flash 吗?
可以。把 SDK 的 base URL 设为 https://api.lazu.ai/v1,模型名填 deepseek-flash。
怎么计费?
按实际用掉的输入、输出和缓存 token 计费,从钱包余额里扣,没有月费。每次请求都能在用量页看到明细。