Qwen · Released 2026-08-26
qwen3.8-flash
在 Lazu 上呼叫 qwen3.8-flash:$0.15 / 百萬輸入 token、$0.47 / 百萬輸出 token,與 Qwen 官方價相同。1M 上下文,最長輸出 131k,支援工具呼叫、圖像理解、推理、結構化輸出。
Qwen 3.8,经 APIMart 接入。
Context1M
Max output131k
Input文字 · 圖像 · 影片
Output文字
Endpoints/v1/chat/completions · /v1/responses
價格與線路
單位:美元 / 百萬 token。可用率為近 7 天,每格 2 小時。
線路
輸入輸出快取讀快取寫 5m
7 天可用率
Qwen 官方價
$0.15
$0.47$0.016$0.20
—
穩定 同官方
$0.15
$0.47$0.016$0.20
59.1%
價格讀取於 2026-10-03 16:51 UTC · 怎麼選線路 · qwen3.8-flash.json · qwen3.8-flash.md
能力
工具呼叫圖像理解推理結構化輸出提示快取
- 思考深度
- low · medium · xhigh
呼叫範例
curl -X POST https://api.lazu.ai/v1/chat/completions \
-H "Authorization: Bearer $LAZU_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "qwen3.8-flash",
"messages": [{ "role": "user", "content": "Hello from Lazu" }]
}'
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.lazu.ai/v1",
api_key=os.getenv("LAZU_API_KEY"),
)
resp = client.chat.completions.create(
model="qwen3.8-flash",
messages=[{"role": "user", "content": "Hello from Lazu"}],
)
print(resp.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.lazu.ai/v1",
apiKey: process.env.LAZU_API_KEY,
});
const resp = await client.chat.completions.create({
model: "qwen3.8-flash",
messages: [{ role: "user", content: "Hello from Lazu" }],
});
console.log(resp.choices[0].message.content);
也可以用 OpenAI SDK 呼叫:把 base_url 換成 https://api.lazu.ai/v1。 完整接入文件
常見問題
穩定線路和優惠線路有什麼差別?
穩定線路走各家官方 API,按標價計費,可用率最高,適合所有場景。優惠線路是逆向渠道:由第三方供應商透過官方客戶端接入,不是官方 API。價格低很多,但可用率會有波動,失敗時不會自動切到穩定線路,上游也可能附帶自己的系統提示,所以只建議在對應的 Agent 工具裡使用:Claude 模型搭配 Claude Code,GPT 模型搭配 Codex,Gemini 模型搭配 Antigravity。自己寫的程式或需要精確控制輸出的場景,請用穩定線路。兩條線路用同一把 Key,可以在每把 Key 上按模型選線路。
用 OpenAI 的 SDK 能呼叫 qwen3.8-flash 嗎?
可以。把 SDK 的 base URL 設為 https://api.lazu.ai/v1,模型名填 qwen3.8-flash。
怎麼計費?
按實際用掉的輸入、輸出和快取 token 計費,從錢包餘額扣除,沒有月費。每次請求都能在用量頁看到明細。