DeepSeek V4 Flash

DeepSeek V4 Flash 是一款效率優化的混合專家(MoE)模型,拥有 284B 總參數和 13B 激活參數,支援 1M token 上下文窗口。它專為快速推理和高吞吐量應用設計,非常適合聊天、摘要和通用任務場景。

快速參考

屬性
模型 IDdeepseek/deepseek-v4-flash
上下文窗口1,000,000 tokens
最大輸出8,192 tokens
訓練數據截止2024
流式
函數調用
結構化輸出
批量 API

定價

類型價格
輸入$0.27 / 1M tokens / 1M tokens
輸出$0.67 / 1M tokens / 1M tokens

何時選擇 Flash 或 Pro

場景推薦
高 QPS 聊天機器人Flash
復雜程式碼生成Pro
批量分類 / 打标Flash
數學證明驗證Pro
實時對話Flash
多步推理Pro

示例

from openai import OpenAI

client = OpenAI(
    base_url="https://api.linkastra.ai/v1",
    api_key="YOUR_API_KEY"
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash",
    messages=[
        {"role": "user", "content": "Summarize this article in 3 bullet points: ..."}
    ],
    temperature=0.5
)

print(response.choices[0].message.content)

相關文件