DeepSeek V4 Flash
DeepSeek V4 Flash 是一款效率優化的混合專家(MoE)模型,拥有 284B 總參數和 13B 激活參數,支援 1M token 上下文窗口。它專為快速推理和高吞吐量應用設計,非常適合聊天、摘要和通用任務場景。
快速參考
| 屬性 | 值 |
|---|
| 模型 ID | deepseek/deepseek-v4-flash |
| 上下文窗口 | 1,000,000 tokens |
| 最大輸出 | 8,192 tokens |
| 訓練數據截止 | 2024 |
| 流式 | ✓ |
| 函數調用 | ✓ |
| 結構化輸出 | ✓ |
| 批量 API | ✓ |
定價
| 類型 | 價格 |
|---|
| 輸入 | $0.27 / 1M tokens / 1M tokens |
| 輸出 | $0.67 / 1M tokens / 1M tokens |
何時選擇 Flash 或 Pro
| 場景 | 推薦 |
|---|
| 高 QPS 聊天機器人 | Flash |
| 復雜程式碼生成 | Pro |
| 批量分類 / 打标 | Flash |
| 數學證明驗證 | Pro |
| 實時對話 | Flash |
| 多步推理 | Pro |
示例
from openai import OpenAI
client = OpenAI(
base_url="https://api.linkastra.ai/v1",
api_key="YOUR_API_KEY"
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-flash",
messages=[
{"role": "user", "content": "Summarize this article in 3 bullet points: ..."}
],
temperature=0.5
)
print(response.choices[0].message.content)
相關文件