微調

微調允许您使用自己的訓練數據定制基礎模型,無需從零構建模型即可提升在領域特定任務上的性能。

支援的基礎模型

基礎模型微調支援
deepseek/deepseek-v4-flash
glm-5.1
astra✓(領域特定)

工作原理

  1. 準備數據 — 以 JSONL 格式上傳訓練數據
  2. 創建任務 — 使用您的參數提交微調任務
  3. 監控 — 跟蹤訓練进度和指标
  4. 部署 — 您的微調模型获得唯一的模型 ID
  5. 調用 — 通過相同的 API 調用您的模型

訓練數據格式

{"messages": [{"role": "system", "content": "You are a customer service assistant."}, {"role": "user", "content": "How do I reset my password?"}, {"role": "assistant", "content": "To reset your password, go to Settings > Security > Reset Password."}]}
{"messages": [{"role": "system", "content": "You are a customer service assistant."}, {"role": "user", "content": "What are your business hours?"}, {"role": "assistant", "content": "Our business hours are Monday to Friday, 9 AM to 6 PM."}]}

創建微調任務

curl https://api.linkastra.ai/v1/fine_tuning/jobs \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek/deepseek-v4-flash",
    "training_file": "file-abc123",
    "hyperparameters": {
      "n_epochs": 3,
      "learning_rate_multiplier": 0.1
    },
    "suffix": "my-model"
  }'

使用您的微調模型

訓練完成後,使用微調模型的 ID:

response = client.chat.completions.create(
    model="deepseek-v4-flash:ft-my-model:abc123",
    messages=[{"role": "user", "content": "How do I reset my password?"}]
)

定價

項目價格
訓練$1.40 / 1M tokens
推理(微調後)基礎模型價格 × 1.5
存储$7 / 模型 / 月

最佳實踐

  • 從 50-100 条高質量样本開始
  • 確保訓練數據在格式和質量上保持一致
  • 以 3 個 epoch 作為起點
  • 在留出的測試集上驗證

相關文件