微调

微调允许您使用自己的训练数据定制基础模型,无需从零构建模型即可提升在领域特定任务上的性能。

支持的基础模型

基础模型微调支持
deepseek/deepseek-v4-flash
glm-5.1
astra✓(领域特定)

工作原理

  1. 准备数据 — 以 JSONL 格式上传训练数据
  2. 创建任务 — 使用您的参数提交微调任务
  3. 监控 — 跟踪训练进度和指标
  4. 部署 — 您的微调模型获得唯一的模型 ID
  5. 调用 — 通过相同的 API 调用您的模型

训练数据格式

{"messages": [{"role": "system", "content": "You are a customer service assistant."}, {"role": "user", "content": "How do I reset my password?"}, {"role": "assistant", "content": "To reset your password, go to Settings > Security > Reset Password."}]}
{"messages": [{"role": "system", "content": "You are a customer service assistant."}, {"role": "user", "content": "What are your business hours?"}, {"role": "assistant", "content": "Our business hours are Monday to Friday, 9 AM to 6 PM."}]}

创建微调任务

curl https://openapi.linkwo.ai/v1/fine_tuning/jobs \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek/deepseek-v4-flash",
    "training_file": "file-abc123",
    "hyperparameters": {
      "n_epochs": 3,
      "learning_rate_multiplier": 0.1
    },
    "suffix": "my-model"
  }'

使用您的微调模型

训练完成后,使用微调模型的 ID:

response = client.chat.completions.create(
    model="deepseek-v4-flash:ft-my-model:abc123",
    messages=[{"role": "user", "content": "How do I reset my password?"}]
)

定价

项目价格
训练$1.40 / 1M tokens
推理(微调后)基础模型价格 × 1.5
存储$7 / 模型 / 月

最佳实践

  • 从 50-100 条高质量样本开始
  • 确保训练数据在格式和质量上保持一致
  • 以 3 个 epoch 作为起点
  • 在留出的测试集上验证

相关文档