微调
微调允许您使用自己的训练数据定制基础模型,无需从零构建模型即可提升在领域特定任务上的性能。
支持的基础模型
| 基础模型 | 微调支持 |
|---|---|
| deepseek/deepseek-v4-flash | ✓ |
| glm-5.1 | ✓ |
| astra | ✓(领域特定) |
工作原理
- 准备数据 — 以 JSONL 格式上传训练数据
- 创建任务 — 使用您的参数提交微调任务
- 监控 — 跟踪训练进度和指标
- 部署 — 您的微调模型获得唯一的模型 ID
- 调用 — 通过相同的 API 调用您的模型
训练数据格式
{"messages": [{"role": "system", "content": "You are a customer service assistant."}, {"role": "user", "content": "How do I reset my password?"}, {"role": "assistant", "content": "To reset your password, go to Settings > Security > Reset Password."}]}
{"messages": [{"role": "system", "content": "You are a customer service assistant."}, {"role": "user", "content": "What are your business hours?"}, {"role": "assistant", "content": "Our business hours are Monday to Friday, 9 AM to 6 PM."}]}创建微调任务
curl https://openapi.linkwo.ai/v1/fine_tuning/jobs \
-H "Authorization: Bearer YOUR_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "deepseek/deepseek-v4-flash",
"training_file": "file-abc123",
"hyperparameters": {
"n_epochs": 3,
"learning_rate_multiplier": 0.1
},
"suffix": "my-model"
}'使用您的微调模型
训练完成后,使用微调模型的 ID:
response = client.chat.completions.create(
model="deepseek-v4-flash:ft-my-model:abc123",
messages=[{"role": "user", "content": "How do I reset my password?"}]
)定价
| 项目 | 价格 |
|---|---|
| 训练 | $1.40 / 1M tokens |
| 推理(微调后) | 基础模型价格 × 1.5 |
| 存储 | $7 / 模型 / 月 |
最佳实践
- 从 50-100 条高质量样本开始
- 确保训练数据在格式和质量上保持一致
- 以 3 个 epoch 作为起点
- 在留出的测试集上验证