DeepSeek V4 Flash
DeepSeek V4 Flash 是一款效率优化的混合专家(MoE)模型,拥有 284B 总参数和 13B 激活参数,支持 1M token 上下文窗口。它专为快速推理和高吞吐量应用设计,非常适合聊天、摘要和通用任务场景。
快速参考
| 属性 | 值 |
|---|
| 模型 ID | deepseek/deepseek-v4-flash |
| 上下文窗口 | 1,000,000 tokens |
| 最大输出 | 8,192 tokens |
| 训练数据截止 | 2024 |
| 流式 | ✓ |
| 函数调用 | ✓ |
| 结构化输出 | ✓ |
| 批量 API | ✓ |
定价
| 类型 | 价格 |
|---|
| 输入 | $0.27 / 1M tokens / 1M tokens |
| 输出 | $0.67 / 1M tokens / 1M tokens |
何时选择 Flash 或 Pro
| 场景 | 推荐 |
|---|
| 高 QPS 聊天机器人 | Flash |
| 复杂代码生成 | Pro |
| 批量分类 / 打标 | Flash |
| 数学证明验证 | Pro |
| 实时对话 | Flash |
| 多步推理 | Pro |
示例
from openai import OpenAI
client = OpenAI(
base_url="https://openapi.linkwo.ai/v1",
api_key="YOUR_API_KEY"
)
response = client.chat.completions.create(
model="deepseek/deepseek-v4-flash",
messages=[
{"role": "user", "content": "Summarize this article in 3 bullet points: ..."}
],
temperature=0.5
)
print(response.choices[0].message.content)
相关文档