DeepSeek V4 Flash

DeepSeek V4 Flash 是一款效率优化的混合专家(MoE)模型,拥有 284B 总参数和 13B 激活参数,支持 1M token 上下文窗口。它专为快速推理和高吞吐量应用设计,非常适合聊天、摘要和通用任务场景。

快速参考

属性
模型 IDdeepseek/deepseek-v4-flash
上下文窗口1,000,000 tokens
最大输出8,192 tokens
训练数据截止2024
流式
函数调用
结构化输出
批量 API

定价

类型价格
输入$0.27 / 1M tokens / 1M tokens
输出$0.67 / 1M tokens / 1M tokens

何时选择 Flash 或 Pro

场景推荐
高 QPS 聊天机器人Flash
复杂代码生成Pro
批量分类 / 打标Flash
数学证明验证Pro
实时对话Flash
多步推理Pro

示例

from openai import OpenAI

client = OpenAI(
    base_url="https://openapi.linkwo.ai/v1",
    api_key="YOUR_API_KEY"
)

response = client.chat.completions.create(
    model="deepseek/deepseek-v4-flash",
    messages=[
        {"role": "user", "content": "Summarize this article in 3 bullet points: ..."}
    ],
    temperature=0.5
)

print(response.choices[0].message.content)

相关文档