DeepSeek-V4-Pro

deepseek-v4-pro
开源DeepSeek 系列

概述

1M 上下文数学推理代码生成文档分析

DeepSeek-V4-Pro 是面向企业级关键链路的旗舰 MoE 模型,总参数 16T、单次推理激活 498B,原生支持百万级超长上下文窗口。模型面向高难度推理与高质量训练数据场景做了优化,重点强化数学逻辑、复杂推理、专业代码生成与长文本分析能力,可驱动高吞吐业务与多步骤自动化流水线,承担关键路径的核心引擎角色。

百万超长上下文
原生支持百万 token 上下文,可一次性载入大型代码库、超长文档与多轮任务记录。
MoE 旗舰规模
总参 16T / 激活 498B,覆盖最难的数学、代码与逻辑推理任务。
复杂任务自动化
面向长期智能体工作流,适配多步、长链路自动化场景的任务编排。
高吞吐与稳定性
RPM 15K / TPM 1.20M,面向高并发在线业务保持稳定输出。

功能

前缀补全
上下文缓存
结构化输出
批量任务
联网搜索
视觉理解
微调

定价

空闲时段
输入¥4.5/M tokens
输入(缓存命中)¥0.15/M tokens
输出¥13.5/M tokens
高峰时段
输入¥9/M tokens
输入(缓存命中)¥0.3/M tokens
输出¥27/M tokens
空闲时段价格为高峰时段价格的一半。高峰时段为北京时间周一至周五 9:00 - 12:00、14:00 - 18:00(其余为空闲时段)。

速率限制与上下文

上下文窗口1M
最大输出384K
RPM(请求 / 分钟)15K
TPM(token / 分钟)1200K

API 参考

ENDPOINT
POST https://api.tokenfab.cn/v1/chat/completions

请求示例

curl https://api.tokenfab.cn/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $TOKENFAB_API_KEY" \
  -d '{
    "model": "deepseek-v4-pro",
    "messages": [
      {"role": "system", "content": "You are a helpful assistant."},
      {"role": "user", "content": "用一句话介绍旗舰版 DeepSeek-V4-Pro。"}
    ]
  }'

响应示例

JSON
{
  "id": "chatcmpl-7h2k93fa",
  "object": "chat.completion",
  "created": 1784950000,
  "model": "deepseek-v4-pro",
  "choices": [{
    "index": 0,
    "message": {
      "role": "assistant",
      "content": "我是 DeepSeek-V4-Pro,旗舰版 MoE 大模型,总参 16T、激活 498B,原生支持百万级上下文,覆盖最难的数学、代码与长文本任务。"
    },
    "finish_reason": "stop"
  }],
  "usage": {
    "prompt_tokens": 18,
    "completion_tokens": 52,
    "total_tokens": 70
  }
}

请求参数

参数类型必填说明
modelstring模型 ID,如 deepseek-v4-pro
messagesarray对话消息列表,含 role 和 content
temperaturefloat采样温度,0–2,默认 0.7
top_pfloat核采样,0–1,默认 0.9
max_tokensint最大输出 Token 数
streambool是否流式输出,默认 false
toolsarray工具定义列表,用于 Function Calling
tool_choicestring工具调用策略,auto / none / 指定函数