Qwen3.7-Max

qwen3.7-max
Qwen 系列

概述

1M 上下文文档分析多语言创意写作

Qwen3.7-Max 是通义千问 3.7 系列的 Max 版本,参数规模达 720B,定位为通用旗舰大模型。模型在复杂知识推理、长文本理解、专业写作与跨语言任务上均处于头部水平,原生支持百万级上下文与多档思考模式。它既可充当企业级知识中枢,也可在 Token Plan 的高单价档位下作为研发与生产主力,覆盖从研究到规模化部署的全链路需求。

720B 旗舰规模
千问 3.7 系列 Max 版本顶级参数规模,覆盖最难的知识推理与多语言任务。
深度推理
支持思考模式切换,可处理复杂多步推理与长链路决策任务。
百万上下文
近百万 token 上下文窗口(991.8K),覆盖长文档、超长报告与多轮任务。
高并发稳定
RPM 30K / TPM 5M,可支撑在线大流量业务场景下的稳定输出。

功能

前缀补全
上下文缓存
结构化输出
批量任务
联网搜索
视觉理解
微调

定价

输入¥12/M tokens
输出¥36/M tokens
输入(缓存命中)¥1.2/M tokens
显式缓存创建¥15/M tokens
内置工具 (按调用次数计费)
web_search¥0.01/次
code_interpreter¥0.02/次
web_extractor¥0.01/次

速率限制与上下文

上下文窗口1M
最大输出64K
RPM(请求 / 分钟)30K
TPM(token / 分钟)5M

内置工具

web_search
Responses API
code_interpreter
Responses API
web_extractor
Responses API

API 参考

ENDPOINT
POST https://api.tokenfab.cn/v1/chat/completions

请求示例

curl https://api.tokenfab.cn/v1/chat/completions \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $TOKENFAB_API_KEY" \
  -d '{
    "model": "qwen3.7-max",
    "messages": [
      {"role": "system", "content": "You are a helpful assistant."},
      {"role": "user", "content": "写一段关于秋天的现代诗。"}
    ]
  }'

响应示例

JSON
{
  "id": "chatcmpl-q3m7x2p8",
  "object": "chat.completion",
  "created": 1784950000,
  "model": "qwen3.7-max",
  "choices": [{
    "index": 0,
    "message": {
      "role": "assistant",
      "content": "我是 Qwen3.7-Max,720B 参数规模的旗舰通用大模型,支持百万级上下文与多档思考模式,适合复杂知识推理与高质量生成任务。"
    },
    "finish_reason": "stop"
  }],
  "usage": {
    "prompt_tokens": 16,
    "completion_tokens": 48,
    "total_tokens": 64
  }
}

请求参数

参数类型必填说明
modelstring模型 ID,如 qwen3.7-max
messagesarray对话消息列表,含 role 和 content
temperaturefloat采样温度,0–2,默认 0.7
top_pfloat核采样,0–1,默认 0.9
max_tokensint最大输出 Token 数
streambool是否流式输出,默认 false
toolsarray工具定义列表,用于 Function Calling
tool_choicestring工具调用策略,auto / none / 指定函数