
Qwen3.7-Max
qwen3.7-maxQwen 系列
概述
1M 上下文文档分析多语言创意写作
Qwen3.7-Max 是通义千问 3.7 系列的 Max 版本,参数规模达 720B,定位为通用旗舰大模型。模型在复杂知识推理、长文本理解、专业写作与跨语言任务上均处于头部水平,原生支持百万级上下文与多档思考模式。它既可充当企业级知识中枢,也可在 Token Plan 的高单价档位下作为研发与生产主力,覆盖从研究到规模化部署的全链路需求。
720B 旗舰规模
千问 3.7 系列 Max 版本顶级参数规模,覆盖最难的知识推理与多语言任务。
深度推理
支持思考模式切换,可处理复杂多步推理与长链路决策任务。
百万上下文
近百万 token 上下文窗口(991.8K),覆盖长文档、超长报告与多轮任务。
高并发稳定
RPM 30K / TPM 5M,可支撑在线大流量业务场景下的稳定输出。
功能
前缀补全✓
上下文缓存✓
结构化输出✓
批量任务✓
联网搜索✓
视觉理解✕
微调✕
定价
输入¥12/M tokens
输出¥36/M tokens
输入(缓存命中)¥1.2/M tokens
显式缓存创建¥15/M tokens
内置工具 (按调用次数计费)
web_search¥0.01/次
code_interpreter¥0.02/次
web_extractor¥0.01/次
速率限制与上下文
上下文窗口1M
最大输出64K
RPM(请求 / 分钟)30K
TPM(token / 分钟)5M
内置工具
web_search
Responses API
code_interpreter
Responses API
web_extractor
Responses API
API 参考
ENDPOINT
POST https://api.tokenfab.cn/v1/chat/completions
请求示例
curl https://api.tokenfab.cn/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $TOKENFAB_API_KEY" \
-d '{
"model": "qwen3.7-max",
"messages": [
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "写一段关于秋天的现代诗。"}
]
}'响应示例
JSON
{
"id": "chatcmpl-q3m7x2p8",
"object": "chat.completion",
"created": 1784950000,
"model": "qwen3.7-max",
"choices": [{
"index": 0,
"message": {
"role": "assistant",
"content": "我是 Qwen3.7-Max,720B 参数规模的旗舰通用大模型,支持百万级上下文与多档思考模式,适合复杂知识推理与高质量生成任务。"
},
"finish_reason": "stop"
}],
"usage": {
"prompt_tokens": 16,
"completion_tokens": 48,
"total_tokens": 64
}
}请求参数
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| model | string | ✓ | 模型 ID,如 qwen3.7-max |
| messages | array | ✓ | 对话消息列表,含 role 和 content |
| temperature | float | — | 采样温度,0–2,默认 0.7 |
| top_p | float | — | 核采样,0–1,默认 0.9 |
| max_tokens | int | — | 最大输出 Token 数 |
| stream | bool | — | 是否流式输出,默认 false |
| tools | array | — | 工具定义列表,用于 Function Calling |
| tool_choice | string | — | 工具调用策略,auto / none / 指定函数 |