
Qwen3.7-Plus
qwen3.7-plusQwen 系列
概述
1M 上下文创意写作代码生成联网搜索
Qwen3.7-Plus 是 Qwen3.7 系列的增强版,主打通用能力升级与更轻量的部署体验。在保持多任务输出质量与跨场景适配能力的前提下,相比 Pro / Max 档位具备更优的性价比,单位任务成本明显降低,可用于规模化在线业务、对话产品、内容生产以及基础编程辅助等多类落地场景。
近百万上下文
991.8K token 上下文窗口,覆盖长文档、多轮任务与企业级报告输入。
增强通用能力
对话、内容创作、代码辅助等多任务通用能力升级,适配规模化业务。
轻量高并发
单请求体量更小、并发上限更高,RPM 30K / TPM 5M。
单位成本更优
输入 ¥2 / 输出 ¥8 / 缓存命中 ¥0.2,整体性价比高于 Max 系列。
功能
前缀补全✓
上下文缓存✓
结构化输出✓
批量任务✓
联网搜索✓
视觉理解✕
微调✕
定价
输入¥2/M tokens
输出¥8/M tokens
输入(缓存命中)¥0.2/M tokens
显式缓存创建¥2/M tokens
内置工具 (按调用次数计费)
web_search¥0.01/次
code_interpreter¥0.02/次
web_extractor¥0.01/次
速率限制与上下文
上下文窗口1M
最大输出64K
RPM(请求 / 分钟)30K
TPM(token / 分钟)5M
内置工具
web_search
Responses API
code_interpreter
Responses API
web_extractor
Responses API
API 参考
ENDPOINT
POST https://api.tokenfab.cn/v1/chat/completions
请求示例
curl https://api.tokenfab.cn/v1/chat/completions \
-H "Content-Type: application/json" \
-H "Authorization: Bearer $TOKENFAB_API_KEY" \
-d '{
"model": "qwen3.7-plus",
"messages": [
{"role": "system", "content": "You are a helpful assistant."},
{"role": "user", "content": "简述 Qwen3.7-Plus 与 Qwen3.7-Max 的差异。"}
]
}'响应示例
JSON
{
"id": "chatcmpl-q3p7m4k9",
"object": "chat.completion",
"created": 1784950000,
"model": "qwen3.7-plus",
"choices": [{
"index": 0,
"message": {
"role": "assistant",
"content": "我是 Qwen3.7-Plus,主打通用能力升级与轻量化部署的增强版本,相比 Max 系列具备更高的性价比,适合规模化业务场景使用。"
},
"finish_reason": "stop"
}],
"usage": {
"prompt_tokens": 17,
"completion_tokens": 42,
"total_tokens": 59
}
}请求参数
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| model | string | ✓ | 模型 ID,如 qwen3.7-plus |
| messages | array | ✓ | 对话消息列表,含 role 和 content |
| temperature | float | — | 采样温度,0–2,默认 0.7 |
| top_p | float | — | 核采样,0–1,默认 0.9 |
| max_tokens | int | — | 最大输出 Token 数 |
| stream | bool | — | 是否流式输出,默认 false |
| tools | array | — | 工具定义列表,用于 Function Calling |
| tool_choice | string | — | 工具调用策略,auto / none / 指定函数 |