Skip to content

参考

基于阿里云百炼帮助中心 + Qwen3 官方博客 + Qwen-Agent GitHub 编写,对照 2026 年 Qwen3.7 系列

速查

  • 首选端点:百炼 OpenAI 兼容 compatible-mode/v1/chat/completions
  • 国内 base_urlhttps://dashscope.aliyuncs.com/compatible-mode/v1
  • 国际 base_urlhttps://dashscope-intl.aliyuncs.com/compatible-mode/v1
  • API Key 环境变量DASHSCOPE_API_KEY(绝不硬编码)
  • 思考模式采样temperature=0.6 / top_p=0.95 / top_k=20(严禁 temperature=0
  • 非思考模式temperature=0.7(默认)
  • 思考开关enable_thinking(放 extra_body)+ thinking_budget
  • 长度限制max_completion_tokens(含思维链 + 回答),勿用 max_tokens
  • 流式默认开stream=true + stream_options.include_usage=true
  • 多轮保留思维链preserve_thinking=true
  • Function Calling 工具名规则:仅字母 / 数字 / _ / -,≤ 64 token
  • 开源协议:Qwen3 全系列 Apache 2.0;Qwen3-Max / Qwen3.7-Max 闭源仅 API
  • 多语言:119 种语言与方言,覆盖九大语系
  • 完整说明见 入门 / 核心 API 与思考模式

端点对照表

端点URL(国内站)用途SDK 兼容
OpenAI 兼容-Chat/compatible-mode/v1/chat/completions默认首选,迁移成本接近 0OpenAI SDK
OpenAI 兼容-Responses/compatible-mode/v1/responses内置联网搜索 + 代码解释器OpenAI SDK(responses 接口)
Anthropic 兼容-Messages/compatible-mode/v1/messages复用 Anthropic SDK 现有代码Anthropic SDK
DashScope 原生/api/v1/services/aigc/text-generation/generation全参数集(result_format 等)DashScope SDK

模型 ID 速查

开源 Dense(Apache 2.0,可下载权重)

模型 ID总参上下文
Qwen3-0.6B6 亿32K
Qwen3-1.7B17 亿32K
Qwen3-4B40 亿32K
Qwen3-8B80 亿128K
Qwen3-14B140 亿128K
Qwen3-32B320 亿128K

开源 MoE(Apache 2.0)

模型 ID总参 / 激活上下文
Qwen3-30B-A3B300 亿 / 30 亿(128 专家 8 激活)128K
Qwen3-235B-A22B2350 亿 / 220 亿(94 层 / 128 专家 8 激活)128K
Qwen3-235B-A22B-Thinking-2507同上(思考子模型)128K
Qwen3-235B-A22B-Instruct-2507同上(指令微调)128K
Qwen3-Coder-480B-A35B-Instruct4800 亿 / 350 亿(含 70% 代码预训练)256K(YaRN→1M)
Qwen3-Next-80B-A3B800 亿 / 30 亿(Hybrid Attention + 极致稀疏 MoE)128K

闭源旗舰(仅百炼 API,无权重下载)

模型 ID定位
qwen3.7-max2026 最新旗舰(订阅 / 按 token)
qwen3.7-plus中阶通用
qwen3.7-flash高并发 / 低延迟
qwen3-max / qwen3-max-thinking万亿级(上一代主力)
qwen3.5-omni-plus全模态(图 / 音 / 视频)
qwen3-coder-480b-a35b-instruct编程旗舰(百炼专属)
qwen3.8-max-preview订阅预览(实验)

历史型号qwen-max / qwen-plus / qwen-turbo(无前缀)属上一代 Qwen2.5,仍可调用但官方建议迁移到 qwen3.x-*

思考模式参数速查

参数位置类型含义
enable_thinkingextra_bodybool思考模式总开关
thinking_budgetextra_bodyint思维链 token 上限
reasoning_effortextra_bodylow / medium / high / xhighthinking_budget 自动互转
top_kextra_bodyint思考模式推荐 20
preserve_thinkingextra_bodybool多轮对话保留历史 reasoning_content
/think / /no_thinkprompt 内容软指令逐轮切换思考模式

curl 调用:上述参数放请求体顶层OpenAI SDK 调用:必须放 extra_body

采样参数推荐

模式temperaturetop_ptop_k
思考模式0.60.9520
非思考模式(默认)0.70.8不设

严禁思考模式用 temperature=0;不要同时设置 temperaturetop_p

返回字段对照

字段含义限制参数
choices[].message.content最终回答max_completion_tokens
choices[].message.reasoning_content思维链(thinking 子模型才有)thinking_budget
choices[].message.tool_calls工具调用数组parallel_tool_calls
usage.prompt_tokens输入 token 数stream_options.include_usage=true 末包返回
usage.completion_tokens输出 token 数(含思维链)同上
usage.total_tokens总 token 数同上

长度限制参数

参数含义状态
max_completion_tokens含「思维链 + 回答」总长度推荐
max_tokens仅限 content(回答)即将废弃
thinking_budget仅限 reasoning_content(思维链)思考模式用

鉴权与 SDK 配置

Python / Node.js / curl

bash
# 环境变量
export DASHSCOPE_API_KEY=sk-xxxxxxxxxxxxxxxxxxxx
python
# Python(OpenAI 兼容)
from openai import OpenAI
client = OpenAI(
    api_key=os.environ["DASHSCOPE_API_KEY"],
    base_url="https://dashscope.aliyuncs.com/compatible-mode/v1",
)
ts
// Node.js(OpenAI 兼容)
import OpenAI from "openai";
const client = new OpenAI({
  apiKey: process.env.DASHSCOPE_API_KEY!,
  baseURL: "https://dashscope.aliyuncs.com/compatible-mode/v1",
});
bash
# curl 直调
curl https://dashscope.aliyuncs.com/compatible-mode/v1/chat/completions \
  -H "Authorization: Bearer $DASHSCOPE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{"model": "qwen-plus", "messages": [...]}'

Function Calling 限制速查

限制项取值
工具名允许字符字母 / 数字 / _ / -
工具名最大长度≤ 64 token
工具描述最大长度≤ 128 token(百炼限制)
单次调用工具数无硬上限(建议 ≤ 10)
并行调用parallel_tool_calls=true 时支持

版本与发布时间线

时间事件
2024-09Qwen2.5 发布(已往代)
2025-04Qwen3 发布:6 Dense + 2 MoE(235B-A22B 旗舰),Apache 2.0,36T tokens 预训练,119 语言
2025-07Qwen3-Coder-480B-A35B-Instruct 发布(256K 原生 / YaRN 1M / SWE-bench SOTA)
2025-07Qwen3-Next-80B-A3B 发布(Hybrid Attention + 极致稀疏 MoE)
2025-072507 后缀迭代(Thinking-2507 / Instruct-2507)
2025-Q4Qwen3-Max-Thinking 万亿级思考旗舰
2026Qwen3.7-Max / Plus / Flash 系列迭代(对标 GPT-5.5 / Claude Opus 4.7)
2026Qwen3.8-Max-Preview 订阅预览(实验)

开源协议与商用

系列协议商用权重下载
Qwen3 Dense(0.6B ~ 32B)Apache 2.0允许
Qwen3 MoE(30B-A3B / 235B-A22B)Apache 2.0允许
Qwen3-Coder-480BApache 2.0允许
Qwen3-Next-80BApache 2.0允许
Qwen3-Max / Qwen3.7-Max闭源仅 API 调用
Qwen2.5(往代)Apache 2.0允许

多语言支持

Qwen3 原生支持 119 种语言与方言,覆盖九大语系:

  • 印欧语系(英 / 西 / 葡 / 法 / 德 / 俄 / 印地 / 波斯…)
  • 汉藏语系(中 / 缅 / 藏…)
  • 闪含语系(阿 / 希伯来…)
  • 南岛语系(印尼 / 马 / 他加禄…)
  • 达罗毗荼语系(泰米尔 / 泰卢固 / 卡纳达…)
  • 突厥语系(土 / 维 / 哈 / 乌兹…)
  • 壮侗语系(泰 / 老 / 壮…)
  • 乌拉尔语系(芬 / 匈 / 爱沙尼亚…)
  • 南亚语系(越 / 高棉…)

官方资源