Qwen(通义千问)API 的 OpenAI 兼容接入 —— 以及 enable_thinking 开关

Qwen 是阿里的模型家族:强、便宜,但海外注册麻烦。通过 DaoXE 就是一次普通的 OpenAI 兼容调用,藏在你的一个 key 后面,还有个全家族通用的思考开关值得知道。

更新于 2026-09-15

Qwen 既有开源版本(Qwen2.5、Qwen3),也有商用档位(qwen-max / plus / turbo)。无需 DashScope key 和阿里云控制台,DaoXE 把 Qwen 放在与 GPT、Claude、DeepSeek 同一个 key 后面。用 qwen-* ID 调 /v1/chat/completions;如何做成本分工见最便宜 API 教程。

通过 DaoXE 调用 Qwen#

用 /v1/chat/completions,模型填 GET /v1/models 里的准确 qwen-* ID。思考行为跨代际变过:Qwen3 混合推理由非标准字段 enable_thinking 切换,而新的 Qwen3.5+ 默认就思考 —— 想要普通输出就发 enable_thinking: false;开思考时部分版本要求流式。

bash
# Qwen "thinking": Qwen3 hybrids toggle it with enable_thinking (an extra
# field, not standard OpenAI); Qwen3.5+ models think BY DEFAULT — send
# enable_thinking: false for plain output. Some builds require streaming when
# thinking is ON.
curl --fail-with-body --show-error --silent \
  https://daoxe.com/v1/chat/completions \
  -H "Authorization: Bearer ${DAOXE_API_KEY}" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "YOUR_EXACT_MODEL_ID",
    "max_tokens": 64,
    "messages": [{"role": "user", "content": "Reply with OK."}],
    "enable_thinking": false
  }'
bash
curl --fail-with-body --show-error --silent \
  https://daoxe.com/v1/chat/completions \
  -H "Authorization: Bearer ${DAOXE_API_KEY}" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "YOUR_EXACT_MODEL_ID",
    "max_tokens": 64,
    "messages": [{"role": "user", "content": "Say hello in one sentence."}]
  }'

Qwen 特有的注意点#

  • enable_thinking 是非标准字段。 它超出 OpenAI 规范;不是每个客户端都会转发。请放进请求体,或用你 SDK 的 extra-body 通道。
  • 新的 Qwen3.5+ 默认就思考。 Qwen3 由 enable_thinking 开关决定;Qwen3.5 则思考默认开着,不显式发 enable_thinking: false 就是思考输出 —— 别指望普通调用返回普通答案。(旧的 /think//no_think 软开关在 Qwen3.5 已移除。)
  • 思考可能强制流式。 开思考时部分 Qwen 版本只走流式返回 —— 要么处理流,要么关思考做简单调用。
  • 开源与商用版本不同。 qwen-max/plus/turbo 与开源 Qwen2.5/Qwen3 在行为和价格上都不同 —— 有意识地选。
  • 只用准确 ID。 从 GET /v1/models 读取 qwen-*,别照搬博客的版本串。

这要花多少钱#

一个余额,一个充值汇率

充值统一按 1 元人民币 = $1 额度,所有支付方式一致;模型再各按自己的美元标价计费 —— 实时单价见定价页。支付宝、微信、USDT、银行卡(Visa · Mastercard)、Apple Pay 与 Google Pay 都是同一个汇率 —— 目录里所有模型共用一个余额,不用选套餐,也没有月度低消。单价与账户绑定且会变动,所以请用一小笔充值去确认,而不是相信教程里的某个数字。

验证你拿到的是真模型#

先证明端点可用,再怀疑客户端 —— 这一步失败,改任何设置都没用:

bash
export DAOXE_API_KEY="your_api_key"

# List the exact model IDs your account can call
curl --fail-with-body --show-error --silent \
  https://daoxe.com/v1/models \
  -H "Authorization: Bearer ${DAOXE_API_KEY}"

先确认连通,再在 temperature 0 下把高难度 prompt 与官方 Qwen/DashScope API 对比,确认模型档位:

别信我们 —— 自己验证

把 开源 benchmark 对准 DaoXE 和官方 API,在 temperature 0 下对比。再学会如何鉴别掉包,让便宜端点无法悄悄把你换成更小的模型。

常见问题#

需要阿里云/DashScope 账号吗?

不需要 —— 通过 DaoXE,Qwen 在你的同一个 DaoXE key 后面,免去 DashScope 注册。

怎么关掉 Qwen 的「思考」?

在请求体里发 enable_thinking: false。它是非标准字段,必要时用你 SDK 的 extra-body 选项。Qwen3 靠它切换混合模式;默认就思考的 Qwen3.5+ 则靠它关闭思考。

为什么只收到流式响应?

部分 Qwen 版本在开思考时要求流式。做简单调用就关思考,或处理流。

这里 Qwen 多少钱?

按模型、按账号 —— 见实时定价。充值统一按 1 元 = $1 额度,所有支付方式一致。

试用 DaoXE —— 并亲自 benchmark 它

一个 key 调 GPT、Claude、Gemini、DeepSeek 等。用开源 benchmark 对准我们做对比 —— 别只听我们说。