Qwen(通义千问)API 的 OpenAI 兼容接入 —— 以及 enable_thinking 开关

Qwen 是阿里的模型家族:强、便宜,但海外注册麻烦。通过 DaoXE 就是一次普通的 OpenAI 兼容调用,藏在你的一个 key 后面,还有个 Qwen3 特有的思考开关值得知道。

更新于 2026-07-20

Qwen 既有开源版本(Qwen2.5、Qwen3),也有商用档位(qwen-max / plus / turbo)。无需 DashScope key 和阿里云控制台,DaoXE 把 Qwen 放在与 GPT、Claude、DeepSeek 同一个 key 后面。用 qwen-* ID 调 /v1/chat/completions;如何做成本分工见最便宜 API 教程

通过 DaoXE 调用 Qwen#

/v1/chat/completions,模型填 GET /v1/models 里的准确 qwen-* ID。Qwen3 有混合推理模式,由非标准字段 enable_thinking 控制 —— 设 false 得普通输出;开启时部分版本要求流式。

bash
# Qwen3 "thinking" is toggled by enable_thinking (an extra field, not standard
# OpenAI). Turn it OFF for plain, cheaper output; some builds require streaming
# when thinking is ON.
curl --fail-with-body --show-error --silent \
  https://daoxe.com/v1/chat/completions \
  -H "Authorization: Bearer ${DAOXE_API_KEY}" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "YOUR_EXACT_MODEL_ID",
    "max_tokens": 64,
    "messages": [{"role": "user", "content": "Reply with OK."}],
    "enable_thinking": false
  }'
bash
curl --fail-with-body --show-error --silent \
  https://daoxe.com/v1/chat/completions \
  -H "Authorization: Bearer ${DAOXE_API_KEY}" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "YOUR_EXACT_MODEL_ID",
    "max_tokens": 64,
    "messages": [{"role": "user", "content": "Say hello in one sentence."}]
  }'

Qwen 特有的注意点#

  • enable_thinking 是非标准字段。 它超出 OpenAI 规范;不是每个客户端都会转发。请放进请求体,或用你 SDK 的 extra-body 通道。
  • 思考可能强制流式。 开思考时部分 Qwen 版本只走流式返回 —— 要么处理流,要么关思考做简单调用。
  • 开源与商用版本不同。 qwen-max/plus/turbo 与开源 Qwen2.5/Qwen3 在行为和价格上都不同 —— 有意识地选。
  • 只用准确 ID。GET /v1/models 读取 qwen-*,别照搬博客的版本串。

支付与真实成本#

支付宝 / 微信 / USDT —— 统一 1 元 = $1

所有支付方式统一按 1 元 = $1 额度充值,模型按各自的美元官方价扣费。按真实汇率约 7,西方旗舰(GPT / Claude / Gemini / Grok)实付约为官方美元价的 1/7(省约 85%)——USDT 同样按此充值,海外持美元者也享此价。诚实提醒:国产廉价模型(DeepSeek / Qwen / GLM)也比官方直连便宜,只是幅度小些,并「所有模型都 1/7」。汇率会变,实时价以定价页为准,充一小笔即可自证。

验证你拿到的是真模型#

先证明端点可用,再怀疑客户端 —— 这一步失败,改任何设置都没用:

bash
export DAOXE_API_KEY="your_api_key"

# List the exact model IDs your account can call
curl --fail-with-body --show-error --silent \
  https://daoxe.com/v1/models \
  -H "Authorization: Bearer ${DAOXE_API_KEY}"

先确认连通,再在 temperature 0 下把高难度 prompt 与官方 Qwen/DashScope API 对比,确认模型档位:

别信我们 —— 自己验证

开源 benchmark 对准 DaoXE 和官方 API,在 temperature 0 下对比。再学会如何鉴别掉包,让便宜端点无法悄悄把你换成更小的模型。

常见问题#

需要阿里云/DashScope 账号吗?

不需要 —— 通过 DaoXE,Qwen 在你的同一个 DaoXE key 后面,免去 DashScope 注册。

怎么关掉 Qwen3 的「思考」?

在请求体里发 enable_thinking: false。它是非标准字段,必要时用你 SDK 的 extra-body 选项。

为什么只收到流式响应?

部分 Qwen 版本在开思考时要求流式。做简单调用就关思考,或处理流。

这里 Qwen 多少钱?

按模型、按账号 —— 见实时定价。相对官方优势:多数主流模型经低价分组约低 30%–80%

试用 DaoXE —— 并亲自 benchmark 它

一个 key 调 GPT、Claude、Gemini、DeepSeek 等。用开源 benchmark 对准我们做对比 —— 别只听我们说。