Qwen — это и открытые релизы (Qwen2.5, Qwen3), и коммерческие тиры (qwen-max / plus / turbo). Вместо ключа DashScope и консоли Alibaba Cloud DaoXE даёт Qwen за тем же ключом, что GPT, Claude и DeepSeek. Вызывайте /v1/chat/completions с ID qwen-*; куда он вписывается по цене — гайд по дешёвым API.
Как вызвать Qwen через DaoXE#
Используйте /v1/chat/completions с точным ID qwen-* из GET /v1/models. У Qwen3 есть гибридный режим рассуждений через нестандартное поле enable_thinking — ставьте false для обычного вывода; при включённом некоторые сборки требуют стриминга.
# Qwen3 "thinking" is toggled by enable_thinking (an extra field, not standard
# OpenAI). Turn it OFF for plain, cheaper output; some builds require streaming
# when thinking is ON.
curl --fail-with-body --show-error --silent \
https://daoxe.com/v1/chat/completions \
-H "Authorization: Bearer ${DAOXE_API_KEY}" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_EXACT_MODEL_ID",
"max_tokens": 64,
"messages": [{"role": "user", "content": "Reply with OK."}],
"enable_thinking": false
}'curl --fail-with-body --show-error --silent \
https://daoxe.com/v1/chat/completions \
-H "Authorization: Bearer ${DAOXE_API_KEY}" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_EXACT_MODEL_ID",
"max_tokens": 64,
"messages": [{"role": "user", "content": "Say hello in one sentence."}]
}'Нюансы именно для Qwen#
- enable_thinking нестандартно. Это доп-поле сверх спецификации OpenAI; не каждый клиент его передаёт. Отправляйте в теле запроса или через extra-body вашего SDK.
- Thinking может требовать стриминг. При включённом thinking часть сборок Qwen отвечает только стримом — ждите поток или выключайте thinking.
- Открытые и коммерческие варианты разные. qwen-max/plus/turbo и открытые Qwen2.5/Qwen3 отличаются поведением и ценой — выбирайте осознанно.
- Только точные ID. Берите
qwen-*изGET /v1/models, не из блога.
Оплата и реальная стоимость#
Alipay / WeChat Pay / USDT — фиксированно 1 ¥ = $1
Любой способ пополняет по фиксированному курсу 1 ¥ = $1, а модели тарифицируются по своей официальной цене в USD. При реальном курсе ~7 ¥/$ западные флагманы (GPT / Claude / Gemini / Grok) выходят примерно в 1/7 официальной цены (≈на 85% дешевле) — и через USDT тот же курс получают держатели USD за рубежом. Честная оговорка: дешёвые китайские модели (DeepSeek / Qwen / GLM) тоже выгоднее прямого доступа, но меньше — это не «всё в 1/7». Курсы меняются; daoxe.com/pricing — источник истины, а небольшое пополнение это подтвердит.
Убедитесь, что отдают настоящую модель#
Сначала проверьте эндпоинт, а не клиент — если это не работает, настройки не помогут:
export DAOXE_API_KEY="your_api_key"
# List the exact model IDs your account can call
curl --fail-with-body --show-error --silent \
https://daoxe.com/v1/models \
-H "Authorization: Bearer ${DAOXE_API_KEY}"Подтвердите связь, затем сравните сложный промпт с официальным API Qwen/DashScope при temperature 0:
Проверяйте нас, а не верьте на слово
Направьте открытый бенчмарк на DaoXE и на официальный API и сравните при temperature 0. Затем изучите, как поймать подмену модели, чтобы дешёвый эндпоинт не подменил вам модель на меньшую.
Частые вопросы#
Нужен ли аккаунт Alibaba Cloud/DashScope?
Нет — через DaoXE Qwen за вашим единым ключом DaoXE, без регистрации в DashScope.
Как выключить «thinking» в Qwen3?
Отправьте enable_thinking: false в теле запроса. Поле нестандартное — при необходимости используйте extra-body вашего SDK.
Почему приходит только стрим?
Часть сборок Qwen требует стриминга при включённом thinking. Выключите thinking для простого вызова или обрабатывайте поток.
Сколько стоит Qwen здесь?
По модели и аккаунту — см. актуальные цены. Преимущество к официалу: обычно на ~30–80% ниже прайса (дешёвые группы).
Попробуйте DaoXE — и проверьте его сами
Один ключ для GPT, Claude, Gemini, DeepSeek и других. Направьте открытый бенчмарк на нас и сравните — не верьте на слово.