Длинный контекст Kimi хорош для больших файлов и repo-масштабных промптов, а через DaoXE он за тем же ключом, что GPT, Claude и DeepSeek — без отдельной регистрации в Moonshot. Вызывайте /v1/chat/completions с ID Kimi. Маршрутизация — гайд по дешёвым API.
Как вызвать Kimi (Moonshot) через DaoXE#
Используйте /v1/chat/completions с точным ID Kimi. K2 thinking по умолчанию ВКЛ; отправляйте thinking disabled в теле запроса, когда нужен обычный вывод.
# Kimi K2 "thinking" builds default reasoning ON. Send thinking disabled
# when you want plain output; omit it to keep reasoning on.
curl --fail-with-body --show-error --silent \
https://daoxe.com/v1/chat/completions \
-H "Authorization: Bearer ${DAOXE_API_KEY}" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_EXACT_MODEL_ID",
"max_tokens": 64,
"messages": [{"role": "user", "content": "Reply with OK."}],
"thinking": {"type": "disabled"}
}'Нюансы именно для Kimi (Moonshot)#
- Thinking по умолчанию ВКЛ (K2). Отправляйте thinking disabled для обычного и более дешёвого вывода; без него рассуждения остаются включёнными.
- Поле reasoning_content. При включённом thinking рассуждения приходят в
reasoning_content— возвращайте его в многошаговом tool use, как у DeepSeek. - Длинный контекст — реальная цена. Большие окна мощны, но токены накапливаются — держите промпты компактными.
- Только точные ID. Берите ID Kimi из
GET /v1/models.
Оплата и реальная стоимость#
Alipay / WeChat Pay / USDT — фиксированно 1 ¥ = $1
Любой способ пополняет по фиксированному курсу 1 ¥ = $1, а модели тарифицируются по своей официальной цене в USD. При реальном курсе ~7 ¥/$ западные флагманы (GPT / Claude / Gemini / Grok) выходят примерно в 1/7 официальной цены (≈на 85% дешевле) — и через USDT тот же курс получают держатели USD за рубежом. Честная оговорка: дешёвые китайские модели (DeepSeek / Qwen / GLM) тоже выгоднее прямого доступа, но меньше — это не «всё в 1/7». Курсы меняются; daoxe.com/pricing — источник истины, а небольшое пополнение это подтвердит.
Убедитесь, что отдают настоящую модель#
Сначала проверьте эндпоинт, а не клиент — если это не работает, настройки не помогут:
export DAOXE_API_KEY="your_api_key"
# List the exact model IDs your account can call
curl --fail-with-body --show-error --silent \
https://daoxe.com/v1/models \
-H "Authorization: Bearer ${DAOXE_API_KEY}"Подтвердите связь, затем сравните длинноконтекстный промпт с официальным API Moonshot при temperature 0 для проверки recall:
Проверяйте нас, а не верьте на слово
Направьте открытый бенчмарк на DaoXE и на официальный API и сравните при temperature 0. Затем изучите, как поймать подмену модели, чтобы дешёвый эндпоинт не подменил вам модель на меньшую.
Частые вопросы#
Почему Kimi «думает», хотя я не просил?
K2 thinking по умолчанию ВКЛ. Отправьте thinking disabled в теле запроса для обычного вывода.
У Kimi есть round-trip reasoning_content?
Да, при включённом thinking — возвращайте reasoning_content в многошаговом tool use, как у DeepSeek.
Нужен ли аккаунт Moonshot?
Нет — через DaoXE Kimi за вашим единым ключом, без сложностей зарубежной регистрации.
Сколько стоит Kimi здесь?
По модели и аккаунту — см. актуальные цены. Преимущество к официалу: обычно на ~30–80% ниже прайса (дешёвые группы).
Попробуйте DaoXE — и проверьте его сами
Один ключ для GPT, Claude, Gemini, DeepSeek и других. Направьте открытый бенчмарк на нас и сравните — не верьте на слово.