Доступ к Kimi (Moonshot) API, OpenAI-совместимо — и его thinking по умолчанию

Kimi известен очень длинным контекстом. Через DaoXE это OpenAI-совместимый вызов — но K2 «thinking» по умолчанию ВКЛючает рассуждения, которые стоит отключать ради обычного и более дешёвого вывода.

Обновлено 2026-07-20

Длинный контекст Kimi хорош для больших файлов и repo-масштабных промптов, а через DaoXE он за тем же ключом, что GPT, Claude и DeepSeek — без отдельной регистрации в Moonshot. Вызывайте /v1/chat/completions с ID Kimi. Маршрутизация — гайд по дешёвым API.

Как вызвать Kimi (Moonshot) через DaoXE#

Используйте /v1/chat/completions с точным ID Kimi. K2 thinking по умолчанию ВКЛ; отправляйте thinking disabled в теле запроса, когда нужен обычный вывод.

bash
# Kimi K2 "thinking" builds default reasoning ON. Send thinking disabled
# when you want plain output; omit it to keep reasoning on.
curl --fail-with-body --show-error --silent \
  https://daoxe.com/v1/chat/completions \
  -H "Authorization: Bearer ${DAOXE_API_KEY}" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "YOUR_EXACT_MODEL_ID",
    "max_tokens": 64,
    "messages": [{"role": "user", "content": "Reply with OK."}],
    "thinking": {"type": "disabled"}
  }'

Нюансы именно для Kimi (Moonshot)#

  • Thinking по умолчанию ВКЛ (K2). Отправляйте thinking disabled для обычного и более дешёвого вывода; без него рассуждения остаются включёнными.
  • Поле reasoning_content. При включённом thinking рассуждения приходят в reasoning_content — возвращайте его в многошаговом tool use, как у DeepSeek.
  • Длинный контекст — реальная цена. Большие окна мощны, но токены накапливаются — держите промпты компактными.
  • Только точные ID. Берите ID Kimi из GET /v1/models.

Оплата и реальная стоимость#

Alipay / WeChat Pay / USDT — фиксированно 1 ¥ = $1

Любой способ пополняет по фиксированному курсу 1 ¥ = $1, а модели тарифицируются по своей официальной цене в USD. При реальном курсе ~7 ¥/$ западные флагманы (GPT / Claude / Gemini / Grok) выходят примерно в 1/7 официальной цены (≈на 85% дешевле) — и через USDT тот же курс получают держатели USD за рубежом. Честная оговорка: дешёвые китайские модели (DeepSeek / Qwen / GLM) тоже выгоднее прямого доступа, но меньше — это не «всё в 1/7». Курсы меняются; daoxe.com/pricing — источник истины, а небольшое пополнение это подтвердит.

Убедитесь, что отдают настоящую модель#

Сначала проверьте эндпоинт, а не клиент — если это не работает, настройки не помогут:

bash
export DAOXE_API_KEY="your_api_key"

# List the exact model IDs your account can call
curl --fail-with-body --show-error --silent \
  https://daoxe.com/v1/models \
  -H "Authorization: Bearer ${DAOXE_API_KEY}"

Подтвердите связь, затем сравните длинноконтекстный промпт с официальным API Moonshot при temperature 0 для проверки recall:

Проверяйте нас, а не верьте на слово

Направьте открытый бенчмарк на DaoXE и на официальный API и сравните при temperature 0. Затем изучите, как поймать подмену модели, чтобы дешёвый эндпоинт не подменил вам модель на меньшую.

Частые вопросы#

Почему Kimi «думает», хотя я не просил?

K2 thinking по умолчанию ВКЛ. Отправьте thinking disabled в теле запроса для обычного вывода.

У Kimi есть round-trip reasoning_content?

Да, при включённом thinking — возвращайте reasoning_content в многошаговом tool use, как у DeepSeek.

Нужен ли аккаунт Moonshot?

Нет — через DaoXE Kimi за вашим единым ключом, без сложностей зарубежной регистрации.

Сколько стоит Kimi здесь?

По модели и аккаунту — см. актуальные цены. Преимущество к официалу: обычно на ~30–80% ниже прайса (дешёвые группы).

Попробуйте DaoXE — и проверьте его сами

Один ключ для GPT, Claude, Gemini, DeepSeek и других. Направьте открытый бенчмарк на нас и сравните — не верьте на слово.