DaoXE обслуживает семейство Grok от xAI в стандартной OpenAI-форме: POST /v1/chat/completions с Grok ID; /v1/responses — на поддерживающих ID. Существующий код OpenAI SDK работает без изменений — меняются только base URL и ключ. Откуда берётся реальная экономия: гайд по дешёвым API.
Как вызвать Grok через DaoXE#
Путь chat: /v1/chat/completions с Authorization: Bearer. Reasoning-ID Grok учитывают мышление на уровне usage: usage.completion_tokens_details.reasoning_tokens показывает, сколько completion-токенов ушло на размышления.
curl --fail-with-body --show-error --silent \
https://daoxe.com/v1/chat/completions \
-H "Authorization: Bearer ${DAOXE_API_KEY}" \
-H "Content-Type: application/json" \
-d '{
"model": "YOUR_EXACT_MODEL_ID",
"max_tokens": 64,
"messages": [{"role": "user", "content": "Say hello in one sentence."}]
}'# xAI reasoning IDs report thinking at the USAGE level, not the message
# level: reasoning_tokens appear in usage.completion_tokens_details. If your
# billing dashboards ignore that detail, cache tokens and thinking tokens both
# look like ordinary completion spend.
from openai import OpenAI
client = OpenAI(base_url="https://daoxe.com/v1", api_key="YOUR_DAOXE_KEY")
r = client.chat.completions.create(
model="YOUR_EXACT_MODEL_ID", # a grok-* id from GET /v1/models
messages=[{"role": "user", "content": "2+2? Think briefly, then answer."}],
)
print(r.choices[0].message.content)
details = r.usage.completion_tokens_details
print(getattr(details, "reasoning_tokens", None)) # thinking, counted hereНюансы именно для Grok#
- Мышление видно в usage, а не в сообщении. В отличие от API с отдельным полем мыслей у сообщения, xAI кладёт
reasoning_tokensвнутрьusage.completion_tokens_details— биллинг или аудит, читающий только верхнеуровневые числа, мышление не увидит. - Есть Responses-поверхность. У xAI есть OpenAI Responses-совместимый эндпоинт; проверьте, заявляет ли конкретный закреплённый ID его, прежде чем направлять Responses-трафик.
- Точные ID из живого списка. Версии Grok меняются; копируйте ID из
GET /v1/models, а не из анонсов.
Сколько это стоит#
Один баланс, один курс пополнения
Пополнение идёт по фиксированному курсу 1 ¥ = $1 квоты любым способом оплаты, а каждая модель тарифицируется по своей цене в USD — актуальные цены по моделям смотрите на daoxe.com/pricing. Курс одинаковый для всех способов оплаты: Alipay, WeChat Pay, USDT, банковская карта (Visa · Mastercard), Apple Pay и Google Pay — один баланс на все модели каталога, без выбора тарифа и без месячного минимума. Цены зависят от аккаунта и меняются, поэтому проверьте небольшим пополнением, а не доверяйте цифре из гайда.
Убедитесь, что отдают настоящую модель#
Сначала проверьте эндпоинт, а не клиент — если это не работает, настройки не помогут:
export DAOXE_API_KEY="your_api_key"
# List the exact model IDs your account can call
curl --fail-with-body --show-error --silent \
https://daoxe.com/v1/models \
-H "Authorization: Bearer ${DAOXE_API_KEY}"Проверьте связность, затем сравните фиксированный промпт при temperature 0 с официальным API xAI, чтобы убедиться в совпадении уровня:
Проверяйте нас, а не верьте на слово
Направьте открытый бенчмарк на DaoXE и на официальный API и сравните при temperature 0. Затем изучите, как поймать подмену модели, чтобы дешёвый эндпоинт не подменил вам модель на меньшую.
Частые вопросы#
Нужна ли консоль xAI?
Нет — Grok идут под вашим единым ключом DaoXE с обычными каталог ID из GET /v1/models.
Куда делись токены мышления?
В usage.completion_tokens_details.reasoning_tokens. Читайте их там для атрибуции затрат.
Какие эндпоинты работают для Grok?
OpenAI-совместимый chat (/v1/chat/completions) и Responses-поверхность на поддерживающих ID.
Сколько стоит Grok здесь?
По модели и аккаунту — см. актуальные цены. Пополнение — фиксированные 1 ¥ = $1 квоты.
Попробуйте DaoXE — и проверьте его сами
Один ключ для GPT, Claude, Gemini, DeepSeek и других. Направьте открытый бенчмарк на нас и сравните — не верьте на слово.