Что должно значить «дёшево»#
Более низкая цена за токен — это экономия только если качество ответа, окно контекста и вызов инструментов совпадают с официальным API. Гнаться за минимальным числом без проверки целостности — прямой путь на релей, который тихо отдаёт меньшую или квантизованную модель. Поэтому цену и проверяемость решайте вместе.
Сначала исключите даунгрейд, потом оптимизируйте цену
Самый дешёвый релей бесполезен, если он подменяет модель. Начните с как распознать подмену модели, потом сравнивайте цены.
Где шлюз реально снижает затраты#
- Один счёт, без накладных расходов на вендоров. Не нужны отдельные аккаунты Anthropic, OpenAI и Google, карты и ежемесячные сверки.
- Маршрутизируйте задачу на модель нужной цены. Дешёвая модель для черновиков, топовая — только когда важно. Всё по одному ключу.
- Китайские модели без лишних барьеров. DeepSeek, Kimi и Qwen из-за рубежа часто мучительно регистрировать — здесь они за тем же ключом.
- Одна валюта, один баланс. Любой способ оплаты пополняет по курсу 1 ¥ = $1 квоты, и все модели списывают с этого одного баланса по своей цене в USD — свою смотрите на странице цен.
Сколько это стоит#
Один баланс, один курс пополнения
Пополнение идёт по фиксированному курсу 1 ¥ = $1 квоты любым способом оплаты, а каждая модель тарифицируется по своей цене в USD — актуальные цены по моделям смотрите на daoxe.com/pricing. Курс одинаковый для всех способов оплаты: Alipay, WeChat Pay, USDT, банковская карта (Visa · Mastercard), Apple Pay и Google Pay — один баланс на все модели каталога, без выбора тарифа и без месячного минимума. Цены зависят от аккаунта и меняются, поэтому проверьте небольшим пополнением, а не доверяйте цифре из гайда.
Посчитайте, какая модель дешевле именно для вашей задачи#
Цена за 1 млн токенов решает удивительно мало. Вы платите эту цену, умноженную на токены, которые реально сжигает ваша нагрузка, — и ошибаются обычно во втором множителе, причём на порядок:
- Вывод обычно в разы дороже ввода. Лаконичная модель выигрывает у формально более дешёвой, но многословной. Сравнивайте стоимость выполненной задачи, а не цену за 1 млн токенов.
- Агенты переотправляют всю переписку. Сессия из двадцати ходов в Cline или Aider стоит намного больше, чем набранный вами промпт: на каждом ходу заново уходит весь накопленный контекст.
- Токены рассуждений тарифицируются. Дешёвая reasoning-модель, думающая 3000 токенов, проигрывает более дорогой, которая отвечает за 200. И у каждой семьи свой способ отдавать мышление — GLM делит бюджет max_tokens, DeepSeek отдельное поле, MiniMax явный флаг, Grok только счётчик в usage, MiMo отдаёт 400 при потере трассы — см. страницы семейств.
- Ретраи и неудачные вызовы инструментов тоже оплачиваются. Success rate — это статья расходов, и поэтому её стоит измерять.
- Неверный ответ стоит вдвое. Если дешёвой модели нужен второй проход, чтобы починить результат, вы заплатили за два вызова плюс своё время.
# Стоимость вызова = реально потраченные токены x актуальная цена вашей модели.
# Токены читаем здесь; цену смотрим на странице цен.
from openai import OpenAI
client = OpenAI(base_url="https://daoxe.com/v1", api_key="ВАШ_КЛЮЧ_DAOXE")
r = client.chat.completions.create(
model="ВАШ_ТОЧНЫЙ_ID_МОДЕЛИ",
temperature=0,
max_tokens=64,
messages=[{"role": "user", "content": "Сформулируй это одной строкой: ..."}],
)
u = r.usage
print(u.prompt_tokens, u.completion_tokens, u.total_tokens)
# Замеряйте РЕАЛЬНУЮ задачу, а не одиночный промпт: агент на каждом ходу
# отправляет всю переписку заново, поэтому сессия из 20 ходов стоит куда больше.Как вызвать каждое семейство#
Каждое семейство доступно по одному base URL и ключу. Claude есть и по OpenAI-совместимому пути, и по нативному Anthropic Messages — для Claude Code и Anthropic SDK используйте Messages.
| Семейство | Как вызвать | Цена |
|---|---|---|
| Claude (Opus / Sonnet / Haiku) | /v1/messages (нативно) или /v1/chat/completions | см. цены |
| GPT | /v1/chat/completions или /v1/responses | см. цены |
| Gemini | /v1/chat/completions | см. цены |
| DeepSeek | /v1/chat/completions | см. цены |
| Kimi / Qwen | /v1/chat/completions | см. цены |
Мы не публикуем выдуманные цены
Цены по моделям меняются и зависят от аккаунта, поэтому здесь плейсхолдеры вместо чисел. Источник истины — daoxe.com/pricing и список моделей вашего аккаунта.
Быстрый старт (60 секунд)#
- Получите список моделей. Скопируйте точный ID нужного семейства.
- Отправьте один маленький запрос. Держите
max_tokensмаленьким, чтобы тест был дешёвым. - Сравните качество и цену. С официальным API на том же промпте при
temperature=0.
export DAOXE_API_KEY="ваш_ключ"
curl --fail-with-body --show-error --silent \
https://daoxe.com/v1/models \
-H "Authorization: Bearer ${DAOXE_API_KEY}"curl --fail-with-body --show-error --silent \
https://daoxe.com/v1/chat/completions \
-H "Authorization: Bearer ${DAOXE_API_KEY}" \
-H "Content-Type: application/json" \
-d '{
"model": "ТОЧНЫЙ_ID_МОДЕЛИ",
"max_tokens": 64,
"messages": [{"role": "user", "content": "Поздоровайся одной фразой."}]
}'Ловушка, о которой молчат#
Некоторые дешёвые endpoint отлично выглядят неделю, а потом тихо деградируют — меньшая модель, агрессивная квантизация или обрезанный контекст. Лечение не вера, а измерение: гоняйте фиксированный набор проб по расписанию и сравнивайте с официальным API. Ровно для этого — открытый бенчмарк и гайд про подмену модели.
Частые вопросы#
Шлюз действительно дешевле, чем напрямую?
Зависит от ваших моделей и объёма, поэтому не верьте заявлению, а посчитайте: сравните актуальную цену вашей модели на daoxe.com/pricing с официальным прайсом вендора и прибавьте, во что вам обходятся несколько вендорских аккаунтов — регистрации, карты, сверки. Само пополнение идёт по фиксированному курсу 1 ¥ = $1 квоты любым способом.
Дешевле — значит хуже модель?
Не должно. Требуйте проверяемости: гоняйте фиксированные пробы и сравнивайте с официальным API. Если провайдер против бенчмарка — уходите.
Можно ли пользоваться DeepSeek и Kimi из-за рубежа?
Да — они за тем же ключом, что снимает обычные проблемы с зарубежной регистрацией и оплатой у этих вендоров.
Как узнать точный ID модели?
Вызовите GET /v1/models с вашим ключом и скопируйте точный ID; ID зависят от аккаунта.
Попробуйте DaoXE — и проверьте его сами
Один ключ для GPT, Claude, Gemini, DeepSeek и других. Направьте открытый бенчмарк на нас и сравните — не верьте на слово.