Я проверил бесплатные AI API-шлюзы реальными запросами: доступные модели, стартовые бонусы и ограничения RPM. Ниже — результаты тестов на момент публикации.

VyceAI

Сайт: https://vyceai.com
API: OpenAI-compatible
Base URL: https://vyceai.com
Список моделей: GET /v1/models
Chat: POST /v1/chat/completions

После регистрации сервис начислил $40 внутреннего API-баланса. Для доступа к моделям нужно привязать Discord.

 Баланс VyceAI после тестов
Баланс VyceAI после тестов

На Free-аккаунте в витрине были доступны четыре текстовые модели:

Model ID

Input / 1M

Output / 1M

Лимиты

gpt-5.6-new

$2

$2

50 млн токенов/день и 60 запросов в минуту

gpt-5.6-luna

$0.20

$1.20

60 запросов в минуту

claude-sonnet-4-6

$3

$15

60 запросов в минуту

deepseek-v4-flash

$0.09

$0.18

60 запросов в минуту


Experiential Labs

Сайт: https://platform.experientiallabs.ai
API: OpenAI-compatible
Base URL: https://api.experientiallabs.ai/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models

Каталог огромный, но я отдельно проверил модели, которые реально можно использовать бесплатно без оплаты.

Модель

qwen3.8-27b

deepseek-v4-flash

gpt-5.6-luna

minimax-m2.7-free

minimax-m3-free

openrouter-free

 Важно: метка FREE в каталоге не всегда означает доступ без оплаты. Например, для части моделей Experiential просит заплатить $1 для верификации аккаунта. Поэтому в список выше я включил только те модели, которые реально удалось вызвать без платежа.
Важно: метка FREE в каталоге не всегда означает доступ без оплаты. Например, для части моделей Experiential просит заплатить $1 для верификации аккаунта. Поэтому в список выше я включил только те модели, которые реально удалось вызвать без платежа.

Лимиты

Конкретного RPM у Experiential в документации я не нашёл, поэтому отдельно проверил gpt-5.6-luna серией коротких запросов.

В первом тесте прошло 20 из 20 запросов без единого HTTP 429. Во втором прогоне отправлено ещё 30 запросов: 29 успешных, 1 ошибка, 0 ответов 429. Весь тест занял 74,02 секунды — фактическая нагрузка составила примерно 24 запроса в минуту.

Поэтому практический результат на момент проверки:

Около 24 RPM модель gpt-5.6-luna выдерживает без rate-limit 429.


Dahl Inference

Сайт: https://inference.dahl.global/
API: OpenAI-compatible
Base URL: https://inference.dahl.global/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models
Баланс: GET /tokens/current

После регистрации сервис начислил 100 млн токенов. Изначально они лежат на балансе аккаунта, после чего их нужно вручную выделить на API-ключ через кнопку Allocate.

Баланс в Dahl
Баланс в Dahl

На момент проверки /v1/models отдавал две модели:

Model ID

MiniMaxAI/MiniMax-M2.7

deepseek-ai/DeepSeek-V4-Flash-0731

У Dahl необычная схема биллинга: например, если запрос и ответ вместе заняли 63 токена, с баланса спишется ровно 63. В тесте MiniMax использовал 43 input + 20 output = 63 токена, и баланс уменьшился ровно на 63. DeepSeek использовал 9 + 2 = 11 токенов, и списалось ровно 11.

MiniMax M2.7 ответил примерно за 0,56 с. DeepSeek V4 Flash оказался заметно медленнее: один запрос завершился HTTP 524, повторный прошёл успешно примерно за 37 секунд.

Лимиты

Отдельный RPM в заголовках API не указывается, поэтому проверил нагрузкой MiniMax M2.7.

Результат: 60 запросов за 60,86 секунды, 60/60 успешных, списано ровно 2700 токенов

То есть на момент проверки сервис стабильно выдерживал как минимум 60 RPM.


APInex

Сайт: https://apinex.bond/
API: OpenAI-compatible
Base URL: https://api.apinex.bond/v1
Chat: POST /v1/chat/completions

После регистрации баланс был $0.00, API дал доступ к пяти моделям из категории Free:

Model ID

free/qwen-3.8-max

free/gpt-5.6-luna

free/glm-5.3-flash

free/deepseek-v4-flash-0731

free/deepseek-v4-pro-0813

Модели APInex
Модели APInex

Лимиты

API сам отдаёт rate-limit в заголовках:

x-ratelimit-limit: 30
x-ratelimit-remaining: ...
x-ratelimit-reset: ...

Пять последовательных запросов к разным моделям дали остаток 29 → 28 → 27 → 26 → 25 с одинаковым временем сброса. Значит, это общий лимит 30 запросов в минуту на аккаунт, а не отдельные 30 RPM на каждую модель.


ModelRouter

Сайт: https://modelrouter.io/
API: OpenAI-compatible
Base URL: https://api.modelrouter.io/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models

На Free-плане дают 150 000 внутренних токенов в сутки. Расход зависит от модели, поэтому это не всегда равно фактическому числу input/output-токенов. Лимит обновляется в полночь UTC, подписка не истекает. Через /v1/models у меня вернулось 59 моделей.

Из интересных моделей проверил:

Модель

Результат

claude-opus-5

работает

claude-sonnet-5

работает

kimi-k3

работает

glm-5.2

работает

gemini-3.1-pro-preview

HTTP 200, но пустой content

gemini-3.6-flash-thinking

HTTP 200, но пустой content

gpt-5.6-sol

HTTP 500

gpt-5.5

HTTP 500

Описание бесплатного тарифа
Описание бесплатного тарифа

Лимиты: 10 запросов в минуту


TokenForge

Сайт: https://tokenforge.ai.studio/
API: OpenAI-compatible
Base URL: https://tokenforge.ai.studio/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models

 Стартовые $50 + ежедневный бонус $20 в TokenForge
Стартовые $50 + ежедневный бонус $20 в TokenForge

После регистрации сервис начисляет $50, плюс можно получать $20 каждый день через Check in. После первого бонуса баланс составил $70.

/v1/models вернул только: claude-opus-5

Лимиты

Собственного RPM-лимита обнаружить не удалось: даже при тесте на 60 запросов API не вернул ни одного HTTP 429. При этом сама модель работала нестабильно — из 60 запросов успешно прошли только 17. То есть жёсткого RPM со стороны TokenForge не видно, но стабильность модели низкая.

Вывод

Если выбирать по результатам тестов, самым щедрым по объёму выглядит Dahl с 100 млн токенов. APInex — один из самых понятных вариантов с полностью бесплатными моделями и лимитом 30 RPM, а VyceAI даёт хороший стартовый баланс и 60 RPM. ModelRouter интересен ежедневным лимитом, но его 150 000 внутренних токенов расходуются с коэффициентом, зависящим от модели. TokenForge, несмотря на большой бонус, оказался самым нестабильным: в нагрузочном тесте успешно прошли только 17 из 60 запросов.

Условия бесплатных тарифов и доступность моделей могут меняться, поэтому все цифры в статье актуальны именно на момент тестирования.

Находки по бесплатным AI-моделям, API и инструментам я также собираю в Telegram-канале AI Ungated: https://t.me/AIUngated

Комментарии (0)