Я проверил бесплатные AI API‑шлюзы реальными запросами: доступные модели, стартовые бонусы и ограничения RPM. Ниже — результаты тестов на момент публикации.
VyceAI
Сайт: https://vyceai.com
API: OpenAI‑compatible
Base URL: https://vyceai.com
Список моделей: GET /v1/models
Chat: POST /v1/chat/completions
После регистрации сервис начислил $40 внутреннего API‑баланса. Для доступа к моделям нужно привязать Discord.

На Free‑аккаунте в витрине были доступны четыре текстовые модели:
Model ID | Input / 1M | Output / 1M | Лимиты |
|---|---|---|---|
| $2 | $2 | 50 млн токенов/день и 60 запросов в минуту |
| $0.20 | $1.20 | 60 запросов в минуту |
| $3 | $15 | 60 запросов в минуту |
| $0.09 | $0.18 | 60 запросов в минуту |
Experiential Labs
Сайт: https://platform.experientiallabs.ai
API: OpenAI‑compatible
Base URL: https://api.experientiallabs.ai/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models
Каталог огромный, но я отдельно проверил модели, которые реально можно использовать бесплатно без оплаты.
Модель |
|---|
|
|
|
|
|
|

FREE в каталоге не всегда означает доступ без оплаты. Например, для части моделей Experiential просит заплатить $1 для верификации аккаунта. Поэтому в список выше я включил только те модели, которые реально удалось вызвать без платежа. Лимиты
Конкретного RPM у Experiential в документации я не нашёл, поэтому отдельно проверил gpt-5.6-luna серией коротких запросов.
В первом тесте прошло 20 из 20 запросов без единого HTTP 429. Во втором прогоне отправлено ещё 30 запросов: 29 успешных, 1 ошибка, 0 ответов 429. Весь тест занял 74,02 секунды — фактическая нагрузка составила примерно 24 запроса в минуту.
Поэтому практический результат на момент проверки:
Около 24 RPM модель
gpt-5.6-lunaвыдерживает без rate‑limit 429.
Dahl Inference
Сайт: https://inference.dahl.global/
API: OpenAI‑compatible
Base URL: https://inference.dahl.global/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models
Баланс: GET /tokens/current
После регистрации сервис начислил 100 млн токенов. Изначально они лежат на балансе аккаунта, после чего их нужно вручную выделить на API‑ключ через кнопку Allocate.

На момент проверки /v1/models отдавал две модели:
Model ID |
|---|
|
|
У Dahl необычная схема биллинга: например, если запрос и ответ вместе заняли 63 токена, с баланса спишется ровно 63. В тесте MiniMax использовал 43 input + 20 output = 63 токена, и баланс уменьшился ровно на 63. DeepSeek использовал 9 + 2 = 11 токенов, и списалось ровно 11.
MiniMax M2.7 ответил примерно за 0,56 с. DeepSeek V4 Flash оказался заметно медленнее: один запрос завершился HTTP 524, повторный прошёл успешно примерно за 37 секунд.
Лимиты
Отдельный RPM в заголовках API не указывается, поэтому проверил нагрузкой MiniMax M2.7.
Результат: 60 запросов за 60,86 секунды, 60/60 успешных, списано ровно 2700 токенов
То есть на момент проверки сервис стабильно выдерживал как минимум 60 RPM.
APInex
Сайт: https://apinex.bond/
API: OpenAI‑compatible
Base URL: https://api.apinex.bond/v1
Chat: POST /v1/chat/completions
После регистрации баланс был $0.00, API дал доступ к пяти моделям из категории Free:
Model ID |
|---|
|
|
|
|
|

Лимиты
API сам отдаёт rate‑limit в заголовках:
x-ratelimit-limit: 30 x-ratelimit-remaining: ... x-ratelimit-reset: ...
Пять последовательных запросов к разным моделям дали остаток 29 → 28 → 27 → 26 → 25 с одинаковым временем сброса. Значит, это общий лимит 30 запросов в минуту на аккаунт, а не отдельные 30 RPM на каждую модель.
ModelRouter
Сайт: https://modelrouter.io/
API: OpenAI‑compatible
Base URL: https://api.modelrouter.io/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models
На Free‑плане дают 150 000 внутренних токенов в сутки. Расход зависит от модели, поэтому это не всегда равно фактическому числу input/output‑токенов. Лимит обновляется в полночь UTC, подписка не истекает. Через /v1/models у меня вернулось 59 моделей.
Из интересных моделей проверил:
Модель | Результат |
|---|---|
| работает |
| работает |
| работает |
| работает |
| HTTP 200, но пустой |
| HTTP 200, но пустой |
| HTTP 500 |
| HTTP 500 |

Лимиты: 10 запросов в минуту
TokenForge
Сайт: https://tokenforge.ai.studio/
API: OpenAI‑compatible
Base URL: https://tokenforge.ai.studio/v1
Chat: POST /v1/chat/completions
Models: GET /v1/models

После регистрации сервис начисляет $50, плюс можно получать $20 каждый день через Check in. После первого бонуса баланс составил $70.
/v1/models вернул только: claude-opus-5
Лимиты
Собственного RPM‑лимита обнаружить не удалось: даже при тесте на 60 запросов API не вернул ни одного HTTP 429. При этом сама модель работала нестабильно — из 60 запросов успешно прошли только 17. То есть жёсткого RPM со стороны TokenForge не видно, но стабильность модели низкая.
Вывод
Если выбирать по результатам тестов, самым щедрым по объёму выглядит Dahl с 100 млн токенов. APInex — один из самых понятных вариантов с полностью бесплатными моделями и лимитом 30 RPM, а VyceAI даёт хороший стартовый баланс и 60 RPM. ModelRouter интересен ежедневным лимитом, но его 150 000 внутренних токенов расходуются с коэффициентом, зависящим от модели. TokenForge, несмотря на большой бонус, оказался самым нестабильным: в нагрузочном тесте успешно прошли только 17 из 60 запросов.
Условия бесплатных тарифов и доступность моделей могут меняться, поэтому все цифры в статье актуальны именно на момент тестирования.
Находки по бесплатным AI‑моделям, API и инструментам я также собираю в Telegram‑канале AI Ungated: https://t.me/AIUngated

