Проверил малоизвестные LLM API с бесплатными моделями, лимитами и реальными запросами.
Вот что получилось:
Atria
Сайт: https://api.atria‑asi.ai/
Документация: https://api.atria‑asi.ai/docs
API: https://api.atria-asi.ai/v1
Сразу после регистрации мне начислили 100 000 000 токенов.

Доступна одна модель — Atria-Dawn-Preview. Это агентная модель Shanghai AI Lab на базе 744B MoE GLM-5.2, рассчитанная на исследовательские, инженерные и многошаговые задачи с инструментами. (Hugging Face)
Контекст — 256K, максимальный output — 65 536 токенов. Модель принимает только текст.
Atria поддерживает сразу три API, все три у меня реально заработали:
Chat Completions HTTP 200 Responses API HTTP 200 Anthropic Messages HTTP 200
Responses API отдельно возвращает reasoning и финальный ответ, Anthropic Messages — блоки thinking и text, а обычный Chat Completions возвращает только текстовый ответ.
Лимиты
В документации указано 60 RPM на аккаунт, причём лимит общий для Chat Completions, Responses и Messages.
Но мой аккаунт во всех ответах стабильно получал:
x-rpm-limit: 50
Поэтому фактически для него сервер выставил 50 RPM.
Дополнительно отправил 51 запрос примерно за минуту:
HTTP 200 — 47 HTTP 429 — 0 ERR — 4
Четыре ошибки были локально отменёнными задачами, а не ответами API. Поэтому жёсткую границу через 429 поймать не удалось, но фактический серверный заголовок показывает 50 RPM. RPD отдельно не указан.
Routeway
Сайт: https://routeway.ai/
Документация: https://docs.routeway.ai/
API: https://api.routeway.ai/v1
После регистрации баланс у меня был $0.00, но бесплатные маршруты при этом работают отдельно от баланса.

/v1/models вернул 263 модели, но бесплатными в каталоге отмечены отдельные маршруты с суффиксом :free.
В моём аккаунте были доступны:
deepseek-v4-flash:free minimax-m2.7:free muse-glimmer-30b:free
По факту результаты получились разные.
minimax-m2.7:free работает:
HTTP 200 MODEL: minimax-m2.7:free ANSWER: API WORKS
Модель возвращает reasoning прямо внутри ответа в блоке <think>, а затем финальный текст.
muse-glimmer-30b:free после первой ошибки заработала стабильно:
TRY 1 — HTTP 200 TRY 2 — HTTP 200 TRY 3 — HTTP 200
Во всех трёх запросах ответ был API WORKS.
А вот deepseek-v4-flash:free у меня не заработал вообще:
HTTP 502 HTTP 502 HTTP 502 HTTP 502
Поэтому в список реально работающих бесплатных моделей я его не включаю.
Лимиты
Routeway сам возвращает лимиты в заголовках:
x-ratelimit-limit-minute: 5 x-ratelimit-limit-day: 200
То есть бесплатный тариф даёт:
5 RPM 200 запросов в сутки
При этом неудачные запросы тоже учитываются в дневной квоте. После серии тестов x-ratelimit-remaining-day уменьшался даже после 502 и 429.
Один раз MiniMax M2.7 вернул:
HTTP 429 model_overloaded
Это была перегрузка самой модели, а не исчерпание лимита аккаунта — следующие запросы снова прошли с HTTP 200.
Selora
Сайт: https://selora.lol/
Документация: https://selora.lol/docs
API: https://api.selora.lol/v1
У Selora есть бесплатный тариф Nova на 14 дней. Для активации нужно привязать Telegram и вступить в канал сервиса.
После активации дают до $5 API‑кредитов на каждые 4 часа, при этом общий недельный лимит — $30.

/v1/models вернул 10 моделей:
claude-fable-5 claude-fable-5-1 claude-haiku-4-5 claude-opus-4-8 claude-opus-5 claude-sonnet-5 gpt-5-6-luna gpt-5-6-sol gpt-6-astra kimi-k3
Проверил все десять через OpenAI‑совместимый /chat/completions — 10 из 10 получили HTTP 200 и вернули API WORKS.
В том числе нормально заработали:
claude-opus-5 claude-sonnet-5 gpt-5-6-sol gpt-6-astra kimi-k3
Есть и Anthropic‑совместимый API через /v1/messages — его отдельно проверил на claude-opus-5, запрос также прошёл успешно.
Лимиты
API сам возвращает:
x-ratelimit-limit: 30 x-ratelimit-remaining: 29 x-ratelimit-reset: 60
То есть лимит составляет 30 RPM.
Отдельного RPD здесь нет — вместо него используется денежное окно:
до $5 / 4 часа до $30 / неделю
На проверку всех десяти моделей ушло совсем немного:
До теста: $5.000000 После теста: $4.999196 Расход: $0.000804
ShareLLM
Сайт: https://sharellm.net/
API: https://sharellm.net/v1
После регистрации ShareLLM сразу даёт отдельный Free‑маршрут для API.
На бесплатном тарифе сейчас доступны:
120 запросов / 5 часов 600 запросов / неделю

Через /v1/models бесплатный ключ вернул 39 моделей. Из них я проверил 10 наиболее интересных:
gpt-5.6-luna grok-4.6 deepseek-v4.1-flash glm-5.3 glm-5.3-flash kimi-k3 qwen3.8-max minimax-m3 gemini-3.8-flash step-5
Все десять маршрутов дали HTTP 200.
gpt-5.6-luna HTTP 200 grok-4.6 HTTP 200 deepseek-v4.1-flash HTTP 200 glm-5.3 HTTP 200 glm-5.3-flash HTTP 200 kimi-k3 HTTP 200 qwen3.8-max HTTP 200 minimax-m3 HTTP 200 gemini-3.8-flash HTTP 200 step-5 HTTP 200
При этом название маршрута не всегда совпадает с тем, что API возвращает в поле model:
gpt-5.6-luna → codex-auto-review glm-5.3 → codely-core kimi-k3 → kimi-k3-oc qwen3.8-max → qwen/qwen3.8-max:free step-5 → step-5-preview
Поэтому названия в /models здесь стоит воспринимать как названия маршрутов, а не как точное указание, какая модель реально стоит за ними.
У kimi-k3 reasoning приходит отдельно в reasoning_content, а финальный ответ — в обычном content. MiniMax M3, наоборот, возвращает рассуждение прямо внутри <think>...</think>.
По скорости разброс большой. Например, deepseek-v4.1-flash и glm-5.3-flash ответили примерно за 1.5 секунды, а маршрут glm-5.3 в одном из тестов занял больше минуты.
Vireonix
Сайт: https://vireonix.ai/
Документация: https://vireonix.ai/docs
API: https://vireonix.ai/v1
Vireonix вообще не требует регистрации и API‑ключа. Достаточно отправить обычный OpenAI‑совместимый запрос.

Через /v1/models доступен один маршрут:
auto
Он сам выбирает модель из общего пула. В описании маршрута указаны MiniMax, Nemotron, GLM, Gemma, Llama, Qwen, GPT‑OSS и некоторые GPT‑модели.
В тесте chat/completions с уникальной строкой вернул HTTP 200 примерно за секунду:
MODEL: auto ANSWER: API WORKS 22b8fc90
Конкретная модель при этом не раскрывается — API возвращает только auto.
У бесплатного маршрута довольно большая квота:
20 000 000 входных токенов / час 200 000 выходных токенов / час контекст до 1 000 000 токенов
Лимит считается по IP и обновляется каждый час. /api/limits отдельно подтвердил, что это стандартная политика, а не временная акция: temporary: false.
OdiRouter
Сайт: https://odirouter.ai
API: https://api.odirouter.ai/v1
У OdiRouter есть отдельный пул моделей с префиксом free-*.

На моём аккаунте среди бесплатных моделей были:
free-claude-haiku-4.5 free-claude-haiku-4-5-20251001 free-gemini-2.5-flash free-gemini-2.5-flash-lite free-gemini-2.5-pro free-gemini-3.1-flash-lite free-gemini-3-flash-preview free-gpt-5.4-mini free-minimax-m2.5 free-minimax-m2.7 free-qwen3.5-flash free-qwen3.5-plus free-qwen-flash-character free-vclaude-haiku-4.5
Не все модели были стабильны. free-gpt-5.4-mini на тесте вернул 502, free-gemini-2.5-flash-lite — 503, а два Gemini preview‑маршрута несколько раз упирались в 504.
Ещё один нюанс с reasoning‑моделями: free-qwen3.5-plus при max_tokens=256 вернул HTTP 200, но финальный content оказался пустым. После увеличения лимита до 1024 модель нормально завершила ответ. Во втором тесте из 299 completion‑токенов 283 пришлись на reasoning, поэтому предыдущего лимита ей, скорее всего, просто не хватило для финального ответа.
prompt_tokens: 25 completion_tokens: 299 reasoning_tokens: 283 total_tokens: 324 finish_reason: stop
Поэтому HTTP 200 с пустым content ещё не означает, что маршрут сломан — у reasoning‑моделей стоит проверить reasoning_content, finish_reason и попробовать увеличить max_tokens.
Итог
Из этой подборки больше всего выделяются Atria, ShareLLM и OdiRouter: у первого огромная бесплатная квота, у второго много сильных моделей, у третьего — отдельный пул реально работающих free-* маршрутов.
Selora тоже очень интересна за счёт Claude Opus, GPT-5.6 Sol и Kimi K3, но бесплатный доступ там ограничен 14 днями. Routeway проще, зато работает при нулевом балансе, а Vireonix вообще не требует регистрации и API‑ключа.
Если знаете другие подобные сервисы — пишите в комментариях. Находки по бесплатным AI‑моделям, API и инструментам я также собираю в Telegram‑канале AI Ungated: https://t.me/AIUngated