Проверил малоизвестные LLM API с бесплатными моделями, лимитами и реальными запросами.
Вот что получилось:
Atria
Сайт: https://api.atria-asi.ai/
Документация: https://api.atria-asi.ai/docs
API: https://api.atria-asi.ai/v1
Сразу после регистрации мне начислили 100 000 000 токенов.
Доступна одна модель — Atria-Dawn-Preview. Это агентная модель Shanghai AI Lab на базе 744B MoE GLM-5.2, рассчитанная на исследовательские, инженерные и многошаговые задачи с инструментами. (Hugging Face)
Контекст — 256K, максимальный output — 65 536 токенов. Модель принимает только текст.
Atria поддерживает сразу три API, все три у меня реально заработали:
Chat Completions HTTP 200
Responses API HTTP 200
Anthropic Messages HTTP 200
Responses API отдельно возвращает reasoning и финальный ответ, Anthropic Messages — блоки thinking и text, а обычный Chat Completions возвращает только текстовый ответ.
Лимиты
В документации указано 60 RPM на аккаунт, причём лимит общий для Chat Completions, Responses и Messages.
Но мой аккаунт во всех ответах стабильно получал:
x-rpm-limit: 50
Поэтому фактически для него сервер выставил 50 RPM.
Дополнительно отправил 51 запрос примерно за минуту:
HTTP 200 — 47
HTTP 429 — 0
ERR — 4
Четыре ошибки были локально отменёнными задачами, а не ответами API. Поэтому жёсткую границу через 429 поймать не удалось, но фактический серверный заголовок показывает 50 RPM. RPD отдельно не указан.
Routeway
Сайт: https://routeway.ai/
Документация: https://docs.routeway.ai/
API: https://api.routeway.ai/v1
После регистрации баланс у меня был $0.00, но бесплатные маршруты при этом работают отдельно от баланса.
/v1/models вернул 263 модели, но бесплатными в каталоге отмечены отдельные маршруты с суффиксом :free.
В моём аккаунте были доступны:
deepseek-v4-flash:free
minimax-m2.7:free
muse-glimmer-30b:free
По факту результаты получились разные.
minimax-m2.7:free работает:
HTTP 200
MODEL: minimax-m2.7:free
ANSWER: API WORKS
Модель возвращает reasoning прямо внутри ответа в блоке <think>, а затем финальный текст.
muse-glimmer-30b:free после первой ошибки заработала стабильно:
TRY 1 — HTTP 200
TRY 2 — HTTP 200
TRY 3 — HTTP 200
Во всех трёх запросах ответ был API WORKS.
А вот deepseek-v4-flash:free у меня не заработал вообще:
HTTP 502
HTTP 502
HTTP 502
HTTP 502
Поэтому в список реально работающих бесплатных моделей я его не включаю.
Лимиты
Routeway сам возвращает лимиты в заголовках:
x-ratelimit-limit-minute: 5
x-ratelimit-limit-day: 200
То есть бесплатный тариф даёт:
5 RPM
200 запросов в сутки
При этом неудачные запросы тоже учитываются в дневной квоте. После серии тестов x-ratelimit-remaining-day уменьшался даже после 502 и 429.
Один раз MiniMax M2.7 вернул:
HTTP 429
model_overloaded
Это была перегрузка самой модели, а не исчерпание лимита аккаунта — следующие запросы снова прошли с HTTP 200.
Selora
Сайт: https://selora.lol/
Документация: https://selora.lol/docs
API: https://api.selora.lol/v1
У Selora есть бесплатный тариф Nova на 14 дней. Для активации нужно привязать Telegram и вступить в канал сервиса.
После активации дают до $5 API-кредитов на каждые 4 часа, при этом общий недельный лимит — $30.
/v1/models вернул 10 моделей:
claude-fable-5
claude-fable-5-1
claude-haiku-4-5
claude-opus-4-8
claude-opus-5
claude-sonnet-5
gpt-5-6-luna
gpt-5-6-sol
gpt-6-astra
kimi-k3
Проверил все десять через OpenAI-совместимый /chat/completions — 10 из 10 получили HTTP 200 и вернули API WORKS.
В том числе нормально заработали:
claude-opus-5
claude-sonnet-5
gpt-5-6-sol
gpt-6-astra
kimi-k3
Есть и Anthropic-совместимый API через /v1/messages — его отдельно проверил на claude-opus-5, запрос также прошёл успешно.
Лимиты
API сам возвращает:
x-ratelimit-limit: 30
x-ratelimit-remaining: 29
x-ratelimit-reset: 60
То есть лимит составляет 30 RPM.
Отдельного RPD здесь нет — вместо него используется денежное окно:
до $5 / 4 часа
до $30 / неделю
На проверку всех десяти моделей ушло совсем немного:
До теста: $5.000000
После теста: $4.999196
Расход: $0.000804
ShareLLM
Сайт: https://sharellm.net/
API: https://sharellm.net/v1
После регистрации ShareLLM сразу даёт отдельный Free-маршрут для API.
На бесплатном тарифе сейчас доступны:
120 запросов / 5 часов
600 запросов / неделю
Через /v1/models бесплатный ключ вернул 39 моделей. Из них я проверил 10 наиболее интересных:
gpt-5.6-luna
grok-4.6
deepseek-v4.1-flash
glm-5.3
glm-5.3-flash
kimi-k3
qwen3.8-max
minimax-m3
gemini-3.8-flash
step-5
Все десять маршрутов дали HTTP 200.
gpt-5.6-luna HTTP 200
grok-4.6 HTTP 200
deepseek-v4.1-flash HTTP 200
glm-5.3 HTTP 200
glm-5.3-flash HTTP 200
kimi-k3 HTTP 200
qwen3.8-max HTTP 200
minimax-m3 HTTP 200
gemini-3.8-flash HTTP 200
step-5 HTTP 200
При этом название маршрута не всегда совпадает с тем, что API возвращает в поле model:
gpt-5.6-luna → codex-auto-review
glm-5.3 → codely-core
kimi-k3 → kimi-k3-oc
qwen3.8-max → qwen/qwen3.8-max:free
step-5 → step-5-preview
Поэтому названия в /models здесь стоит воспринимать как названия маршрутов, а не как точное указание, какая модель реально стоит за ними.
У kimi-k3 reasoning приходит отдельно в reasoning_content, а финальный ответ — в обычном content. MiniMax M3, наоборот, возвращает рассуждение прямо внутри <think>...</think>.
По скорости разброс большой. Например, deepseek-v4.1-flash и glm-5.3-flash ответили примерно за 1.5 секунды, а маршрут glm-5.3 в одном из тестов занял больше минуты.
Vireonix
Сайт: https://vireonix.ai/
Документация: https://vireonix.ai/docs
API: https://vireonix.ai/v1
Vireonix вообще не требует регистрации и API-ключа. Достаточно отправить обычный OpenAI-совместимый запрос.
Через /v1/models доступен один маршрут:
auto
Он сам выбирает модель из общего пула. В описании маршрута указаны MiniMax, Nemotron, GLM, Gemma, Llama, Qwen, GPT-OSS и некоторые GPT-модели.
В тесте chat/completions с уникальной строкой вернул HTTP 200 примерно за секунду:
MODEL: auto
ANSWER: API WORKS 22b8fc90
Конкретная модель при этом не раскрывается — API возвращает только auto.
У бесплатного маршрута довольно большая квота:
20 000 000 входных токенов / час
200 000 выходных токенов / час
контекст до 1 000 000 токенов
Лимит считается по IP и обновляется каждый час. /api/limits отдельно подтвердил, что это стандартная политика, а не временная акция: temporary: false.
OdiRouter
Сайт: https://odirouter.ai
API: https://api.odirouter.ai/v1
У OdiRouter есть отдельный пул моделей с префиксом free-*.
На моём аккаунте среди бесплатных моделей были:
free-claude-haiku-4.5
free-claude-haiku-4-5-20251001
free-gemini-2.5-flash
free-gemini-2.5-flash-lite
free-gemini-2.5-pro
free-gemini-3.1-flash-lite
free-gemini-3-flash-preview
free-gpt-5.4-mini
free-minimax-m2.5
free-minimax-m2.7
free-qwen3.5-flash
free-qwen3.5-plus
free-qwen-flash-character
free-vclaude-haiku-4.5
Не все модели были стабильны. free-gpt-5.4-mini на тесте вернул 502, free-gemini-2.5-flash-lite — 503, а два Gemini preview-маршрута несколько раз упирались в 504.
Ещё один нюанс с reasoning-моделями: free-qwen3.5-plus при max_tokens=256 вернул HTTP 200, но финальный content оказался пустым. После увеличения лимита до 1024 модель нормально завершила ответ. Во втором тесте из 299 completion-токенов 283 пришлись на reasoning, поэтому предыдущего лимита ей, скорее всего, просто не хватило для финального ответа.
prompt_tokens: 25
completion_tokens: 299
reasoning_tokens: 283
total_tokens: 324
finish_reason: stop
Поэтому HTTP 200 с пустым content ещё не означает, что маршрут сломан — у reasoning-моделей стоит проверить reasoning_content, finish_reason и попробовать увеличить max_tokens.
Итог
Из этой подборки больше всего выделяются Atria, ShareLLM и OdiRouter: у первого огромная бесплатная квота, у второго много сильных моделей, у третьего — отдельный пул реально работающих free-* маршрутов.
Selora тоже очень интересна за счёт Claude Opus, GPT-5.6 Sol и Kimi K3, но бесплатный доступ там ограничен 14 днями. Routeway проще, зато работает при нулевом балансе, а Vireonix вообще не требует регистрации и API-ключа.
Если знаете другие подобные сервисы — пишите в комментариях. Находки по бесплатным AI-моделям, API и инструментам я также собираю в Telegram-канале AI Ungated: https://t.me/AIUngated
Автор: Ungated


