Где ещё дают LLM API бесплатно: проверяю очередные находки. AI router.. AI router. API.. AI router. API. Claude.. AI router. API. Claude. gemini.. AI router. API. Claude. gemini. llm.. AI router. API. Claude. gemini. llm. minimax.. AI router. API. Claude. gemini. llm. minimax. Natural Language Processing.. AI router. API. Claude. gemini. llm. minimax. Natural Language Processing. OpenAI-compatible API.. AI router. API. Claude. gemini. llm. minimax. Natural Language Processing. OpenAI-compatible API. qwen.. AI router. API. Claude. gemini. llm. minimax. Natural Language Processing. OpenAI-compatible API. qwen. бесплатные API.. AI router. API. Claude. gemini. llm. minimax. Natural Language Processing. OpenAI-compatible API. qwen. бесплатные API. искусственный интеллект.. AI router. API. Claude. gemini. llm. minimax. Natural Language Processing. OpenAI-compatible API. qwen. бесплатные API. искусственный интеллект. Машинное обучение.. AI router. API. Claude. gemini. llm. minimax. Natural Language Processing. OpenAI-compatible API. qwen. бесплатные API. искусственный интеллект. Машинное обучение. нейросети.. AI router. API. Claude. gemini. llm. minimax. Natural Language Processing. OpenAI-compatible API. qwen. бесплатные API. искусственный интеллект. Машинное обучение. нейросети. Облачные сервисы.. AI router. API. Claude. gemini. llm. minimax. Natural Language Processing. OpenAI-compatible API. qwen. бесплатные API. искусственный интеллект. Машинное обучение. нейросети. Облачные сервисы. Проектирование API.

Проверил малоизвестные LLM API с бесплатными моделями, лимитами и реальными запросами.

Вот что получилось:

Atria

Сайт: https://api.atria-asi.ai/
Документация: https://api.atria-asi.ai/docs
API: https://api.atria-asi.ai/v1

Сразу после регистрации мне начислили 100 000 000 токенов.

Новый аккаунт сразу после регистрации: 100 млн доступных токенов.

Новый аккаунт сразу после регистрации: 100 млн доступных токенов.

Доступна одна модель — Atria-Dawn-Preview. Это агентная модель Shanghai AI Lab на базе 744B MoE GLM-5.2, рассчитанная на исследовательские, инженерные и многошаговые задачи с инструментами. (Hugging Face)

Контекст — 256K, максимальный output — 65 536 токенов. Модель принимает только текст.

Atria поддерживает сразу три API, все три у меня реально заработали:

Chat Completions    HTTP 200
Responses API       HTTP 200
Anthropic Messages  HTTP 200

Responses API отдельно возвращает reasoning и финальный ответ, Anthropic Messages — блоки thinking и text, а обычный Chat Completions возвращает только текстовый ответ.

Лимиты

В документации указано 60 RPM на аккаунт, причём лимит общий для Chat Completions, Responses и Messages.

Но мой аккаунт во всех ответах стабильно получал:

x-rpm-limit: 50

Поэтому фактически для него сервер выставил 50 RPM.

Дополнительно отправил 51 запрос примерно за минуту:

HTTP 200 — 47
HTTP 429 — 0
ERR      — 4

Четыре ошибки были локально отменёнными задачами, а не ответами API. Поэтому жёсткую границу через 429 поймать не удалось, но фактический серверный заголовок показывает 50 RPM. RPD отдельно не указан.


Routeway

Сайт: https://routeway.ai/
Документация: https://docs.routeway.ai/
API: https://api.routeway.ai/v1

После регистрации баланс у меня был $0.00, но бесплатные маршруты при этом работают отдельно от баланса.

 Routeway после тестов: 12 API-запросов при балансе $0.00.

Routeway после тестов: 12 API-запросов при балансе $0.00.

/v1/models вернул 263 модели, но бесплатными в каталоге отмечены отдельные маршруты с суффиксом :free.

В моём аккаунте были доступны:

deepseek-v4-flash:free
minimax-m2.7:free
muse-glimmer-30b:free

По факту результаты получились разные.

minimax-m2.7:free работает:

HTTP 200
MODEL: minimax-m2.7:free
ANSWER: API WORKS

Модель возвращает reasoning прямо внутри ответа в блоке <think>, а затем финальный текст.

muse-glimmer-30b:free после первой ошибки заработала стабильно:

TRY 1 — HTTP 200
TRY 2 — HTTP 200
TRY 3 — HTTP 200

Во всех трёх запросах ответ был API WORKS.

А вот deepseek-v4-flash:free у меня не заработал вообще:

HTTP 502
HTTP 502
HTTP 502
HTTP 502

Поэтому в список реально работающих бесплатных моделей я его не включаю.

Лимиты

Routeway сам возвращает лимиты в заголовках:

x-ratelimit-limit-minute: 5
x-ratelimit-limit-day: 200

То есть бесплатный тариф даёт:

5 RPM
200 запросов в сутки

При этом неудачные запросы тоже учитываются в дневной квоте. После серии тестов x-ratelimit-remaining-day уменьшался даже после 502 и 429.

Один раз MiniMax M2.7 вернул:

HTTP 429
model_overloaded

Это была перегрузка самой модели, а не исчерпание лимита аккаунта — следующие запросы снова прошли с HTTP 200.


Selora

Сайт: https://selora.lol/
Документация: https://selora.lol/docs
API: https://api.selora.lol/v1

У Selora есть бесплатный тариф Nova на 14 дней. Для активации нужно привязать Telegram и вступить в канал сервиса.

После активации дают до $5 API-кредитов на каждые 4 часа, при этом общий недельный лимит — $30.

Selora после тестов: 11 API-запросов, лимит $5 на 4 часа и $30 в неделю.

Selora после тестов: 11 API-запросов, лимит $5 на 4 часа и $30 в неделю.

/v1/models вернул 10 моделей:

claude-fable-5
claude-fable-5-1
claude-haiku-4-5
claude-opus-4-8
claude-opus-5
claude-sonnet-5
gpt-5-6-luna
gpt-5-6-sol
gpt-6-astra
kimi-k3

Проверил все десять через OpenAI-совместимый /chat/completions10 из 10 получили HTTP 200 и вернули API WORKS.

В том числе нормально заработали:

claude-opus-5
claude-sonnet-5
gpt-5-6-sol
gpt-6-astra
kimi-k3

Есть и Anthropic-совместимый API через /v1/messages — его отдельно проверил на claude-opus-5, запрос также прошёл успешно.

Лимиты

API сам возвращает:

x-ratelimit-limit: 30
x-ratelimit-remaining: 29
x-ratelimit-reset: 60

То есть лимит составляет 30 RPM.

Отдельного RPD здесь нет — вместо него используется денежное окно:

до $5 / 4 часа
до $30 / неделю

На проверку всех десяти моделей ушло совсем немного:

До теста:    $5.000000
После теста: $4.999196
Расход:      $0.000804

ShareLLM

Сайт: https://sharellm.net/
API: https://sharellm.net/v1

После регистрации ShareLLM сразу даёт отдельный Free-маршрут для API.

На бесплатном тарифе сейчас доступны:

120 запросов / 5 часов
600 запросов / неделю
Бесплатный тариф ShareLLM: 120 запросов за 5 часов и 600 запросов в неделю.

Бесплатный тариф ShareLLM: 120 запросов за 5 часов и 600 запросов в неделю.

Через /v1/models бесплатный ключ вернул 39 моделей. Из них я проверил 10 наиболее интересных:

gpt-5.6-luna
grok-4.6
deepseek-v4.1-flash
glm-5.3
glm-5.3-flash
kimi-k3
qwen3.8-max
minimax-m3
gemini-3.8-flash
step-5

Все десять маршрутов дали HTTP 200.

gpt-5.6-luna         HTTP 200
grok-4.6             HTTP 200
deepseek-v4.1-flash  HTTP 200
glm-5.3              HTTP 200
glm-5.3-flash        HTTP 200
kimi-k3              HTTP 200
qwen3.8-max          HTTP 200
minimax-m3           HTTP 200
gemini-3.8-flash     HTTP 200
step-5               HTTP 200

При этом название маршрута не всегда совпадает с тем, что API возвращает в поле model:

gpt-5.6-luna  → codex-auto-review
glm-5.3       → codely-core
kimi-k3       → kimi-k3-oc
qwen3.8-max   → qwen/qwen3.8-max:free
step-5        → step-5-preview

Поэтому названия в /models здесь стоит воспринимать как названия маршрутов, а не как точное указание, какая модель реально стоит за ними.

У kimi-k3 reasoning приходит отдельно в reasoning_content, а финальный ответ — в обычном content. MiniMax M3, наоборот, возвращает рассуждение прямо внутри <think>...</think>.

По скорости разброс большой. Например, deepseek-v4.1-flash и glm-5.3-flash ответили примерно за 1.5 секунды, а маршрут glm-5.3 в одном из тестов занял больше минуты.


Vireonix

Сайт: https://vireonix.ai/
Документация: https://vireonix.ai/docs
API: https://vireonix.ai/v1

Vireonix вообще не требует регистрации и API-ключа. Достаточно отправить обычный OpenAI-совместимый запрос.

Vireonix: бесплатный API без аккаунта и без API-ключа.

Vireonix: бесплатный API без аккаунта и без API-ключа.

Через /v1/models доступен один маршрут:

auto

Он сам выбирает модель из общего пула. В описании маршрута указаны MiniMax, Nemotron, GLM, Gemma, Llama, Qwen, GPT-OSS и некоторые GPT-модели.

В тесте chat/completions с уникальной строкой вернул HTTP 200 примерно за секунду:

MODEL:  auto
ANSWER: API WORKS 22b8fc90

Конкретная модель при этом не раскрывается — API возвращает только auto.

У бесплатного маршрута довольно большая квота:

20 000 000 входных токенов / час
200 000 выходных токенов / час
контекст до 1 000 000 токенов

Лимит считается по IP и обновляется каждый час. /api/limits отдельно подтвердил, что это стандартная политика, а не временная акция: temporary: false.


OdiRouter

Сайт: https://odirouter.ai
API: https://api.odirouter.ai/v1

У OdiRouter есть отдельный пул моделей с префиксом free-*.

Список бесплатных моделей OdiRouter.

Список бесплатных моделей OdiRouter.

На моём аккаунте среди бесплатных моделей были:

free-claude-haiku-4.5
free-claude-haiku-4-5-20251001
free-gemini-2.5-flash
free-gemini-2.5-flash-lite
free-gemini-2.5-pro
free-gemini-3.1-flash-lite
free-gemini-3-flash-preview
free-gpt-5.4-mini
free-minimax-m2.5
free-minimax-m2.7
free-qwen3.5-flash
free-qwen3.5-plus
free-qwen-flash-character
free-vclaude-haiku-4.5

Не все модели были стабильны. free-gpt-5.4-mini на тесте вернул 502, free-gemini-2.5-flash-lite503, а два Gemini preview-маршрута несколько раз упирались в 504.

Ещё один нюанс с reasoning-моделями: free-qwen3.5-plus при max_tokens=256 вернул HTTP 200, но финальный content оказался пустым. После увеличения лимита до 1024 модель нормально завершила ответ. Во втором тесте из 299 completion-токенов 283 пришлись на reasoning, поэтому предыдущего лимита ей, скорее всего, просто не хватило для финального ответа.

prompt_tokens:     25
completion_tokens: 299
reasoning_tokens:  283
total_tokens:      324
finish_reason:     stop

Поэтому HTTP 200 с пустым content ещё не означает, что маршрут сломан — у reasoning-моделей стоит проверить reasoning_content, finish_reason и попробовать увеличить max_tokens.


Итог

Из этой подборки больше всего выделяются Atria, ShareLLM и OdiRouter: у первого огромная бесплатная квота, у второго много сильных моделей, у третьего — отдельный пул реально работающих free-* маршрутов.

Selora тоже очень интересна за счёт Claude Opus, GPT-5.6 Sol и Kimi K3, но бесплатный доступ там ограничен 14 днями. Routeway проще, зато работает при нулевом балансе, а Vireonix вообще не требует регистрации и API-ключа.

Если знаете другие подобные сервисы — пишите в комментариях. Находки по бесплатным AI-моделям, API и инструментам я также собираю в Telegram-канале AI Ungated: https://t.me/AIUngated

Автор: Ungated

Источник