Бесплатные LLM API: практическое тестирование шести сервисов с реальными лимитами
Разработчики ищут способы интегрировать мощные языковые модели в свои проекты без начальных инвестиций. Однако многие сервисы, обещающие бесплатные API, скрывают существенные ограничения. В этой статье собраны результаты реальных запросов к шести платформам: Atria, Routeway, Selora, ShareLLM, Vireonix и OdiRouter. Мы разобрали, какие модели действительно доступны, как настроены лимиты скорости и потребления, и где встречаются технические сбои.
# Где получить доступ к LLM API бесплатно: результаты независимого тестирования
В эпоху распространения больших языковых моделей (LLM) доступ к ним через открытый API стал критически важным ресурсом для разработчиков. Платформы вроде OpenAI или Anthropic предлагают мощные инструменты, но часто требуют платных подписок или начального депозита. В ответ на этот спрос появилось множество агрегаторов и нишевых сервисов, предлагающих бесплатные ключи. Однако маркетинговые обещания иногда не совпадают с реальностью.
Ниже представлен анализ шести сервисов, основанный на прямых запросах к их API. Проверка включала тестирование доступности моделей, работу форматов ответов (включая отображение цепочки рассуждений) и точность заявленных ограничений скорости и объема трафика.
Atria: Гигантские квоты и агентные возможности
Сервис Atria (api.atria-asi.ai) представляет собой платформу от Shanghai AI Lab. После регистрации пользователь получает доступ к модели Atria-Dawn-Preview — агентной системе, построенной на базе архитектуры MoE (Mixture of Experts) с общим количеством параметров 744 миллиарда (GLM-5.2).
Ключевые характеристики * Модель: Atria-Dawn-Preview (744B MoE). * Контекст: Поддержка до 256 000 токенов (256K). * Максимальный вывод: 65 536 токенов. * Начальная квота: Сразу после создания аккаунта доступно 100 миллионов токенов.
Тестирование и ограничения Сервис поддерживает три формата взаимодействия: стандартный Chat Completions, Responses API и Anthropic Messages. В ходе тестов все три интерфейса возвращали статус 200 (ОК).
Главный интерес представляет лимит скорости запросов (RPM — Requests Per Minute). Документация указывает на предел в 60 запросов в минуту для одного аккаунта. Однако практическое тестирование показало, что сервер возвращает заголовок x-rpm-limit: 50, что означает фактическую скорость 50 запросов в минуту.
* Статус лимитов: При отправке 51 запроса за минуту система вернула 47 успешных ответов (200 OK) и 4 ошибки (ERR), связанные с отменой локальных задач, а не блокировкой со стороны API (код 429). * Вывод: Жесткой ошибки недоступности не было, но реальная скорость подачи запросов ограничена 50 в минуту.
Routeway: Доступ без баланса, но с низкой скоростью
Платформа Routeway (routeway.ai) предлагает подход, при котором бесплатный доступ к определенным маршрутам не зависит от балансового счета пользователя. Регистрация создает аккаунт с нулевым балансом, однако тестовые запросы проходят без ошибок.
Доступные модели
В каталоге доступно 263 модели, из которых бесплатные помечены суффиксом :free. Тестировали следующие маршруты:
1. minimax-m2.7:free: Работает стабильно. Модель возвращает блок <think> с промежуточными рассуждениями перед финальным ответом.
2. muse-glimmer-30b:free: После нескольких попыток (HTTP 502) сервис начал работать стабильно.
3. deepseek-v4-flash:free: Не работал на момент тестов. Возвращались постоянные ошибки 502 (Bad Gateway), поэтому маршрут исключен из списка надежных.
Лимиты трафика Сервис четко коммуницирует лимиты через HTTP-заголовки: * 5 RPM: 5 запросов в минуту. * 200 запросов в сутки: Дневная квота.
Важно отметить, что неудачные запросы (ошибки 502 или 429) засчитываются в дневную квоту. Также была зафиксирована ситуация, когда модель возвращала ошибку 429 с кодом model_overloaded. Это указывало не на исчерпание лимитов аккаунта, а на перегрузку конкретного экземпляра модели, которая позже восстановила работоспособность.
Selora: Премиум-модели на условно-бесплатном тарифе
Selora (selora.lol) предлагает доступ к передовым моделям, таким как Claude Opus, Sonnet, GPT-5.6 Sol и Kimi K3, через бесплатный тарифный план «Nova».
Условия доступа Бесплатный тариф активен в течение 14 дней. Для получения доступа необходимо: 1. Привязать аккаунт Telegram. 2. Войти в официальный канал сервиса.
Квоты и лимиты * Финансовая квота: До 5 долларов США API-кредитов каждые 4 часа. Общий недельный лимит — 30 долларов. * Скорость (RPM): 30 запросов в минуту. * Расход: Тестирование 10 моделей сжигало микро-количества средств (около $0.0008 за 10 запросов), но счетчик работал корректно.
Все протестированные модели (Claude Opus 5, GPT-5.6 Sol, Kimi K3 и другие) вернули статус 200 и корректно обработали запросы в формате OpenAI и Anthropic.
ShareLLM: Огромный выбор моделей и путаница в названиях
ShareLLM (sharellm.net) выделяется огромным количеством доступных моделей (39 бесплатных маршрутов). Тестировали 10 наиболее значимых, включая версии Grok 4.6, DeepSeek V4.1, Qwen3.8 Max и Gemini 3.8 Flash.
Наблюдения
* Стабильность: Все проверенные модели вернули HTTP 200.
* Названия маршрутов: Существует несоответствие между именем маршрута в списке моделей и тем, что реально используется API. Например, маршрут gpt-5.6-luna использует модель codex-auto-review, а qwen3.8-max — qwen/qwen3.8-max:free. Это требует от разработчика осторожности при интерпретации документации.
* Обработка рассуждений: Разные модели отображают логику по-разному. У kimi-k3 логика разделена на блок reasoning_content, а у MiniMax M3 — на теги <think>...</think>. Скорость работы моделей сильно варьируется: от 1.5 секунды для быстрых версий до более чем минуты для тяжелых моделей.
Vireonix: API без регистрации и ключей
Vireonix (vireonix.ai) предлагает уникальный сервис: доступ к API без необходимости регистрации аккаунта и создания ключей API. Для работы достаточно отправить прямую OpenAI-совместимую команду.
Технические детали
* Маршрут: Доступен только один агрегированный маршрут auto, который сам выбирает модель из пула (MiniMax, Nemotron, Qwen, Llama и др.).
* Лимиты:
* 20 000 000 входных токенов в час.
* 200 000 выходных токенов в час.
* Контекст до 1 000 000 токенов.
* Политика: Лимиты считаются по IP-адресу и обновляются каждый час. Это подтверждено отдельным эндпоинтом проверки ограничений (/api/limits), который вернул temporary: false.
OdiRouter: Проблемы с reasoning-моделями
OdiRouter (odirouter.ai) предоставляет отдельный пул моделей с префиксом free-*, включая версии Claude Haiku и Gemini. Однако тестирование выявило нестабильность работы некоторых каналов.
Проблемы и особенности
* Сбои: Маршруты free-gpt-5.4-mini (ошибка 502), free-gemini-2.5-flash-lite (ошибка 503) и пรีวิว-версии Gemini давали таймауты (504).
* Нюанс с рассуждениями: Модель free-qwen3.5-plus при коротком лимите вывода (256 токенов) возвращала HTTP 200, но пустой контент ответа. Это произошло потому, что значительная часть лимита уходила на логику рассуждений (283 токенов reasoning против 25 completion). Увеличение лимита до 1024 токенов решило проблему. Это подчеркивает важность учета скрытых затрат на генерацию логики для reasoning-моделей.
Итоговое резюме
Анализ шести сервисов показывает разнообразие подходов к бесплатному доступу:
1. Atria: Лучший выбор для тех, кому нужны огромные объемы трафика (100 млн токенов) и поддержка контекста 256K. Однако скорость ограничена до 50 запросов в минуту. 2. ShareLLM и OdiRouter: Предоставляют широкий спектр моделей, включая современные версии от Grok и Gemini. ShareLLM более стабилен, но требует внимательности к реальным названиям моделей. OdiRouter удобен наличием явного пула бесплатных моделей, но страдает от нестабильности отдельных маршрутов. 3. Selora: Уникальна доступом к элитным моделям (Opus, Sol), но тариф ограничен временем (14 дней) и требует верификации через Telegram. 4. Routeway: Работает без депозита, но имеет низкий лимит скорости (5 RPM) и проблемы с определенными моделями. 5. Vireonix: Самый простой вариант для мгновенного старта без регистрации, с высокими часовыми лимитами, но без выбора конкретной модели.
Для интеграции в продакшн рекомендуется комбинировать эти сервисы или использовать их для прототипирования и обучения моделей перед переходом на платные подписки.
*Примечание редактора:* Мир LLM-инфраструктуры меняется стремительно. То, что работает сегодня, может устареть завтра. Рекомендуется регулярно проверять актуальные статусы доступности на официальных документах сервисов.