Бесплатные API-шлюзы для доступа к большим языковым моделям — удобный способ познакомиться с технологией без затрат. Автор обзора на Habr протестировал шесть таких сервисов реальными запросами, чтобы выяснить, какие модели доступны без оплаты, какие стартовые бонусы начисляются и какие лимиты RPM действуют на практике.

Первым в списке идет VyceAI. После регистрации сервис начислил $40 внутреннего API-баланса, но для доступа к моделям требуется привязать Discord. На Free-аккаунте доступны четыре текстовые модели: gpt-5.6-new, gpt-5.6-luna, claude-sonnet-4-6 и deepseek-v4-flash. Лимиты составляют 60 запросов в минуту, а дневной лимит для gpt-5.6-new — 250 млн токенов. Цены варьируются от $0.09 до $3 за миллион входных токенов.

СервисСтартовый бонусДоступные моделиЛимиты
VyceAI$40gpt-5.6-new, gpt-5.6-luna, claude-sonnet-4-6, deepseek-v4-flash60 RPM, 250 млн токенов/день для gpt-5.6-new
Experiential Labsqwen3.8-27b, deepseek-v4-flash, gpt-5.6-luna, minimax-m2.7-free, minimax-m3-free, openrouter-free~24 RPM для gpt-5.6-luna
Dahl Inference100 млн токеновMiniMax-M2.7, DeepSeek-V4-Flash-073160 RPM (MiniMax M2.7)
APInex$0free/qwen-3.8-max, free/gpt-5.6-luna, free/glm-5.3-flash, free/deepseek-v4-flash-0731, free/deepseek-v4-pro-081330 RPM на аккаунт
ModelRouter150 000 токенов/сутки59 моделей, включая claude-opus-5, claude-sonnet-5, kimi-k3, glm-5.210 RPM
TokenForge$50 + $20/деньclaude-opus-5Нет явного RPM, но нестабильная работа

Experiential Labs предлагает огромный каталог моделей, но не все из них доступны бесплатно. Метка FREE в каталоге не всегда означает отсутствие оплаты: для некоторых моделей сервис требует $1 для верификации аккаунта. Автору удалось бесплатно вызвать qwen3.8-27b, deepseek-v4-flash, gpt-5.6-luna, minimax-m2.7-free, minimax-m3-free и openrouter-free. Практический тест показал, что gpt-5.6-luna выдерживает около 24 запросов в минуту без ошибок 429.

Experiential Labs позволяет бесплатно вызывать ряд моделей, но метка FREE не всегда означает отсутствие платежа.

Dahl Inference начисляет 100 млн токенов после регистрации, которые нужно вручную выделить на API-ключ. Доступны две модели: MiniMaxAI/MiniMax-M2.7 и deepseek-ИИ/DeepSeek-V4-Flash-0731. Схема биллинга необычная: списывается ровно столько токенов, сколько заняли запрос и ответ вместе. Тест показал, что MiniMax M2.7 отвечает примерно за 0,56 секунды, а DeepSeek V4 Flash — заметно медленнее, иногда с ошибкой HTTP 524. Нагрузочный тест MiniMax M2.7 показал стабильные 60 RPM.

APInex предоставляет доступ к пяти бесплатным моделям, включая free/gpt-5.6-luna и free/deepseek-v4-flash-0731. API сам отдает rate-limit в заголовках: общий лимит 30 запросов в минуту на аккаунт. ModelRouter на Free-плане дает 150 000 внутренних токенов в сутки и 10 RPM. Через /v1/models доступно 59 моделей, но некоторые из них работают нестабильно: gemini-3.1-pro-preview возвращает пустой content, а gpt-5.6-sol — ошибку 500.

TokenForge начисляет $50 стартового баланса и $20 ежедневно через Check in. После первого бонуса баланс составил $70. Доступна только одна модель — claude-opus-5. Собственного RPM-лимита обнаружить не удалось, но модель работала нестабильно: из 60 запросов успешно прошли только 17.

Эти сервисы позволяют разработчикам тестировать приложения без финансовых вложений, но важно учитывать ограничения и возможную нестабильность работы. Рекомендуется проверять актуальные лимиты и доступность моделей перед началом использования.