Бесплатные модели
Доступные модели, суточные квоты и использование API.
Модели и ограничения
| Аккаунт | Запросов в сутки |
|---|---|
| Зарегистрированный, с подтверждённой почтой | 10 |
| Пополнения от 500 ₽ суммарно | 100 |
Квота общая для перечисленных моделей, веб-чата и API-ключей всех рабочих пространств одного аккаунта. Она обновляется ежедневно в 00:00 UTC. Учитываются успешные пополнения за вычетом возвратов; расходование баланса не уменьшает повышенную квоту. GoRouter Free использует отдельную квоту.
| Модель | Контекст | Максимальный выход |
|---|---|---|
Ling 3.0 Flash Sante (free)inclusionai/ling-3.0-flash-sante:free | 262 144 | 32 768 |
Novita: до 30 запросов в минуту на модель у провайдера, суммарно для всех пользователей API и чата. Бесплатная и платная версии одной модели используют общую очередь. Ожидание — до 60 сек., в очереди — до 30 запросов на модель.
Novita: по умолчанию заявлены отсутствие обучения на запросах и Zero Data Retention; условия предусматривают исключения для предоставления сервиса, поддержки и требований закона. Политика конфиденциальности · Условия использования, п. 10.2
Запрос к API
Бесплатные модели работают через Chat Completions и веб-чат. Баланс за запросы не списывается. Используйте ID модели с суффиксом :free.
curl https://gorouter.ru/api/v1/chat/completions \
-H "Authorization: Bearer $GOROUTER_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "inclusionai/ling-3.0-flash-sante:free",
"messages": [{"role": "user", "content": "Привет!"}],
"max_tokens": 1024
}'Для потокового ответа добавьте "stream": true. Вызовы инструментов и рассуждения доступны у моделей, которые их поддерживают.
Остаток квоты
Ответ содержит заголовки:
| Заголовок | Значение |
|---|---|
x-gorouter-free-tier | Уровень: base или funded |
x-gorouter-free-limit | Суточная квота |
x-gorouter-free-remaining | Осталось запросов с учётом выполняющихся |
x-gorouter-free-reset | Следующее обновление квоты в UTC |
При исчерпании квоты API возвращает 429 free_quota_exceeded. Заголовок Retry-After указывает число секунд до её обновления. Начавшаяся генерация расходует один запрос, в том числе при отмене клиентом; подтверждённый отказ провайдера возвращает запрос в квоту.
Очередь провайдера
При достижении частоты запросов провайдера запрос ожидает своей очереди в рамках открытого соединения. Отмена или истечение ожидания до отправки провайдеру освобождает резерв: деньги и бесплатный запрос не расходуются.
При заполненной очереди API возвращает 429 provider_queue_full, при истечении ожидания — 429 provider_queue_timeout. Retry-After указывает, через сколько секунд можно повторить запрос; это не гарантирует свободное место. Если провайдер вернул 429, следующие отправки приостанавливаются на указанный им срок. Начавшаяся генерация автоматически не повторяется.