Google: Gemini 2.5 Flash Lite

google/gemini-2.5-flash-lite
Документация

Gemini 2.5 Flash-Lite — это легковесная модель рассуждений в семействе Gemini 2.5, оптимизированная для сверхнизкой задержки и экономической эффективности. Она обеспечивает улучшенную пропускную способность, более быструю генерацию токенов и лучшую производительность в общих бенчмарках по сравнению с более ранними моделями Flash. По умолчанию «мышление» (т.е. многопроходные рассуждения) отключено для приоритета скорости, но разработчики могут включить его через параметр Reasoning API, чтобы избирательно обменивать стоимость на интеллект.

Модальности
Вход / выход за 1 млн
12,38 ₽ / 49,51 ₽
Контекст
1 048 576
Добавлена
22 июл. 2025 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

2 поставщика · 5 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
Google AI StudioДешевле
google-ai-studio/flex·Стандарт
6,19 ₽24,76 ₽0,62 ₽668 мс75 ток/с100,00%
google-vertex/eu·Стандарт
12,38 ₽49,51 ₽1,24 ₽441 мс76 ток/с99,36%
google-vertex·Стандарт
12,38 ₽49,51 ₽1,24 ₽1,09 с78 ток/с99,39%
google-ai-studio·Стандарт
12,38 ₽49,51 ₽1,24 ₽601 мс173 ток/с98,16%
google-ai-studio/priority·Стандарт
22,28 ₽89,12 ₽2,23 ₽233 мс396 ток/с98,83%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены12,38 ₽за 1 млн токенов
Выходные токены49,51 ₽за 1 млн токенов
Чтение кэша1,24 ₽за 1 млн токенов
Запись кэша10,31 ₽за 1 млн токенов
Входное изображение12,38 ₽за 1 млн токенов
Входное аудио37,13 ₽за 1 млн токенов
Кэш входного аудио3,71 ₽за 1 млн токенов
Веб-поиск1,73 ₽за поиск
Reasoning-токены49,51 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
GPQA Diamond
55%точность

396 задач

τ-bench Verified — Airline
47,3%точность

50 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

textimagefileaudiovideo

Выходные модальности

text
include_reasoningmax_tokensreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_p

Пример запроса

AUDIO_BASE64=$(base64 < audio.wav | tr -d '\n')

curl https://gorouter.ru/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d "{"model":"google/gemini-2.5-flash-lite","input_audio":{"data":"$AUDIO_BASE64","format":"wav"}}"