Google: Gemma 4 26B A4B

google/gemma-4-26b-a4b-it
Документация

Gemma 4 26B A4B IT — это модель Mixture-of-Experts (MoE) с инструкционной настройкой от Google DeepMind. Несмотря на 25.2B общих параметров, во время инференса активируется только 3.8B на токен, что обеспечивает качество, близкое к -31B, при доле вычислительных затрат. Поддерживает мультимодальный ввод, включая текст, изображения и видео (до 60 секунд при 1fps). Имеет контекстное окно в 256K токенов, встроенный вызов функций, настраиваемый режим мышления/рассуждения и поддержку структурированного вывода. Выпущена под лицензией Apache 2.0.

Модальности
Вход / выход за 1 млн
8,66 ₽ / 42,08 ₽
Контекст
262 144
Добавлена
3 апр. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

9 поставщика · 9 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
DarkbloomДешевле
darkbloom·Стандарт
5,20 ₽27,23 ₽2,73 с11 ток/с99,99%
cloudflare·Стандарт
12,38 ₽37,13 ₽538 мс46 ток/с99,94%
deepinfra/fp8·FP8
8,66 ₽42,08 ₽361 мс26 ток/с99,89%
nextbit/bf16·BF16
12,38 ₽49,51 ₽6,19 ₽806 мс35 ток/с99,77%
siliconflow/fp8·FP8
14,85 ₽49,51 ₽1,3 с31 ток/с98,62%
novita/bf16·BF16
16,09 ₽49,51 ₽841 мс35 ток/с99,87%
venice/bf16·BF16
16,09 ₽49,51 ₽6,19 ₽1,22 с20 ток/с98,11%
parasail/bf16·BF16
16,09 ₽49,51 ₽6,19 ₽946 мс17 ток/с98,59%
google-vertex/global·Стандарт
18,57 ₽74,27 ₽2,5 с23 ток/с99,60%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены8,66 ₽за 1 млн токенов
Выходные токены42,08 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Интеллекттоп 63%
26,1индекс

место 73 из 117

Кодтоп 53%
39,3индекс

место 75 из 143

Агентные задачитоп 67%
11индекс

место 78 из 118

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
GPQA Diamond
73,9%точность

3 552 задач

τ-bench Verified — Airline
68,3%точность

1 044 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

imagetextvideo

Выходные модальности

text
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "google/gemma-4-26b-a4b-it",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'