Meta: Llama 4 Maverick

meta-llama/llama-4-maverick
Документация

Llama 4 Maverick 17B Instruct (128E) — это высокопроизводительная мультимодальная языковая модель от Meta, построенная на архитектуре смеси экспертов (MoE) с 128 экспертами и 17 миллиардами активных параметров на один прямой проход (всего 400B). Она поддерживает многоязычный текстовый и графический ввод и создаёт многоязычный текст и код на 12 поддерживаемых языках. Оптимизированная для задач зрения и языка, Maverick доработана с помощью инструкций для поведения, подобного ассистенту, логических рассуждений над изображениями и универсального мультимодального взаимодействия. Maverick отличается ранним слиянием для нативной мультимодальности и контекстным окном на 1 миллионов токенов. Модель обучалась на тщательно подобранной смеси публичных, лицензированных и данных платформы Meta, охватывающей примерно 22 триллионов токенов, с датой отсечения знаний — август 2024. Выпущенная в апреле 5, 2025 под лицензией сообщества Llama 4, Maverick подходит для исследовательских и коммерческих приложений, требующих продвинутого мультимодального понимания и высокой пропускной способности модели.

Модальности
Вход / выход за 1 млн
24,76 ₽ / 86,15 ₽
Контекст
1 048 576
Добавлена
5 апр. 2025 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

5 поставщика · 5 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
DigitalOceanДешевле
digitalocean·Стандарт
24,76 ₽86,15 ₽645 мс11 ток/с99,95%
deepinfra/base·FP8
24,76 ₽99,02 ₽458 мс39 ток/с99,13%
novita/fp8·FP8
33,42 ₽105,21 ₽481 мс7 ток/с99,86%
parasail/fp8·FP8
43,32 ₽123,78 ₽21,04 ₽536 мс39 ток/с99,96%
google-vertex/us-east5·Стандарт
43,32 ₽142,34 ₽296 мс24 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены24,76 ₽за 1 млн токенов
Выходные токены86,15 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Интеллекттоп 89%
14,5индекс

место 103 из 117

Кодтоп 80%
16,3индекс

место 114 из 143

Агентные задачитоп 95%
1,2индекс

место 112 из 118

Design Arena

ELO и доля побед по категориям визуальных задач.

Источник
3Dтоп 97%
940ELO
40,2%побед9,5 ссреднее125/130место
UI-компонентытоп 96%
923ELO
40,8%побед12,7 ссреднее130/136место
Визуализация данныхтоп 98%
902ELO
38,4%побед11 ссреднее134/137место
Категории кодатоп 98%
901ELO
35,8%побед13,1 ссреднее137/141место
Веб-сайтытоп 96%
888ELO
34,4%побед13,6 ссреднее144/151место
Разработка игртоп 98%
874ELO
33,7%побед14,3 ссреднее136/139место

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
GPQA Diamond
65,9%точность

2 931 задач

τ-bench Verified — Airline
44,6%точность

448 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

textimage

Выходные модальности

text
frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/llama-4-maverick",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'