Meta: Llama 4 Scout

meta-llama/llama-4-scout
Документация

Llama 4 Scout 17B Instruct (16E) — это языковая модель со смешанной экспертной архитектурой (MoE), разработанная компанией Meta, которая активирует 17 миллиарда параметров из общего числа 109B. Модель поддерживает нативный мультимодальный ввод (текст и изображения) и многоязычный вывод (текст и код) на 12 поддерживаемых языках. Созданная для ассистентского взаимодействия и визуального рассуждения, Scout использует 16 экспертов за один прямой проход и имеет длину контекста в 10 миллиона токенов, с обучающим корпусом объёмом около 40 триллионов токенов. Разработанная для высокой эффективности и локального или коммерческого развёртывания, Llama 4 Scout включает раннее слияние для бесшовной интеграции модальностей. Модель дообучена на инструкциях для использования в многоязычных чатах, генерации подписей и задачах понимания изображений. Выпущена под лицензией Llama 4 Community License, модель последний раз обучалась на данных, актуальных по август 2024, и была публично запущена в апреле 5, 2025.

Модальности
Вход / выход за 1 млн
12,38 ₽ / 37,13 ₽
Контекст
1 310 720
Добавлена
5 апр. 2025 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

3 поставщика · 3 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
DeepInfraДешевле
deepinfra/fp8·FP8
12,38 ₽37,13 ₽566 мс5 ток/с99,89%
novita/bf16·BF16
22,28 ₽73,03 ₽874 мс3 ток/с99,73%
google-vertex/us-east5·Стандарт
30,94 ₽86,64 ₽584 мс10 ток/с99,99%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены12,38 ₽за 1 млн токенов
Выходные токены37,13 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Интеллекттоп 95%
10,3индекс

место 111 из 117

Кодтоп 96%
8,2индекс

место 136 из 143

Агентные задачитоп 98%
1,1индекс

место 115 из 118

Design Arena

ELO и доля побед по категориям визуальных задач.

Источник
Визуализация данныхтоп 97%
915ELO
39,3%побед11,7 ссреднее132/137место
Категории кодатоп 100%
811ELO
26,6%побед12 ссреднее141/141место
Разработка игртоп 100%
809ELO
27,4%побед14,9 ссреднее139/139место
UI-компонентытоп 100%
791ELO
25,5%побед12,1 ссреднее136/136место
Веб-сайтытоп 100%
767ELO
22,7%побед11,9 ссреднее151/151место

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

textimage

Выходные модальности

text
frequency_penaltylogit_biasmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/llama-4-scout",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'