Meta: Llama 3.1 8B Instruct

meta-llama/llama-3.1-8b-instruct
Документация

Последний класс моделей Meta (Llama 3.1) был выпущен в различных размерах и вариантах. Эта версия 8B, настроенная по инструкциям, быстрая и эффективная. Она продемонстрировала высокую производительность по сравнению с ведущими закрытыми моделями в оценках людьми. Чтобы узнать больше о выпуске модели, нажмите здесь. Использование этой модели регулируется Политикой допустимого использования Meta.

Модальности
Вход / выход за 1 млн
6,19 ₽ / 9,90 ₽
Контекст
131 072
Добавлена
23 июл. 2024 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

5 поставщика · 5 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
DeepInfraДешевле
deepinfra/fp8·FP8
2,48 ₽4,95 ₽547 мс17 ток/с99,96%
novita/fp8·FP8
2,48 ₽6,19 ₽494 мс55 ток/с99,87%
groq·Стандарт
6,19 ₽9,90 ₽3,09 ₽255 мс95 ток/с99,93%
cloudflare/fp8·FP8
18,81 ₽35,52 ₽434 мс17 ток/с100,00%
coreweave/bf16·BF16
27,23 ₽27,23 ₽27,23 ₽123 мс110 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены6,19 ₽за 1 млн токенов
Выходные токены9,90 ₽за 1 млн токенов
Чтение кэша3,09 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Кодтоп 98%
5,4индекс

место 139 из 143

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
τ-bench Verified — Airline
30,9%точность

1 200 задач

GPQA Diamond
29,1%точность

4 356 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/llama-3.1-8b-instruct",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'