Meta: Llama 3.3 70B Instruct

meta-llama/llama-3.3-70b-instruct
Документация

Многоязычная большая языковая модель Meta Llama 3.3 (LLM) — это предобученная и инструкционно настроенная генеративная модель в 70B (текст на входе/текст на выходе). Модель Llama 3.3, инструкционно настроенная и работающая только с текстом, оптимизирована для многоязычных диалоговых сценариев и превосходит многие доступные открытые и закрытые чат-модели на распространённых отраслевых бенчмарках. Поддерживаемые языки: английский, немецкий, французский, итальянский, португальский, хинди, испанский и тайский. Model Card

Модальности
Вход / выход за 1 млн
117,17 ₽ / 117,17 ₽
Контекст
131 072
Добавлена
6 дек. 2024 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

12 поставщика · 13 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
DeepInfraДешевле
deepinfra/turbo·FP8
12,38 ₽39,61 ₽487 мс13 ток/с98,14%
novita/bf16·BF16
16,71 ₽49,51 ₽668 мс28 ток/с95,55%
akashml/fp8·FP8
24,76 ₽64,36 ₽12,38 ₽1,07 с26 ток/с99,61%
parasail/fp8·FP8
27,23 ₽61,89 ₽13,62 ₽782 мс36 ток/с99,52%
crusoe/bf16·BF16
30,94 ₽92,83 ₽16,09 ₽482 мс54 ток/с100,00%
groq·Стандарт
73,03 ₽97,78 ₽36,51 ₽182 мс29 ток/с99,93%
coreweave/fp16·FP16
87,88 ₽87,88 ₽87,88 ₽203 мс47 ток/с99,94%
google-vertex/us-central1·Стандарт
89,12 ₽89,12 ₽469 мс60 ток/с100,00%
google-vertex·Стандарт
89,12 ₽89,12 ₽299 мс24 ток/с99,34%
together·Стандарт
128,73 ₽128,73 ₽894 мс28 ток/с99,48%
cloudflare/fp8·FP8
36,27 ₽278,87 ₽697 мс23 ток/с99,31%
nebius/fp8·FP8
16,09 ₽49,51 ₽6,16 с1 ток/с19,88%
sambanova-turbo·Стандарт
74,27 ₽148,53 ₽503 мс109 ток/с94,91%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены117,17 ₽за 1 млн токенов
Выходные токены117,17 ₽за 1 млн токенов
Чтение кэша117,17 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Кодтоп 90%
11,9индекс

место 128 из 143

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
GPQA Diamond
49,5%точность

5 148 задач

τ-bench Verified — Airline
38,9%точность

1 494 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "meta-llama/llama-3.3-70b-instruct",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'