NVIDIA: Nemotron 3 Super

nvidia/nemotron-3-super-120b-a12b
Документация

NVIDIA Nemotron 3 Super — это открытая гибридная модель MoE с параметрами 120B, активирующая всего 12B параметров для максимальной вычислительной эффективности и точности в сложных мультиагентных приложениях. Построенная на гибридной архитектуре Mamba-Transformer Mixture-of-Experts с многотокенным предсказанием (MTP), она обеспечивает более чем 50% более высокую генерацию токенов по сравнению с ведущими открытыми моделями. Модель имеет контекстное окно в 1M токенов для долгосрочной когерентности агента, междокументного рассуждения и многошагового планирования задач. Латентный MoE позволяет вызывать 4 экспертов по стоимости вывода только одного, улучшая интеллект и обобщение. Многосредовое обучение RL на 10+ средах обеспечивает ведущую точность на бенчмарках, включая AIME 2025, TerminalBench и SWE-Bench Verified. Полностью открытая с весами, наборами данных и рецептами под открытой лицензией NVIDIA, Nemotron 3 Super позволяет легко настраивать и безопасно развертывать где угодно — от рабочей станции до облака.

Модальности
Вход / выход за 1 млн
10,52 ₽ / 49,51 ₽
Контекст
1 000 000
Добавлена
11 мар. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

2 поставщика · 2 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
DeepInfraДешевле
deepinfra/bf16·BF16
10,52 ₽49,51 ₽1,36 с45 ток/с99,95%
digitalocean·Стандарт
37,13 ₽80,45 ₽7,43 ₽1,02 с12 ток/с99,55%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены10,52 ₽за 1 млн токенов
Выходные токены49,51 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Интеллекттоп 65%
25,7индекс

место 76 из 117

Кодтоп 54%
37,7индекс

место 77 из 143

Агентные задачитоп 73%
8,8индекс

место 85 из 118

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningreasoning_effortrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "nvidia/nemotron-3-super-120b-a12b",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'