NVIDIA: Nemotron 3 Nano 30B A3B

nvidia/nemotron-3-nano-30b-a3b
Документация

NVIDIA Nemotron 3 Nano 30B A3B — это небольшая языковая MoE модель с наивысшей вычислительной эффективностью и точностью для разработчиков, создающих специализированные агентные AI системы. Модель полностью открыта: открытые веса, наборы данных и рецепты позволяют разработчикам легко настраивать, оптимизировать и разворачивать модель на своей инфраструктуре для максимальной конфиденциальности и безопасности.

Модальности
Вход / выход за 1 млн
6,19 ₽ / 24,76 ₽
Контекст
262 144
Добавлена
14 дек. 2025 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

4 поставщика · 4 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
DeepInfraДешевле
deepinfra/fp4·FP4
6,19 ₽24,76 ₽3,09 ₽2,91 с77 ток/с100,00%
novita/fp4·FP4
6,19 ₽24,76 ₽374 мс217 ток/с100,00%
crusoe/fp8·FP8
6,19 ₽24,76 ₽3,71 ₽280 мс108 ток/с100,00%
nebius/fp8·FP8
7,43 ₽29,71 ₽321 мс186 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены6,19 ₽за 1 млн токенов
Выходные токены24,76 ₽за 1 млн токенов
Чтение кэша3,09 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Интеллекттоп 89%
14,5индекс

место 103 из 117

Кодтоп 84%
14,4индекс

место 120 из 143

Агентные задачитоп 87%
2индекс

место 102 из 118

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
GPQA Diamond
60,6%точность

1 253 задач

τ-bench Verified — Airline
52,3%точность

300 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "nvidia/nemotron-3-nano-30b-a3b",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'