NVIDIA: Nemotron 3.5 Content Safety

nvidia/nemotron-3.5-content-safety
Документация

NVIDIA Nemotron 3.5 Content Safety — это компактная мультимодальная модель-гардрейл с 4B параметрами от NVIDIA, дообученная на основе Google Gemma-3-4B. Она модерирует как входные запросы, так и ответы для LLMs и VLMs, принимая текстовые и графические данные на вход и возвращая текстовый вывод: классификацию «безопасно/небезопасно» для пользовательского запроса и ответа, метки категорий безопасности и опциональную трассировку рассуждений. Модель охватывает 12 языков с контекстным окном до 128K токенов. Она подходит для модерации запросов и ответов, классификации контента, конвейеров безопасности и корпоративных гардрейлов AI с применением политик, а также включает переключаемый режим рассуждений. Модель входит в семейство открытых моделей NVIDIA Nemotron для агентных AI.

Модальности
Вход / выход за 1 млн
24,72 ₽ / 24,72 ₽
Контекст
131 072
Добавлена
4 июн. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

1 поставщика · 1 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
DeepInfraДешевле
deepinfra/bf16·BF16
24,72 ₽24,72 ₽104 мс127,5 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены24,72 ₽за 1 млн токенов
Выходные токены24,72 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Для этой версии модели публичных результатов пока нет.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

textimage

Выходные модальности

text
frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstoptemperaturetop_ktop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "nvidia/nemotron-3.5-content-safety",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'