Inference.net: Schematron V2 Turbo

inference-net/schematron-v2-turbo
Документация

Schematron V2 Turbo — это модель 3B-параметрического HTML-to-JSON извлечения данных от Inference.net. Она оптимизирована на пропускную способность для высоконагруженных задач извлечения. Инструкции по извлечению должны передаваться через JSON-схему в response_format, а не через системные или пользовательские промпты.

Модальности
Вход / выход за 1 млн
3,61 ₽ / 18,06 ₽
Контекст
128 000
Добавлена
12 сент. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Автоматическая маршрутизация учитывает цену и доступность провайдеров. Стратегию можно выбрать вручную.

Выбор с учётом цены и доступности
"provider": {}

1 поставщика · 1 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
InferenceNetДешевле
inference-net·Стандарт
3,61 ₽18,06 ₽968 мс8 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены3,61 ₽за 1 млн токенов
Выходные токены18,06 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Для этой версии модели публичных результатов пока нет.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltylogit_biasmax_tokensmin_ppresence_penaltyresponse_formatseedstopstructured_outputstemperaturetop_ktop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "inference-net/schematron-v2-turbo",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'