AssemblyAI: Universal-3.5 Pro

assemblyai/universal-3-5-pro
Документация

Universal-3.5 Pro — это модель распознавания речи от AssemblyAI, предоставляемая через Sync API и возвращающая полную расшифровку с таймштампами на уровне слов в одном синхронном ответе для аудиофрагментов продолжительностью до 120 секунд. Она принимает входные данные 16-бит WAV и поддерживает подсказки в свободной форме, ключевые термины и контекст диалога, чтобы направлять распознавание в сторону доменной лексики.

Модальности
Аудио
< 0,01 ₽ за секунду
Контекст
0
Добавлена
22 сент. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Для этой модели используется маршрут, указанный в таблице провайдеров.

Для этой модели используется фиксированный маршрут. Выбор и сортировка провайдеров недоступны.

1 поставщика · 1 endpoint-вариантов

Поставщик / endpointДанныеЦенаЗадержкаСкоростьДоступность
AssemblyAIФиксированный
assemblyai·Стандарт
< 0,01 ₽за секунду100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Аудио< 0,01 ₽за секунду
Audio Seconds (Prompted)< 0,01 ₽за секунду

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Для этой версии модели публичных результатов пока нет.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

audio

Выходные модальности

transcription

Пример запроса

AUDIO_BASE64=$(base64 < audio.wav | tr -d '\n')

curl https://gorouter.ru/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d "{"model":"assemblyai/universal-3-5-pro","input_audio":{"data":"$AUDIO_BASE64","format":"wav"}}"