Meta: Muse Voice Transcribe 1.0
meta/muse-voice-transcribe-1.0Muse Voice Transcribe 1.0 — это синхронная модель преобразования речи в текст от Meta. Она подходит для push-to-talk, определения конца фразы и транскрибации с учётом говорящего, поддерживает смещение ключевых слов для доменных терминов и смещение языка с помощью подсказок с названиями языков. Принимает монофоническое 16-битное PCM WAV аудио с частотой 16 kHz или 24 kHz для записей продолжительностью до 10 минут. Она не предоставляет пословные временные метки или оценки уверенности, а другие аудиоформаты перед загрузкой необходимо конвертировать в WAV.
Muse Voice Transcribe 1.0 — это синхронная модель преобразования речи в текст от Meta. Она подходит для push-to-talk, определения конца фразы и транскрибации с учётом говорящего, поддерживает смещение ключевых слов для доменных терминов и смещение языка с помощью подсказок с названиями языков. Принимает монофоническое 16-битное PCM WAV аудио с частотой 16 kHz или 24 kHz для записей продолжительностью до 10 минут. Она не предоставляет пословные временные метки или оценки уверенности, а другие аудиоформаты перед загрузкой необходимо конвертировать в WAV.
Поставщики, endpoint’ы и маршрутизация
Для этой модели используется маршрут, указанный в таблице провайдеров.
1 поставщика · 1 endpoint-вариантов
Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.
Цены
Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.
Бенчмарки
Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.
Параметры и модальности
Поддержка параметров синхронизирована с текущей версией модели.