Fish Audio: Transcribe 1 Pro

fish-audio/transcribe-1-pro
Документация

Transcribe 1 Pro — это модель распознавания речи в текст от Fish Audio, оптимизированная для интервью, совещаний и подкастов. Она размечает говорящих встроенными метками speaker, сохраняет эмоциональную окраску и признаки голосовых событий, такие как [laughter], автоматически определяет язык и может возвращать посегментные результаты с таймкодами на уровне слов.

Модальности
Аудио
0,01 ₽ за секунду
Контекст
0
Добавлена
24 сент. 2026 г.

Провайдеры

Для этой модели используется маршрут, указанный в таблице провайдеров.

Для этой модели используется фиксированный маршрут. Выбор и сортировка провайдеров недоступны.

Провайдеры: 1Варианты: 1

ПровайдерЦенаЗадержкаСкоростьДоступность
fish-audio
0,01 ₽за секунду——100,00%

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Аудио0,01 ₽за секунду

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

audio

Выходные модальности

transcription

Пример запроса

AUDIO_BASE64=$(base64 < audio.wav | tr -d '\n')

curl https://gorouter.ru/api/v1/audio/transcriptions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d "{"model":"fish-audio/transcribe-1-pro","input_audio":{"data":"$AUDIO_BASE64","format":"wav"}}"