Microsoft AI: MAI-Voice-2.1
microsoft/mai-voice-2.1MAI-Voice-2.1 — это модель преобразования текста в речь с максимальной точностью воспроизведения и выразительностью от Microsoft AI. Она создаёт естественную речь студийного качества на 23 языках, обеспечивая детальную просодию, нюансированную выразительность и стабильность голоса при генерации длинного контента. Модель подходит для аудиокниг, подкастов, лекций, озвучивания и брендового аудио, где важна максимальное качество голоса. Модель ставит естественность и выразительность выше генерации, критичной к задержке. На OpenRouter задайте для voice полный голос ID с суффиксом модели, например "en-US-Harper:MAI-Voice-2.1". Локаль голоса определяет язык синтеза. Установите response_format в значение "mp3" или "pcm" (24 kHz моно). Harper и Grant поддерживают стили речи agent, customer-call-center, educational и narrator, а многие локализованные голоса добавляют эмоциональные стили, такие как excited, happy, sad и whispering. Полный список голосов приведён в поле supported_voices в модели API. См. руководство по преобразованию текста в речь.
MAI-Voice-2.1 — это модель преобразования текста в речь с максимальной точностью воспроизведения и выразительностью от Microsoft AI. Она создаёт естественную речь студийного качества на 23 языках, обеспечивая детальную просодию, нюансированную выразительность и стабильность голоса при генерации длинного контента. Модель подходит для аудиокниг, подкастов, лекций, озвучивания и брендового аудио, где важна максимальное качество голоса. Модель ставит естественность и выразительность выше генерации, критичной к задержке.
На OpenRouter задайте для voice полный голос ID с суффиксом модели, например "en-US-Harper:MAI-Voice-2.1". Локаль голоса определяет язык синтеза. Установите response_format в значение "mp3" или "pcm" (24 kHz моно). Harper и Grant поддерживают стили речи agent, customer-call-center, educational и narrator, а многие локализованные голоса добавляют эмоциональные стили, такие как excited, happy, sad и whispering. Полный список голосов приведён в поле supported_voices в модели API. См. руководство по преобразованию текста в речь.
Провайдеры
Для этой модели используется маршрут, указанный в таблице провайдеров.
Для этой модели используется фиксированный маршрут. Выбор и сортировка провайдеров недоступны.
Цены
Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.
Параметры и модальности
Поддержка параметров синхронизирована с текущей версией модели.