OpenAI: GPT Audio

openai/gpt-audio
Документация

Модель gpt-audio — это OpenAI первая общедоступная аудиомодель. Новый снимок модели включает улучшенный декодер для более естественного звучания голоса и лучшей согласованности голоса. Стоимость Audio составляет $32 за миллион входных токенов и $64 за миллион выходных токенов.

Модальности
Выходные токены
1 237,76 ₽ за 1 млн токенов
Контекст
128 000
Добавлена
19 янв. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

1 поставщика · 1 endpoint-вариантов

Поставщик / endpointДанныеЦенаЗадержкаСкоростьДоступность
OpenAIДешевле
openai·Стандарт
1 237,76 ₽за 1 млн токенов660 мс86 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены309,44 ₽за 1 млн токенов
Выходные токены1 237,76 ₽за 1 млн токенов
Входное аудио3 960,82 ₽за 1 млн токенов
Выходное аудио7 921,64 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Для этой версии модели публичных результатов пока нет.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

textaudio

Выходные модальности

textaudio
frequency_penaltylogit_biaslogprobsmax_tokenspresence_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "openai/gpt-audio",
    "messages": [{"role": "user", "content": "Создай атмосферную электронную композицию"}],
    "modalities": ["text", "audio"],
        "audio": {"voice": "alloy", "format": "mp3"}
  }' | jq -r '.choices[0].message.audio.data' | base64 -d > output.mp3