Qwen: Qwen3.7 Flash

qwen/qwen3.7-flash
Документация

Qwen3.7 Flash — это модель визуально-языкового рассуждения от Alibaba. Она подходит для мультимодальных агентов, визуального программирования, поиска и компьютерного взаимодействия, с сильными сторонами в распознавании объектов, пространственном понимании и восприятии реального мира.

Модальности
Вход / выход за 1 млн
от 3,71 ₽ / от 16,09 ₽
Контекст
1 000 000
Добавлена
27 июл. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

1 поставщика · 1 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
AlibabaДешевле
alibaba·Стандарт
3,71 ₽16,09 ₽0,74 ₽592 мс62 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены · ≤32K3,71 ₽за 1 млн токенов
Входные токены · ≤256K12,38 ₽за 1 млн токенов
Входные токены · >256K24,76 ₽за 1 млн токенов
Выходные токены · ≤32K16,09 ₽за 1 млн токенов
Выходные токены · ≤256K49,51 ₽за 1 млн токенов
Выходные токены · >256K99,02 ₽за 1 млн токенов
Чтение кэша · ≤32K0,74 ₽за 1 млн токенов
Чтение кэша · ≤256K2,48 ₽за 1 млн токенов
Чтение кэша · >256K4,95 ₽за 1 млн токенов
Cache Creation (5min) · ≤32K4,70 ₽за 1 млн токенов
Cache Creation (5min) · ≤256K15,47 ₽за 1 млн токенов
Cache Creation (5min) · >256K30,94 ₽за 1 млн токенов
Cache Read (5min) · ≤32K0,37 ₽за 1 млн токенов
Cache Read (5min) · ≤256K1,24 ₽за 1 млн токенов
Cache Read (5min) · >256K2,48 ₽за 1 млн токенов
Запись кэша4,70 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Для этой версии модели публичных результатов пока нет.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

textimagevideo

Выходные модальности

text
include_reasoninglogprobsmax_tokenspresence_penaltyreasoningresponse_formatseedtemperaturetool_choicetoolstop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.7-flash",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'