Qwen: Qwen3.5-Flash
qwen/qwen3.5-flash-02-23Нативные визуально-языковые Flash-модели Qwen3.5 построены на гибридной архитектуре, которая объединяет механизм линейного внимания с разреженной моделью смеси экспертов, обеспечивая более высокую эффективность инференса. По сравнению с серией 3 эти модели совершают скачок в производительности как для чисто текстовых, так и для мультимодальных задач, предлагая быстрое время отклика и одновременно балансируя скорость инференса и общую производительность.
Нативные визуально-языковые Flash-модели Qwen3.5 построены на гибридной архитектуре, которая объединяет механизм линейного внимания с разреженной моделью смеси экспертов, обеспечивая более высокую эффективность инференса. По сравнению с серией 3 эти модели совершают скачок в производительности как для чисто текстовых, так и для мультимодальных задач, предлагая быстрое время отклика и одновременно балансируя скорость инференса и общую производительность.
Поставщики, endpoint’ы и маршрутизация
Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.
1 поставщика · 1 endpoint-вариантов
Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.
Цены
Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.
Бенчмарки
Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.
Параметры и модальности
Поддержка параметров синхронизирована с текущей версией модели.