Qwen: Qwen3 VL 8B Thinking

qwen/qwen3-vl-8b-thinking
Документация

Qwen3-VL-8B-Thinking — это вариант мультимодальной модели Qwen3-VL-8B, оптимизированный для рассуждений, предназначенный для продвинутого визуального и текстового мышления при работе со сложными сценами, документами и временными последовательностями. Он объединяет улучшенное мультимодальное согласование и обработку длинного контекста (нативно 256K, расширяется до 1M токенов) для таких задач, как научный визуальный анализ, каузальный вывод и математические рассуждения по изображениям или видео. По сравнению с версией Instruct, версия Thinking вводит более глубокое слияние визуального и языкового и продуманные пути рассуждений, которые улучшают производительность в задачах длинных логических цепочек, решении задач STEM и многошаговом понимании видео. Она достигает более сильной временной привязки благодаря Interleaved-MRoPE и эмбеддингам с учётом временных меток, сохраняя при этом надёжное OCR, многоязычное понимание и генерацию текста на уровне крупных текстовых LLMs.

Модальности
Вход / выход за 1 млн
22,28 ₽ / 259,93 ₽
Контекст
131 072
Добавлена
14 окт. 2025 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

1 поставщика · 1 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
AlibabaДешевле
alibaba·Стандарт
22,28 ₽259,93 ₽795 мс130 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены22,28 ₽за 1 млн токенов
Выходные токены259,93 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Для этой версии модели публичных результатов пока нет.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

imagetext

Выходные модальности

text
frequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-vl-8b-thinking",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'