Qwen: Qwen3 Next 80B A3B Thinking

qwen/qwen3-next-80b-a3b-thinking
Документация

Qwen3-Next-80B-A3B-Thinking — это чат-модель с приоритетом рассуждений в линейке Qwen3-Next, которая по умолчанию выводит структурированные «трассы мышления». Она предназначена для сложных многошаговых задач: математических доказательств, синтеза и отладки кода, логики и агентного планирования — и показывает сильные результаты в оценках знаний, рассуждений, программирования, согласованности и многоязычности. По сравнению с предыдущими вариантами Qwen3 она делает акцент на стабильности при длинных цепочках рассуждений и эффективном масштабировании во время инференса, а также настроена на следование сложным инструкциям при снижении повторяющегося или нецелевого поведения. Модель подходит для агентных фреймворков и использования инструментов (вызов функций), рабочих процессов с интенсивным поиском информации и стандартизированного бенчмаркинга, где требуются пошаговые решения. Она поддерживает длинные детализированные ответы и использует ориентированные на пропускную способность техники (например, предсказание нескольких токенов) для более быстрой генерации. Обратите внимание, что она работает только в режиме мышления.

Модальности
Вход / выход за 1 млн
18,57 ₽ / 148,53 ₽
Контекст
262 144
Добавлена
11 сент. 2025 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

2 поставщика · 2 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
AlibabaДешевле
alibaba·Стандарт
18,57 ₽148,53 ₽440 мс210,5 ток/с100,00%
google-vertex/global·Стандарт
18,57 ₽148,53 ₽382 мс37 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены18,57 ₽за 1 млн токенов
Выходные токены148,53 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Интеллекттоп 81%
16,9индекс

место 94 из 117

Кодтоп 80%
17,4индекс

место 113 из 143

Агентные задачитоп 86%
2,1индекс

место 101 из 118

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-next-80b-a3b-thinking",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'