Qwen: Qwen3.6 35B A3B

qwen/qwen3.6-35b-a3b
Документация

Qwen3.6-35B-A3B — это мультимодальная модель с открытыми весами от Alibaba Cloud с 35 миллиардами параметров суммарно и 3 миллиардами активных параметров на токен. Она использует гибридную разреженную архитектуру смеси экспертов, сочетающую гейтированное линейное внимание DeltaNet со стандартными гейтированными слоями внимания, что обеспечивает эффективный инференс за небольшую долю вычислительных затрат. Модель поддерживает нативное окно контекста на 262K токенов (расширяемое до 1M с помощью YaRN) и принимает текстовые, графические и видеовходные данные. В неё встроен режим размышления с сохранением следов рассуждений в многоходовых беседах, вызов функций и структурированный вывод. Модель выпущена под лицензией Apache 2.0.

Модальности
Вход / выход за 1 млн
12,38 ₽ / 111,40 ₽
Контекст
262 144
Добавлена
27 апр. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

10 поставщика · 10 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
DarkbloomДешевле
darkbloom/fp4·FP4
6,19 ₽86,64 ₽5,59 с22 ток/с99,99%
akashml/fp8·FP8
12,38 ₽111,40 ₽6,19 ₽1,16 с37 ток/с99,96%
venice/fp8·FP8
12,38 ₽123,78 ₽612 мс140 ток/с100,00%
parasail/fp8·FP8
18,57 ₽123,78 ₽6,19 ₽475 мс44 ток/с100,00%
atlas-cloud/fp8·FP8
23,02 ₽137,86 ₽23,02 ₽1,27 с110 ток/с99,98%
io-net/fp8·FP8
23,52 ₽147,29 ₽11,14 ₽562 мс198 ток/с99,83%
coreweave/fp8·FP8
30,94 ₽154,72 ₽30,94 ₽295 мс105 ток/с100,00%
siliconflow/fp8·FP8
24,76 ₽198,04 ₽1,16 с22 ток/с99,92%
deepinfra/fp8·FP8
12,38 ₽117,59 ₽468 мс18 ток/с93,20%
phala·Стандарт
24,76 ₽157,19 ₽1,29 с10 ток/с90,50%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены12,38 ₽за 1 млн токенов
Выходные токены111,40 ₽за 1 млн токенов
Чтение кэша6,19 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Интеллекттоп 55%
32,1индекс

место 64 из 117

Кодтоп 51%
41,9индекс

место 72 из 143

Агентные задачитоп 51%
21,6индекс

место 60 из 118

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
GPQA Diamond
81,9%точность

1 776 задач

τ-bench Verified — Airline
71,1%точность

494 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

textimagevideo

Выходные модальности

text
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.6-35b-a3b",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'