Qwen: Qwen3.5 397B A17B

qwen/qwen3.5-397b-a17b
Документация

Серия Qwen3.5 (397B–A17B) — это нативная модель «Vision-Language», построенная на гибридной архитектуре, которая объединяет механизм линейного внимания с разреженной моделью «смесь экспертов», что обеспечивает более высокую эффективность вывода. Она демонстрирует производительность, сопоставимую с ведущими современными моделями, в широком спектре задач: понимание языка, логические рассуждения, генерация кода, агентные сценарии, понимание изображений и видео, а также взаимодействие с графическими интерфейсами (GUI). Благодаря развитым возможностям генерации кода и агентному подходу модель показывает высокую обобщающую способность в разнообразных прикладных областях.

Модальности
Вход / выход за 1 млн
48,27 ₽ / 289,63 ₽
Контекст
262 144
Добавлена
16 февр. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

10 поставщика · 10 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
AlibabaДешевле
alibaba·Стандарт
48,27 ₽289,63 ₽1,17 с47 ток/с100,00%
deepinfra/fp8·FP8
55,70 ₽371,33 ₽27,23 ₽561 мс34 ток/с99,54%
digitalocean·Стандарт
68,08 ₽433,21 ₽13,74 ₽1,02 с12 ток/с96,64%
atlas-cloud/fp8·FP8
68,08 ₽433,21 ₽68,08 ₽2,15 с47 ток/с99,95%
phala·Стандарт
68,08 ₽433,21 ₽27,85 ₽1,93 с45 ток/с99,67%
parasail/fp8·FP8
61,89 ₽445,59 ₽37,13 ₽774 мс42 ток/с100,00%
novita·Стандарт
74,27 ₽445,59 ₽1,2 с32 ток/с99,69%
streamlake·Стандарт
74,27 ₽445,59 ₽14,85 ₽1,33 с49 ток/с99,07%
venice·Стандарт
92,83 ₽556,99 ₽1,99 с44 ток/с98,88%
gmicloud/fp8·FP8
74,27 ₽445,59 ₽2,85 с45 ток/с63,41%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены48,27 ₽за 1 млн токенов
Выходные токены289,63 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Интеллекттоп 52%
34,3индекс

место 60 из 117

Кодтоп 41%
48,2индекс

место 58 из 143

Агентные задачитоп 56%
19,8индекс

место 66 из 118

Design Arena

ELO и доля побед по категориям визуальных задач.

Источник
Веб-сайтытоп 40%
1 208ELO
52,5%побед140,7 ссреднее60/151место
3Dтоп 39%
1 201ELO
56,7%побед104,7 ссреднее50/130место
Категории кодатоп 40%
1 201ELO
52,6%побед135,7 ссреднее55/141место
Визуализация данныхтоп 46%
1 197ELO
53,2%побед123,9 ссреднее63/137место
UI-компонентытоп 50%
1 187ELO
51,4%побед133,2 ссреднее67/136место
SVGтоп 45%
1 178ELO
56,1%побед73,4 ссреднее44/99место
Разработка игртоп 52%
1 176ELO
50,1%побед142,5 ссреднее72/139место

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
GPQA Diamond
86%точность

5 142 задач

τ-bench Verified — Airline
78,7%точность

1 450 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

textimagevideo

Выходные модальности

text
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3.5-397b-a17b",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'