Qwen: Qwen3 235B A22B Instruct 2507

qwen/qwen3-235b-a22b-2507
Документация

Qwen3-235B-A22B-Instruct-2507 — это многоязычная языковая модель, настроенная на инструкции и основанная на архитектуре смеси экспертов Qwen3-235B, с 22B активными параметрами за один прямой проход. Она оптимизирована для генерации текста общего назначения, включая следование инструкциям, логические рассуждения, математику, код и использование инструментов. Модель поддерживает нативную длину контекста 262K и не реализует «режим мышления» (блоки thinking). По сравнению с базовой версией, эта версия обеспечивает значительные улучшения в охвате знаний, рассуждениях на длинном контексте, бенчмарках программирования и согласованности с открытыми задачами. Она особенно сильна в многоязычном понимании, математических рассуждениях (например, AIME, HMMT) и оценках согласованности, таких как Arena-Hard и WritingBench.

Модальности
Вход / выход за 1 млн
10,83 ₽ / 43,32 ₽
Контекст
262 144
Добавлена
21 июл. 2025 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

10 поставщика · 11 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
GMICloudДешевле
gmicloud/fp8·FP8
10,83 ₽43,32 ₽2,17 ₽1,48 с24 ток/с97,90%
deepinfra/fp8·FP8
11,14 ₽68,08 ₽592 мс7 ток/с99,74%
novita/fp8·FP8
11,14 ₽71,79 ₽726 мс34 ток/с99,95%
alibaba·Стандарт
18,50 ₽74,02 ₽510 мс48 ток/с100,00%
nebius/fp8·FP8
24,76 ₽74,27 ₽568 мс38 ток/с96,60%
venice/fp8·FP8
18,57 ₽92,83 ₽872 мс9 ток/с99,92%
parasail/fp8·FP8
17,33 ₽99,02 ₽6,19 ₽592 мс27 ток/с100,00%
streamlake·Стандарт
43,32 ₽25,99 ₽173,29 ₽103,97 ₽898 мс30 ток/с100,00%
atlas-cloud/fp8·FP8
24,76 ₽108,92 ₽24,76 ₽1,04 с34 ток/с99,87%
google-vertex/us-south1·Стандарт
27,23 ₽108,92 ₽559 мс44 ток/с100,00%
google-vertex/us-south1·Стандарт
30,94 ₽123,78 ₽489 мс36 ток/с98,53%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены10,83 ₽за 1 млн токенов
Выходные токены43,32 ₽за 1 млн токенов
Чтение кэша2,17 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Design Arena

ELO и доля побед по категориям визуальных задач.

Источник
Визуализация данныхтоп 79%
1 090ELO
49%побед49,9 ссреднее108/137место
Веб-сайтытоп 81%
1 075ELO
43,6%побед55,1 ссреднее121/151место
Категории кодатоп 83%
1 060ELO
42,6%побед53,8 ссреднее117/141место
3Dтоп 89%
1 035ELO
41,1%побед39,5 ссреднее115/130место
UI-компонентытоп 89%
989ELO
38,4%побед38,3 ссреднее121/136место
Разработка игртоп 93%
987ELO
35%побед64,3 ссреднее128/139место

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
GPQA Diamond
74,7%точность

3 561 задач

τ-bench Verified — Airline
46,3%точность

1 500 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-235b-a22b-2507",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'