Qwen: Qwen3 235B A22B Thinking 2507

qwen/qwen3-235b-a22b-thinking-2507
Документация

Qwen3-235B-A22B-Thinking-2507 — это высокопроизводительная открытая языковая модель архитектуры Mixture-of-Experts (MoE), оптимизированная для сложных задач рассуждения. Она активирует 22B из своих 235B параметров за один прямой проход и изначально поддерживает до 262,144 токенов контекста. Этот вариант «только для размышлений» улучшает структурированные логические рассуждения, математику, естественные науки и длительную генерацию текста, демонстрируя сильные результаты в бенчмарках AIME, SuperGPQA, LiveCodeBench и MMLU-Redux. Модель принудительно использует специальный режим рассуждения (response) и предназначена для генерации большого количества токенов (до 81,920 токенов) в сложных областях. Модель дообучена на инструкциях и превосходно справляется с пошаговыми рассуждениями, использованием инструментов, агентными сценариями работы и многоязычными задачами. Этот релиз представляет собой самую производительную открытую версию в серии Qwen3-235B, превосходящую многие закрытые модели в сценариях структурированных рассуждений.

Модальности
Вход / выход за 1 млн
28,47 ₽ / 284,68 ₽
Контекст
131 072
Добавлена
25 июл. 2025 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

3 поставщика · 3 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
AlibabaДешевле
alibaba·Стандарт
28,47 ₽284,68 ₽790 мс67 ток/с100,00%
novita/fp8·FP8
37,13 ₽371,33 ₽2,43 с21 ток/с98,47%
venice/fp8·FP8
55,70 ₽433,21 ₽1,29 с17 ток/с92,96%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены28,47 ₽за 1 млн токенов
Выходные токены284,68 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Интеллекттоп 75%
19,9индекс

место 87 из 117

Кодтоп 73%
22,1индекс

место 104 из 143

Агентные задачитоп 79%
3,8индекс

место 93 из 118

Design Arena

ELO и доля побед по категориям визуальных задач.

Источник
Веб-сайтытоп 81%
1 069ELO
42%побед113,1 ссреднее122/151место
Категории кодатоп 85%
1 054ELO
40,8%побед112,6 ссреднее119/141место
3Dтоп 88%
1 038ELO
40,4%побед87,6 ссреднее114/130место
Разработка игртоп 92%
993ELO
34,2%побед121,8 ссреднее127/139место
Визуализация данныхтоп 92%
970ELO
32,6%побед104,3 ссреднее125/137место
UI-компонентытоп 92%
969ELO
34%побед126,4 ссреднее124/136место

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
GPQA Diamond
80,1%точность

4 347 задач

τ-bench Verified — Airline
61,3%точность

1 448 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltyinclude_reasoninglogprobsmax_tokenspresence_penaltyreasoningrepetition_penaltyresponse_formatseedstoptemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-235b-a22b-thinking-2507",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'