Qwen: Qwen3 Coder 480B A35B

qwen/qwen3-coder
Документация

Qwen3-Coder-480B-A35B-Instruct — это модель генерации кода, основанная на архитектуре смеси экспертов (MoE), разработанная командой Qwen. Она оптимизирована для агентных задач кодирования, таких как вызов функций, использование инструментов и длинноконтекстное рассуждение по репозиториям. Модель имеет 480 миллиардов параметров, из которых 35 миллиардов активны во время каждого прямого прохода (8 из 160 экспертов). Цены на конечные точки Alibaba варьируются в зависимости от длины контекста. Если длина запроса превышает 128k входных токенов, применяется более высокая цена.

Модальности
Вход / выход за 1 млн
37,13 ₽ / 123,78 ₽
Контекст
262 144
Добавлена
23 июл. 2025 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

5 поставщика · 5 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
DeepInfraДешевле
deepinfra/turbo·FP4
37,13 ₽123,78 ₽12,38 ₽311 мс76 ток/с99,16%
venice/fp8·FP8
43,32 ₽185,66 ₽4,95 ₽632 мс42,5 ток/с98,31%
novita/fp8·FP8
47,03 ₽191,85 ₽928 мс36 ток/с95,43%
google-vertex/us-south1·Стандарт
27,23 ₽222,80 ₽919 мс67 ток/с100,00%
alibaba/opensource·Стандарт
120,68 ₽603,41 ₽1,22 с37 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены37,13 ₽за 1 млн токенов
Выходные токены123,78 ₽за 1 млн токенов
Чтение кэша12,38 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Design Arena

ELO и доля побед по категориям визуальных задач.

Источник
Веб-сайтытоп 58%
1 175ELO
61,7%побед68,3 ссреднее87/151место
Категории кодатоп 60%
1 164ELO
61,2%побед62,1 ссреднее84/141место
UI-компонентытоп 65%
1 136ELO
61,4%побед39,1 ссреднее88/136место
Разработка игртоп 65%
1 135ELO
58,7%побед59 ссреднее89/139место
Визуализация данныхтоп 78%
1 103ELO
54,9%побед54,1 ссреднее106/137место

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
GPQA Diamond
61,6%точность

5 106 задач

τ-bench Verified — Airline
47%точность

1 450 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltylogit_biaslogprobsmax_tokensmin_ppresence_penaltyrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen/qwen3-coder",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'