Z.ai: GLM 4.5 Air

z-ai/glm-4.5-air
Документация

GLM-4.5-Air — это облегченная версия нашей последней серии флагманских моделей, специально созданная для агентных приложений. Как и GLM-4.5, она использует архитектуру «смесь экспертов» (MoE), но с более компактным размером параметров. GLM-4.5-Air также поддерживает гибридные режимы вывода, предлагая «режим мышления» для сложных рассуждений и использования инструментов, а также «режим без мышления» для взаимодействия в реальном времени. Пользователи могут управлять поведением рассуждений с помощью логического параметра reasoning enabled. Подробнее в нашей документации

Модальности
Вход / выход за 1 млн
16,09 ₽ / 105,21 ₽
Контекст
131 072
Добавлена
25 июл. 2025 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

3 поставщика · 3 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
NovitaДешевле
novita/bf16·BF16
16,09 ₽105,21 ₽3,09 ₽660 мс40 ток/с99,36%
siliconflow/fp8·FP8
17,33 ₽106,45 ₽1,53 с22 ток/с100,00%
z-ai/fp8·FP8
24,76 ₽136,15 ₽3,71 ₽1,27 с39 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены16,09 ₽за 1 млн токенов
Выходные токены105,21 ₽за 1 млн токенов
Чтение кэша3,09 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Design Arena

ELO и доля побед по категориям визуальных задач.

Источник
Визуализация данныхтоп 41%
1 208ELO
58,5%побед99,9 ссреднее55/137место
3Dтоп 54%
1 163ELO
54,1%побед86,6 ссреднее69/130место
Веб-сайтытоп 60%
1 163ELO
51,3%побед126,5 ссреднее90/151место
Категории кодатоп 63%
1 158ELO
51,4%побед121,1 ссреднее88/141место
UI-компонентытоп 64%
1 147ELO
54,4%побед93,6 ссреднее87/136место
Разработка игртоп 68%
1 130ELO
48,4%побед117,4 ссреднее94/139место
SVGтоп 73%
1 109ELO
50,8%побед41,9 ссреднее72/99место

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
τ-bench Verified — Airline
71,4%точность

1 150 задач

GPQA Diamond
64,8%точность

4 341 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltyinclude_reasoningmax_tokenspresence_penaltyreasoningrepetition_penaltyseedstoptemperaturetool_choicetoolstop_ktop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "z-ai/glm-4.5-air",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'