Z.ai: GLM 4.7 Flash

z-ai/glm-4.7-flash
Документация

Являясь моделью класса 30B-SOTA, GLM-4.7-Flash предлагает новый вариант, который балансирует производительность и эффективность. Она дополнительно оптимизирована для агентских сценариев использования в кодинге, усиливая возможности программирования, планирования долгосрочных задач и взаимодействия с инструментами, и достигла ведущих показателей среди open-source моделей того же размера в нескольких актуальных публичных рейтингах бенчмарков.

Модальности
Вход / выход за 1 млн
7,43 ₽ / 49,51 ₽
Контекст
202 752
Добавлена
19 янв. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

4 поставщика · 4 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
DeepInfraДешевле
deepinfra/bf16·BF16
7,43 ₽49,51 ₽1,24 ₽361 мс18 ток/с99,23%
venice/fp8·FP8
7,43 ₽49,51 ₽1,24 ₽583 мс47,5 ток/с98,03%
cloudflare·Стандарт
7,49 ₽49,51 ₽385 мс34 ток/с99,04%
novita/bf16·BF16
8,66 ₽49,51 ₽1,24 ₽1,29 с36,5 ток/с84,04%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены7,43 ₽за 1 млн токенов
Выходные токены49,51 ₽за 1 млн токенов
Чтение кэша1,24 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Design Arena

ELO и доля побед по категориям визуальных задач.

Источник
UI-компонентытоп 34%
1 231ELO
57,6%побед116,3 ссреднее45/136место
Веб-сайтытоп 38%
1 211ELO
54%побед159 ссреднее56/151место
Категории кодатоп 42%
1 199ELO
53,1%побед150,1 ссреднее58/141место
Разработка игртоп 55%
1 171ELO
49,7%побед153,7 ссреднее76/139место
3Dтоп 55%
1 161ELO
51,2%побед116,9 ссреднее71/130место
Визуализация данныхтоп 68%
1 145ELO
45,3%побед126,8 ссреднее92/137место
SVGтоп 81%
1 076ELO
44,2%побед81,7 ссреднее80/99место

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
τ-bench Verified — Airline
61,9%точность

1 598 задач

GPQA Diamond
51,4%точность

5 622 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "z-ai/glm-4.7-flash",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'