Z.ai: GLM 5.3 Prime
z-ai/glm-5.3-primeGLM-5.3-Prime — это высокоскоростной вариант модели GLM-5.3 от Z.ai, который наследует все её возможности, обеспечивая при этом в 1.5–2× большую пропускную способность вывода благодаря ускорению инференса. Модель поддерживает ввод и вывод текста с контекстным окном в 1M токенов и до 128K выходных токенов и предназначена для задач написания кода и агентных сценариев, включая долгосрочную многошаговую оркестрацию агентов, диалог в реальном времени и потоковую генерацию кода. Режим рассуждения всегда включён и не может быть отключён. Поддерживаются уровни рассуждения low, high и max; по умолчанию используется max.
GLM-5.3-Prime — это высокоскоростной вариант модели GLM-5.3 от Z.ai, который наследует все её возможности, обеспечивая при этом в 1.5–2× большую пропускную способность вывода благодаря ускорению инференса. Модель поддерживает ввод и вывод текста с контекстным окном в 1M токенов и до 128K выходных токенов и предназначена для задач написания кода и агентных сценариев, включая долгосрочную многошаговую оркестрацию агентов, диалог в реальном времени и потоковую генерацию кода.
Режим рассуждения всегда включён и не может быть отключён. Поддерживаются уровни рассуждения low, high и max; по умолчанию используется max.
Провайдеры
Провайдер выбирается автоматически с учётом цены и доступности. Для явного выбора скопируйте его ID из таблицы. Как указать провайдера
Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.
Цены
Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.
Параметры и модальности
Поддержка параметров синхронизирована с текущей версией модели.