Z.ai: GLM 4.6V
z-ai/glm-4.6vGLM-4.6V — это большая мультимодальная модель, предназначенная для высокоточного визуального понимания и рассуждений в длинном контексте по изображениям, документам и смешанным медиа. Модель поддерживает до 128K токенов, обрабатывает сложные макеты страниц и диаграммы непосредственно как визуальные входные данные, а также интегрирует нативную мультимодальную функцию вызова для связи восприятия с последующим выполнением инструментов. Модель также обеспечивает чередующуюся генерацию изображений и текста и рабочие процессы реконструкции UI, включая синтез из скриншота в HTML и итеративное визуальное редактирование.
GLM-4.6V — это большая мультимодальная модель, предназначенная для высокоточного визуального понимания и рассуждений в длинном контексте по изображениям, документам и смешанным медиа. Модель поддерживает до 128K токенов, обрабатывает сложные макеты страниц и диаграммы непосредственно как визуальные входные данные, а также интегрирует нативную мультимодальную функцию вызова для связи восприятия с последующим выполнением инструментов. Модель также обеспечивает чередующуюся генерацию изображений и текста и рабочие процессы реконструкции UI, включая синтез из скриншота в HTML и итеративное визуальное редактирование.
Поставщики, endpoint’ы и маршрутизация
Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.
2 поставщика · 2 endpoint-вариантов
Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.
Цены
Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.
Бенчмарки
Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.
Параметры и модальности
Поддержка параметров синхронизирована с текущей версией модели.