Inception: Mercury 2.5
inception/mercury-2.5Mercury 2.5 — самая быстрая рассуждающая LLM и последняя диффузионная LLM (dLLM) от Inception. Вместо последовательной генерации токенов, Mercury 2.5 производит и уточняет несколько токенов параллельно, достигая 1,107 токенов/сек на стандартном GPUs. Он обеспечивает скачок интеллекта на 10+ пунктов по сравнению с Mercury 2, при качестве, сопоставимом с оптимизированными по стоимости фронтирными моделями, такими как GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5. Mercury 2.5 поддерживает настраиваемые уровни рассуждения, параллельные вызовы инструментов и вывод JSON, соответствующий схеме. Он создан для производственных нагрузок, где задержки накапливаются: поисковые агенты, голосовые пайплайны и кодирующие субагенты. Подробнее в записи блога.
Mercury 2.5 — самая быстрая рассуждающая LLM и последняя диффузионная LLM (dLLM) от Inception. Вместо последовательной генерации токенов, Mercury 2.5 производит и уточняет несколько токенов параллельно, достигая 1,107 токенов/сек на стандартном GPUs. Он обеспечивает скачок интеллекта на 10+ пунктов по сравнению с Mercury 2, при качестве, сопоставимом с оптимизированными по стоимости фронтирными моделями, такими как GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5. Mercury 2.5 поддерживает настраиваемые уровни рассуждения, параллельные вызовы инструментов и вывод JSON, соответствующий схеме. Он создан для производственных нагрузок, где задержки накапливаются: поисковые агенты, голосовые пайплайны и кодирующие субагенты. Подробнее в записи блога.
Поставщики, endpoint’ы и маршрутизация
Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.
1 поставщика · 1 endpoint-вариантов
Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.
Цены
Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.
Бенчмарки
Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.
Параметры и модальности
Поддержка параметров синхронизирована с текущей версией модели.