Inception: Mercury 2.5

inception/mercury-2.5
Документация

Mercury 2.5 — самая быстрая рассуждающая LLM и последняя диффузионная LLM (dLLM) от Inception. Вместо последовательной генерации токенов, Mercury 2.5 производит и уточняет несколько токенов параллельно, достигая 1,107 токенов/сек на стандартном GPUs. Он обеспечивает скачок интеллекта на 10+ пунктов по сравнению с Mercury 2, при качестве, сопоставимом с оптимизированными по стоимости фронтирными моделями, такими как GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5. Mercury 2.5 поддерживает настраиваемые уровни рассуждения, параллельные вызовы инструментов и вывод JSON, соответствующий схеме. Он создан для производственных нагрузок, где задержки накапливаются: поисковые агенты, голосовые пайплайны и кодирующие субагенты. Подробнее в записи блога.

Модальности
Вход / выход за 1 млн
4,94 ₽ / 18,51 ₽
Контекст
260 000
Добавлена
8 сент. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

1 поставщика · 1 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
InceptionДешевле
inception·Стандарт
4,94 ₽18,51 ₽0,49 ₽1,1 с225 ток/с99,98%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены4,94 ₽за 1 млн токенов
Выходные токены18,51 ₽за 1 млн токенов
Чтение кэша0,49 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Для этой версии модели публичных результатов пока нет.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
include_reasoningmax_tokensreasoningreasoning_effortresponse_formatstopstructured_outputstemperaturetool_choicetools

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "inception/mercury-2.5",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'