Inception: Mercury 2

inception/mercury-2
Документация

Mercury 2 — это чрезвычайно быстрая модель рассуждений LLM и первая диффузионная модель рассуждений LLM (dLLM). Вместо последовательной генерации токенов Mercury 2 создаёт и уточняет несколько токенов параллельно, достигая >1,000 токенов/сек на стандартном GPUs. Mercury 2 работает в 5x+ раз быстрее, чем ведущие оптимизированные по скорости LLMs, такие как Claude 4.5 Haiku и GPT 5 Mini, при значительно меньшей стоимости. Mercury 2 поддерживает настраиваемые уровни рассуждений, контекст 128K, нативное использование инструментов и вывод JSON, соответствующий схеме. Создан для рабочих процессов программирования, где задержки накапливаются, для голосовых/поисковых операций в реальном времени и агентных циклов. Совместим с OpenAI API. Подробнее читайте в блог-посте.

Модальности
Вход / выход за 1 млн
30,94 ₽ / 92,83 ₽
Контекст
128 000
Добавлена
4 мар. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

1 поставщика · 1 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
InceptionДешевле
inception·Стандарт
30,94 ₽92,83 ₽3,09 ₽856 мс257 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены30,94 ₽за 1 млн токенов
Выходные токены92,83 ₽за 1 млн токенов
Чтение кэша3,09 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Интеллекттоп 71%
21,9индекс

место 83 из 117

Кодтоп 60%
31,1индекс

место 85 из 143

Агентные задачитоп 69%
9,5индекс

место 81 из 118

Design Arena

ELO и доля побед по категориям визуальных задач.

Источник
ASCII-арттоп 98%
1 042ELO
28,8%побед17 ссреднее71/73место
Веб-сайтытоп 87%
1 034ELO
21,3%побед6,8 ссреднее131/151место
Категории кодатоп 89%
1 027ELO
21,2%побед5,8 ссреднее125/141место
SVGтоп 94%
1 022ELO
24,8%побед2,7 ссреднее93/99место
Визуализация данныхтоп 87%
1 021ELO
22,1%побед3,6 ссреднее119/137место
3Dтоп 92%
1 015ELO
22,9%побед4 ссреднее119/130место
Разработка игртоп 90%
1 007ELO
19,6%побед5,3 ссреднее124/139место
UI-компонентытоп 89%
998ELO
18,9%побед4,7 ссреднее120/136место

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
include_reasoningmax_tokensreasoningreasoning_effortresponse_formatstopstructured_outputstemperaturetool_choicetools

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "inception/mercury-2",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'