Автор моделей

Inception

Модели, созданные командой Inception и доступные через единый API GoRouter.

2

моделей в каталоге

Модели автора

Хостинг-провайдеры и условия маршрутизации указаны на странице каждой модели.

Inception: Mercury 2.5 Preview

inception/mercury-2.5-preview

Mercury 2.5 — это самая быстрая рассуждающая LLM и новейшая диффузионная LLM (dLLM) от Inception. Вместо последовательной генерации токенов Mercury 2.5 создаёт и уточняет несколько токенов параллельно, достигая 1,107 tokens/sec на стандартном GPUs. Она обеспечивает скачок интеллекта на 10+ пунктов по сравнению с Mercury 2, при этом качество сопоставимо с оптимизированными по стоимости фронтирными моделями, такими как GPT-5, 6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5. Mercury 2.5 поддерживает настраиваемые уровни рассуждений, параллельные вызовы инструментов и вывод JSON, согласованный со схемой. Он создан для производственных нагрузок, где задержка накапливается: поисковые агенты, голосовые конвейеры и кодирующие субагенты.

автор inception31 авг. 2026 г.4,95 ₽ / 1 млн входных18,57 ₽ / 1 млн выходных
Inception: Mercury 2

inception/mercury-2

Mercury 2 — это чрезвычайно быстрая модель рассуждений LLM и первая диффузионная модель рассуждений LLM (dLLM). Вместо последовательной генерации токенов Mercury 2 создаёт и уточняет несколько токенов параллельно, достигая >1,000 токенов/сек на стандартном GPUs. Mercury 2 работает в 5x+ раз быстрее, чем ведущие оптимизированные по скорости LLMs, такие как Claude 4.5 Haiku и GPT 5 Mini, при значительно меньшей стоимости. Mercury 2 поддерживает настраиваемые уровни рассуждений, контекст 128K, нативное использование инструментов и вывод JSON, соответствующий схеме. Создан для рабочих процессов программирования, где задержки накапливаются, для голосовых/поисковых операций в реальном времени и агентных циклов. Совместим с OpenAI API. Подробнее читайте в блог-посте.

автор inception4 мар. 2026 г.30,94 ₽ / 1 млн входных92,83 ₽ / 1 млн выходных