Inception
Inception обслуживает эти модели как инфраструктурный провайдер. Авторы моделей указаны отдельно в списке.
2
моделей в каталоге
Модели на хостинге Inception
В списке показаны только включённые модели из публичного каталога GoRouter.
inception/mercury-2.5-preview
Mercury 2.5 — это самая быстрая рассуждающая LLM и новейшая диффузионная LLM (dLLM) от Inception. Вместо последовательной генерации токенов Mercury 2.5 создаёт и уточняет несколько токенов параллельно, достигая 1,107 tokens/sec на стандартном GPUs. Она обеспечивает скачок интеллекта на 10+ пунктов по сравнению с Mercury 2, при этом качество сопоставимо с оптимизированными по стоимости фронтирными моделями, такими как GPT-5, 6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5. Mercury 2.5 поддерживает настраиваемые уровни рассуждений, параллельные вызовы инструментов и вывод JSON, согласованный со схемой. Он создан для производственных нагрузок, где задержка накапливается: поисковые агенты, голосовые конвейеры и кодирующие субагенты.
inception/mercury-2
Mercury 2 — это чрезвычайно быстрая модель рассуждений LLM и первая диффузионная модель рассуждений LLM (dLLM). Вместо последовательной генерации токенов Mercury 2 создаёт и уточняет несколько токенов параллельно, достигая >1,000 токенов/сек на стандартном GPUs. Mercury 2 работает в 5x+ раз быстрее, чем ведущие оптимизированные по скорости LLMs, такие как Claude 4.5 Haiku и GPT 5 Mini, при значительно меньшей стоимости. Mercury 2 поддерживает настраиваемые уровни рассуждений, контекст 128K, нативное использование инструментов и вывод JSON, соответствующий схеме. Создан для рабочих процессов программирования, где задержки накапливаются, для голосовых/поисковых операций в реальном времени и агентных циклов. Совместим с OpenAI API. Подробнее читайте в блог-посте.