Хостинг-провайдер

DekaLLM

DekaLLM обслуживает эти модели как инфраструктурный провайдер. Авторы моделей указаны отдельно в списке.

7

моделей в каталоге

Модели на хостинге DekaLLM

В списке показаны только включённые модели из публичного каталога GoRouter.

qwen/qwen3.6-35b-a3b

Qwen3.6-35B-A3B — это мультимодальная модель с открытыми весами от Alibaba Cloud с 35 миллиардами параметров суммарно и 3 миллиардами активных параметров на токен. Она использует гибридную разреженную архитектуру смеси экспертов, сочетающую гейтированное линейное внимание DeltaNet со стандартными гейтированными слоями внимания, что обеспечивает эффективный инференс за небольшую долю вычислительных затрат. Модель поддерживает нативное окно контекста на 262K токенов (расширяемое до 1M с помощью YaRN) и принимает текстовые, графические и видеовходные данные. В неё встроен режим размышления с сохранением следов рассуждений в многоходовых беседах, вызов функций и структурированный вывод. Модель выпущена под лицензией Apache 2.0.

автор qwen27 апр. 2026 г.12,06 ₽ / 1 млн входных108,50 ₽ / 1 млн выходных

google/gemma-4-26b-a4b-it

Gemma 4 26B A4B IT — это модель Mixture-of-Experts (MoE) с инструкционной настройкой от Google DeepMind. Несмотря на 25.2B общих параметров, во время инференса активируется только 3.8B на токен, что обеспечивает качество, близкое к -31B, при доле вычислительных затрат. Поддерживает мультимодальный ввод, включая текст, изображения и видео (до 60 секунд при 1fps). Имеет контекстное окно в 256K токенов, встроенный вызов функций, настраиваемый режим мышления/рассуждения и поддержку структурированного вывода. Выпущена под лицензией Apache 2.0.

автор google3 апр. 2026 г.5,06 ₽ / 1 млн входных26,52 ₽ / 1 млн выходных

nvidia/nemotron-3-super-120b-a12b

NVIDIA Nemotron 3 Super — это открытая гибридная модель MoE с параметрами 120B, активирующая всего 12B параметров для максимальной вычислительной эффективности и точности в сложных мультиагентных приложениях. Построенная на гибридной архитектуре Mamba-Transformer Mixture-of-Experts с многотокенным предсказанием (MTP), она обеспечивает более чем 50% более высокую генерацию токенов по сравнению с ведущими открытыми моделями. Модель имеет контекстное окно в 1M токенов для долгосрочной когерентности агента, междокументного рассуждения и многошагового планирования задач. Латентный MoE позволяет вызывать 4 экспертов по стоимости вывода только одного, улучшая интеллект и обобщение. Многосредовое обучение RL на 10+ средах обеспечивает ведущую точность на бенчмарках, включая AIME 2025, TerminalBench и SWE-Bench Verified. Полностью открытая с весами, наборами данных и рецептами под открытой лицензией NVIDIA, Nemotron 3 Super позволяет легко настраивать и безопасно развертывать где угодно — от рабочей станции до облака.

автор nvidia11 мар. 2026 г.10,25 ₽ / 1 млн входных48,22 ₽ / 1 млн выходных

openai/gpt-oss-120b

gpt-oss-120b — это модель языка с открытым весом, на 117B параметров, архитектуры Mixture-of-Experts (MoE) от OpenAI, предназначенная для производственных сценариев с высокими требованиями к рассуждению, агентных и универсальных задач. Она активирует 5.1B параметров за прямой проход и оптимизирована для работы на одном H100 GPU с нативной квантизацией MXFP4. Модель поддерживает настраиваемую глубину рассуждений, полный доступ к цепочке рассуждений и нативное использование инструментов, включая вызов функций, просмотр веб-страниц и генерацию структурированных выходных данных.

автор openai5 авг. 2025 г.4,46 ₽ / 1 млн входных20,49 ₽ / 1 млн выходных

openai/gpt-oss-20b

gpt-oss-20b — это модель с открытыми весами, выпущенная OpenAI с 21B параметрами под лицензией Apache 2.0. В ней используется архитектура смеси экспертов (MoE) с 3.6B активными параметрами на прямой проход, что обеспечивает более низкую задержку вывода и возможность развертывания на потребительском или однопроцессорном оборудовании GPU. Модель обучается в формате ответов Harmony от OpenAI и поддерживает настройку уровня рассуждений, дообучение, а также агентные возможности, включая вызов функций, использование инструментов и структурированные выходные данные.

автор openai5 авг. 2025 г.3,62 ₽ / 1 млн входных15,67 ₽ / 1 млн выходных

qwen/qwen3-30b-a3b-instruct-2507

Qwen3-30B-A3B-Instruct-2507 — это языковая модель смеси экспертов с 30.5B параметрами от Qwen, с 3.3B активными параметрами на каждый вывод. Она работает в режиме без мышления и предназначена для качественного следования инструкциям, многоязычного понимания и использования агентных инструментов. Дообученная на инструкциях, она демонстрирует конкурентоспособные результаты в бенчмарках рассуждений (AIME, ZebraLogic), кодирования (MultiPL-E, LiveCodeBench) и согласованности (IFEval, WritingBench). Она превосходит свою версию без инструкций в субъективных и открытых задачах, сохраняя при этом высокую фактическую точность и производительность в кодировании.

автор qwen29 июл. 2025 г.10,85 ₽ / 1 млн входных36,17 ₽ / 1 млн выходных

mistralai/mistral-nemo

Модель с параметрами 12B и длиной контекста 128k токенов, созданная Mistral в сотрудничестве с NVIDIA. Модель является многоязычной и поддерживает английский, французский, немецкий, испанский, итальянский, португальский, китайский, японский, корейский, арабский и хинди. Она поддерживает вызов функций и выпущена под лицензией Apache 2.0.

автор mistralai19 июл. 2024 г.2,29 ₽ / 1 млн входных3,62 ₽ / 1 млн выходных