Together
Together обслуживает эти модели как инфраструктурный провайдер. Авторы моделей указаны отдельно в списке.
20
моделей в каталоге
Модели на хостинге Together
В списке показаны только включённые модели из публичного каталога GoRouter.
z-ai/glm-5.3-flash
GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного программирования и долгосрочных агентных задач. Её гибридная архитектура разрежённого и линейного внимания сохраняет точное поведение при работе с длинным контекстом, одновременно снижая вычислительные накладные расходы.
z-ai/glm-5.3
GLM-5.3 — это крупномасштабная модель рассуждения от Z.ai, созданная для сложной разработки программного обеспечения и долгосрочных агентных задач. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании, а также в балансе между производительностью и эффективностью использования токенов. Рассуждение всегда включено и не может быть отключено. Поддерживаются уровни усилий рассуждения low, high и max; по умолчанию используется max.
qwen/qwen3.8-2.4t-a95b
Qwen3.8 2.4T A95B — это открытая по весам разреженная модель смеси экспертов от Qwen и открытая по весам версия Qwen3.8 Max, с 95 миллиардами активных параметров из 2.4 триллионов всего. Она подходит для программирования, исследований, сложных рассуждений и агентных рабочих процессов.
deepseek/deepseek-v4-pro-0813
DeepSeek V4 Pro 0813 — это крупномасштабная модель смеси экспертов от DeepSeek. Это GA-й выпуск DeepSeek V4 Pro.
meta/muse-glimmer-30b
Muse Glimmer 30B — это плотная мультимодальная модель с открытыми весами от Meta Superintelligence Labs, дистиллированная из Muse Spark и оптимизированная для автономных агентов на потребительском оборудовании. Она подходит для долгосрочных агентных и программных рабочих процессов, обеспечивая многошаговые рассуждения, надёжное использование инструментов, восстановление после сбоев, понимание изображений и многоязычную поддержку более чем 100 языков.
deepseek/deepseek-v4-flash-0731
DeepSeek V4 Flash 0731 — это разреженная модель смеси экспертов от DeepSeek, с 13B активными параметрами из 284B общих. Эта переобученная версия подходит для задач кодирования, рассуждений и агентных рабочих процессов. Это GA-релиз DeepSeek V4 Flash.
thinkingmachines/inkling-small
Inkling Small — это открытая мультимодальная модель смеси экспертов с открытыми весами от лаборатории Thinking Machines, с 12B активными параметрами из 276B общих. Она позиционируется как меньший и более эффективный представитель семейства Inkling и подходит для рассуждений, программирования, агентных рабочих процессов, генерации с дополнением на основе поиска, следования инструкциям и многоязычного общения.
thinkingmachines/inkling
Inkling — это мультимодальная модель со смесью экспертов и открытыми весами от лаборатории Thinking Machines, с 41B активными параметрами из 975B общих. Она предназначена для универсальных рассуждений, написания кода, использования в агентных системах и инструментальных средах, дополнения с检索-усиленной генерацией, следования инструкциям, а также для многоязычных диалоговых сценариев. Встроенное понимание изображений и звука позволяет модели обрабатывать мультимодальные данные наряду с текстом.
moonshotai/kimi-k3
Kimi K3 — это мультимодальная модель рассуждений с открытыми весами на 2.8T параметров от Moonshot AI. Она подходит для сложного программирования, работы со знаниями и длительных агентных сценариев, а особенно сильна в навигации по крупным репозиториям, использовании инструментов, отладке и итеративной работе с изображениями, логами, тестами и обратной связью от выполнения. В её архитектуре используются KDA и Attention Residuals для вычислительной эффективности.
z-ai/glm-5.2
GLM 5.2 — это крупномасштабная модель рассуждения от Z.ai. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и подходит для долгосрочных агентных рабочих процессов, разработки программного обеспечения на уровне проектов и сложной многоэтапной автоматизации. Поддерживаются уровни усилий рассуждения high и xhigh; xhigh соответствует максимальному уровню рассуждения. Модель особенно сильна в написании кода и использовании инструментов в длительных задачах, способна сохранять инженерный контекст и последовательно следовать стандартам на протяжении всего цикла разработки — от требований до развертывания на нескольких платформах — в рамках одной задачи.
moonshotai/kimi-k2.7-code
MoonshotAI: Kimi K2.7 Code — это модель, ориентированная на программирование, из семейства Kimi K2 от Moonshot AI, созданная для надёжного выполнения комплексных задач программирования в условиях длинных контекстов. Она использует нативную мультимодальную архитектуру смеси экспертов, которая принимает текст и изображения на входе, и всегда работает в режиме мышления, сохраняя полное содержимое рассуждений при многоходовых диалогах. С контекстным окном в 256K токенов модель нацелена на долгосрочное программирование, декомпозицию агентских задач и многоходовые диалоги. Модель активирует 32B параметров из примерно 1T общих.
nvidia/parakeet-tdt-0.6b-v3
Parakeet TDT 0.6B v3 — это мультиязычная модель преобразования речи в текст с 600M параметрами от NVIDIA, построенная на архитектуре FastConformer-TDT. Обученная на датасете Granary (более 670,000 часов аудио), она поддерживает автоматическое определение языка для всех официальных языков EU и достигает среднего показателя частоты ошибок в словах 6.34% на лидерборде HuggingFace Open ASR. Возвращает транскрибированный текст с пунктуацией и временными метками сегментов.
openai/whisper-large-v3
Whisper Large V3 — это открытая модель автоматического распознавания речи от OpenAI, которая обеспечивает как транскрибацию аудио, так и перевод. Она поддерживает 99+ языков и принимает распространённые аудиоформаты, включая mp3, mp4, wav, webm, flac и ogg. С 1,550M параметрами модель достигает показателя ошибок в 10.3% слов и хорошо подходит для помехоустойчивой многоязычной транскрибации в сложных условиях. Поддерживается детализация временных меток на уровне слов и сегментов.
canopylabs/orpheus-3b-0.1-ft
Orpheus 3B — это англоязычная модель синтеза речи от Canopy Labs, тонко настроенная для естественной просодии и выразительного озвучивания. Она предлагает 7 предустановленных голосов и подходит для озвучивания повествований, голосовых ассистентов и интерактивных приложений, где приоритетом является естественность речи.
hexgrad/kokoro-82m
Kokoro 82M — это легковесная модель синтеза речи с открытыми весами от hexgrad. Она преобразует текст в речь на 8 языках (американский и британский английский, испанский, французский, хинди, итальянский, японский, португальский и китайский) с использованием 54 предустановленных голосов, сгруппированных по языку и полу. При 82M параметрах она хорошо подходит для многоязычных TTS развертываний, где важны компактность и эффективность затрат.
google/gemma-4-31b-it
Gemma 4 31B Instruct — это 30.7B плотная мультимодальная модель Google DeepMind, поддерживающая ввод текста и изображений с выводом текста. Она имеет контекстное окно размером 256K токенов, настраиваемый режим мышления/рассуждений, встроенный вызов функций и многоязычную поддержку для 140+ языков. Сильна в задачах программирования, рассуждений и понимания документов. Лицензия Apache 2.0.
qwen/qwen3.5-9b
Qwen3.5-9B — это мультимодальная фундаментальная модель из семейства Qwen3.5, разработанная для обеспечения сильных рассуждений, программирования и визуального понимания в эффективной архитектуре с 9B параметрами. Она использует унифицированный дизайн «зрение-язык» с ранним слиянием мультимодальных токенов, что позволяет модели обрабатывать и рассуждать над текстом и изображениями в одном контексте.
openai/gpt-oss-120b
gpt-oss-120b — это модель языка с открытым весом, на 117B параметров, архитектуры Mixture-of-Experts (MoE) от OpenAI, предназначенная для производственных сценариев с высокими требованиями к рассуждению, агентных и универсальных задач. Она активирует 5.1B параметров за прямой проход и оптимизирована для работы на одном H100 GPU с нативной квантизацией MXFP4. Модель поддерживает настраиваемую глубину рассуждений, полный доступ к цепочке рассуждений и нативное использование инструментов, включая вызов функций, просмотр веб-страниц и генерацию структурированных выходных данных.
openai/gpt-oss-20b
gpt-oss-20b — это модель с открытыми весами, выпущенная OpenAI с 21B параметрами под лицензией Apache 2.0. В ней используется архитектура смеси экспертов (MoE) с 3.6B активными параметрами на прямой проход, что обеспечивает более низкую задержку вывода и возможность развертывания на потребительском или однопроцессорном оборудовании GPU. Модель обучается в формате ответов Harmony от OpenAI и поддерживает настройку уровня рассуждений, дообучение, а также агентные возможности, включая вызов функций, использование инструментов и структурированные выходные данные.
meta-llama/llama-3.3-70b-instruct
Многоязычная большая языковая модель Meta Llama 3.3 (LLM) — это предобученная и инструкционно настроенная генеративная модель в 70B (текст на входе/текст на выходе). Модель Llama 3.3, инструкционно настроенная и работающая только с текстом, оптимизирована для многоязычных диалоговых сценариев и превосходит многие доступные открытые и закрытые чат-модели на распространённых отраслевых бенчмарках. Поддерживаемые языки: английский, немецкий, французский, итальянский, португальский, хинди, испанский и тайский. Model Card