Модели
470 моделей · цены в рублях по текущему курсу пополнения
Google: Gemini 3.8 Flash
Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями благодаря 3.7 Flash в разработке ПО, агентных задачах и многошаговых рассуждениях.
MiniMax: H3 Max
MiniMax H3 Max — это модель генерации видео от MiniMax, выпущенная совместно с fal.ai. Созданная путём дополнительного обучения на основе MiniMax H3, она предназначена для более быстрой генерации видео из текста и из изображения с управляемыми ключевыми кадрами первого или последнего кадра.
Anthropic: Claude Fable 5.1
Claude Fable 5.1 превосходит Claude Fable 5 по всем направлениям, при этом наибольший прогресс наблюдается в агентном программировании, длительных агентных рабочих процессах и интеллектуальной работе: особенно в длительном рефакторинге кода, генерации front-end и визуального кода, а также в финансовых и аналитических задачах. Он также, как правило, более лаконичен, чем Fable 5, в своих планах и сводках. Мы рекомендуем протестировать его как прямое обновление везде, где вы сегодня используете Fable 5, а также вместе с Opus 5 для задач, требующих сложных рассуждений.
Inception: Mercury 2.5 Preview
Mercury 2.5 — это самая быстрая рассуждающая LLM и новейшая диффузионная LLM (dLLM) от Inception. Вместо последовательной генерации токенов Mercury 2.5 создаёт и уточняет несколько токенов параллельно, достигая 1,107 tokens/sec на стандартном GPUs. Она обеспечивает скачок интеллекта на 10+ пунктов по сравнению с Mercury 2, при этом качество сопоставимо с оптимизированными по стоимости фронтирными моделями, такими как GPT-5, 6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5. Mercury 2.5 поддерживает настраиваемые уровни рассуждений, параллельные вызовы инструментов и вывод JSON, согласованный со схемой. Он создан для производственных нагрузок, где задержка накапливается: поисковые агенты, голосовые конвейеры и кодирующие субагенты.
IBM: Granite 4.2 8B
Granite 4.2 8B — это плотная модель рассуждений от IBM. Она подходит для математики, генерации кода, многоязычного диалога и агентных рабочих процессов, требующих многошаговых рассуждений. Она поддерживает режимы полного, низкого усилия и без размышлений. Модель поддерживает 12 языков: английский, немецкий, испанский, французский, японский, португальский, арабский, чешский, итальянский, корейский, нидерландский и китайский.
Tencent: Hy4 preview
Tencent: Hy4 preview — это модель смеси экспертов от Tencent, с 49B активными параметрами из 770B общих. Она предназначена для агентов кодирования, сложных рабочих процессов с использованием инструментов и задач производительности, которые требуют планирования, непрерывности контекста и устойчивого многошагового выполнения.
Alibaba: Wan 3.0 Prime
Wan 3.0 Prime — это быстрый вариант Wan 3.0 от Alibaba. Поддерживает генерацию видео из текста и из первого кадра изображения.
Z.ai: GLM Flash Latest
Текущая модель: Z.ai: GLM 5.3 Flash
Эта модель всегда перенаправляет на последнюю модель в семействе GLM Flash.
Qwen: Qwen3.8 Flash
Qwen3.8 Flash — это мультимодальная модель рассуждений от Alibaba. Она подходит для помощи в написании кода, агентных рабочих процессов, визуального понимания, анализа документов и кодовой базы, взаимодействия с рабочим столом, анализа графиков и анализа длинных видео.
Meta: Muse Image
Muse Image — это агентная модель генерации изображений от Meta, которая создаёт и редактирует изображения по тексту и референсным изображениям. В отличие от однопроходных моделей изображений, она рассуждает перед рендерингом, разбивая составные запросы и уточняя свой результат в цепочке рассуждений, а также вызывает веб-поиск для фактической точности по запросам, требующим глубоких знаний. Модель поддерживает генерацию изображений по тексту, точечное редактирование изображений, композицию из нескольких изображений, управление по референсному изображению для согласованности стиля и объекта в серии, а также точный рендеринг текста внутри сгенерированных изображений. Итеративное редактирование работает путём передачи предыдущего выходного изображения обратно с новой инструкцией.
Z.ai: GLM 5.3 Flash
−50%GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного программирования и долгосрочных агентных задач. Её гибридная архитектура разрежённого и линейного внимания сохраняет точное поведение при работе с длинным контекстом, одновременно снижая вычислительные накладные расходы.
Recraft: Recraft V4 Styles Pro
Recraft V4 Styles Pro — это модель генерации изображений с согласованным стилем от Recraft. Каждый запрос требует по крайней мере одно референсное изображение стиля и создаёт новое изображение, которое воспроизводит технику рендеринга, цвет, текстуру и композицию референса, а не редактирует его. Модель создаёт растровые изображения с разрешением примерно 2K. Примечание: от 1 до 10 референсных изображений в формате PNG, JPG или WEBP, каждое размером не менее 256 px по короткой стороне. Цена состоит из двух частей: $0.10 за изображение плюс одноразовая плата $0.005 за создание стиля для каждого запроса, независимо от того, сколько изображений возвращает этот запрос. Запрос с одним изображением стоит $0.105, а запрос с шестью изображениями — $0.605.
Recraft: Recraft V4 Styles Vector
Recraft V4 Styles Vector — это модель генерации изображений с единым стилем от Recraft. Каждый запрос требует как минимум одно референсное изображение стиля и генерирует новое изображение, которое воспроизводит технику рендеринга, цвет, текстуру и композицию референса, а не редактирует его. Она обеспечивает вывод SVG для графики, которой нужно чисто масштабироваться. Примечание: от 1 до 10 референсных изображений в форматах PNG, JPG или WEBP, каждое не менее 256 пикселей по короткой стороне. Цена состоит из двух частей: $0.05 за изображение плюс разовый сбор $0.005 за создание стиля на каждый запрос, независимо от того, сколько изображений возвращает этот запрос. Запрос одного изображения стоит $0.055, а запрос шести изображений — $0.305.
Recraft: Recraft V4 Styles Pro Vector
Recraft V4 Styles Pro Vector — это модель генерации изображений с сохранением стиля от Recraft. Каждый запрос требует как минимум одно референсное изображение стиля и создаёт новое изображение, воспроизводящее технику рендеринга, цвет, текстуру и композицию референса, а не редактирующее его. Она выдаёт результат в формате SVG для графики, которая должна масштабироваться без потери качества. Примечание: 1–10 референсных изображений в форматах PNG, JPG или WEBP, каждое размером не менее 256 px по короткой стороне. Ценообразование состоит из двух частей: $0.12 за изображение плюс разовый сбор в размере $0.005 за создание стиля на каждый запрос, независимо от количества изображений, возвращаемых этим запросом. Запрос на одно изображение стоит $0.125, а запрос на шесть изображений — $0.725.
Recraft: Recraft V4 Styles
Recraft V4 Styles — это модель генерации изображений с согласованным стилем от Recraft. Каждый запрос требует как минимум одного референсного изображения стиля и генерирует новое изображение, которое воспроизводит технику рендеринга, цвет, текстуру и композицию референса, а не редактирует его. Она создаёт растровые изображения с разрешением примерно 1K. Примечание: от 1 до 10 референсных изображений в PNG, JPG или WEBP, каждое размером не менее 256 пикселей по короткой стороне. Цена состоит из двух частей: $0.035 за изображение плюс разовый сбор $0.005 за создание стиля за запрос, независимо от того, сколько изображений возвращает запрос. Запрос на одно изображение стоит $0.040, а запрос на шесть изображений — $0.215.
Alibaba: Wan 3.0
−15%Wan 3.0 — это модель генерации видео от Alibaba для генерации видео из текста, изображений и по эталону. Она создаёт видео с разрешением 480p, 720p или 1080p длительностью от 2 до 30 секунд.
HeyGen: Avatar IV
HeyGen: Avatar IV — это модель преобразования изображения в видео, которая оживляет одно фото, превращая его в выразительное видео с говорящей головой и синхронизацией губ. Вместо простого подбора формы губ под слова, она интерпретирует вокальный тон, ритм и эмоции аудио, чтобы управлять движениями головы, мимикой и жестами, создавая результат с разрешением до 1080p. Озвучка берётся из одного из двух источников: текстовый сценарий, который модель озвучивает с помощью синтеза речи HeyGen, либо предоставленная аудиодорожка, под которую изображение синхронизирует губы напрямую. Сквозные параметры позволяют выбрать голос, настроить параметры голоса, задать выразительность, указать конкретные движения, заменить или удалить фон, добавить субтитры и задать название видео.
Meta: Muse Spark 1.2 Contributor
Muse Spark 1.2 contributor tier — это модель рассуждения от Meta, предназначенная для разработчиков, которые хотят начать создавать приложения с еще более низкими затратами. Она значительно дешевле, чем Muse Spark 1.2. Ваши запросы и результаты могут использоваться для улучшения продуктов Meta, что делает эту модель идеальной для экспериментов, обучения и проектов на ранних стадиях, не беспокоясь о расходах. Это модель рассуждения от Meta, предназначенная для сложных агентных задач. Она принимает текст, изображения, видео, аудио и документы в формате PDF, возвращает текст и предлагает контекстное окно на 1M токенов. Модель создана для поддержки многоагентных рабочих процессов, выступая либо как основной агент, который планирует и распределяет задачи, либо как субагент, выполняющий задачи параллельно. Она работает с различными средами разработки кода и поддерживает структурированный вывод, параллельные вызовы функций и настраиваемое усилие рассуждения. В тестировании Meta модель показывает хорошие результаты при многофайловом рефакторинге, длительных сессиях отладки, генерации целых репозиториев и задачах, выходящих далеко за пределы одного запроса.
DeepSeek: DeepSeek V4 Flash Vision Exp
DeepSeek V4 Flash Vision Exp — это экспериментальная версия с поддержкой зрения DeepSeek V4 Flash 0731 от DeepSeek, добавляющая понимание изображений, сохраняя при этом уровень базовой модели в работе с текстом, включая агентные сценарии и рассуждения. Это разреженная модель на основе смеси экспертов с 13B активными параметрами из общего числа 284B. Она подходит для понимания документов и диаграмм, ответов на вопросы по изображениям и мультимодальных агентных рабочих процессов, объединяющих текст и изображения.
Tencent: Hy-MT2-1.8B
Hy-MT2-1.8B — это компактная 1.8B-параметрическая модель перевода от Tencent. Она поддерживает 33 языковых пар и пять пар китайских диалектов и языков меньшинств, а также рабочие процессы для структурированного перевода, перевода на основе разделителей, контекстного перевода, перевода с использованием глоссария и перевода с управлением стилем.
Tencent: Hy-MT2-30B-A3B
Hy-MT2-30B-A3B — это флагманская модель перевода Tencent в семействе MT2. Она поддерживает языковые пары 33, а также пять пар китайских диалектов и миноритарных языков, с рабочими процессами для структурированного перевода, перевода на основе разделителей, перевода с использованием глоссариев и стилизованного перевода. В ней используется 3B активных параметров из 30B общего числа.
Black Forest Labs: FLUX Video Upscale
FLUX Video Upscale — это модель масштабирования видео от Black Forest Labs. Она увеличивает одно исходное видео в 1.5× до 3×, сохраняя его длительность, с опциональным промптом и режимами обработки — точным или творческим.
Z.ai: GLM Latest
−5%Текущая модель: Z.ai: GLM 5.3
Эта модель всегда перенаправляет на последнюю модель GLM от Z.ai.
Tencent: Hy-MT2-7B
Hy-MT2-7B — это модель перевода с 7B параметров от Tencent. Она поддерживает 33 языковых пар, а также пять пар для китайских диалектов и языков меньшинств, с рабочими процессами для структурированного, разделительного, контекстного, глоссарного и стилистически управляемого перевода.
Z.ai: GLM 5.3
−5%GLM-5.3 — это крупномасштабная модель рассуждения от Z.ai, созданная для сложной разработки программного обеспечения и долгосрочных агентных задач. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании, а также в балансе между производительностью и эффективностью использования токенов. Рассуждение всегда включено и не может быть отключено. Поддерживаются уровни усилий рассуждения low, high и max; по умолчанию используется max.
Qwen: Qwen3.8 27B
Qwen3.8 27B — это открытая модель с публичными весами, относящаяся к классу плотных мультимодальных моделей «зрение-язык» от компании Qwen. Она подходит для задач программирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, поддерживая гибкий режим рассуждений, который можно включать или отключать.
NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B
Nemotron 3.5 ASR Streaming Multilingual 0.6B — это модель распознавания речи от NVIDIA. Её архитектура FastConformer-RNNT, учитывающая промпты и кэш, нацелена на транскрипцию с низкой задержкой более чем на 40 языках для субтитров в реальном времени, голосовых агентов и конвейеров многоязычной транскрипции.
Mistral: Voxtral Small 24B 2507 STT
Voxtral Small 24B 2507 STT — это модель транскрипции речи от Mistral AI. Она подходит для задач транскрипции, перевода и понимания аудио, которым выгодна её большая ёмкость модели.
Mistral: Voxtral Mini 3B 2507
Voxtral Mini 3B 2507 — это модель для распознавания речи и аудио от Mistral AI. Она подходит для задач транскрипции, перевода и компактной обработки аудио.
ByteDance Seed: Seedream 5.0 Lite
Seedream 5.0 Lite — это модель генерации изображений от ByteDance Seed. Она подходит для профессионального визуального творчества, которому способствуют веб-подключённый поиск, понимание сложных промптов, визуальные референсы и широкий охват знаний.