Модели

470 моделей · цены в рублях по текущему курсу пополнения

Google: Gemini 3.8 Flash

Gemini 3.8 Flash — это самая интеллектуальная модель Flash от Google со значительными улучшениями благодаря 3.7 Flash в разработке ПО, агентных задачах и многошаговых рассуждениях.

автор google2 сент. 2026 г.92,83 ₽ / 1 млн входных464,16 ₽ / 1 млн выходных

MiniMax: H3 Max

MiniMax H3 Max — это модель генерации видео от MiniMax, выпущенная совместно с fal.ai. Созданная путём дополнительного обучения на основе MiniMax H3, она предназначена для более быстрой генерации видео из текста и из изображения с управляемыми ключевыми кадрами первого или последнего кадра.

автор minimax2 сент. 2026 г.от 7,74 ₽ за секунду

Anthropic: Claude Fable 5.1

Claude Fable 5.1 превосходит Claude Fable 5 по всем направлениям, при этом наибольший прогресс наблюдается в агентном программировании, длительных агентных рабочих процессах и интеллектуальной работе: особенно в длительном рефакторинге кода, генерации front-end и визуального кода, а также в финансовых и аналитических задачах. Он также, как правило, более лаконичен, чем Fable 5, в своих планах и сводках. Мы рекомендуем протестировать его как прямое обновление везде, где вы сегодня используете Fable 5, а также вместе с Opus 5 для задач, требующих сложных рассуждений.

автор anthropic1 сент. 2026 г.1 237,76 ₽ / 1 млн входных6 188,78 ₽ / 1 млн выходных

Inception: Mercury 2.5 Preview

Mercury 2.5 — это самая быстрая рассуждающая LLM и новейшая диффузионная LLM (dLLM) от Inception. Вместо последовательной генерации токенов Mercury 2.5 создаёт и уточняет несколько токенов параллельно, достигая 1,107 tokens/sec на стандартном GPUs. Она обеспечивает скачок интеллекта на 10+ пунктов по сравнению с Mercury 2, при этом качество сопоставимо с оптимизированными по стоимости фронтирными моделями, такими как GPT-5, 6 Luna (Low), Gemini 3.5 Flash-Lite и Claude Haiku 4.5. Mercury 2.5 поддерживает настраиваемые уровни рассуждений, параллельные вызовы инструментов и вывод JSON, согласованный со схемой. Он создан для производственных нагрузок, где задержка накапливается: поисковые агенты, голосовые конвейеры и кодирующие субагенты.

автор inception31 авг. 2026 г.4,95 ₽ / 1 млн входных18,57 ₽ / 1 млн выходных

IBM: Granite 4.2 8B

Granite 4.2 8B — это плотная модель рассуждений от IBM. Она подходит для математики, генерации кода, многоязычного диалога и агентных рабочих процессов, требующих многошаговых рассуждений. Она поддерживает режимы полного, низкого усилия и без размышлений. Модель поддерживает 12 языков: английский, немецкий, испанский, французский, японский, португальский, арабский, чешский, итальянский, корейский, нидерландский и китайский.

автор ibm-granite31 авг. 2026 г.12,38 ₽ / 1 млн входных18,57 ₽ / 1 млн выходных

Tencent: Hy4 preview

Tencent: Hy4 preview — это модель смеси экспертов от Tencent, с 49B активными параметрами из 770B общих. Она предназначена для агентов кодирования, сложных рабочих процессов с использованием инструментов и задач производительности, которые требуют планирования, непрерывности контекста и устойчивого многошагового выполнения.

автор tencent28 авг. 2026 г.103,23 ₽ / 1 млн входных309,56 ₽ / 1 млн выходных

Alibaba: Wan 3.0 Prime

Wan 3.0 Prime — это быстрый вариант Wan 3.0 от Alibaba. Поддерживает генерацию видео из текста и из первого кадра изображения.

автор alibaba27 авг. 2026 г.от 9,82 ₽ за секунду

Z.ai: GLM Flash Latest

Текущая модель: Z.ai: GLM 5.3 Flash

Эта модель всегда перенаправляет на последнюю модель в семействе GLM Flash.

автор ~z-ai27 авг. 2026 г.9,28 ₽ / 1 млн входных30,94 ₽ / 1 млн выходных

Qwen: Qwen3.8 Flash

Qwen3.8 Flash — это мультимодальная модель рассуждений от Alibaba. Она подходит для помощи в написании кода, агентных рабочих процессов, визуального понимания, анализа документов и кодовой базы, взаимодействия с рабочим столом, анализа графиков и анализа длинных видео.

автор qwen26 авг. 2026 г.18,57 ₽ / 1 млн входных58,17 ₽ / 1 млн выходных

Meta: Muse Image

Muse Image — это агентная модель генерации изображений от Meta, которая создаёт и редактирует изображения по тексту и референсным изображениям. В отличие от однопроходных моделей изображений, она рассуждает перед рендерингом, разбивая составные запросы и уточняя свой результат в цепочке рассуждений, а также вызывает веб-поиск для фактической точности по запросам, требующим глубоких знаний. Модель поддерживает генерацию изображений по тексту, точечное редактирование изображений, композицию из нескольких изображений, управление по референсному изображению для согласованности стиля и объекта в серии, а также точный рендеринг текста внутри сгенерированных изображений. Итеративное редактирование работает путём передачи предыдущего выходного изображения обратно с новой инструкцией.

автор meta26 авг. 2026 г.1,24 ₽ за изображение

Z.ai: GLM 5.3 Flash

50%

GLM-5.3-Flash — это нативная мультимодальная модель от Z.ai. Она подходит для эффективного программирования и долгосрочных агентных задач. Её гибридная архитектура разрежённого и линейного внимания сохраняет точное поведение при работе с длинным контекстом, одновременно снижая вычислительные накладные расходы.

автор z-ai26 авг. 2026 г.9,28 ₽ / 1 млн входных30,94 ₽ / 1 млн выходных

Recraft: Recraft V4 Styles Pro

Recraft V4 Styles Pro — это модель генерации изображений с согласованным стилем от Recraft. Каждый запрос требует по крайней мере одно референсное изображение стиля и создаёт новое изображение, которое воспроизводит технику рендеринга, цвет, текстуру и композицию референса, а не редактирует его. Модель создаёт растровые изображения с разрешением примерно 2K. Примечание: от 1 до 10 референсных изображений в формате PNG, JPG или WEBP, каждое размером не менее 256 px по короткой стороне. Цена состоит из двух частей: $0.10 за изображение плюс одноразовая плата $0.005 за создание стиля для каждого запроса, независимо от того, сколько изображений возвращает этот запрос. Запрос с одним изображением стоит $0.105, а запрос с шестью изображениями — $0.605.

автор recraft26 авг. 2026 г.12,38 ₽ за изображение

Recraft: Recraft V4 Styles Vector

Recraft V4 Styles Vector — это модель генерации изображений с единым стилем от Recraft. Каждый запрос требует как минимум одно референсное изображение стиля и генерирует новое изображение, которое воспроизводит технику рендеринга, цвет, текстуру и композицию референса, а не редактирует его. Она обеспечивает вывод SVG для графики, которой нужно чисто масштабироваться. Примечание: от 1 до 10 референсных изображений в форматах PNG, JPG или WEBP, каждое не менее 256 пикселей по короткой стороне. Цена состоит из двух частей: $0.05 за изображение плюс разовый сбор $0.005 за создание стиля на каждый запрос, независимо от того, сколько изображений возвращает этот запрос. Запрос одного изображения стоит $0.055, а запрос шести изображений — $0.305.

автор recraft26 авг. 2026 г.6,19 ₽ за изображение

Recraft: Recraft V4 Styles Pro Vector

Recraft V4 Styles Pro Vector — это модель генерации изображений с сохранением стиля от Recraft. Каждый запрос требует как минимум одно референсное изображение стиля и создаёт новое изображение, воспроизводящее технику рендеринга, цвет, текстуру и композицию референса, а не редактирующее его. Она выдаёт результат в формате SVG для графики, которая должна масштабироваться без потери качества. Примечание: 1–10 референсных изображений в форматах PNG, JPG или WEBP, каждое размером не менее 256 px по короткой стороне. Ценообразование состоит из двух частей: $0.12 за изображение плюс разовый сбор в размере $0.005 за создание стиля на каждый запрос, независимо от количества изображений, возвращаемых этим запросом. Запрос на одно изображение стоит $0.125, а запрос на шесть изображений — $0.725.

автор recraft26 авг. 2026 г.14,85 ₽ за изображение

Recraft: Recraft V4 Styles

Recraft V4 Styles — это модель генерации изображений с согласованным стилем от Recraft. Каждый запрос требует как минимум одного референсного изображения стиля и генерирует новое изображение, которое воспроизводит технику рендеринга, цвет, текстуру и композицию референса, а не редактирует его. Она создаёт растровые изображения с разрешением примерно 1K. Примечание: от 1 до 10 референсных изображений в PNG, JPG или WEBP, каждое размером не менее 256 пикселей по короткой стороне. Цена состоит из двух частей: $0.035 за изображение плюс разовый сбор $0.005 за создание стиля за запрос, независимо от того, сколько изображений возвращает запрос. Запрос на одно изображение стоит $0.040, а запрос на шесть изображений — $0.215.

автор recraft26 авг. 2026 г.4,33 ₽ за изображение

Alibaba: Wan 3.0

15%

Wan 3.0 — это модель генерации видео от Alibaba для генерации видео из текста, изображений и по эталону. Она создаёт видео с разрешением 480p, 720p или 1080p длительностью от 2 до 30 секунд.

автор alibaba24 авг. 2026 г.от 6,14 ₽ за секунду

HeyGen: Avatar IV

HeyGen: Avatar IV — это модель преобразования изображения в видео, которая оживляет одно фото, превращая его в выразительное видео с говорящей головой и синхронизацией губ. Вместо простого подбора формы губ под слова, она интерпретирует вокальный тон, ритм и эмоции аудио, чтобы управлять движениями головы, мимикой и жестами, создавая результат с разрешением до 1080p. Озвучка берётся из одного из двух источников: текстовый сценарий, который модель озвучивает с помощью синтеза речи HeyGen, либо предоставленная аудиодорожка, под которую изображение синхронизирует губы напрямую. Сквозные параметры позволяют выбрать голос, настроить параметры голоса, задать выразительность, указать конкретные движения, заменить или удалить фон, добавить субтитры и задать название видео.

автор heygen24 авг. 2026 г.7,22 ₽ за секунду

Meta: Muse Spark 1.2 Contributor

Muse Spark 1.2 contributor tier — это модель рассуждения от Meta, предназначенная для разработчиков, которые хотят начать создавать приложения с еще более низкими затратами. Она значительно дешевле, чем Muse Spark 1.2. Ваши запросы и результаты могут использоваться для улучшения продуктов Meta, что делает эту модель идеальной для экспериментов, обучения и проектов на ранних стадиях, не беспокоясь о расходах. Это модель рассуждения от Meta, предназначенная для сложных агентных задач. Она принимает текст, изображения, видео, аудио и документы в формате PDF, возвращает текст и предлагает контекстное окно на 1M токенов. Модель создана для поддержки многоагентных рабочих процессов, выступая либо как основной агент, который планирует и распределяет задачи, либо как субагент, выполняющий задачи параллельно. Она работает с различными средами разработки кода и поддерживает структурированный вывод, параллельные вызовы функций и настраиваемое усилие рассуждения. В тестировании Meta модель показывает хорошие результаты при многофайловом рефакторинге, длительных сессиях отладки, генерации целых репозиториев и задачах, выходящих далеко за пределы одного запроса.

автор meta21 авг. 2026 г.12,38 ₽ / 1 млн входных24,76 ₽ / 1 млн выходных

DeepSeek: DeepSeek V4 Flash Vision Exp

DeepSeek V4 Flash Vision Exp — это экспериментальная версия с поддержкой зрения DeepSeek V4 Flash 0731 от DeepSeek, добавляющая понимание изображений, сохраняя при этом уровень базовой модели в работе с текстом, включая агентные сценарии и рассуждения. Это разреженная модель на основе смеси экспертов с 13B активными параметрами из общего числа 284B. Она подходит для понимания документов и диаграмм, ответов на вопросы по изображениям и мультимодальных агентных рабочих процессов, объединяющих текст и изображения.

автор deepseek21 авг. 2026 г.от 27,23 ₽ / 1 млн входныхот 81,69 ₽ / 1 млн выходных

Tencent: Hy-MT2-1.8B

Hy-MT2-1.8B — это компактная 1.8B-параметрическая модель перевода от Tencent. Она поддерживает 33 языковых пар и пять пар китайских диалектов и языков меньшинств, а также рабочие процессы для структурированного перевода, перевода на основе разделителей, контекстного перевода, перевода с использованием глоссария и перевода с управлением стилем.

автор tencent20 авг. 2026 г.5,45 ₽ / 1 млн входных21,91 ₽ / 1 млн выходных

Tencent: Hy-MT2-30B-A3B

Hy-MT2-30B-A3B — это флагманская модель перевода Tencent в семействе MT2. Она поддерживает языковые пары 33, а также пять пар китайских диалектов и миноритарных языков, с рабочими процессами для структурированного перевода, перевода на основе разделителей, перевода с использованием глоссариев и стилизованного перевода. В ней используется 3B активных параметров из 30B общего числа.

автор tencent20 авг. 2026 г.9,16 ₽ / 1 млн входных36,51 ₽ / 1 млн выходных

Black Forest Labs: FLUX Video Upscale

FLUX Video Upscale — это модель масштабирования видео от Black Forest Labs. Она увеличивает одно исходное видео в 1.5× до 3×, сохраняя его длительность, с опциональным промптом и режимами обработки — точным или творческим.

автор black-forest-labs19 авг. 2026 г.от 10,83 ₽ за мегапиксель-секунду

Z.ai: GLM Latest

5%

Текущая модель: Z.ai: GLM 5.3

Эта модель всегда перенаправляет на последнюю модель GLM от Z.ai.

автор ~z-ai19 авг. 2026 г.173,29 ₽ / 1 млн входных544,61 ₽ / 1 млн выходных

Tencent: Hy-MT2-7B

Hy-MT2-7B — это модель перевода с 7B параметров от Tencent. Она поддерживает 33 языковых пар, а также пять пар для китайских диалектов и языков меньшинств, с рабочими процессами для структурированного, разделительного, контекстного, глоссарного и стилистически управляемого перевода.

автор tencent19 авг. 2026 г.9,16 ₽ / 1 млн входных36,51 ₽ / 1 млн выходных

Z.ai: GLM 5.3

5%

GLM-5.3 — это крупномасштабная модель рассуждения от Z.ai, созданная для сложной разработки программного обеспечения и долгосрочных агентных задач. Она поддерживает ввод и вывод текста с контекстным окном в 1M токенов и превосходит GLM-5.2 в кодировании, а также в балансе между производительностью и эффективностью использования токенов. Рассуждение всегда включено и не может быть отключено. Поддерживаются уровни усилий рассуждения low, high и max; по умолчанию используется max.

автор z-ai18 авг. 2026 г.173,29 ₽ / 1 млн входных544,61 ₽ / 1 млн выходных

Qwen: Qwen3.8 27B

Qwen3.8 27B — это открытая модель с публичными весами, относящаяся к классу плотных мультимодальных моделей «зрение-язык» от компании Qwen. Она подходит для задач программирования, профессиональных рабочих процессов, исследований, мультимодального взаимодействия и длительных агентских задач, поддерживая гибкий режим рассуждений, который можно включать или отключать.

автор qwen14 авг. 2026 г.52,60 ₽ / 1 млн входных315,63 ₽ / 1 млн выходных

NVIDIA: Nemotron 3.5 ASR Streaming Multilingual 0.6B

Nemotron 3.5 ASR Streaming Multilingual 0.6B — это модель распознавания речи от NVIDIA. Её архитектура FastConformer-RNNT, учитывающая промпты и кэш, нацелена на транскрипцию с низкой задержкой более чем на 40 языках для субтитров в реальном времени, голосовых агентов и конвейеров многоязычной транскрипции.

автор nvidia13 авг. 2026 г.< 0,01 ₽ за секунду

Mistral: Voxtral Small 24B 2507 STT

Voxtral Small 24B 2507 STT — это модель транскрипции речи от Mistral AI. Она подходит для задач транскрипции, перевода и понимания аудио, которым выгодна её большая ёмкость модели.

автор mistralai13 авг. 2026 г.< 0,01 ₽ за секунду

Mistral: Voxtral Mini 3B 2507

Voxtral Mini 3B 2507 — это модель для распознавания речи и аудио от Mistral AI. Она подходит для задач транскрипции, перевода и компактной обработки аудио.

автор mistralai13 авг. 2026 г.< 0,01 ₽ за секунду

ByteDance Seed: Seedream 5.0 Lite

Seedream 5.0 Lite — это модель генерации изображений от ByteDance Seed. Она подходит для профессионального визуального творчества, которому способствуют веб-подключённый поиск, понимание сложных промптов, визуальные референсы и широкий охват знаний.

автор bytedance-seed13 авг. 2026 г.4,33 ₽ за изображение