MiniMax: MiniMax M1
minimax/minimax-m1MiniMax-M1 — это крупномасштабная модель с открытым весом, предназначенная для рассуждений, оптимизированная для длинного контекста и эффективного вывода. Она использует гибридную архитектуру смеси экспертов (MoE) в сочетании с пользовательским механизмом «молниеносного внимания», позволяющим обрабатывать длинные последовательности — до 1 миллионов токенов — при сохранении конкурентоспособной эффективности FLOP. При общем количестве 456 миллиардов параметров и 45.9B активных параметров на токен этот вариант оптимизирован для сложных многошаговых задач рассуждения. Обученная с помощью пользовательского конвейера обучения с подкреплением (CISPO), модель M1 превосходно справляется с пониманием длинного контекста, разработкой программного обеспечения, автономным использованием инструментов и математическими рассуждениями. Бенчмарки демонстрируют высокую производительность в задачах FullStackBench, SWE-bench, MATH, GPQA и TAU-Bench, часто превосходя другие открытые модели, такие как DeepSeek R1 и Qwen3-235B.
MiniMax-M1 — это крупномасштабная модель с открытым весом, предназначенная для рассуждений, оптимизированная для длинного контекста и эффективного вывода. Она использует гибридную архитектуру смеси экспертов (MoE) в сочетании с пользовательским механизмом «молниеносного внимания», позволяющим обрабатывать длинные последовательности — до 1 миллионов токенов — при сохранении конкурентоспособной эффективности FLOP. При общем количестве 456 миллиардов параметров и 45.9B активных параметров на токен этот вариант оптимизирован для сложных многошаговых задач рассуждения.
Обученная с помощью пользовательского конвейера обучения с подкреплением (CISPO), модель M1 превосходно справляется с пониманием длинного контекста, разработкой программного обеспечения, автономным использованием инструментов и математическими рассуждениями. Бенчмарки демонстрируют высокую производительность в задачах FullStackBench, SWE-bench, MATH, GPQA и TAU-Bench, часто превосходя другие открытые модели, такие как DeepSeek R1 и Qwen3-235B.
Поставщики, endpoint’ы и маршрутизация
Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.
2 поставщика · 2 endpoint-вариантов
Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.
Цены
Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.
Бенчмарки
Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.
Параметры и модальности
Поддержка параметров синхронизирована с текущей версией модели.