DeepSeek: DeepSeek V4.1 Flash
deepseek/deepseek-v4.1-flashDeepSeek V4.1 Flash — это разреженная модель смеси экспертов от DeepSeek и первая модель, построенная на архитектуре Causal Encoder-Decoder (CED) компании. Она активирует 8B параметров на входе и 16B на выходе из базовой модели с 552B параметрами; такое асимметричное разделение обеспечивает низкий объём вычислений на токен по сравнению с общим размером модели. Понимание изображений изначально присуще архитектуре: визуальные и текстовые эмбеддинги обучаются совместно с самого начала предварительного обучения, а не добавляются впоследствии, как в более ранней экспериментальной модели V4 Flash Vision Exp. Она подходит для агентов, работающих с кодом, терминалом и компьютером, а также для задач с длинным горизонтом, которые должны выполняться до конца на протяжении многих шагов, и для анализа длинного контекста. Сжатое KV кэширование сокращает объём кэш-памяти примерно до четверти по сравнению с предыдущим поколением Flash, значительно снижая затраты на агентных нагрузках. DeepSeek позиционирует её как экономичный уровень семейства V4.1 и сообщает, что она превосходит V4 Pro по производительности, скорости и времени выполнения задач.
DeepSeek V4.1 Flash — это разреженная модель смеси экспертов от DeepSeek и первая модель, построенная на архитектуре Causal Encoder-Decoder (CED) компании. Она активирует 8B параметров на входе и 16B на выходе из базовой модели с 552B параметрами; такое асимметричное разделение обеспечивает низкий объём вычислений на токен по сравнению с общим размером модели. Понимание изображений изначально присуще архитектуре: визуальные и текстовые эмбеддинги обучаются совместно с самого начала предварительного обучения, а не добавляются впоследствии, как в более ранней экспериментальной модели V4 Flash Vision Exp.
Она подходит для агентов, работающих с кодом, терминалом и компьютером, а также для задач с длинным горизонтом, которые должны выполняться до конца на протяжении многих шагов, и для анализа длинного контекста. Сжатое KV кэширование сокращает объём кэш-памяти примерно до четверти по сравнению с предыдущим поколением Flash, значительно снижая затраты на агентных нагрузках. DeepSeek позиционирует её как экономичный уровень семейства V4.1 и сообщает, что она превосходит V4 Pro по производительности, скорости и времени выполнения задач.
Поставщики, endpoint’ы и маршрутизация
Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Автоматическая маршрутизация учитывает цену и доступность провайдеров. Стратегию можно выбрать вручную.
9 поставщика · 9 endpoint-вариантов
Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.
Цены
Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.
Бенчмарки
Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.
Параметры и модальности
Поддержка параметров синхронизирована с текущей версией модели.