DeepSeek: DeepSeek V3.1 Terminus

deepseek/deepseek-v3.1-terminus
Документация

DeepSeek-V3.1 Terminus — это обновление модели DeepSeek V3.1, которое сохраняет исходные возможности модели, одновременно устраняя проблемы, о которых сообщают пользователи, включая согласованность языка и возможности агентов, а также дополнительно оптимизируя производительность модели в задачах написания кода и поисковых агентов. Это большая гибридная модель рассуждений (671B параметров, 37B активны), которая поддерживает как режим мышления, так и режим без мышления. Она расширяет базу DeepSeek-V3 двухэтапным процессом обучения на длинном контексте, достигая до 128K токенов, и использует FP8 микроскейлинг для эффективного вывода. Пользователи могут управлять поведением рассуждений с помощью логического значения reasoning enabled. Подробнее в нашей документации Модель улучшает использование инструментов, генерацию кода и эффективность рассуждений, достигая производительности, сравнимой с DeepSeek-R1 на сложных бенчмарках, при этом отвечая быстрее. Она поддерживает структурированные вызовы инструментов, агентов для работы с кодом и поисковых агентов, что делает её подходящей для исследовательских, кодовых и агентных рабочих процессов.

Модальности
Вход / выход за 1 млн
33,42 ₽ / 123,78 ₽
Контекст
163 840
Добавлена
22 сент. 2025 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

4 поставщика · 4 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
AtlasCloudДешевле
atlas-cloud/fp8·FP8
37,13 ₽117,59 ₽16,09 ₽1,84 с36 ток/с100,00%
novita/fp8·FP8
33,42 ₽123,78 ₽16,71 ₽2,07 с25 ток/с100,00%
siliconflow/fp8·FP8
33,42 ₽123,78 ₽1,61 с17 ток/с97,49%
streamlake·Стандарт
70,68 ₽42,41 ₽212,15 ₽127,29 ₽1,55 с41 ток/с100,00%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены33,42 ₽за 1 млн токенов
Выходные токены123,78 ₽за 1 млн токенов
Чтение кэша16,71 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Интеллекттоп 57%
31,4индекс

место 66 из 117

Кодтоп 48%
43,5индекс

место 68 из 143

Агентные задачитоп 56%
19,9индекс

место 65 из 118

Design Arena

ELO и доля побед по категориям визуальных задач.

Источник
UI-компонентытоп 39%
1 206ELO
59,5%побед157,5 ссреднее52/136место
Веб-сайтытоп 42%
1 204ELO
56,4%побед199,8 ссреднее63/151место
Категории кодатоп 44%
1 197ELO
56%побед197,5 ссреднее61/141место
Визуализация данныхтоп 49%
1 189ELO
53,4%побед166,8 ссреднее67/137место
3Dтоп 45%
1 181ELO
56%побед155,7 ссреднее58/130место
Разработка игртоп 58%
1 167ELO
52,5%побед235,2 ссреднее80/139место
SVGтоп 74%
1 103ELO
50,1%побед80,2 ссреднее73/99место

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
GPQA Diamond
80,5%точность

4 728 задач

τ-bench Verified — Airline
68,6%точность

1 050 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltyinclude_reasoninglogit_biasmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstopstructured_outputstemperaturetool_choicetoolstop_ktop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "deepseek/deepseek-v3.1-terminus",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'