Ling-3.0-flash

inclusionai/ling-3.0-flash
Документация

Ling-3.0-flash — это модель со смесью экспертов (MoE) с 124B параметрами, при этом на каждый токен активируется примерно 5.1B параметров. Модель разработана с приоритетом эффективности использования токенов и продакшн-масштабного агентного инференса, что позволяет разработчикам выполнять больше полезной работы в рамках ограниченных бюджетов на токены, задержку и стоимость обслуживания.

Модальности
Вход / выход за 1 млн
2,60 ₽ / 7,80 ₽
Контекст
262 144
Добавлена
23 июл. 2026 г.

Поставщики, endpoint’ы и маршрутизация

Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.

Сначала самый дешёвый доступный endpoint
"provider": { "sort": "price" }

2 поставщика · 2 endpoint-вариантов

Поставщик / endpointДанныеВход / 1 млнВыход / 1 млнКэш / 1 млнЗадержкаСкоростьДоступность
NovitaДешевле65%
novita·Стандарт
7,43 ₽2,60 ₽22,28 ₽7,80 ₽0,52 ₽655 мс247 ток/с100,00%
deepinfra/bf16·BF16
7,43 ₽22,28 ₽1,49 ₽1,03 с46 ток/с98,71%

Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.

Цены

Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.

ОперацияСтоимость
Входные токены2,60 ₽за 1 млн токенов
Выходные токены7,80 ₽за 1 млн токенов
Чтение кэша0,52 ₽за 1 млн токенов

Бенчмарки

Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.

Artificial Analysis

Сводные индексы способностей модели.

Источник
Интеллекттоп 45%
37,8индекс

место 52 из 117

Кодтоп 38%
50,6индекс

место 53 из 143

Агентные задачитоп 38%
29,3индекс

место 44 из 118

Публичные eval-задачи

Точность опубликованных прогонов.

Источник
GPQA Diamond
73%точность

196 задач

τ-bench Verified — Airline
57,3%точность

50 задач

Данные API на 02.09.2026, 12:01:44.

Параметры и модальности

Поддержка параметров синхронизирована с текущей версией модели.

Входные модальности

text

Выходные модальности

text
frequency_penaltyinclude_reasoninglogit_biaslogprobsmax_tokensmin_ppresence_penaltyreasoningrepetition_penaltyresponse_formatseedstoptemperaturetool_choicetoolstop_ktop_logprobstop_p

Пример запроса

curl https://gorouter.ru/api/v1/chat/completions \
  -H "Authorization: Bearer $GOROUTER_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "inclusionai/ling-3.0-flash",
    "messages": [{"role": "user", "content": "Привет!"}]
  }'