DeepSeek: R1 Distill Llama 70B
deepseek/deepseek-r1-distill-llama-70bDeepSeek R1 Distill Llama 70B — это дистиллированная большая языковая модель, основанная на Llama-3.3-70B-Instruct и использующая выходные данные DeepSeek R1. Модель объединяет передовые методы дистилляции для достижения высокой производительности по множеству бенчмарков, включая: AIME 2024 pass@1: 70.0 MATH-500 pass@1: 94.5 CodeForces Rating: 1633 Модель использует точную настройку на выходных данных DeepSeek R1, что обеспечивает конкурентоспособную производительность, сравнимую с более крупными передовыми моделями.
DeepSeek R1 Distill Llama 70B — это дистиллированная большая языковая модель, основанная на Llama-3.3-70B-Instruct и использующая выходные данные DeepSeek R1. Модель объединяет передовые методы дистилляции для достижения высокой производительности по множеству бенчмарков, включая:
- AIME 2024 pass@1: 70.0
- MATH-500 pass@1: 94.5
- CodeForces Rating: 1633
Модель использует точную настройку на выходных данных DeepSeek R1, что обеспечивает конкурентоспособную производительность, сравнимую с более крупными передовыми моделями.
Поставщики, endpoint’ы и маршрутизация
Один поставщик может предлагать несколько endpoint-вариантов: стандартный, flex, priority или региональный. Без дополнительных настроек выбирается самый дешёвый доступный endpoint.
1 поставщика · 1 endpoint-вариантов
Красный и жёлтый щиты отмечают предупреждения о данных. Наведите на значок для подробностей. Условия конкретного endpoint могут отличаться от общей политики провайдера.
Цены
Стоимость показана в рублях по текущему курсу пополнения. Итоговая сумма зависит от фактического usage ответа.
Бенчмарки
Результаты стандартизированных оценок. Для индексов, ELO и точности большее значение означает лучший результат.
Параметры и модальности
Поддержка параметров синхронизирована с текущей версией модели.