R1 Distill Llama 70B
- Разработчик:
- DeepSeek
- Релиз:
- Идентификатор:
-
deepseek/deepseek-r1-distill-llama-70b
Модель недоступна с
Ни один провайдер больше не обслуживает R1 Distill Llama 70B, поэтому запросы к ней через API RouterAI не выполняются, а цены не показываются. Если провайдер появится снова, модель вернётся в каталог автоматически. Пока можно выбрать другую модель в каталоге.
Возможности R1 Distill Llama 70B
DeepSeek R1 Distill Llama 70B — это дистиллированная крупная языковая модель, основанная на Llama-3.3-70B-Instruct, с использованием выводов из DeepSeek R1. Модель сочетает в себе передовые методы дистилляции для достижения высокой производительности по нескольким бенчмаркам, включая:
- AIME 2024 pass@1: 70.0
- MATH-500 pass@1: 94.5
- Рейтинг CodeForces: 1633
Модель использует тонкую настройку на основе выводов DeepSeek R1, что позволяет ей демонстрировать конкурентоспособную производительность, сопоставимую с более крупными передовыми моделями.
Характеристики R1 Distill Llama 70B
Контекстное окно
- Всего
- 8K токенов
- На выход
- 7K токенов
Модальности
- Вход
- Текст
- Выход
- Текст
Сильные стороны
- Рассуждения
-
GPQA Diamond: 40,2 %
Вопросы уровня PhD по биологии, физике и химии (подвыборка Diamond).
- Режим рассуждений
Сравнение R1 Distill Llama 70B с другими нейросетями: бенчмарки и рейтинг
Все замеры модели 12
- Intelligence Index
- 7,9
- IFBench
- 27,6 %
- MMLU-Pro
- 79,5 %
- LiveCodeBench
- 26,6 %
- SciCode
- 31,3 %
- Math Index
- 53,7
- AIME
- 67,0 %
- MATH-500
- 93,5 %
- GPQA Diamond
- 40,2 %
- Humanity's Last Exam
- 5,1 %
- τ²-Bench
- 21,9 %
- Terminal-Bench Hard
- 1,5 %