Загрузка...

R1 Distill Llama 70B

Разработчик:
DeepSeek
Релиз:
Идентификатор:
deepseek/deepseek-r1-distill-llama-70b

Модель недоступна с

Ни один провайдер больше не обслуживает R1 Distill Llama 70B, поэтому запросы к ней через API RouterAI не выполняются, а цены не показываются. Если провайдер появится снова, модель вернётся в каталог автоматически. Пока можно выбрать другую модель в каталоге.

Возможности R1 Distill Llama 70B

DeepSeek R1 Distill Llama 70B — это дистиллированная крупная языковая модель, основанная на Llama-3.3-70B-Instruct, с использованием выводов из DeepSeek R1. Модель сочетает в себе передовые методы дистилляции для достижения высокой производительности по нескольким бенчмаркам, включая:

  • AIME 2024 pass@1: 70.0
  • MATH-500 pass@1: 94.5
  • Рейтинг CodeForces: 1633

Модель использует тонкую настройку на основе выводов DeepSeek R1, что позволяет ей демонстрировать конкурентоспособную производительность, сопоставимую с более крупными передовыми моделями.

Характеристики R1 Distill Llama 70B

  • 70 млрд параметров

Контекстное окно

Всего
8K токенов
На выход
7K токенов

Модальности

Вход
Текст
Выход
Текст

Сильные стороны

Рассуждения
GPQA Diamond: 40,2 %
Вопросы уровня PhD по биологии, физике и химии (подвыборка Diamond).
Поддерживает:
  • Режим рассуждений

Сравнение R1 Distill Llama 70B с другими нейросетями: бенчмарки и рейтинг

Все замеры модели 12
Intelligence Index
7,9
IFBench
27,6 %
MMLU-Pro
79,5 %
LiveCodeBench
26,6 %
SciCode
31,3 %
Math Index
53,7
AIME
67,0 %
MATH-500
93,5 %
GPQA Diamond
40,2 %
Humanity's Last Exam
5,1 %
τ²-Bench
21,9 %
Terminal-Bench Hard
1,5 %