Загрузка...

Llama 3.1 Nemotron Ultra 253B v1

Разработчик: NVIDIA
Идентификатор:
Скопировано!

Модель недоступна с

Ни один провайдер больше не обслуживает Llama 3.1 Nemotron Ultra 253B v1, поэтому запросы к ней через API RouterAI не выполняются, а цены не показываются. Если провайдер появится снова, модель вернётся в каталог автоматически. Пока можно выбрать другую модель в каталоге.

Характеристики Llama 3.1 Nemotron Ultra 253B v1

Контекстное окно 131K

Дата релиза 08 апреля 2025

Мультимодальность

Входящие данные:

  • Текст

Исходящие данные:

  • Текст

Что умеет Llama 3.1 Nemotron Ultra 253B v1

Llama-3.1-Nemotron-Ultra-253B-v1 — это крупная языковая модель (LLM), оптимизированная для продвинутого рассуждения, интерактивного общения с человеком, генерации с дополнением извлечением (RAG) и выполнения задач с вызовом инструментов. Происходя из Meta’s Llama-3.1-405B-Instruct, она была значительно модифицирована с использованием поиска нейронной архитектуры (NAS), что привело к повышенной эффективности, снижению использования памяти и улучшению задержки вывода. Модель поддерживает длину контекста до 128K токенов и может эффективно работать на узле с 8x NVIDIA H100.

Примечание: вы должны включить detailed thinking on в системную подсказку, чтобы включить рассуждение. Пожалуйста, ознакомьтесь с Рекомендациями по использованию для получения дополнительной информации.