Загрузка...

Llama 3.2 11B Vision Instruct

Разработчик: Meta Llama
Идентификатор:
Скопировано!

Модель недоступна с

Ни один провайдер больше не обслуживает Llama 3.2 11B Vision Instruct, поэтому запросы к ней через API RouterAI не выполняются, а цены не показываются. Если провайдер появится снова, модель вернётся в каталог автоматически. Пока можно выбрать другую модель в каталоге.

Характеристики Llama 3.2 11B Vision Instruct

Контекстное окно 131K

Дата релиза 25 сентября 2024

Мультимодальность

Входящие данные:

  • Текст
  • Изображения

Исходящие данные:

  • Текст

Что умеет Llama 3.2 11B Vision Instruct

Llama 3.2 11B Vision — это мультимодальная модель с 11 миллиардами параметров, разработанная для выполнения задач, сочетающих визуальные и текстовые данные. Она предназначена для таких задач, как создание подписей к изображениям и ответы на визуальные вопросы, соединяя языковую генерацию и визуальное рассуждение. Предварительно обученная на обширном наборе данных пар изображение-текст, она показывает хорошие результаты в сложном и высокоточном анализе изображений.

Ее способность интегрировать визуальное понимание с обработкой языка делает ее подходящим решением для отраслей, требующих комплексных визуально-лингвистических AI-приложений, таких как создание контента, AI-управляемое обслуживание клиентов и исследования.

Использование этой модели регулируется Политикой допустимого использования Meta.