Llama 3.2 11B Vision Instruct
Модель недоступна с
Ни один провайдер больше не обслуживает Llama 3.2 11B Vision Instruct, поэтому запросы к ней через API RouterAI не выполняются, а цены не показываются. Если провайдер появится снова, модель вернётся в каталог автоматически. Пока можно выбрать другую модель в каталоге.
Характеристики Llama 3.2 11B Vision Instruct
Контекстное окно 131K
Дата релиза 25 сентября 2024
Мультимодальность
Входящие данные:
- Текст
- Изображения
Исходящие данные:
- Текст
Что умеет Llama 3.2 11B Vision Instruct
Llama 3.2 11B Vision — это мультимодальная модель с 11 миллиардами параметров, разработанная для выполнения задач, сочетающих визуальные и текстовые данные. Она предназначена для таких задач, как создание подписей к изображениям и ответы на визуальные вопросы, соединяя языковую генерацию и визуальное рассуждение. Предварительно обученная на обширном наборе данных пар изображение-текст, она показывает хорошие результаты в сложном и высокоточном анализе изображений.
Ее способность интегрировать визуальное понимание с обработкой языка делает ее подходящим решением для отраслей, требующих комплексных визуально-лингвистических AI-приложений, таких как создание контента, AI-управляемое обслуживание клиентов и исследования.
Использование этой модели регулируется Политикой допустимого использования Meta.