Новости про LLaVA
LLaVA [Нейросеть/модель]
LLaVA (Large Language and Vision Assistant) — это открытая мультимодальная нейросеть, которая объединяет визуальный энкодер CLIP с языковой моделью Vicuna/LLaMA для понимания изображений и текста. Разработана исследователями из Microsoft, UW-Madison и Columbia University.

