L
AI-проект

LLaVA

LLaVA (Large Language and Vision Assistant) — open vision-language проект, соединяющий visual encoder и LLM через visual instruction tuning. Он используется для диалога по изображениям и мультимодального reasoning.

О проекте

LLaVA (Large Language and Vision Assistant) — open vision-language проект, соединяющий visual encoder и LLM через visual instruction tuning. Он используется для диалога по изображениям и мультимодального reasoning.

Теги

#VLM #multimodal #vision-language #instruction tuning