Preprint2024
Unveiling encoder-free vision-language models
Unknown
This paper proposes encoder-free vision-language models that directly process visual features without a separate vision encoder, simplifying architecture and improving efficiency.
0Jan 1, 2024Large Language ModelsComputer Vision