DataComp-VLM: Improved Open Datasets for Vision-Language Models Paper • 2606.28551 • Published Jun 26 • 54
A Stationary (and Therefore Compatible) Representation is All You Need Paper • 2606.12488 • Published Jun 10 • 2
On Large Multimodal Models as Open-World Image Classifiers Paper • 2503.21851 • Published Mar 27, 2025 • 8
How to Take a Memorable Picture? Empowering Users with Actionable Feedback Paper • 2602.21877 • Published Feb 25 • 18