Submitted by
Yueyan Li
AI & ML interests
Natural Language Processing, Multimodal Information Processing
Recent Activity
View all activity
Papers
Why Do Video Diffusion Models Violate Physics? Unveiling the Flaws in Attention Mechanisms
Reading Images Like Texts: Sequential Image Understanding in Vision-Language Models