论文列表
Zigzag Diffusion Sampling: Diffusion Models Can Self-lmprove via Self-Reflection - 邵世通 港科大
MLLM can see? Dynamic Correction Decoding for Hallycination Mitigatior - 王晨曦 浙大
F3Set: Towards Analyzing Fast, Frequent, and Fine-grained Events from Videos - 刘照宇 新国立
Temporal Reasoning Transfer from Text to Video - 刘源鑫 北大
reconstructive visual instruction tuning - 王淏辰 中科院自动化所
Towards Semantic Equivalence of Tokenization in Multimodal LLM - 吴胜琼 新国立
主持人
饶珈源,上海交通大学二年级博士生,研究方向为计算机视觉、体育分析,个人主页 https://jyrao.github.io。