多模态论文分享@ICLR2025

3037
0
2025-03-22 15:07:18
76
28
270
22
论文列表 Zigzag Diffusion Sampling: Diffusion Models Can Self-lmprove via Self-Reflection - 邵世通 港科大 MLLM can see? Dynamic Correction Decoding for Hallycination Mitigatior - 王晨曦 浙大 F3Set: Towards Analyzing Fast, Frequent, and Fine-grained Events from Videos - 刘照宇 新国立 Temporal Reasoning Transfer from Text to Video - 刘源鑫 北大 reconstructive visual instruction tuning - 王淏辰 中科院自动化所 Towards Semantic Equivalence of Tokenization in Multimodal LLM - 吴胜琼 新国立 主持人 饶珈源,上海交通大学二年级博士生,研究方向为计算机视觉、体育分析,个人主页 https://jyrao.github.io。
全球一线青年学者发起的AI分享平台,聚焦「学术-落地-创业」闭环。 合作/投稿/加入我们 请联系:zenrran@gmail.com
接下来播放
自动连播
客服
顶部
赛事库 课堂 2021拜年纪