3D视觉工坊很荣幸邀请到了新加坡国立大学在读博士生高崇凯,为大家着重分享他们团队的工作:
VLA-OS: Structuring and Dissecting Planning Representations and Paradigms in Vision-Language-Action Models
论文:https://arxiv.org/pdf/2506.17561
主页:https://nus-lins-lab.github.io/vlaos/
代码:https://github.com/HeegerGao/VLA-OS
直播大纲
1.疑云密布:VLA模型在进行任务规划时的“盲人摸象”挑战
2.抽丝剥茧:VLA‑OS ——「乐高式」实验平台的模块化架构
3.水落石出:视觉规划表征与分层VLA范式的优势崛起
4.月映万川:VLA模型的“第一性原理”与未来研究方向