具身智能大模型简介

8.6万
20
2024-11-27 16:23:25
2267
1238
6980
1155
受到自然语言处理、计算机视觉领域中基础模型的成功的启发,具身智能领域也在尝试设计、训练、微调大模型来解决现实生活中最普遍存在的机器人操作问题。本次分享主题为“Vision-language-action models for robot manipulation”,即面向机器人操作任务的视觉语言动作模型。本次分享介绍了机器人操作任务(robot manipulation)的重要性和挑战,梳理了近期比较典型的使用视觉语言动作模型(vision-language-action models)来解决这类任务的研究(RT-1, RT-2, RT-X, RT-H, OpenVLA, pi0, RDT, GR-2, DROID),并总结其中的要点、不足和未来工作。
AI Alignment 北大人工智能对齐团队官方唯一账号,旨在交流分享AI对齐领域前沿进展,转载请标明出处
客服
顶部
赛事库 课堂 2021拜年纪