具身智能观察

GeoWAM:面向自动驾驶的视觉几何世界动作模型

原标题:GeoWAM: Visual Geometry World Action Models for Autonomous Driving

产业动态AI 65

来源:arXiv cs.RO发布时间待核实

arXiv:2608.23486v1 Announce Type: cross Abstract: World action models (WAMs) have recently gained increasing attention as a framework for jointly modeling scene evolution and ego actions in autonomous driving. Most existing WAMs learn scene dynamics in pixel space by combining a video-generation backbone for future-observation prediction with an action head for ego-trajectory prediction.

GeoWAM:面向自动驾驶的视觉几何世界动作模型 | 具身智能观察