具身智能观察

超越数据扩展:以表征为中心的 VLA 继续预训练

原标题:Beyond Data Scaling: Representation-Centric Continued Pre-training for Vision-Language-Action Models

技术动态AI 75

来源:arXiv cs.RO发布时间待核实

arXiv:2608.27550v1 Announce Type: new Abstract: Scaling robot data is crucial for building generalist Vision-Language-Action (VLA) models, yet robot trajectories are harder to scale than web-scale image-text data because embodied collection is costly and sparsely covers the physical world.