超越数据扩展:以表征为中心的 VLA 继续预训练
原标题:Beyond Data Scaling: Representation-Centric Continued Pre-training for Vision-Language-Action Models
技术动态AI 75
来源:arXiv cs.RO发布时间待核实
arXiv:2608.27550v1 Announce Type: new Abstract: Scaling robot data is crucial for building generalist Vision-Language-Action (VLA) models, yet robot trajectories are harder to scale than web-scale image-text data because embodied collection is costly and sparsely covers the physical world.