TacVLA: Contact-Aware Tactile Fusion for Robust Vision-Language-Action Manipulation
Research
Source: arXiv cs.ROPublish time unverified
arXiv:2603.12665v3 Announce Type: replace Abstract: Vision-Language-Action (VLA) models have demonstrated significant advantages in robotic manipulation. However, their reliance on vision and language often leads to suboptimal performance in tasks involving visual occlusion, fine-grained manipulation, and physical contact.