感知哪个模态重要:证据门控正则化强化 VLA 策略
Original title: Sensing Which Modality Matters: Evidence-Gated Regularization for Robust VLA Policies
ResearchAI 88
Source: arXiv cs.ROPublish time unverified
arXiv:2609.03142v1 Announce Type: new Abstract: Vision-Language-Action (VLA) policies fuse multimodal sensory inputs, but training on limited and homogeneous robot demonstrations encourages spurious inter-sensor correlations rather than task-relevant signal, a failure we term modality entanglement.