Role-conditioned sub-token routing for efficient vision-language-action policies
Read the original at arxiv.org→arXiv:2608.18410v1 Announce Type: new Abstract: Vision-Language-Action (VLA) models process long multimodal token sequences, making inference expensive in both memory and computation. Existing efficiency methods...
Original headline: "Role-Conditioned Sub-Token Routing for Efficient Vision-Language-Action Policies"
Coverage timeline
- Aug 20, 04:00 UTC arXiv cs.LG lead source Role-Conditioned Sub-Token Routing for Efficient Vision-Language-Action Policies