Preprint
Jul 2026
ExToken: Structured Exploration for Efficient Vision-Language-Action Reinforcement Fine-tuning
ExToken is introduced, a simple yet general framework that condition VLA policies on discrete behavioral priors derived from offline demonstrations for structured exploration that consistently accelerates convergence, improves task performance, and exhibits strong robustness under highly constrained interaction budgets.
Yilun Kong, Yunpeng Qing, Guozheng Ma et al.
· 0 citations