Prioritized Rollouts for Efficient World Model-based Vision-Language-Action Policy Optimization
arXiv preprint, 2026
U-GROW filters failure tails and prioritizes high-uncertainty states for world-model rollouts, improving the efficiency of VLA policy optimization without changing its training objective.





