Correct Me If I’m Wrong: Language Guided Exploration for VLAs
Published in Reinforcement Learning for Vision-Language-Action Models Workshop, 2026
We let humans steer VLA exploration during post-training by simply revising the language instruction.
Recommended citation: Sunshine Jiang, John Marangola, David Zhang, Nitish Dashora, Pulkit Agrawal, Zhang-Wei Hong. (2026). "Correct Me If I’m Wrong: Language Guided Exploration for VLAs." Reinforcement Learning for Vision-Language-Action Models Workshop.
Download Paper
