Preprint2025
Interactive post-training for vision-language-action models
Unknown
Introduces RIPT-VLA, a reinforcement-learning-based interactive post-training paradigm for fine-tuning pretrained Vision-Language-Action models.
0May 1, 2025Fine TuningComputer Vision
arXiv