Fast: Efficient action tokenization for vision-language-action models
Unknown
This paper introduces Fast, an efficient action tokenization method for vision-language-action models, aiming to improve the speed and practicality of generalist robot policies.