Preprint2021
BEiT
Unknown
BEiT adapts BERT-style masked language modeling to vision by predicting discrete visual tokens for masked image patches.
0Jun 1, 2021TransformersComputer Vision
arXiv
A comprehensive index of artificial intelligence and machine-learning research with AI-generated summaries, citation metrics, and direct links to papers and code.