Implementation of Vision Transformer, a simple way to achieve SOTA in vision classification with only a single transformer encoder, in Pytorch
Python25,534 stars3,495 forksMIT artificial-intelligenceattention-mechanismcomputer-visionimage-classificationtransformers