Generative models of images › Computer Vision: CNNs / Encoder-only Transformers / Vision Transformers
Lecture 5: Computer Vision: CNNs / Encoder-only Transformers / Vision Transformers
Wed, Jan 28
Readings
- Convolutional Networks. Ian Goodfellow, Yoshua Bengio, & Aaron Courville (2016). Deep Learning, Chapter 9.1 - 9.3.
- BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding. Devlin et al. (2018). NAACL.
- An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale. Dosovitskiy et al. (2021). ICLR.
Lecturer: Matt Gormley
Unit: Generative models of images
Loading PDF…
Loading PDF…