Kurz-Fakten
- Bausteine: Faltungsschichten, Pooling, vollverbundene Schichten am Ende
- Erkennt Muster unabhängig von ihrer Position im Bild
- ResNet löste ab 2015 das Training sehr tiefer Netze
- Vision Transformer haben CNNs bei großen Datenmengen teils abgelöst
Bedeutung in der Praxis
Für die Praxis in kleineren Projekten bleiben vortrainierte CNNs die erste Wahl: Sie brauchen weniger Daten als Vision Transformer und laufen auf gewöhnlicher Hardware.