Kurz-Fakten

  • Bausteine: Faltungsschichten, Pooling, vollverbundene Schichten am Ende
  • Erkennt Muster unabhängig von ihrer Position im Bild
  • ResNet löste ab 2015 das Training sehr tiefer Netze
  • Vision Transformer haben CNNs bei großen Datenmengen teils abgelöst

Bedeutung in der Praxis

Für die Praxis in kleineren Projekten bleiben vortrainierte CNNs die erste Wahl: Sie brauchen weniger Daten als Vision Transformer und laufen auf gewöhnlicher Hardware.

Verwandte Begriffe