Wie Modelle wirklich lernen, vom einfachen Gradientenabstieg bis zu Adam
Der Full-Batch-Gradientenabstieg nutzt jedes Trainingsbeispiel, um jede Aktualisierung zu berechnen; der stochastische Gradientenabstieg geht ins andere Extrem und nutzt nur eines. Der Mini-Batch-Gradientenabstieg liegt dazwischen mit einem kleinen Batch, und auf diesem Kompromiss läuft das Deep Learning in der Praxis.
🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.
▶ Stochastischer & Mini-Batch-Gradientenabstieg