Hoe modellen daadwerkelijk leren, van gewone gradient descent tot Adam
Gradiëntaccumulatie simuleert een grotere batch wanneer het geheugen beperkt is. In plaats van na elke micro-batch een stap te zetten, tel je gradiënten van meerdere micro-batches bij elkaar op, en zet dan één optimizer-stap.
🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.
▶ Gradiëntaccumulatie