Gradiëntaccumulatie

Hoe modellen daadwerkelijk leren, van gewone gradient descent tot Adam

Gradiëntaccumulatie simuleert een grotere batch wanneer het geheugen beperkt is. In plaats van na elke micro-batch een stap te zetten, tel je gradiënten van meerdere micro-batches bij elkaar op, en zet dan één optimizer-stap.

🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.

▶ Gradiëntaccumulatie
← Batchgrootte schalenInitialisatie & signaalschaal →