Batchgrootte schalen

Hoe modellen daadwerkelijk leren, van gewone gradient descent tot Adam

Batchgrootte, geschreven als B, verandert de ruis in gradiëntschattingen. Een kleine batch geeft een ruizige maar goedkope schatting. Een grote batch geeft een stabielere schatting, maar elke update kost meer.

🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.

▶ Batchgrootte schalen
← Mixed Precision & Loss ScalingGradiëntaccumulatie →