Gradiëntclipping

Hoe modellen daadwerkelijk leren, van gewone gradient descent tot Adam

Gradiëntclipping beperkt hoe groot een update kan worden. Als een batch een enorme gradiënt oplevert, schaalt clipping die omlaag voordat de optimizer-stap plaatsvindt.

🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.

▶ Gradiëntclipping
← Optimizer-diagnostiekAdam versus AdamW →