Adam

Hoe modellen daadwerkelijk leren, van gewone gradient descent tot Adam

Adam combineert twee ideeën: momentum voor de gemiddelde gradiënt, en RMSProp-achtige schaling voor de gemiddelde gekwadrateerde gradiënt. Vervolgens corrigeert het de vroege bias, omdat die lopende gemiddelden op nul beginnen.

🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.

▶ Adam
← RMSPropStochastische & mini-batch GD →