Jak se modely reálně učí, od klasického gradientního sestupu po Adam
Adam kombinuje dvě myšlenky: momentum pro průměrný gradient a škálování ve stylu RMSProp pro průměr druhých mocnin gradientu. Poté opravuje počáteční posun (bias), protože tyto klouzavé průměry začínají na nule.
🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.
▶ Adam