RMSProp

How models actually learn, from vanilla gradient descent to Adam

RMSProp адаптує розмір кроку окремо для кожного параметра. Він відстежує ковзну середню квадратів градієнтів, а потім ділить градієнт на корінь з цієї середньої.

🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.

▶ RMSProp
← МоментумAdam →