How models actually learn, from vanilla gradient descent to Adam
Регуляризацію часто представляють як штраф, доданий до втрати. Геометрично він змінює, які вектори параметрів вважаються дешевими чи дорогими. Це змінює форму задачі оптимізації. Два символи повторюються нижче: R(θ) називає штрафний терм, а λ (лямбда) задає, наскільки сильно він рахується.
🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.
▶ Регуляризація як геометрія