Jak se modely reálně učí, od klasického gradientního sestupu po Adam
Celodávkový gradientní sestup (full-batch GD) používá k výpočtu každé aktualizace každý trénovací příklad; stochastický gradientní sestup jde do druhého extrému a používá pouze jeden příklad. Mini-batch gradientní sestup stojí uprostřed s malou dávkou a právě na tomto kompromisu hluboké učení ve skutečnosti funguje.
🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.
▶ Stochastický a mini-batch GD