Cách các mô hình thực sự học, từ gradient descent thuần túy đến Adam
Gradient descent full-batch dùng mọi ví dụ huấn luyện để tính từng bước cập nhật; gradient descent ngẫu nhiên (stochastic) đi tới thái cực ngược lại và chỉ dùng một ví dụ duy nhất. Gradient descent minibatch nằm ở giữa với một batch nhỏ, và sự thỏa hiệp đó chính là thứ mà học sâu thực sự vận hành trên đó.
🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.
▶ GD ngẫu nhiên & minibatch