Cách các mô hình thực sự học, từ gradient descent thuần túy đến Adam
Việc tối ưu hóa có thể thất bại trước khi bắt đầu nếu thang đo ban đầu sai. Nếu trọng số quá nhỏ, tín hiệu và gradient có thể biến mất dần. Nếu trọng số quá lớn, các kích hoạt và gradient có thể bùng nổ hoặc bão hòa.
🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.
▶ Khởi tạo & thang đo tín hiệu