Mixed Precision & Loss Scaling

Bagaimana model sebenarnya belajar, dari gradient descent dasar hingga Adam

Pelatihan mixed precision menggunakan format angka yang lebih kecil demi kecepatan dan memori. Alih-alih menyimpan setiap perhitungan dalam presisi penuh (float 32-bit standar), banyak operasi menggunakan float16 atau bfloat16: format 16-bit yang memakai separuh memori dengan imbalan presisi yang lebih rendah dan, untuk float16, rentang ukuran yang bisa direpresentasikan lebih sempit.

🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.

▶ Mixed Precision & Loss Scaling
← Alternating Least SquaresPenskalaan Batch Size →