Cómo aprenden realmente los modelos, del descenso por gradiente básico a Adam
El tamaño de lote, escrito B, cambia el ruido en las estimaciones del gradiente. Un lote pequeño da una estimación ruidosa pero barata. Un lote grande da una estimación más estable, pero cada actualización cuesta más.
🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.
▶ Escalado del Tamaño de Lote