Parada Antecipada

Como os modelos realmente aprendem, da descida do gradiente simples ao Adam

A parada antecipada usa o desempenho de validação para decidir quando parar o treino. Se a loss de validação parar de melhorar por tempo suficiente, você mantém o melhor checkpoint e para. O progresso aqui é contado em épocas: uma época é uma passagem completa pelos dados de treino, e a validação normalmente é verificada depois de cada uma.

🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.

▶ Parada Antecipada
← Localizador de Taxa de AprendizadoLaboratório de Otimizadores →