Adam

मॉडल वास्तव में कैसे सीखते हैं, सादे ग्रेडिएंट डिसेंट से लेकर Adam तक

Adam दो विचारों को जोड़ता है: औसत ग्रेडिएंट के लिए मोमेंटम, और औसत वर्गित ग्रेडिएंट के लिए RMSProp-शैली स्केलिंग। फिर यह शुरुआती पूर्वाग्रह को ठीक करता है क्योंकि वे चलते औसत शून्य से शुरू होते हैं।

🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.

▶ Adam
← RMSPropस्टोकास्टिक और मिनी-बैच GD →