モデルが実際にどう学習するか — 普通の勾配降下法からAdamまで
凸損失には強力な保証がある。すべての局所最小値が大域最小値になるのだ。それが最適化を概念的にすっきりさせる。多くの古典的なMLの目的関数は凸だが、深層ネットワークは普通そうではない。
🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.