Příznaky a kódování reálného světa

Klasické modely postavené z matematiky, kterou už znáte

Skutečná data vzácně přicházejí jako čistá mřížka čísel. Dataset zákazníků může mít sloupec pro město, sloupec pro to, jak se někdo dozvěděl o produktu, a sloupec pro příjem domácnosti, a každý z těchto sloupců může mít mezery, kde nikdo neodpověděl. Každý model v tomto kurzu, od přímky po rozhodovací strom, tajně předpokládá, že jeho vstup je už seznam čísel bez ničeho chybějícího. Kódování příznaků je práce, která se děje před začátkem tréninku, měnící kategorie a mezery na čísla, která model skutečně může použít.

🔒 This is a Pro lesson — the interactive figure, worked examples, quiz and practice open with Pro access.

▶ Příznaky a kódování reálného světa
← Ovladač overfittingu: Kapacita, trénovací vs odložená dataPolynomiální regrese a rozšíření báze →