14. Ангилал
•Бичлэгийн цуглууллаг өгөгдсөн
•Бичлэг бүр нь атрибутын цогцыг агуулсан ба
нэг атрибут нь нэг класс.
•Бусад атрибутын утгын зориулалтаар
класс атрибутын загварыг гаргах
•Зорилго: Өмнө нь үл мэдэгдэх бичлэгийг
байж болохуйц мөн зөв классд
тодорхойлох
•Test set нь загварын нарийн тодорхойлохын
тулд ашигладаг бөгөөд сүүлийн үед өгөгдсөн
өгөгдлийн цуглууллагыг training set болон test
set гэж хуваадаг болсон.Training set нь
загварыг босгон байгуулахад хэрэглэдэг бол
test set нь түүнийг батлахад хэрэглэдэг.
15. Ангилал
Tid Refund Marital
Status
Taxable
Income Cheat
Refund Marital
Status
Taxable
Income Cheat
1
Yes
Single
125K
No
No
Single
75K
?
2
No
Married
100K
No
Yes
Married
50K
?
3
No
Single
70K
No
No
Married
150K
?
4
Yes
Married
120K
No
Yes
Divorced 90K
?
5
No
Divorced 95K
Yes
No
Single
40K
?
6
No
Married
No
No
Married
80K
?
60K
10
7
Yes
Divorced 220K
No
8
No
Single
85K
Yes
9
No
Married
75K
No
10
10
No
Single
90K
Yes
Training
Set
Learn
Classifier
Test
Set
Model