어느 메일 서버에서 추출한 단어들을 (정상 메일, 스팸 메일)로 분류한 결과가 아래와 같다. 나이브 베이지안 기법을 활용해 이진분류기(Boolean 또는 Binary Classifier) 분석모형을 만들려고 할 때, 함수 계산식으로 옳지 않은 것은? (단, 분류하려는 입력 텍스트는 “you free lottery”이다)
보기
| 구분 | 추출 단어 | 분류 |
|---|---|---|
| 1 | you free scholarship | 정상 메일 |
| 2 | free to contact me | 정상 메일 |
| 3 | you ticket lottery | 스팸 메일 |
| 4 | me free lottery | 스팸 메일 |
| 5 | you won award | 정상 메일 |
| 6 | free get free you | 스팸 메일 |
- 1P(스팸|텍스트) = 0.006
- 2P(정상) = 0.5
- 3P(스팸) = 0.5
- 4P(정상|텍스트) = 0.006
꿈라CBT