빅데이터분석기사 필기 · 제4회 · 44번

Q.4420224빅데이터 모델링

어느 메일 서버에서 추출한 단어들을 (정상 메일, 스팸 메일)로 분류한 결과가 아래와 같다. 나이브 베이지안 기법을 활용해 이진분류기(Boolean 또는 Binary Classifier) 분석모형을 만들려고 할 때, 함수 계산식으로 옳지 않은 것은? (단, 분류하려는 입력 텍스트는 “you free lottery”이다)

보기
구분추출 단어분류
1you free scholarship정상 메일
2free to contact me정상 메일
3you ticket lottery스팸 메일
4me free lottery스팸 메일
5you won award정상 메일
6free get free you스팸 메일
  • 1P(스팸|텍스트) = 0.006
  • 2P(정상) = 0.5
  • 3P(스팸) = 0.5
  • 4P(정상|텍스트) = 0.006

정답: 4 · P(정상|텍스트) = 0.006

해설
해설 불러오는 중…
이 회차 문제 풀어보기 →빅데이터분석기사 필기 더 풀기