빅데이터분석기사 필기 · 9회 변형(엑셀) · 보통 난이도 · 46번

Q.4620249보통 변형빅데이터 모델링

텍스트 마이닝에서 활용되는 자연어 처리 기법에 관한 설명 중 옳지 않은 것은?

  • 1Tokenization(토큰화) : 긴 텍스트를 문장이나 단어 같은 작은 단위로 나눈다.
  • 2Stop words removal(불용어 제거) : '은/는/이/가'처럼 자주 등장하지만 의미가 크지 않은 단어를 걸러 낸다.
  • 3Stemming(어간 추출) : 문장 내 각 단어가 명사인지 동사인지 품사를 판별해 표시한다.
  • 4POS tagging(품사 태깅) : 문장 안의 단어마다 품사를 결정하여 붙인다.

정답: 3 · Stemming(어간 추출) : 문장 내 각 단어가 명사인지 동사인지 품사를 판별해 표시한다.

해설
해설 불러오는 중…
이 회차 문제 풀어보기 →빅데이터분석기사 필기 더 풀기