텍스트 마이닝에서 활용되는 자연어 처리 기법에 관한 설명 중 옳지 않은 것은?
- 1Tokenization(토큰화) : 긴 텍스트를 문장이나 단어 같은 작은 단위로 나눈다.
- 2Stop words removal(불용어 제거) : '은/는/이/가'처럼 자주 등장하지만 의미가 크지 않은 단어를 걸러 낸다.
- 3Stemming(어간 추출) : 문장 내 각 단어가 명사인지 동사인지 품사를 판별해 표시한다.
- 4POS tagging(품사 태깅) : 문장 안의 단어마다 품사를 결정하여 붙인다.
꿈라CBT