빅데이터분석기사 필기 · 9회 변형(엑셀) · 어려움 난이도 · 41번

Q.4120249어려움 변형빅데이터 모델링

다음 <보기>는 SVM의 설정을 바꾸어 가며 실험한 결과이다. 이에 대한 해석으로 가장 적절한 것은?

보기
실험설정학습 정확도검증 정확도서포트 벡터 수
선형 커널, C = 0.010.710.70많음
선형 커널, C = 10.860.84보통
RBF 커널, C = 10001.000.62매우 많음
  • 1㉢은 학습 정확도가 1.00으로 완벽하므로 가장 우수한 모형이며, 검증 정확도가 낮은 것은 검증 데이터에 오류가 있기 때문이다.
  • 2C는 오분류 허용 정도를 정하는 값으로, ㉠은 규제가 지나쳐 과소적합, ㉢은 과대적합이므로 균형 잡힌 ㉡이 적절하다.
  • 3서포트 벡터 수가 많을수록 경계가 안정적이므로 ㉢이 가장 신뢰할 수 있으며, C 값은 성능과 무관하다.
  • 4RBF 커널은 언제나 선형 커널보다 우수하므로 ㉢의 검증 성능이 낮은 것은 커널 선택이 아니라 데이터 부족 때문이며, 데이터를 늘리면 반드시 해결된다.

정답: 2 · C는 오분류 허용 정도를 정하는 값으로, ㉠은 규제가 지나쳐 과소적합, ㉢은 과대적합이므로 균형 잡힌 ㉡이 적절하다.

해설
해설 불러오는 중…
이 회차 문제 풀어보기 →빅데이터분석기사 필기 더 풀기