빅데이터분석기사 필기 · 10회 변형(엑셀) · 어려움 난이도 · 64번

Q.64202510어려움 변형빅데이터 결과 해석

다음 <보기>는 학습 데이터의 양을 늘려 가며 측정한 학습곡선이다. 이에 대한 진단과 대응으로 가장 적절한 것은?

보기
학습 데이터 수학습 오차검증 오차
1,0000.290.34
5,0000.310.33
20,0000.320.33
80,0000.320.32

사람이 같은 과제를 수행할 때의 오차는 약 0.08로 알려져 있다.

  • 1학습 오차와 검증 오차가 0.32로 수렴했으므로 모형이 최적 상태에 도달한 것이며, 더 이상 개선할 여지가 없다.
  • 2두 오차가 0.32에서 함께 수렴해 사람의 0.08과 차이가 크므로 데이터 부족이 아닌 과소적합이며, 모형 복잡도를 키워야 한다.
  • 3검증 오차가 학습 오차보다 항상 크거나 같으므로 전형적인 과대적합이며, 드롭아웃과 가중치 규제를 강화해야 한다.
  • 4데이터를 80,000건에서 400,000건으로 다섯 배 더 늘리면 두 오차가 모두 0.08 수준까지 낮아질 것이므로 데이터 수집을 최우선으로 진행해야 한다.

정답: 2 · 두 오차가 0.32에서 함께 수렴해 사람의 0.08과 차이가 크므로 데이터 부족이 아닌 과소적합이며, 모형 복잡도를 키워야 한다.

해설
해설 불러오는 중…
이 회차 문제 풀어보기 →빅데이터분석기사 필기 더 풀기