빅데이터분석기사 필기 · 11회 변형(엑셀) · 어려움 난이도 · 56번

Q.56202511어려움 변형빅데이터 모델링

다음 <보기>의 결과에 대한 진단으로 가장 적절한 것은?

보기

하루 콜센터 문의 건수포아송 회귀로 모형화하였다.

  • 포아송분포는 평균과 분산이 같다고 가정한다.
  • 실제 자료의 평균은 40, 분산은 320이었다.
  • 모형의 거의 모든 변수가 p < 0.001로 유의하게 나왔다.
  • 1분산이 평균보다 크면 데이터가 더 풍부하다는 뜻이므로, 모든 변수가 유의한 것은 자연스러운 결과이다.
  • 2포아송 회귀는 분산에 대한 가정이 없으므로 평균과 분산의 차이는 결과 해석에 영향을 주지 않는다.
  • 3분산이 평균의 8배인 과대산포 상태이므로, 음이항 회귀나 준포아송 모형을 함께 검토해야 한다.
  • 4종속변수가 건수이므로 로그 변환 후 일반 선형회귀를 적용하면 과대산포가 자동으로 해소된다.

정답: 3 · 분산이 평균의 8배인 과대산포 상태이므로, 음이항 회귀나 준포아송 모형을 함께 검토해야 한다.

해설
해설 불러오는 중…
이 회차 문제 풀어보기 →빅데이터분석기사 필기 더 풀기