다음 <보기>의 결과에 대한 진단으로 가장 적절한 것은?
보기
하루 콜센터 문의 건수를 포아송 회귀로 모형화하였다.
- 포아송분포는 평균과 분산이 같다고 가정한다.
- 실제 자료의 평균은 40, 분산은 320이었다.
- 모형의 거의 모든 변수가 p < 0.001로 유의하게 나왔다.
- 1분산이 평균보다 크면 데이터가 더 풍부하다는 뜻이므로, 모든 변수가 유의한 것은 자연스러운 결과이다.
- 2포아송 회귀는 분산에 대한 가정이 없으므로 평균과 분산의 차이는 결과 해석에 영향을 주지 않는다.
- 3분산이 평균의 8배인 과대산포 상태이므로, 음이항 회귀나 준포아송 모형을 함께 검토해야 한다.
- 4종속변수가 건수이므로 로그 변환 후 일반 선형회귀를 적용하면 과대산포가 자동으로 해소된다.
꿈라CBT