빅데이터분석기사 필기 제8회 기출문제

80문항 · 회원가입 없이 무료 · 문제를 누르면 정답을 바로 확인할 수 있어요.

시험 모드로 풀기해설 모드로 풀기

빅데이터 분석 기획

  1. 1.차원축소 기법을 적용하는 목적으로 가장 거리가 먼 것은?
  2. 2.카산드라, 몽고디비 등이 해당되는, 반정형·비정형 데이터를 저장하는 저장소를 무엇이라 하는가?
  3. 3.다음 보기 가운데 비정형 데이터의 예로 보기에 가장 어려운 것은?
  4. 4.다음 중 데이터 마스킹 기법에 관한 설명으로 옳지 않은 것은?
  5. 5.다음 중 데이터웨어하우스의 주요 특징에 해당하지 않는 것은?
  6. 6.다음 보기 가운데 데이터 분석 과정에서 수행하는 핵심 업무라고 보기 어려운 것은?
  7. 7.다음 중 내부 데이터와 외부 데이터에 관한 설명 중 옳지 않은 것을 고르시오.
  8. 8.데이터 전처리 단계에서 수행하는 정규화에 관한 설명 중 옳지 않은 것은?
  9. 9.빅데이터의 주요 특징에 관한 설명 중 옳은 것은 무엇인가?
  10. 10.다음 중 데이터 변환 작업에 해당하지 않는 것은?
  11. 11.다음 중 개인정보 보호법에 관한 설명으로 옳지 않은 것은 무엇인가?
  12. 12.다음 보기 중에서 분산 저장 시스템에 해당하지 않는 것은 무엇인가?
  13. 13.데이터를 측정할 때 활용되는 척도와 해당 예시가 올바르게 짝지어진 것은?
  14. 14.지도학습 모델에 관한 설명 중 가장 적절하지 않은 것은?
  15. 15.다음 중 데이터 표준화에 관한 설명으로 가장 적절한 것은?
  16. 16.정량적 데이터와 정성적 데이터에 관한 설명 중 가장 적절하지 않은 것은?
  17. 17.데이터 3법에 관한 설명 중 옳지 않은 것을 고르시오.
  18. 18.다음 중 Key-value 데이터베이스에 관한 설명 중 가장 적절하지 않은 것은?
  19. 19.아래 설명이 가리키는 개념으로 옳은 것은? 보기 다양한 유형의 대규모 데이터를 수집·저장·처리·분석할 수 있도록 하드웨어와 소프트웨어 환경을 제공하는 기술적 인프
  20. 20.데이터 비식별화 기법과 그 방법이 올바르게 짝지어진 것은?

빅데이터 탐색

  1. 21.주성분 분석을 수행한 결과 고윳값이 각각 4, 3.5, 2, 0.5로 나타났다. 이때 제3주성분이 설명하는 전체 데이터 분산의 비율은 몇 %인가?
  2. 22.다음 보기 중 기술통계량에 해당한다고 보기 가장 어려운 것은?
  3. 23.결측값을 처리하는 대체 방법에 관한 설명 중 가장 적절하지 않은 것은?
  4. 24.소득과 암 발생률 간의 상관관계를 살펴보려 한다. 이때 두 변수 모두에 영향을 주는 나이, 음주, 흡연 변수의 영향을 통제(제거)한 상태에서 분석하려고 할 때,
  5. 25.같은 확률분포를 따르는 독립확률변수들에서 뽑은 n개 표본의 평균이, n이 충분히 크면 정규분포에 근사한다는 내용의 정리는?
  6. 26.과적합을 막고 데이터 분석 모형의 복잡도를 낮추기 위한 목적으로 규제 기법이 활용된다. 가중치 제곱을 패널티 항으로 두어 가중치 크기를 축소시키는 기법은 무엇인가
  7. 27.목표로 하는 분포에서 표본을 뽑아내는 샘플링 기법에 해당하지 않는 것은 다음 중 무엇인가?
  8. 28.다음 중 파생변수에 관한 설명 중 가장 적절하지 않은 것은?
  9. 29.다음 박스플롯은 지역에 따른 소득액(Revenue)을 보여준다. 이를 설명한 내용 중 가장 적절하지 않은 것은? 100 200 300 400 500 600 Rev
  10. 30.K후보가 지역별 전체 유권자를 대상으로 가지역에서 71명, 나지역에서 134명의 표를 얻었다고 할 때, 가지역과 나지역 득표율에 대한 모비율 차이의 추정값을 구하
  11. 31.기술통계량에 관한 다음 설명 중 옳지 않은 것을 고르시오.
  12. 32.어느 학생이 통계학 시험에서 받은 점수가 60, 70, 80점이라고 할 때, 이 자료의 표본분산은 얼마인가?
  13. 33.데이터 n개(x₁, x₂, …, xₙ)를 이용해 계산한 아래의 점 추정량에 관한 설명 중 옳은 것은? (단, A는 평균, B는 분산이다) 보기 \(A=\dfrac
  14. 34.어떤 마술 시연을 10회 시행하여 성공 횟수가 6회 이하이면 귀무가설을 채택한다고 하자. 대립가설이 아래와 같이 주어질 때, 제2종 오류가 발생할 확률로 옳은 것
  15. 35.다음은 가설 검정에 관한 설명이다. ( ) 안에 들어갈 용어로 옳은 것은? 보기 가설 검정이란 어떤 가설이 사실인지 여부를 통계적으로 판단하는 절차이다. 일반적으
  16. 36.양수 값을 가지는 데이터를 정규분포에 가깝게 만들기 위해 사용하는 변환 기법은 무엇인가?
  17. 37.어느 제조업체에서 기존 공정과 신규 공정 기술 각각의 불량률과 정상률을 조사한 결과가 아래 표와 같다. 불량률 발생에 대한 오즈비와 위험도를 구하면? 보기 구분
  18. 38.단봉 분포(Unimodal Distribution)이며 꼬리가 오른쪽으로 길게 늘어진 분포에서 최빈값, 중앙값, 평균값 사이의 크기 관계로 옳은 것은?
  19. 39.모집단으로부터 n개의 표본을 뽑아 표본평균의 분포를 살펴보려고 한다. 다음 설명 가운데 가장 옳지 않은 것은?
  20. 40.다음 중 불균형 데이터에 관한 설명으로 적절하지 않은 것은?

빅데이터 모델링

  1. 41.다음 중 주성분 분석(Principal Component Analysis)에 관한 설명으로 올바른 것을 모두 고르시오. 보기 (가) 주성분 분석을 이용한 차원축소
  2. 42.다음 중 서포트벡터머신(SVM)에 관한 설명 중 적절하지 않은 것은?
  3. 43.다음 중 나이브 베이즈 분석 기법에 관한 설명 가운데 적절하지 않은 것은?
  4. 44.주어진 문제를 해결하기 위한 하향식 접근 방법에 관한 설명 중 가장 적절하지 않은 것은?
  5. 45.다음과 같은 인공신경망 분석 결과가 주어졌을 때, 출력값으로 옳은 것은? 보기 은닉 노드의 개수 = 2개 은닉 노드에 들어오는 입력값 = (0.2, 0.1) 은닉
  6. 46.앙상블 분석의 주요 기법에 관한 설명 중 옳지 않은 것을 고르시오.
  7. 47.다음 중 경사하강법에 관한 설명으로 가장 적절한 것은?
  8. 48.로지스틱 회귀분석과 선형회귀에 관한 설명 중 옳지 않은 것을 고르시오.
  9. 49.다음 중 결정계수에 관한 설명으로 옳은 것은?
  10. 50.두 지점 (xᵢ, xⱼ) 사이의 군집 간 거리를 계산할 때 다음과 같이 정의되는 측정 방식의 명칭은? (단, p는 거리를 결정하는 매개변수이며 0보다 큰 양수이다
  11. 51.다음 중 데이터 분석 모형에 관한 설명으로 적절하지 않은 것은?
  12. 52.다음 중 부스팅(Boosting)에 관한 설명으로 옳지 않은 것을 고르시오.
  13. 53.신경망 모형을 구축할 때 전체 학습 데이터를 분할하는 배치 크기에 관한 설명 중 가장 적절하지 않은 것은?
  14. 54.의사결정나무 분석 모형에 관한 설명 중 옳은 것을 모두 고른 것은? 보기 (가) 결과가 트리 형태로 시각화되므로 이해하기 쉽고, 결과에 대한 설명력이 명확하다.
  15. 55.비모수 검정 방법에 관한 다음 설명 중 옳지 않은 것을 고르시오.
  16. 56.다중공선성(Multicollinearity)에 관한 설명 중 가장 적절한 것은?
  17. 57.다음 ( )에 들어갈 용어로 가장 적절한 것은? 보기 seq2seq(sequence-to-sequence) 모델에서는 인코더를 거쳐 ( )(이)가 생성된다.
  18. 58.아래는 어떤 회귀분석 결과를 정리한 분산분석표이다. 다음 중 옳지 않은 값을 고르시오. 보기 요 인 제곱합 자유도 제곱평균 F 비 회 귀 72 - - 잔 차 -
  19. 59.데이터 분석 단계 중 도메인 지식을 바탕으로 의미 있는 변수를 찾아내는 작업으로 옳은 것은?
  20. 60.텍스트 마이닝에서 주로 활용되는 기법을 설명한 내용 중 옳지 않은 것은?

빅데이터 결과 해석

  1. 61.실젯값 xᵢ와 예측값 yᵢ 간의 차이를 측정하는 성능평가 지표에 대한 설명으로 옳지 않은 것은 다음 중 무엇인가?
  2. 62.다음 중 교차검증에 관한 설명으로 적절하지 않은 것은?
  3. 63.데이터 분석 결과에서 나타나는 편향(Bias)과 분산(Variance)에 관한 설명 중 가장 적절한 것은?
  4. 64.기초통계량과 그래프 등을 활용하여 시각적으로 데이터를 탐색할 때 파악할 수 없는 것은 다음 중 무엇인가?
  5. 65.실제 값이 참인 경우에 모델이 참으로 예측할 확률을 나타내는 지표는 다음 중 무엇인가?
  6. 66.모자이크 플롯을 활용한 관계 시각화에 관한 설명 중 옳지 않은 것을 고르시오.
  7. 67.분석 모형의 성능을 평가할 때 활용하는 ROC 곡선에 관한 설명 중 옳지 않은 것을 고르시오. (단, FPR은 False Positive Rate, TPR은 Tr
  8. 68.다음 혼동행렬을 바탕으로 계산한 성능평가 지표 값 중 옳지 않은 것은 무엇인가? 보기 실제(Actual Class) \ 예측(Predicted Class) 긍정(
  9. 69.총선 결과를 시각화하려고 한다. 각 지역의 실제 면적 대신 해당 지역에서 당선된 국회의원 수를 기준으로 표현하려 할 때 가장 알맞은 시각화 도구는?
  10. 70.데이터 분석 활용 계획에 관한 설명 중 가장 적절하지 않은 것은?
  11. 71.확률분포나 데이터가 한쪽으로 치우친 정도, 즉 비대칭성을 측정하는 통계적 척도로 옳은 것은?
  12. 72.코로나 발생률을 지역별과 월별로 나누어 시각화 도구를 활용해 나타내려고 한다. 다음 중 가장 적절한 인포그래픽 도구의 조합은?
  13. 73.Ben Fry가 정의한 데이터 시각화의 7단계 프로세스를 순서대로 바르게 나열한 것은?
  14. 74.순위(서열) 척도로 측정된 변수들 간의 상관성을 알아보려고 할 때, 다음 중 사용하기에 가장 적절한 상관계수는?
  15. 75.여러 주요 지역 간의 수출액과 수입액을 시각화하려고 한다. 관계 시각화 도구를 활용하여 영역의 크기로 수출액을, 점의 크기로 수입액을 표현하려 할 때 가장 알맞은
  16. 76.다음 중 K-폴드 교차검증에 관한 설명으로 옳지 않은 것은 무엇인가?
  17. 77.다음 중 과적합(overfitting)을 막기 위한 방법으로 적절하지 않은 것은?
  18. 78.다변량 분산분석(MANOVA)에 관한 설명 중 옳은 것을 고르시오.
  19. 79.다음 연도별 출생아 수와 합계 출산율(여성 1명이 평생 낳을 것으로 기대되는 평균 출생아 수)에 관한 설명 중 가장 적절한 것은? 출생아수(만 명) 합계 출산율
  20. 80.기계학습의 매개변수와 초매개변수에 관한 다음 설명 중 옳지 않은 것을 고르시오.

← 빅데이터분석기사 필기 다른 회차 보기