빅데이터분석기사 필기 제12회 기출문제

80문항 · 회원가입 없이 무료 · 문제를 누르면 정답을 바로 확인할 수 있어요.

시험 모드로 풀기해설 모드로 풀기

빅데이터 분석 기획

  1. 1.다음 <보기>에서 두 데이터 세트를 하나로 결합하는 작업에 활용해야 할 맵리듀스(MapReduce) 디자인 패턴으로 가장 적절한 것은? 보기 국내 한
  2. 2.다음 <보기>의 상황에서 문제가 되고 있는 데이터 품질 요소로 가장 적절한 것은? 보기 A 통신사의 데이터 분석팀은 고객 이탈 예측 모델을 만들기 위해
  3. 3.개인정보 비식별화 조치 이후 수행하는 익명성(재식별 가능성) 검증 방법에 대한 설명으로 옳지 않은 것은?
  4. 4.다음 <보기>에서 설명하는 과정을 가리키는 용어로 가장 적절한 것은? 보기 웹 크롤러가 수집해 온 HTML 원본 문서는 태그와 텍스트가 뒤섞인 하나의
  5. 5.스크래피(Scrapy)에 대한 설명으로 가장 적절한 것은?
  6. 6.빅데이터 플랫폼의 계층 구조에서 소프트웨어 계층에 해당하지 않는 것은?
  7. 7.다음 <보기>에서 설명하는 NoSQL 데이터베이스로 가장 적절한 것은? 보기 도입 비용이 저렴한 오픈소스 기반의 NoSQL 데이터베이스이다. 데이터를
  8. 8.하둡 분산 파일 시스템(HDFS)에 대한 설명으로 옳은 것은?
  9. 9.여러 대의 웹 서버에서 발생하는 대용량 로그 데이터를 수집하여 하둡 분산 파일 시스템(HDFS)에 저장하기 위한 도구로 가장 적절한 것은?
  10. 10.다음은 분석 대상과 분석 방법을 기준으로 분석 주제를 네 가지 유형으로 나눈 표이다. (ㄱ)~(ㄹ)에 들어갈 용어를 바르게 짝지은 것은? 보기 구분 분석 대상(W
  11. 11.다음 <보기>는 데이터 분석 방법론인 KDD와 CRISP-DM을 비교한 설명이다. 이 중 옳은 것만을 모두 고른 것은? 보기 ㄱ. KDD 분석 방법론은
  12. 12.빅데이터 분석 절차 중 다음 <보기>에서 설명하는 단계로 가장 적절한 것은? 보기 데이터 분석을 수행하기에 앞서 해당 업무 영역의 현황을 파악·분석 한
  13. 13.빅데이터 분석 과제를 ROI(투자 대비 효과) 관점에서 평가할 때, 그 구성 요소에 대한 설명으로 적절하지 않은 것은?
  14. 14.다음 <보기>에서 설명하는 법률로 가장 적절한 것은? 보기 금융거래 등 상거래에서 발생하는 개인신용정보의 수집·조사·처리·유통 및 이용 에 관한 사항을
  15. 15.분석 마스터 플랜에 대한 설명으로 가장 적절한 것은?
  16. 16.인공지능(AI) 모델을 설계할 때 고려해야 할 요소로 적절하지 않은 것은?
  17. 17.빅데이터를 성공적으로 활용하기 위해 필요한 3대 구성 요소로 가장 적절한 것은?
  18. 18.분석 과제의 우선순위를 시급성과 난이도의 두 축으로 평가할 때, '난이도'를 판단하는 기준으로 가장 적절하지 않은 것은?
  19. 19.다음 <보기>에서 설명하는 분석 조직 구조의 유형으로 가장 적절한 것은? 보기 전사 차원의 분석 전담 조직을 별도로 설치 하여, 조직 전체의 분석 업무
  20. 20.다음 <보기>에서 설명하는 데이터 저장 방식으로 가장 적절한 것은? 보기 정형 데이터뿐 아니라 로그·이미지·영상 등 비정형 데이터까지 원래의 형태(Ra

빅데이터 탐색

  1. 21.다음 중 3차 중심적률(Third Central Moment)과 직접적으로 관련된 통계량은?
  2. 22.다음 <보기>에서 설명하는 표본추출 방법으로 가장 적절한 것은? 보기 모집단을 구성하는 N개의 개체에 1, 2, 3, ···, N의 일련번호를 부여한다
  3. 23.다음 중 데이터에서 이상값(Outlier)이 발생하는 원인으로 옳지 않은 것은?
  4. 24.모평균이 \(\mu\)이고 모분산이 \(\sigma^{2}\)인 모집단에서 크기가 2인 표본 \((X_{1}, X_{2})\)를 서로 독립적으로 추출하였다. 이때
  5. 25.확률변수 X가 1, 2, 3, 4, 5, 6의 값을 각각 \(\frac{1}{6}\)의 확률로 가질 때, X의 분산 Var(X)의 값은?
  6. 26.피어슨 상관계수(Pearson Correlation Coefficient)에 대한 설명으로 옳지 않은 것은?
  7. 27.다음 <보기>의 괄호 안에 들어갈 통계 이론으로 가장 적절한 것은? 보기 모집단이 어떤 분포를 따르는지와 관계없이, 표본의 크기 n이 충분히 크다면 표
  8. 28.다음 <보기>는 A 질병과 B 질병 환자의 치료기간을 나타낸 박스플롯(Box Plot)이다. 이에 대한 해석으로 옳지 않은 것은?
  9. 29.차원 축소 기법에 대한 설명으로 옳지 않은 것은?
  10. 30.원-핫 인코딩(One-Hot Encoding)에 대한 설명으로 옳지 않은 것은?
  11. 31.다음 <보기>의 괄호 안에 들어갈 용어를 순서대로 바르게 짝지은 것은? 보기 가설검정에서 귀무가설\((H_{0})\)이 참임에도 불구하고 이를 기각하는
  12. 32.데이터 변환(Transformation) 기술에 대한 설명으로 적절하지 않은 것은?
  13. 33.다음 <보기>는 통계적 가설검정의 절차를 순서 없이 나열한 것이다. 수행 순서를 바르게 나열한 것은? 보기 ㄱ. 표본 데이터로부터 검정통계량을 계산한다
  14. 34.다음 <보기>는 변수 선택(Feature Selection) 기법에 대한 설명이다. 이 중 옳은 것만을 모두 고른 것은? 보기 가. 필터(Filter)
  15. 35.평균(Mean)의 종류에 대한 설명으로 적절하지 않은 것은?
  16. 36.차원 축소(Dimensionality Reduction)에 대한 설명으로 옳지 않은 것은?
  17. 37.데이터의 산포(퍼짐 정도)를 나타내는 기초통계량에 대한 설명으로 옳은 것은?
  18. 38.결측값 처리 방법에 대한 설명으로 적절하지 않은 것은?
  19. 39.주성분 분석(PCA)에 대한 설명으로 적절하지 않은 것은?
  20. 40.다음 <보기>의 조건에서 데이터의 변동을 가장 잘 설명하는 제1주성분(PC1)의 식으로 가장 적절한 것은? 보기 표준화된 두 변수 A 와 B 가 있다.

빅데이터 모델링

  1. 41.다음 중 서포트 벡터 머신(SVM) 모델의 커널 함수(Kernel Function)로 적절하지 않은 것은?
  2. 42.다음 <보기>의 목적함수를 최소화하는 방식으로 회귀계수를 추정하는 분석 방법으로 가장 적절한 것은? 보기 목적함수 = \(\Sigma (y_{i} -
  3. 43.파생변수(Derived Variable)에 대한 설명으로 가장 적절한 것은?
  4. 44.다음 중 명목형(Nominal) 변수로 구성된 데이터 사이의 거리를 측정하는 방법으로 가장 적절한 것은?
  5. 45.다음 <보기>와 같이 두 클래스의 데이터가 주어졌을 때, 이 데이터를 하나의 선형 초평면(직선)으로는 분리할 수 없는 논리 회로는? 보기 클래스 A :
  6. 46.다음 <보기>는 어느 대학 특강에 참석한 학생 200명을 학년별로 집계한 결과이다. '학년별 참석 인원의 비율에 차이가 없다'는 귀무가설을 카이제곱 적
  7. 47.인코더-디코더 구조에서 입력 데이터의 각 부분에 서로 다른 중요도(가중치)를 부여하여, 디코더가 중요한 정보를 선택적으로 활용하도록 하는 메커니즘은?
  8. 48.로지스틱 회귀(Logistic Regression)에 대한 설명으로 옳지 않은 것은?
  9. 49.다음 중 은닉 마르코프 모델(HMM, Hidden Markov Model)의 구성 요소에 해당하지 않는 것은?
  10. 50.t-분포에 대한 설명으로 옳지 않은 것은?
  11. 51.서로 독립인 두 집단의 관측값을 크기순으로 매긴 순위(rank)를 이용하여 두 집단 간 차이를 검정하는 비모수 검정 방법으로 가장 적절한 것은?
  12. 52.이전 시점의 상태를 기억하여 다음 단계로 전달하는 구조를 가지며, 시계열·음성·텍스트와 같은 순차적(Sequence) 데이터를 처리하는 데 특화된 딥러닝 모델은?
  13. 53.앙상블 기법인 배깅(Bagging)과 부스팅(Boosting)에 대한 설명으로 옳지 않은 것은?
  14. 54.나이브 베이즈 분류기(Naive Bayes Classifier)에 대한 설명으로 적절하지 않은 것은?
  15. 55.다음 <보기>는 신경망 출력층에서 얻은 실제값과 예측값이다. 이때 평균제곱오차(MSE, Mean Squared Error)의 값은? 보기 실제값(y)
  16. 56.자기상관함수(ACF, Autocorrelation Function)에 대한 설명으로 적절하지 않은 것은?
  17. 57.랜덤 포레스트(Random Forest)에 대한 설명으로 옳지 않은 것은?
  18. 58.심층 신경망(Deep Neural Network)의 역전파(Backpropagation) 과정에서, 출력층으로부터 멀어질수록 오차 정보가 점점 미미하게 전달되어
  19. 59.선형회귀분석이 성립하기 위한 기본 가정에 대한 설명으로 적절하지 않은 것은?
  20. 60.다중공선성(Multicollinearity)에 대한 설명으로 적절하지 않은 것은?

빅데이터 결과 해석

  1. 61.다음 중 데이터 누수(Data Leakage)가 발생한 사례로 가장 적절한 것은?
  2. 62.다음 <보기>의 혼동행렬(Confusion Matrix)을 이용하여 계산한 F1-Score의 값으로 옳은 것은? 보기 예측 Positive 예측 Neg
  3. 63.다음 <보기>와 같은 조건으로 그리드 서치(Grid Search)와 K-Fold 교차검증을 함께 수행할 때, 수행되는 전체 모델 학습 횟수는? 보기 하
  4. 64.데이터 불균형(Class Imbalance) 문제에 대한 설명으로 적절하지 않은 것은?
  5. 65.ROC 곡선(Receiver Operating Characteristic Curve)에 대한 설명으로 적절하지 않은 것은?
  6. 66.회귀(Regression) 문제와 분류(Classification) 문제에 대한 설명으로 적절하지 않은 것은?
  7. 67.하이퍼파라미터 최적화 기법에 대한 설명으로 적절하지 않은 것은?
  8. 68.홀드아웃(Hold-out)과 K-Fold 교차검증에 대한 설명으로 적절하지 않은 것은?
  9. 69.분석 모델의 리모델링(Remodeling) 시 고려해야 할 사항으로 옳지 않은 것은?
  10. 70.분석 결과에 대한 정량적 평가(Quantitative Evaluation)의 특징으로 적절하지 않은 것은?
  11. 71.분석 모형의 '전개(Deployment)' 단계에 대한 설명으로 가장 옳은 것은?
  12. 72.스태킹(Stacking)과 블렌딩(Blending)에 대한 설명으로 옳은 것은?
  13. 73.다음 중 연관분석(Association Analysis)의 적용 사례로 가장 적절하지 않은 것은?
  14. 74.다음 <보기>의 거래 데이터에서 '빵 → 우유' 연관 규칙의 신뢰도(Confidence)와 향상도(Lift)를 바르게 계산한 것은? 보기 구분 거래 건
  15. 75.박스-콕스(Box-Cox) 변환에 대한 설명으로 적절하지 않은 것은?
  16. 76.다음 <보기>는 포아송분포에 대한 설명이다. 이 중 옳은 것만을 모두 고른 것은? 보기 ㄱ. 포아송분포는 단위 시간 또는 단위 공간에서 어떤 사건이 발
  17. 77.인포그래픽(Infographic)에 대한 설명으로 적절하지 않은 것은?
  18. 78.비교 시각화(Comparison Visualization) 기법에 대한 설명으로 옳지 않은 것은?
  19. 79.히스토그램(Histogram)에 대한 설명으로 옳지 않은 것은?
  20. 80.데이터 시각화 유형과 그에 해당하는 기법을 짝지은 것으로 옳지 않은 것은?

← 빅데이터분석기사 필기 다른 회차 보기