빅데이터분석기사 필기 제2회 기출문제

80문항 · 회원가입 없이 무료 · 문제를 누르면 정답을 바로 확인할 수 있어요.

시험 모드로 풀기해설 모드로 풀기

빅데이터 분석 기획

  1. 1.개인정보 보호법의 규정상 반드시 개인의 동의를 받아야 하는 경우에 해당하는 것은 다음 중 무엇인가?
  2. 2.정형 데이터의 품질 검증을 위해 테이블, 컬럼, 데이터 사전 등으로부터 주요 데이터를 수집하고 확인하며, 테이블의 컬럼 이름과 자료명이 서로 일치하지 않는지 등을
  3. 3.진단분석(Diagnostics Analysis)에 관한 설명 중 옳은 것을 고르시오.
  4. 4.다음 중 데이터 비식별화 방법의 개념 설명으로 가장 적절한 것은?
  5. 5.다음 그림은 손글씨 알파벳을 모아 놓은 EMNIST(Extended MNIST) 데이터베이스의 예시로, 기계학습 분야에서 훈련 및 검증 용도로 폭넓게 쓰인다. 이
  6. 6.한 중학교에서 학생들의 신체 치수(키, 몸무게 등)와 교복 사이즈 데이터를 학습시킨 뒤, 새로 전입한 학생의 신체 치수를 입력하여 해당 학생에게 맞는 교복 사이즈
  7. 7.업계에서 통용되는 데이터 분석 표준용어 중 하나로, 데이터 소스에서 데이터를 추출한 뒤 분석하기 쉬운 형태로 변환하고, 이렇게 변환된 최종 데이터를 대상 시스템에
  8. 8.데이터 품질점검 항목에 관한 다음 설명 중 옳은 것은 무엇인가?
  9. 9.데이터의 유형에 따른 수집 방법의 연결이 적절하지 않은 것은?
  10. 10.데이터 비식별화 조치와 그 처리 방법에 관한 설명으로 가장 적절하지 않은 것은?
  11. 11.다음 문제 가운데 비지도 학습을 활용하기에 가장 알맞은 것은 무엇인가?
  12. 12.딥러닝에 관한 설명 중 가장 적절한 것은 무엇인가?
  13. 13.다음 보기에서 설명하는 것으로 옳은 것은? 보기 데이터에 대해 표준화된 관리 체계를 마련하고, 이를 운영하기 위한 프레임워크와 저장소를 구축하는 것
  14. 14.비정형 데이터 분석에 활용되는 대표적인 데이터 소스로 다음 중 옳은 것은?
  15. 15.개인정보 보호법상 개인정보처리자에게 부과된 의무 규정에 해당하지 않는 것은 다음 중 무엇인가?
  16. 16.(입력, 출력) 형태의 쌍으로 데이터가 제공될 때 그 둘 사이의 대응관계를 학습하며, 입력에 대응하는 출력을 연결짓는 관계를 익히는 방법으로 주로 분류 및 회귀분
  17. 17.빅데이터 분석 과정을 5단계로 나눌 때, 그 절차를 올바르게 나열한 것은 무엇인가?
  18. 18.아래 보기가 설명하는 개념으로 옳은 것은? 보기 데이터 집합 내 다른 대부분의 측정값들과 뚜렷하게 차이가 나는 샘플 또는 변숫값
  19. 19.데이터 분석 조직의 성숙도가 발전해 가는 단계에 해당하지 않는 것은 다음 중 무엇인가?
  20. 20.인공신경망(Artificial Neural Network)의 구조에서 반복적인 학습 과정을 통해 개선해 나가고자 하는 목푯값은 다음 중 무엇인가?

빅데이터 탐색

  1. 21.확률표본추출 기법 중 층화추출방법에 관한 설명으로 적절하지 않은 것은 무엇인가?
  2. 22.기계학습에서 예측하고자 하는 대상 클래스의 표본이 극히 드물 때 나타나는 군집 또는 클래스 불균형(Class Imbalance) 문제에 대한 해결 방안으로 옳지
  3. 23.회귀분석에서 여러 변수 가운데 유효한 변수를 골라내기 위해 사용하는 Feature Selection(변수 선택) 모델의 기법에 해당하지 않는 것은?
  4. 24.상관계수에 관한 설명 중 옳은 것을 고르면?
  5. 25.병렬 차트(Parallel Chart)를 작성하는 방법에 관한 설명 중 옳지 않은 것은 무엇인가?
  6. 26.탐색적 데이터 분석(EDA, Exploratory Data Analysis)에 관한 설명 중 가장 적절하지 않은 것은 무엇인가?
  7. 27.데이터 분석에서 주요 변수를 선택할 때 나타나는 차원의 저주(The Curse of Dimensionality)에 관한 설명 중 옳지 않은 것을 고르시오.
  8. 28.다층 퍼셉트론(Perceptron)에서 발생하는 데이터 불균형(Imbalanced 또는 Unbalanced Dataset) 문제의 해결 방법에 관한 설명 중 가장
  9. 29.데이터사이언스 학과에는 학생이 모두 25명 있다. 다섯 시간 동안 평균 10명이 스마트폰을 사용한다고 할 때, 한 시간 동안 스마트폰 사용자가 한 명도 없을 확률
  10. 30.파생변수에 관한 설명 중 옳지 않은 것을 고르시오.
  11. 31.데이터를 시각적으로 탐색할 때 흔히 활용하는 박스 플롯(Box-plot)을 통해 파악할 수 없는 것은?
  12. 32.통계학과 학생 가운데 25명을 뽑아 키를 잰 결과 평균 170cm, 표준편차 5cm가 나왔다. 아래 \(t\)분포의 확률값을 활용하여 모평균에 대한 95% 신뢰구
  13. 33.저장된 데이터를 바탕으로 연구 목적에 부합하는 가설을 설정하고 데이터를 분석하는 작업을 가리키며, 데이터의 구조와 특징을 파악한 뒤 분석 과정에서 얻은 정보를 근
  14. 34.어느 고등학교 학생 120명의 키를 측정하였더니 확률변수 \(X\)가 정규분포 \(X{\sim}N(175,\ 20^2)\)을 따르는 것으로 나타났다. 지수의 키가
  15. 35.다음은 가설 검정 과정에서 나타나는 오류에 관한 설명이다. (ㄱ), (ㄴ)에 들어갈 용어로 옳은 것은? 보기 통계적 가설은 표본의 특성을 나타내는 모수에 관한 주
  16. 36.정규분포와 \(t\)-분포에 관한 다음 설명 가운데 옳지 않은 것은?
  17. 37.어느 데이터사이언스 전공 학생 6명이 받은 통계학 점수가 다음과 같을 때, 성적 평균의 점추정치로 적절한 것은? 보기 통계학 성적 80, 85, 90, 70, 7
  18. 38.불균형 데이터(Imbalanced Data) 문제에 대응하는 기법 가운데 아래 설명에 부합하는 것은 무엇인가? 보기 다수 클래스에 속한 데이터 중 일부만을 활용한
  19. 39.스페인 프로 리그 소속 B 축구 구단 선수들의 연봉에 대한 대푯값을 구하고자 한다. B 축구 구단 소속 선수 전원의 연봉을 조사해 보니, 특정 한두 명 선수의 연
  20. 40.다음 보기 중 분포의 형태가 나머지와 다른 하나는?

빅데이터 모델링

  1. 41.다음 중 빅데이터 분석 모델링을 수행하는 순서로 올바른 것은?
  2. 42.다음 그림에 나타난 시계열 분해(Time Series Decomposition) 결과에서 파악할 수 없는 요인은 무엇인가? (단, 관측 데이터(Observed D
  3. 43.앙상블 분석에서 활용되는 대표적인 두 가지 학습 기법과 해당 알고리즘의 짝으로 옳은 것은 다음 중 무엇인가?
  4. 44.인공신경망(Artificial Neural Network)에서 학습으로 결정되는 것이 아니라 사용자가 직접 설정하는 하이퍼파라미터(Hyperparameter, 초
  5. 45.아래 보기의 설명에 부합하는 다변량 분석 기법은 무엇인가? 보기 개체들의 특성을 측정한 뒤, 개체들 간 특성의 유사성(또는 비유사성)을 측정한다. 개체 간의 비유
  6. 46.프로세스적 관점에서 상향식 접근 방법으로 데이터 분석을 수행할 때, 그 절차를 올바르게 나열한 것은 무엇인가?
  7. 47.다음 문제 상황 가운데 로지스틱 회귀분석(Logistic Regression Analysis)을 적용하기에 가장 적절하지 않은 것은?
  8. 48.다음 중 서포트벡터머신(SVM, Support Vector Machine) 기법이 갖는 장점과 가장 거리가 먼 설명은?
  9. 49.아래 보기에서 설명하고 있는 앙상블 분석(Ensemble Analysis)의 부스팅(Boosting) 알고리즘으로 옳은 것은? 보기 약 분류기(학습기)를 가중치를
  10. 50.합성곱 신경망(CNN, Convolutional Neural Network)을 활용해 아래 그림처럼 이미지의 특징을 추출하고자 한다. 입력 데이터 크기가 (5,
  11. 51.아래 설명이 가리키는 데이터 분석 기법으로 옳은 것은? 보기 기업 내부에서 발생하는 트랜잭션 데이터를 모델링하는 데 사용된다. 트랜잭션 데이터에서 각 이벤트(개체
  12. 52.K-means(K-평균) 군집분석모형을 활용한 군집분석(Clustering Analysis)에서 군집의 개수(K)를 결정하기 위해 다음과 같은 코드(Tensorf
  13. 53.다음 중 랜덤포레스트(Random Forest) 분석 기법에 관한 설명 가운데 옳지 않은 것을 고르시오.
  14. 54.어느 스마트폰 공장에서 생산 라인을 거쳐 모델 A는 50개, 모델 B는 30개, 모델 C는 20개가 만들어졌다. 검사 결과 각 모델의 불량률은 A 1%, B 2%
  15. 55.인공신경망 분석모형에서 활용되는 하이퍼파라미터(Hyperparameter)에 관한 설명 중 가장 옳지 않은 것은?
  16. 56.독립변수는 연속형이고 종속변수는 범주형인 경우에 대표적으로 활용되는 회귀분석 기법으로 옳은 것은?
  17. 57.빅데이터 분석 유형을 분석대상과 방법 기준으로 구분할 때, 해결하고자 하는 문제와 그에 대한 분석 방법을 모두 알고 있는 상황에서 활용하는 방식으로 가장 알맞은
  18. 58.회귀분석모형을 구축할 때 처음에 모든 독립변수를 포함한 회귀식을 만든 후, 회귀 모형에 미치는 영향력이 가장 작은 변수부터 하나씩 제거해 가며 최적의 회귀식을 찾
  19. 59.사건 \(X\)가 일어나는 데 원인이 되는 \(P(A)\), \(P(B)\)의 사전확률이 주어졌을 때, 사건 \(X\)가 발생했을 경우 그 원인이 사건 \(B\)
  20. 60.다음 보기 가운데 시계열 분석에 사용되는 모형으로 보기 어려운 것은?

빅데이터 결과 해석

  1. 61.적합도 검정(Goodness of Fit Test)에 관한 다음 설명 중 가장 옳지 않은 것은?
  2. 62.인포그래픽(Infographics)이 가지는 특징에 관한 설명 중 옳지 않은 것은 무엇인가?
  3. 63.선형회귀(Linear Regression) 분석에 관한 다음 설명 중 옳지 않은 것을 모두 고른 것은? 보기 (ㄱ) 독립변수의 회귀계수가 유의한지 검정할 때 카이
  4. 64.학습 데이터를 활용하여 데이터 분석모형의 교차 타당성을 확인하고자 할 때 사용하는 K-fold 다중교차방법에 관한 설명 중 옳은 것은 무엇인가?
  5. 65.아래 그림은 실젯값과 예측값 간의 차이(Residual)를 나타낸 잔차 그래프(Residual Plot)이다. 이를 설명한 내용으로 가장 적절한 것은? Resid
  6. 66.다음 중 데이터 분석결과의 활용에 관한 설명으로 옳지 않은 것은 무엇인가?
  7. 67.회귀식 \(Y=a+bX\)의 두 모수 \((a,\ b)\)를 최대우도추정법(Maximum Likelihood Estimation)으로 추정하고자 한다. 9개의 관
  8. 68.변수 간의 관계를 눈으로 확인할 수 있도록 시각화할 때 산점도(Scatter Plot)를 활용한다. 어떤 변수가 다른 변수에 미치는 영향을 산점도 방식으로 시각화
  9. 69.아래 내용이 설명하는 차트로 가장 알맞은 것은? 보기 변수의 개수만큼 축을 그려 축마다 측정값을 표시함 여러 측정항목 사이의 균형을 한눈에 파악할 수 있음 각 측
  10. 70.빅데이터 분석모형의 평가에 대한 설명 중 가장 적절하지 않은 것은?
  11. 71.회귀분석모형을 통해 얻은 추정값과 실제 데이터 간의 차이를 잔차(Residual)라고 부르며, 이 값이 작을수록 해당 회귀모형이 실제 데이터를 잘 설명한다고 판단
  12. 72.지도 학습 기반 분류 알고리즘의 성능을 평가한 결과 아래와 같은 혼동행렬(Confusion Matrix)이 산출되었다. 이때 정밀도(Precision)와 재현율(
  13. 73.다음 자료는 신기술에 대한 연도별 투자(기획 자금, 기술투자, 인력지원)와 그에 따른 기술·경제적 성과(5점 척도로 측정)를 나타낸 것이다. 연도별 투자에 따른
  14. 74.독립변수의 개수가 k개일 때, 다중회귀분석모형을 나타내는 회귀식으로 알맞은 것은 무엇인가? (단, βi는 모수를, ε는 잔차(Residual)를 의미한다)
  15. 75.의료 현장에서 질환을 진단할 때 활용되는 데이터 분석모형의 민감도(Sensitivity)와 특이도(Specificity)에 관한 설명 중 옳지 않은 것은?
  16. 76.구축된 분석모형의 교차 타당성을 학습 데이터로 확인하고자 할 때 활용되는 기법 중, 아래와 같은 특징을 지닌 데이터 검증 방법은 무엇인가? 보기 데이터를 무작위로
  17. 77.데이터 분석모형의 진단에 관한 설명 중 가장 적절하지 않은 것은 무엇인가?
  18. 78.다음 조건을 바탕으로 분석모형의 진단 평가를 설명한 내용 가운데 옳지 않은 것은? 보기 구 분 예측(예) 예측(아니오) 실제(예) 참긍정, True Positiv
  19. 79.분류 모형의 예측 성능을 검증할 때 혼동행렬(Confusion Matrix)이 활용되며, 이는 실제 관측값에 대한 예측값의 정확성을 판단하는 도구이다. 혼동행렬로
  20. 80.다음 그림은 ROC(Receiver Operating Characteristic, 수신자 조작 특성) 곡선을 보여준다. 세 가지 모델(Model 1, 2, 3)의

← 빅데이터분석기사 필기 다른 회차 보기