빅데이터분석기사 필기 제6회 기출문제

80문항 · 회원가입 없이 무료 · 문제를 누르면 정답을 바로 확인할 수 있어요.

시험 모드로 풀기해설 모드로 풀기

빅데이터 분석 기획

  1. 1.세 개의 데이터 60, 70, 80에 최소-최대 정규화(Min-Max Normalization)를 적용했을 때, 변환된 값들의 합은 얼마인가?
  2. 2.빅데이터 분석 업무 수행을 위한 조직 구조에 관한 설명 중 옳지 않은 것은?
  3. 3.다음 중 데이터 거버넌스(Data Governance)를 구성하는 요소에 해당하지 않는 것은?
  4. 4.기업의 분석 준비도(Readiness)를 진단할 때 분석 업무 도입 방법론, 분석 기법의 라이브러리, 분석 효과성 평가, 정기적인 개선 여부 등을 점검 대상으로
  5. 5.데이터 분석 마스터 플랜을 수립하는 작업에 해당하는 것으로 옳은 것은?
  6. 6.다음 중 빅데이터분석 산업이 갖는 단점에 해당하지 않는 것은?
  7. 7.인공지능 시스템을 구현하는 기법에 관한 설명 중 옳지 않은 것은?
  8. 8.데이터 탐색 업무에 관한 설명 중 가장 적절하지 않은 것은 무엇인가?
  9. 9.사양이 낮은 서버들로 구성된 제한적인 환경에서 빅데이터를 효율적으로 저장하고자 할 때, 대용량·데이터 집중형 애플리케이션을 지원하면서 사용자에게 고성능의 Faul
  10. 10.데이터 전처리 과정에서 이루어지는 데이터 정제(Data Cleansing) 업무에 해당하지 않는 것은 다음 중 무엇인가?
  11. 11.데이터의 유형은 정형, 반정형, 비정형으로 나눌 수 있다. 이러한 구분과 가장 관련이 깊은 빅데이터의 특성은 무엇인가?
  12. 12.분산 파일 시스템(Distributed File System)에 관한 설명 중 옳은 것은 무엇인가?
  13. 13.데이터 분석으로 개선사항을 이끌어내고자 할 때, 분석 대상의 현황을 파악하여 개선과제를 정의하는 단계로 옳은 것은 무엇인가?
  14. 14.데이터 저장 시스템에 관한 다음 설명 중 옳지 않은 것은 무엇인가?
  15. 15.다음 중 외부 데이터에 관한 설명으로 가장 적절한 것은?
  16. 16.데이터를 수집하고 통계분석을 수행할 때 고려해야 할 사항에 대한 설명 중 옳지 않은 것은?
  17. 17.데이터 안에 섞여 있는 노이즈(Noise, 잡음) 때문에 거칠게 분포하는 데이터를 부드럽게 다듬어 노이즈를 없애는 데이터 변환 기법은?
  18. 18.다음 중 데이터 사이언스(Data Science)에 관한 설명으로 옳은 것은?
  19. 19.어느 기업의 데이터 분석 수준을 진단해 본 결과, 분석 준비도는 기준치보다 낮게 나타났으나 비즈니스, 조직, 역량, IT 영역의 성숙도는 높다고 평가되었다. 사분
  20. 20.비정형 데이터가 지닌 특성에 대한 설명으로 옳은 것은 무엇인가?

빅데이터 탐색

  1. 21.탐색적 데이터 분석(EDA, Exploratory Data Analysis)에 관한 설명 중 옳지 않은 것은?
  2. 22.상자 모양과 T자형 선을 이용해 데이터를 표현함으로써 중앙값, 사분위 범위, 이상치 등을 파악할 수 있는 아래와 같은 차트를 무엇이라고 하는가? 사분위범위(IQR
  3. 23.데이터의 추출·변환·적재(로드, 저장) 과정을 가리키는 용어로, 기존의 데이터를 저장 또는 집계해 분석한 뒤 비즈니스 의사결정에 활용하는 작업을 무엇이라 부르는가
  4. 24.다음 중 기술통계량에 관한 설명 가운데 옳지 않은 것을 고르시오.
  5. 25.아래 그림처럼 독립변수(X)와 종속변수(Y)가 교차하는 지점을 도표 위에 점으로 나타내면 두 변수 간의 관계를 파악할 수 있다. 이러한 도표를 무엇이라고 하는가?
  6. 26.K은행에서는 한 시간 동안 창구 업무를 위해 방문하는 고객 수의 평균(m)과 아래에 제시된 분포를 활용하여, 업무를 차질 없이 처리하는 데 필요한 적정 직원 수를
  7. 27.주성분 분석(PCA, Principal Component Analysis)에 관한 설명 중 옳지 않은 것을 고르시오.
  8. 28.독립변수 X에 대해 어떤 사건이 발생할 확률을 p=P(Y=1|X)라고 하자. Odds Ratio(오즈비, O₁=p/(1-p))와 파라미터 (a, b)의 관계가 아
  9. 29.다음 중 데이터에서 이상값(Outlier)이 발생하는 원인으로 옳지 않은 것은?
  10. 30.다음 보기 가운데 데이터 전처리(Data Pre-processing) 과정에 포함되지 않는 작업은 무엇인가?
  11. 31.이상값(Outlier)의 처리에 대한 설명 중 옳지 않은 것을 고르시오.
  12. 32.아래 설명에 해당하는 MapReduce 작업의 디자인 패턴(Design Pattern)으로 옳은 것은? 보기 서로 간의 특별한 관계를 찾아내기 위해 다른 데이터세
  13. 33.K대학병원의 조사에 따르면, 흡연자 200명 가운데 폐암 환자가 20명이었고, 비흡연자 220명 가운데 폐암 환자가 4명이었다. 흡연 여부에 따른 폐암의 오즈비(
  14. 34.다음 중 파생변수(Derived Variable)를 활용한 사례로 적절하지 않은 것은?
  15. 35.다음 중 변수 변환 기법인 원-핫 인코딩(One-hot Encoding)에 관한 설명으로 옳지 않은 것은?
  16. 36.다음 보기 가운데 변수의 특성이 나머지와 다른 것은 무엇인가?
  17. 37.측정 단위가 상이한 자료들을 서로 비교하고자 할 때 주로 활용되며, 표준편차를 표본평균(또는 모평균)으로 나누어 구하는 값은 무엇인가?
  18. 38.다음에서 설명하는 결측값 처리 기법으로 옳은 것은? 보기 관측되지 않았거나 칸이 비어 있는 결측치를 다루기 위해 평균 대치, 단순 확률 대치 등을 한 번만 수행하
  19. 39.모집단으로부터 추출된 아래 표본 데이터의 평균과 표본분산을 계산하면 얼마인가? 보기 2, 4, 6, 8, 10
  20. 40.클래스 불균형(Class Imbalance, 데이터 불균형)에 관한 다음 설명 중 옳지 않은 것은?

빅데이터 모델링

  1. 41.회귀분석 모형을 적용하기 전에는 독립변수들 간의 상관관계(변수들 사이의 다중공선성)를 우선적으로 점검할 필요가 있다. 다중공선성을 측정하는 데 활용되는 지표로 알
  2. 42.회귀분석 모형의 성능 평가 지표 중 하나인 결정계수(Coefficient of Determination, R²)에 관한 설명 중 옳지 않은 것은?
  3. 43.의사결정나무 분석 알고리즘 가운데, 다항분포에서 우도비 검정통계량을 활용한 엔트로피 지수(Entropy Index)를 계산해 부모마디로부터 자식마디로 분기하는 기
  4. 44.설명변수(독립변수)를 2개 이상 포함하는 다중회귀분석 모형을 만들 때 요구되는 가정으로 적절하지 않은 것은?
  5. 45.시계열 데이터에서 시차를 둔 값들 간의 선형관계를 측정하면, 과거 시점의 자료를 활용하여 이후 시점의 값을 예측하는 것이 가능하다. 이와 같은 시계열 자료의 특성
  6. 46.랜덤포레스트(Random Forest)에 관한 설명 중 옳지 않은 것은?
  7. 47.앙상블 분석(Ensemble Analysis)의 배깅(Bagging)과 부스팅(Boosting) 학습 방법에 관한 다음 설명 중 옳지 않은 것을 고르시오.
  8. 48.인과 분석(Causal Analysis)에 관한 설명으로 가장 적절한 것은?
  9. 49.다음 중 회귀분석 모형을 구축하는 순서로 올바른 것은?
  10. 50.독립변수가 연속형이며 종속변수가 범주형일 때 활용할 수 있는 데이터 분석 모형으로 가장 적절하지 않은 것은 다음 중 무엇인가?
  11. 51.어느 조사 자료가 1,000명의 대상자에 대해 변수 10,000개를 측정한 데이터세트(대상자의 수보다 변수의 수가 많은 경우)로 주어졌다. 이 데이터로 분석 모형
  12. 52.데이터를 수집한 뒤 아래와 같은 문제를 해소하고자 실시하는 전처리 작업으로 옳은 것은? 보기 데이터세트에 포함된 특성이 늘어나면, 특성 하나하나가 차원이 되어 차
  13. 53.하나의 종속변수와 여러 개의 독립변수 간 선형관계를 분석하는 모형(다중선형회귀)의 성능 평가에 사용하는 지표로 알맞은 것은?
  14. 54.회귀분석에 관한 다음 설명 중 옳지 않은 것은?
  15. 55.시계열 분석에 관한 다음 설명 중 옳지 않은 것을 모두 고른 것은? 보기 (가) 시계열 자료는 크게 정상성(Stationarity) 자료와 비정상성(Non-Sta
  16. 56.Reset 게이트와 Update 게이트를 활용하여 순환신경망(Recurrent Neural Network)의 학습시간을 단축하고 성능을 향상시키는 딥러닝 기법으로
  17. 57.아래 그림처럼 의사결정나무를 활용해 변수의 값(X)에 따라 분류분석을 수행하려고 한다. 이 의사결정나무 구조에서 X₁과 X₂에 들어갈 값으로 알맞은 것은? X ≥
  18. 58.회귀분석 결과의 해석에 대한 설명 중 가장 옳지 않은 것은 무엇인가?
  19. 59.데이터 분할(Data Splitting)과 관련하여 옳지 않은 설명은 무엇인가?
  20. 60.절편을 포함한 다중회귀분석 모형으로 회귀식을 추정하려고 하며, 독립변수는 12개이다. 종속변수 각각에 대해 세 가지 범주(계절, 월, 지역)를 고려해야 한다면 필

빅데이터 결과 해석

  1. 61.인공신경망 모델을 학습시킬 때 과적합을 막기 위한 방법으로 옳지 않은 것은?
  2. 62.다음 중 시간 시각화 기법에 관한 설명으로 옳지 않은 것은?
  3. 63.어떤 사건이나 주제를 마치 이야기를 풀어가듯 구성하고, 해당 사건(주제)이 전개되는 양상을 전방위로 연결해 시각적으로 보여주고자 할 때 활용되는 인포그래픽 기법은
  4. 64.하이퍼파라미터(Hyper Parameter, 초매개변수)의 최적화를 위해 활용하는 다음의 기법은 무엇인가? 보기 알려지지 않은 목적함수를 최대화(또는 최소화)할
  5. 65.데이터 시각화에 관한 설명 중 옳지 않은 것을 고르시오.
  6. 66.머신러닝(기계학습)을 통계적 분석 기법과 비교한 설명 중 옳지 않은 것은?
  7. 67.아래 보기에서 설명하는 특징에 해당하는 인포그래픽 기법은 무엇인가? 보기 역사적 사건이나 이벤트를 시간 순서에 따라 표현 전체 길이와 각 포인트별로 표시해야 할
  8. 68.인공신경망의 학습률(Learning Rate)에 관한 설명 중 옳지 않은 것을 고르시오.
  9. 69.매개변수와 초매개변수에 관한 설명 중 옳지 않은 것을 고르시오.
  10. 70.인포그래픽(Infographics)에 관한 설명 중 옳지 않은 것을 고르시오.
  11. 71.다음 중 적합도 검정에 Kolmogorov-Smirnov(K-S) Test 방법을 적용한 예제로 옳은 것은? 보기 (가) K고등학교 3학년 학생들의 수학시험 점수
  12. 72.아래에 제시된 특징에 해당하는 군집분석 알고리즘은? 보기 군집의 개수(클러스터 수)를 미리 지정할 필요가 없음(군집 수 파라미터 불필요) 특정 점을 중심으로 반경
  13. 73.초매개변수(Hyper Parameter)에 관한 설명 중 가장 적절한 것은?
  14. 74.다중 교차 검증(K-fold Cross Validation)에 관한 설명 중 옳지 않은 것은?
  15. 75.아래는 혼동행렬을 활용한 머신러닝 모델의 성능평가 결과를 나타낸 것이다. 다음 설명 중 옳지 않은 것을 고르시오. 보기 실제 범주값 \ 예측 범주값 Yes No
  16. 76.아래 보기에서 설명하고 있는 교차 검증 기법으로 옳은 것은? 보기 전체 n개의 관측값 가운데 단 하나의 관측값만 검증(시험) 데이터로 두고, 나머지 n-1개의 관
  17. 77.로지스틱 회귀분석을 수행한 결과 예측력을 갖춘 모형이라는 평가를 받았다. p = 민감도, c = 특이도 (0 < c < 1)일 때, 다음 중 옳지 않은
  18. 78.다음 중 비교 시각화 기법에 관한 설명 가운데 옳지 않은 것은?
  19. 79.다음은 K사 에어컨의 시험검사 결과로서 Gas 주입량(%)에 따른 냉방능력(Kcal/h)을 나타낸 것이다. 이에 관한 설명으로 옳은 것은? 냉방능력(Kcal/h)
  20. 80.종합병원, 의원 등 의료기관이 제공하는 서비스의 품질 수준을 점검하고자 할 때, Service Quality(SERVQUAL)에 기반한 평가지표에 해당하는 항목을

← 빅데이터분석기사 필기 다른 회차 보기