빅데이터분석기사 필기 제3회 기출문제

80문항 · 회원가입 없이 무료 · 문제를 누르면 정답을 바로 확인할 수 있어요.

시험 모드로 풀기해설 모드로 풀기

빅데이터 분석 기획

  1. 1.소셜 데이터, 이미지, 오디오와 같은 비정형 데이터를 저장하는 데 주로 활용되며, 아파치 재단의 Cassandra가 대표적인 예로 꼽히는 시스템은 무엇인가?
  2. 2.데이터 분석 마스터 플랜(로드맵)을 수립할 때 고려해야 할 사항으로 적절하지 않은 것은?
  3. 3.다음 보기 가운데 개인정보에 해당한다고 보기 가장 어려운 것은?
  4. 4.원천 데이터 소스에서 데이터를 뽑아내고, 분석하기 쉬운 형태로 변환한 뒤, 그 결과 데이터를 목표 시스템에 적재하는 역할을 수행하는 핵심 구성요소(기술 및 도구)
  5. 5.다음 보기 가운데 데이터 비식별화 기법에 해당하지 않는 것은?
  6. 6.데이터 과학자(Data Scientist)가 갖추어야 할 기본 소양으로 보기 어려운 것은?
  7. 7.데이터 전처리 단계에서 이루어지는 데이터 스케일링(Data Scaling)에 관한 설명 중 옳지 않은 것은 무엇인가?
  8. 8.아파치 하둡(Apache Hadoop)의 작업을 관리하는 워크플로우 도구로 알맞은 것은 무엇인가?
  9. 9.개인정보 처리자에게 금지되는 행위로 가장 옳지 않은 것은?
  10. 10.다음 중 데이터를 수집할 때 고려해야 할 사항으로 가장 적절하지 않은 것은?
  11. 11.데이터 분석 시스템 구현 방법을 활용할 때, 빅데이터 분석절차를 올바른 순서로 나열한 것은?
  12. 12.다음 중 빅데이터의 대표적 특성으로 알려진 3V에 해당하지 않는 것은?
  13. 13.아래 보기에서 설명하고 있는 규제의 명칭으로 옳은 것은? 보기 유럽 연합의 법률로, 유럽 연합 또는 유럽경제지역에 속한 모든 개인의 사생활과 개인정보를 보호하기
  14. 14.한 기업이 다른 기업으로부터 별도의 인터페이스를 거쳐 데이터(개인정보 수집과 이용에 동의한 데이터)를 전달받고, 이를 기반으로 여러 서비스(금융기업 간 개인정보
  15. 15.아래 내용이 설명하는 빅데이터 분석 업무는 무엇인가? 보기 데이터 분석으로 개선사항을 도출하고자 분석 대상 과제의 현황을 파악 분석대상 과제의 문제점 파악을 위해
  16. 16.재현 데이터(Synthetic Data)에 관한 설명 중 가장 적절한 것은 무엇인가?
  17. 17.아래에서 설명하고 있는 데이터 품질관리 특성으로 옳은 것은? 보기 실세계에 존재하는 객체(사건, 사물, 개념 등)의 값이 오류 없이 저장되어 있는 것을 의미함 분
  18. 18.조직의 의사결정 지원을 목적으로 널리 활용되는 데이터웨어하우스(Data Warehouse)의 주요 특징에 해당하지 않는 것은?
  19. 19.전통적인 인공지능과 최신 인공지능을 비교한 설명 중 가장 적절한 것은?
  20. 20.데이터 분석을 목적으로 데이터 수집과 저장 계획을 세울 때 고려해야 할 사항으로 적절하지 않은 것은 무엇인가?

빅데이터 탐색

  1. 21.다음 그림과 같이 오른쪽으로 긴 꼬리를 갖는 분포 그래프에 대한 설명 중 옳은 것은?
  2. 22.유의확률(Significance Probability)에 관한 설명으로 옳은 것은 다음 중 무엇인가?
  3. 23.탐색적 데이터 분석 단계에서 산출한 대푯값들에 관한 설명 중 옳지 않은 것은?
  4. 24.\(n\)개의 표본을 이용해 계산한 표본평균(\(\overline{X}\))의 정규분포 근사화에 관한 설명 중 옳지 않은 것은?
  5. 25.기술 통계학에서 활용되는 통계량인 범위, 중앙값, 최빈값, 평균 가운데 나머지와 성질이 다른 하나는?
  6. 26.유의수준(Significance Level)의 개념을 가장 올바르게 설명한 것은?
  7. 27.아래 그림을 활용해 주성분 분석 기반의 영상인식 시스템을 구축하려고 한다. 픽셀값으로부터 산출한 이미지의 특성값(공분산 행렬, \(A\))과 고유벡터(Eigenv
  8. 28.서로 독립인(\(Cov(X,\ Y){=}0\)) 두 확률변수 \(X\)와 \(Y\)가 포아송분포를 따르고, 평균은 각각 \(E(X){=}4\), \(E(Y){=}
  9. 29.데이터 정제 단계에서 이루어져야 하는 작업으로 알맞은 것은 다음 중 무엇인가?
  10. 30.주성분 분석(PCA, Principal Component Analysis)은 차원축소에 활용되는 기법이다. 이때 사용되는 공분산 행렬에 관한 설명 중 옳지 않은
  11. 31.다음 중 데이터 분석 시 표본조사 방법 대신 전수조사를 실시해야 하는 경우로 가장 적절한 것은?
  12. 32.주성분 분석(PCA, Principal Component Analysis)에 관한 다음 설명 중 옳지 않은 것은 무엇인가?
  13. 33.중심극한정리(Central Limit Theorem)에 관한 설명 중 가장 적절한 것은?
  14. 34.변수 처리 과정에서 활용되는 차원축소(Dimensionality Reduction)에 관한 설명 중 옳지 않은 것은?
  15. 35.박스칵스 변환(Box-cox Transformation)에 관한 설명 중 옳지 않은 것을 고르시오.
  16. 36.점추정(Point Estimation)에 사용되는 추정량이 갖추어야 할 주요 성질(추정량 결정기준)에 해당하지 않는 것은 다음 중 무엇인가?
  17. 37.기술통계에서 대표값으로 흔히 쓰이는 평균(Mean)에 관한 설명 중 옳은 것은?
  18. 38.확률적 근거에 기반하여 표본을 뽑는 확률표본추출방법 가운데, 집단 내부는 이질적이고 집단 사이는 동질적인 특성을 보이는 방법은 무엇인가?
  19. 39.다음 중 상관계수의 기본 개념에 대한 설명으로 올바른 것은?
  20. 40.다음 중 불균형 데이터(Imbalanced Data)에 관한 설명 중 적절하지 않은 것은?

빅데이터 모델링

  1. 41.다음 그림에 제시된 인공신경망에서 활성화 함수가 출력하는 결과 가운데 \(Y_3\)의 값은 얼마인가? [단, Output \(Y{=}(Y_1,\ Y_2,\ Y_3
  2. 42.다음 자료는 5명의 의사가 네 가지 혈압 치료약(A, B, C, D)에 대해 매긴 선호도 서열을 정리한 것이다. 이 자료를 Friedman(프리드만) 검정으로 분
  3. 43.회귀분석을 할 때 독립변수들 간의 강한 상관관계 때문에 나타나는 다중공선성(Multicollinearity) 문제에 대한 해결 방법으로 적절하지 않은 것은 다음
  4. 44.딥러닝 기법 중 하나인 심층신뢰신경망(DBN, Deep Belief Network)에 관한 설명 가운데 옳은 것은?
  5. 45.사회연결망 분석(Social Network Analysis)에서 노드의 중심성(Centrality)을 평가하는 척도에 관한 설명 중 옳지 않은 것은?
  6. 46.시계열 자료에서 서로 다른 시차 값(Lagged Value) 간의 선형관계를 파악하는 데 활용되는 것은 무엇인가?
  7. 47.목표변수가 이산형일 때 의사결정나무 분석모형을 적용하는 경우, 활용되는 검정 방법에 해당하지 않는 것은?
  8. 48.커널 함수(Kernel Function)에 관한 다음 설명 가운데 옳지 않은 것은?
  9. 49.심층신경망을 이용한 딥러닝 분석에서 비용함수 최소화를 위해 활용하는 경사하강법(Gradient Descent) 기법에 해당하지 않는 것은?
  10. 50.아래 상황에서 사용하기에 알맞은 비모수 검정 방법은 무엇인가? 보기 우리나라 대학생의 IQ 중앙값은 115이다. K대학 학생들의 IQ 중앙값이 115 이상이라는
  11. 51.분류의 정확도를 향상시키기 위해 여러 분류 모형의 결과를 결합하는 앙상블 분석(Ensemble Analysis)이 활용된다. 앙상블 분석모형의 설계에 사용되는 학
  12. 52.다음은 단순회귀분석 결과에서 모형의 유의성을 검정하고자 만든 분산분석표(ANOVA, Analysis of Variance)이다. 아래 설명 가운데 옳지 않은 것은
  13. 53.시계열 데이터 분석에 활용되는 자기회귀 누적이동평균모형(ARIMA, Autoregressive Integrated Moving Average)에 관한 설명 중 옳
  14. 54.모집단에 대해 정규분포를 가정하기 어려운 상황에서, 짝을 이룬 표본(대응표본)에 대한 비모수 검정 방법으로 가장 적절한 것은 무엇인가?
  15. 55.인공신경망 모델에서 학습으로 결정되지 않고 사용자가 미리 직접 설정해야 하는 하이퍼파라미터는 무엇인가?
  16. 56.서포트벡터머신(SVM, Support Vector Machine)은 서로 다른 분류에 속한 데이터 간의 간격(Margin)을 최대로 하는 평면을 찾고 이를 기준으
  17. 57.딥러닝에서 활용하는 소프트맥스(Softmax) 활성화 함수에 관한 설명 중 옳지 않은 것은?
  18. 58.아래 설명에 부합하는 인공신경망의 활성화 함수는 무엇인가? 보기 유한한 구간 (a, b) 내의 한정된 값을 반환하며, a와 b로는 주로 0과 1이 사용된다. 정의
  19. 59.다음 설명과 해당 기법의 연결이 올바른 것은? 보기 (가) 합성곱 연산을 사용 Feature Map을 활용하여 학습 로봇 이미지 인식, 컴퓨터 비전, 영상분석 및
  20. 60.인공신경망의 활성화 함수(Activation Function)에 관한 설명 중 옳은 것은 무엇인가?

빅데이터 결과 해석

  1. 61.아래 보기에서 설명하고 있는 교차검증 방법은 무엇인가? 보기 주어진 데이터세트를 무작위(Random)로 서로 겹치지 않는 두 부분으로 나눈다. 한쪽은 모형의 학습
  2. 62.아래는 혼동행렬(Confusion Matrix)을 나타낸 표이다. 이를 바탕으로 계산한 민감도(Sensitivity)와 정밀도(Precision)의 값이 올바르게
  3. 63.예측 모형의 예측오차(\(y_i-\widehat{y}_i\))를 측정하는 지표 중 하나인 평균절대백분오차비율(MAPE, Mean Absolute Percentag
  4. 64.특정 통계 수치를 바탕으로 지도의 면적을 왜곡시켜 표현하는 시각화 기법으로, 지도에 의한 비교 통계도라고도 불리는 것은 무엇인가?
  5. 65.다음 중 로지스틱 회귀분석(Logistic Regression Analysis)에 관한 설명 가운데 적절하지 않은 것은?
  6. 66.다음 ROC(Receiver Operating Characteristic) 곡선 및 AUC(Area under the Curve)에 관한 설명 중 옳지 않은 것을
  7. 67.빅데이터 서비스(또는 비즈니스) 모델을 활용했을 때 기대되는 효과로 적절하지 않은 것은?
  8. 68.다음에서 설명하는 시각화 기법으로 옳은 것은? 보기 서로 다른 변수들 간에 존재하는 연관성을 표현 광고비 지출액과 매출액 사이의 관련성 표현 스캐터 플롯, 행렬,
  9. 69.아래 표는 머신러닝 모델의 성능 평가를 위한 혼동행렬(Confusion Matrix)이다. 실제 긍정(Positive) 범주 가운데 모델이 긍정으로 정확히 예측(
  10. 70.데이터 분석결과를 시각화하는 것에 관한 설명 중 가장 옳지 않은 것은?
  11. 71.참/거짓, 양성/음성, 남성/여성처럼 두 가지 범주로 분류하는 이진분류기의 성능 평가에는 혼동행렬(Confusion Matrix)이 활용된다. 다음 중 혼동행렬을
  12. 72.아래 표는 머신러닝 모델의 성능 평가를 위해 만든 혼동행렬(Confusion Matrix)이다. 실제 부정(Negative)인 범주 가운데 부정으로 정확하게 예측
  13. 73.다음 보기 가운데 데이터 분석결과를 시각화하는 기법으로 보기 어려운 것은?
  14. 74.학습 데이터를 기반으로 교차 검증 방법을 활용하여 데이터 분석모형을 개발할 때, 다음 중 옳지 않은 설명은 무엇인가?
  15. 75.아래 보기의 설명에 각각 해당하는 데이터 분석 방법으로 알맞은 것은? 보기 (가) 뉴턴의 관성의 법칙에 의하면 관성은 물체의 질량(무게)에 정비례하며, 물체의 질
  16. 76.다음 거래 데이터세트(Data Set)가 있을 때, 연관규칙 '오렌지, 사과 ⇒ 자몽'의 지지도와 신뢰도를 구하면 각각 얼마인가? 보기 {오렌지
  17. 77.모집단이 특정 확률분포를 따른다는 가정이 타당한지를 검정하는 적합도 검정에서, 실제 관측도수(\(O_i\))와 확률분포에서 계산된 기대도수(\(E_i\))를 이용
  18. 78.다음 보기 중 관계 시각화에 해당하는 기법은 무엇인가?
  19. 79.인공신경망을 분석할 때 과적합을 방지하기 위한 방법으로 적절하지 않은 것은?
  20. 80.시계열 데이터를 구성하는 주요 성분(패턴)에 해당하지 않는 것은 무엇인가?

← 빅데이터분석기사 필기 다른 회차 보기