빅데이터분석기사 필기 제6회 기출문제
80문항 · 회원가입 없이 무료 · 문제를 누르면 정답을 바로 확인할 수 있어요.
빅데이터 분석 기획
- 1.세 개의 데이터 60, 70, 80에 최소-최대 정규화(Min-Max Normalization)를 적용했을 때, 변환된 값들의 합은 얼마인가?
- 2.빅데이터 분석 업무 수행을 위한 조직 구조에 관한 설명 중 옳지 않은 것은?
- 3.다음 중 데이터 거버넌스(Data Governance)를 구성하는 요소에 해당하지 않는 것은?
- 4.기업의 분석 준비도(Readiness)를 진단할 때 분석 업무 도입 방법론, 분석 기법의 라이브러리, 분석 효과성 평가, 정기적인 개선 여부 등을 점검 대상으로
- 5.데이터 분석 마스터 플랜을 수립하는 작업에 해당하는 것으로 옳은 것은?
- 6.다음 중 빅데이터분석 산업이 갖는 단점에 해당하지 않는 것은?
- 7.인공지능 시스템을 구현하는 기법에 관한 설명 중 옳지 않은 것은?
- 8.데이터 탐색 업무에 관한 설명 중 가장 적절하지 않은 것은 무엇인가?
- 9.사양이 낮은 서버들로 구성된 제한적인 환경에서 빅데이터를 효율적으로 저장하고자 할 때, 대용량·데이터 집중형 애플리케이션을 지원하면서 사용자에게 고성능의 Faul
- 10.데이터 전처리 과정에서 이루어지는 데이터 정제(Data Cleansing) 업무에 해당하지 않는 것은 다음 중 무엇인가?
- 11.데이터의 유형은 정형, 반정형, 비정형으로 나눌 수 있다. 이러한 구분과 가장 관련이 깊은 빅데이터의 특성은 무엇인가?
- 12.분산 파일 시스템(Distributed File System)에 관한 설명 중 옳은 것은 무엇인가?
- 13.데이터 분석으로 개선사항을 이끌어내고자 할 때, 분석 대상의 현황을 파악하여 개선과제를 정의하는 단계로 옳은 것은 무엇인가?
- 14.데이터 저장 시스템에 관한 다음 설명 중 옳지 않은 것은 무엇인가?
- 15.다음 중 외부 데이터에 관한 설명으로 가장 적절한 것은?
- 16.데이터를 수집하고 통계분석을 수행할 때 고려해야 할 사항에 대한 설명 중 옳지 않은 것은?
- 17.데이터 안에 섞여 있는 노이즈(Noise, 잡음) 때문에 거칠게 분포하는 데이터를 부드럽게 다듬어 노이즈를 없애는 데이터 변환 기법은?
- 18.다음 중 데이터 사이언스(Data Science)에 관한 설명으로 옳은 것은?
- 19.어느 기업의 데이터 분석 수준을 진단해 본 결과, 분석 준비도는 기준치보다 낮게 나타났으나 비즈니스, 조직, 역량, IT 영역의 성숙도는 높다고 평가되었다. 사분
- 20.비정형 데이터가 지닌 특성에 대한 설명으로 옳은 것은 무엇인가?
빅데이터 탐색
- 21.탐색적 데이터 분석(EDA, Exploratory Data Analysis)에 관한 설명 중 옳지 않은 것은?
- 22.상자 모양과 T자형 선을 이용해 데이터를 표현함으로써 중앙값, 사분위 범위, 이상치 등을 파악할 수 있는 아래와 같은 차트를 무엇이라고 하는가? 사분위범위(IQR
- 23.데이터의 추출·변환·적재(로드, 저장) 과정을 가리키는 용어로, 기존의 데이터를 저장 또는 집계해 분석한 뒤 비즈니스 의사결정에 활용하는 작업을 무엇이라 부르는가
- 24.다음 중 기술통계량에 관한 설명 가운데 옳지 않은 것을 고르시오.
- 25.아래 그림처럼 독립변수(X)와 종속변수(Y)가 교차하는 지점을 도표 위에 점으로 나타내면 두 변수 간의 관계를 파악할 수 있다. 이러한 도표를 무엇이라고 하는가?
- 26.K은행에서는 한 시간 동안 창구 업무를 위해 방문하는 고객 수의 평균(m)과 아래에 제시된 분포를 활용하여, 업무를 차질 없이 처리하는 데 필요한 적정 직원 수를
- 27.주성분 분석(PCA, Principal Component Analysis)에 관한 설명 중 옳지 않은 것을 고르시오.
- 28.독립변수 X에 대해 어떤 사건이 발생할 확률을 p=P(Y=1|X)라고 하자. Odds Ratio(오즈비, O₁=p/(1-p))와 파라미터 (a, b)의 관계가 아
- 29.다음 중 데이터에서 이상값(Outlier)이 발생하는 원인으로 옳지 않은 것은?
- 30.다음 보기 가운데 데이터 전처리(Data Pre-processing) 과정에 포함되지 않는 작업은 무엇인가?
- 31.이상값(Outlier)의 처리에 대한 설명 중 옳지 않은 것을 고르시오.
- 32.아래 설명에 해당하는 MapReduce 작업의 디자인 패턴(Design Pattern)으로 옳은 것은? 보기 서로 간의 특별한 관계를 찾아내기 위해 다른 데이터세
- 33.K대학병원의 조사에 따르면, 흡연자 200명 가운데 폐암 환자가 20명이었고, 비흡연자 220명 가운데 폐암 환자가 4명이었다. 흡연 여부에 따른 폐암의 오즈비(
- 34.다음 중 파생변수(Derived Variable)를 활용한 사례로 적절하지 않은 것은?
- 35.다음 중 변수 변환 기법인 원-핫 인코딩(One-hot Encoding)에 관한 설명으로 옳지 않은 것은?
- 36.다음 보기 가운데 변수의 특성이 나머지와 다른 것은 무엇인가?
- 37.측정 단위가 상이한 자료들을 서로 비교하고자 할 때 주로 활용되며, 표준편차를 표본평균(또는 모평균)으로 나누어 구하는 값은 무엇인가?
- 38.다음에서 설명하는 결측값 처리 기법으로 옳은 것은? 보기 관측되지 않았거나 칸이 비어 있는 결측치를 다루기 위해 평균 대치, 단순 확률 대치 등을 한 번만 수행하
- 39.모집단으로부터 추출된 아래 표본 데이터의 평균과 표본분산을 계산하면 얼마인가? 보기 2, 4, 6, 8, 10
- 40.클래스 불균형(Class Imbalance, 데이터 불균형)에 관한 다음 설명 중 옳지 않은 것은?
빅데이터 모델링
- 41.회귀분석 모형을 적용하기 전에는 독립변수들 간의 상관관계(변수들 사이의 다중공선성)를 우선적으로 점검할 필요가 있다. 다중공선성을 측정하는 데 활용되는 지표로 알
- 42.회귀분석 모형의 성능 평가 지표 중 하나인 결정계수(Coefficient of Determination, R²)에 관한 설명 중 옳지 않은 것은?
- 43.의사결정나무 분석 알고리즘 가운데, 다항분포에서 우도비 검정통계량을 활용한 엔트로피 지수(Entropy Index)를 계산해 부모마디로부터 자식마디로 분기하는 기
- 44.설명변수(독립변수)를 2개 이상 포함하는 다중회귀분석 모형을 만들 때 요구되는 가정으로 적절하지 않은 것은?
- 45.시계열 데이터에서 시차를 둔 값들 간의 선형관계를 측정하면, 과거 시점의 자료를 활용하여 이후 시점의 값을 예측하는 것이 가능하다. 이와 같은 시계열 자료의 특성
- 46.랜덤포레스트(Random Forest)에 관한 설명 중 옳지 않은 것은?
- 47.앙상블 분석(Ensemble Analysis)의 배깅(Bagging)과 부스팅(Boosting) 학습 방법에 관한 다음 설명 중 옳지 않은 것을 고르시오.
- 48.인과 분석(Causal Analysis)에 관한 설명으로 가장 적절한 것은?
- 49.다음 중 회귀분석 모형을 구축하는 순서로 올바른 것은?
- 50.독립변수가 연속형이며 종속변수가 범주형일 때 활용할 수 있는 데이터 분석 모형으로 가장 적절하지 않은 것은 다음 중 무엇인가?
- 51.어느 조사 자료가 1,000명의 대상자에 대해 변수 10,000개를 측정한 데이터세트(대상자의 수보다 변수의 수가 많은 경우)로 주어졌다. 이 데이터로 분석 모형
- 52.데이터를 수집한 뒤 아래와 같은 문제를 해소하고자 실시하는 전처리 작업으로 옳은 것은? 보기 데이터세트에 포함된 특성이 늘어나면, 특성 하나하나가 차원이 되어 차
- 53.하나의 종속변수와 여러 개의 독립변수 간 선형관계를 분석하는 모형(다중선형회귀)의 성능 평가에 사용하는 지표로 알맞은 것은?
- 54.회귀분석에 관한 다음 설명 중 옳지 않은 것은?
- 55.시계열 분석에 관한 다음 설명 중 옳지 않은 것을 모두 고른 것은? 보기 (가) 시계열 자료는 크게 정상성(Stationarity) 자료와 비정상성(Non-Sta
- 56.Reset 게이트와 Update 게이트를 활용하여 순환신경망(Recurrent Neural Network)의 학습시간을 단축하고 성능을 향상시키는 딥러닝 기법으로
- 57.아래 그림처럼 의사결정나무를 활용해 변수의 값(X)에 따라 분류분석을 수행하려고 한다. 이 의사결정나무 구조에서 X₁과 X₂에 들어갈 값으로 알맞은 것은? X ≥
- 58.회귀분석 결과의 해석에 대한 설명 중 가장 옳지 않은 것은 무엇인가?
- 59.데이터 분할(Data Splitting)과 관련하여 옳지 않은 설명은 무엇인가?
- 60.절편을 포함한 다중회귀분석 모형으로 회귀식을 추정하려고 하며, 독립변수는 12개이다. 종속변수 각각에 대해 세 가지 범주(계절, 월, 지역)를 고려해야 한다면 필
빅데이터 결과 해석
- 61.인공신경망 모델을 학습시킬 때 과적합을 막기 위한 방법으로 옳지 않은 것은?
- 62.다음 중 시간 시각화 기법에 관한 설명으로 옳지 않은 것은?
- 63.어떤 사건이나 주제를 마치 이야기를 풀어가듯 구성하고, 해당 사건(주제)이 전개되는 양상을 전방위로 연결해 시각적으로 보여주고자 할 때 활용되는 인포그래픽 기법은
- 64.하이퍼파라미터(Hyper Parameter, 초매개변수)의 최적화를 위해 활용하는 다음의 기법은 무엇인가? 보기 알려지지 않은 목적함수를 최대화(또는 최소화)할
- 65.데이터 시각화에 관한 설명 중 옳지 않은 것을 고르시오.
- 66.머신러닝(기계학습)을 통계적 분석 기법과 비교한 설명 중 옳지 않은 것은?
- 67.아래 보기에서 설명하는 특징에 해당하는 인포그래픽 기법은 무엇인가? 보기 역사적 사건이나 이벤트를 시간 순서에 따라 표현 전체 길이와 각 포인트별로 표시해야 할
- 68.인공신경망의 학습률(Learning Rate)에 관한 설명 중 옳지 않은 것을 고르시오.
- 69.매개변수와 초매개변수에 관한 설명 중 옳지 않은 것을 고르시오.
- 70.인포그래픽(Infographics)에 관한 설명 중 옳지 않은 것을 고르시오.
- 71.다음 중 적합도 검정에 Kolmogorov-Smirnov(K-S) Test 방법을 적용한 예제로 옳은 것은? 보기 (가) K고등학교 3학년 학생들의 수학시험 점수
- 72.아래에 제시된 특징에 해당하는 군집분석 알고리즘은? 보기 군집의 개수(클러스터 수)를 미리 지정할 필요가 없음(군집 수 파라미터 불필요) 특정 점을 중심으로 반경
- 73.초매개변수(Hyper Parameter)에 관한 설명 중 가장 적절한 것은?
- 74.다중 교차 검증(K-fold Cross Validation)에 관한 설명 중 옳지 않은 것은?
- 75.아래는 혼동행렬을 활용한 머신러닝 모델의 성능평가 결과를 나타낸 것이다. 다음 설명 중 옳지 않은 것을 고르시오. 보기 실제 범주값 \ 예측 범주값 Yes No
- 76.아래 보기에서 설명하고 있는 교차 검증 기법으로 옳은 것은? 보기 전체 n개의 관측값 가운데 단 하나의 관측값만 검증(시험) 데이터로 두고, 나머지 n-1개의 관
- 77.로지스틱 회귀분석을 수행한 결과 예측력을 갖춘 모형이라는 평가를 받았다. p = 민감도, c = 특이도 (0 < c < 1)일 때, 다음 중 옳지 않은
- 78.다음 중 비교 시각화 기법에 관한 설명 가운데 옳지 않은 것은?
- 79.다음은 K사 에어컨의 시험검사 결과로서 Gas 주입량(%)에 따른 냉방능력(Kcal/h)을 나타낸 것이다. 이에 관한 설명으로 옳은 것은? 냉방능력(Kcal/h)
- 80.종합병원, 의원 등 의료기관이 제공하는 서비스의 품질 수준을 점검하고자 할 때, Service Quality(SERVQUAL)에 기반한 평가지표에 해당하는 항목을
꿈라CBT