빅데이터분석기사 필기 제12회 기출문제
80문항 · 회원가입 없이 무료 · 문제를 누르면 정답을 바로 확인할 수 있어요.
빅데이터 분석 기획
- 1.다음 <보기>에서 두 데이터 세트를 하나로 결합하는 작업에 활용해야 할 맵리듀스(MapReduce) 디자인 패턴으로 가장 적절한 것은? 보기 국내 한
- 2.다음 <보기>의 상황에서 문제가 되고 있는 데이터 품질 요소로 가장 적절한 것은? 보기 A 통신사의 데이터 분석팀은 고객 이탈 예측 모델을 만들기 위해
- 3.개인정보 비식별화 조치 이후 수행하는 익명성(재식별 가능성) 검증 방법에 대한 설명으로 옳지 않은 것은?
- 4.다음 <보기>에서 설명하는 과정을 가리키는 용어로 가장 적절한 것은? 보기 웹 크롤러가 수집해 온 HTML 원본 문서는 태그와 텍스트가 뒤섞인 하나의
- 5.스크래피(Scrapy)에 대한 설명으로 가장 적절한 것은?
- 6.빅데이터 플랫폼의 계층 구조에서 소프트웨어 계층에 해당하지 않는 것은?
- 7.다음 <보기>에서 설명하는 NoSQL 데이터베이스로 가장 적절한 것은? 보기 도입 비용이 저렴한 오픈소스 기반의 NoSQL 데이터베이스이다. 데이터를
- 8.하둡 분산 파일 시스템(HDFS)에 대한 설명으로 옳은 것은?
- 9.여러 대의 웹 서버에서 발생하는 대용량 로그 데이터를 수집하여 하둡 분산 파일 시스템(HDFS)에 저장하기 위한 도구로 가장 적절한 것은?
- 10.다음은 분석 대상과 분석 방법을 기준으로 분석 주제를 네 가지 유형으로 나눈 표이다. (ㄱ)~(ㄹ)에 들어갈 용어를 바르게 짝지은 것은? 보기 구분 분석 대상(W
- 11.다음 <보기>는 데이터 분석 방법론인 KDD와 CRISP-DM을 비교한 설명이다. 이 중 옳은 것만을 모두 고른 것은? 보기 ㄱ. KDD 분석 방법론은
- 12.빅데이터 분석 절차 중 다음 <보기>에서 설명하는 단계로 가장 적절한 것은? 보기 데이터 분석을 수행하기에 앞서 해당 업무 영역의 현황을 파악·분석 한
- 13.빅데이터 분석 과제를 ROI(투자 대비 효과) 관점에서 평가할 때, 그 구성 요소에 대한 설명으로 적절하지 않은 것은?
- 14.다음 <보기>에서 설명하는 법률로 가장 적절한 것은? 보기 금융거래 등 상거래에서 발생하는 개인신용정보의 수집·조사·처리·유통 및 이용 에 관한 사항을
- 15.분석 마스터 플랜에 대한 설명으로 가장 적절한 것은?
- 16.인공지능(AI) 모델을 설계할 때 고려해야 할 요소로 적절하지 않은 것은?
- 17.빅데이터를 성공적으로 활용하기 위해 필요한 3대 구성 요소로 가장 적절한 것은?
- 18.분석 과제의 우선순위를 시급성과 난이도의 두 축으로 평가할 때, '난이도'를 판단하는 기준으로 가장 적절하지 않은 것은?
- 19.다음 <보기>에서 설명하는 분석 조직 구조의 유형으로 가장 적절한 것은? 보기 전사 차원의 분석 전담 조직을 별도로 설치 하여, 조직 전체의 분석 업무
- 20.다음 <보기>에서 설명하는 데이터 저장 방식으로 가장 적절한 것은? 보기 정형 데이터뿐 아니라 로그·이미지·영상 등 비정형 데이터까지 원래의 형태(Ra
빅데이터 탐색
- 21.다음 중 3차 중심적률(Third Central Moment)과 직접적으로 관련된 통계량은?
- 22.다음 <보기>에서 설명하는 표본추출 방법으로 가장 적절한 것은? 보기 모집단을 구성하는 N개의 개체에 1, 2, 3, ···, N의 일련번호를 부여한다
- 23.다음 중 데이터에서 이상값(Outlier)이 발생하는 원인으로 옳지 않은 것은?
- 24.모평균이 \(\mu\)이고 모분산이 \(\sigma^{2}\)인 모집단에서 크기가 2인 표본 \((X_{1}, X_{2})\)를 서로 독립적으로 추출하였다. 이때
- 25.확률변수 X가 1, 2, 3, 4, 5, 6의 값을 각각 \(\frac{1}{6}\)의 확률로 가질 때, X의 분산 Var(X)의 값은?
- 26.피어슨 상관계수(Pearson Correlation Coefficient)에 대한 설명으로 옳지 않은 것은?
- 27.다음 <보기>의 괄호 안에 들어갈 통계 이론으로 가장 적절한 것은? 보기 모집단이 어떤 분포를 따르는지와 관계없이, 표본의 크기 n이 충분히 크다면 표
- 28.다음 <보기>는 A 질병과 B 질병 환자의 치료기간을 나타낸 박스플롯(Box Plot)이다. 이에 대한 해석으로 옳지 않은 것은?
- 29.차원 축소 기법에 대한 설명으로 옳지 않은 것은?
- 30.원-핫 인코딩(One-Hot Encoding)에 대한 설명으로 옳지 않은 것은?
- 31.다음 <보기>의 괄호 안에 들어갈 용어를 순서대로 바르게 짝지은 것은? 보기 가설검정에서 귀무가설\((H_{0})\)이 참임에도 불구하고 이를 기각하는
- 32.데이터 변환(Transformation) 기술에 대한 설명으로 적절하지 않은 것은?
- 33.다음 <보기>는 통계적 가설검정의 절차를 순서 없이 나열한 것이다. 수행 순서를 바르게 나열한 것은? 보기 ㄱ. 표본 데이터로부터 검정통계량을 계산한다
- 34.다음 <보기>는 변수 선택(Feature Selection) 기법에 대한 설명이다. 이 중 옳은 것만을 모두 고른 것은? 보기 가. 필터(Filter)
- 35.평균(Mean)의 종류에 대한 설명으로 적절하지 않은 것은?
- 36.차원 축소(Dimensionality Reduction)에 대한 설명으로 옳지 않은 것은?
- 37.데이터의 산포(퍼짐 정도)를 나타내는 기초통계량에 대한 설명으로 옳은 것은?
- 38.결측값 처리 방법에 대한 설명으로 적절하지 않은 것은?
- 39.주성분 분석(PCA)에 대한 설명으로 적절하지 않은 것은?
- 40.다음 <보기>의 조건에서 데이터의 변동을 가장 잘 설명하는 제1주성분(PC1)의 식으로 가장 적절한 것은? 보기 표준화된 두 변수 A 와 B 가 있다.
빅데이터 모델링
- 41.다음 중 서포트 벡터 머신(SVM) 모델의 커널 함수(Kernel Function)로 적절하지 않은 것은?
- 42.다음 <보기>의 목적함수를 최소화하는 방식으로 회귀계수를 추정하는 분석 방법으로 가장 적절한 것은? 보기 목적함수 = \(\Sigma (y_{i} -
- 43.파생변수(Derived Variable)에 대한 설명으로 가장 적절한 것은?
- 44.다음 중 명목형(Nominal) 변수로 구성된 데이터 사이의 거리를 측정하는 방법으로 가장 적절한 것은?
- 45.다음 <보기>와 같이 두 클래스의 데이터가 주어졌을 때, 이 데이터를 하나의 선형 초평면(직선)으로는 분리할 수 없는 논리 회로는? 보기 클래스 A :
- 46.다음 <보기>는 어느 대학 특강에 참석한 학생 200명을 학년별로 집계한 결과이다. '학년별 참석 인원의 비율에 차이가 없다'는 귀무가설을 카이제곱 적
- 47.인코더-디코더 구조에서 입력 데이터의 각 부분에 서로 다른 중요도(가중치)를 부여하여, 디코더가 중요한 정보를 선택적으로 활용하도록 하는 메커니즘은?
- 48.로지스틱 회귀(Logistic Regression)에 대한 설명으로 옳지 않은 것은?
- 49.다음 중 은닉 마르코프 모델(HMM, Hidden Markov Model)의 구성 요소에 해당하지 않는 것은?
- 50.t-분포에 대한 설명으로 옳지 않은 것은?
- 51.서로 독립인 두 집단의 관측값을 크기순으로 매긴 순위(rank)를 이용하여 두 집단 간 차이를 검정하는 비모수 검정 방법으로 가장 적절한 것은?
- 52.이전 시점의 상태를 기억하여 다음 단계로 전달하는 구조를 가지며, 시계열·음성·텍스트와 같은 순차적(Sequence) 데이터를 처리하는 데 특화된 딥러닝 모델은?
- 53.앙상블 기법인 배깅(Bagging)과 부스팅(Boosting)에 대한 설명으로 옳지 않은 것은?
- 54.나이브 베이즈 분류기(Naive Bayes Classifier)에 대한 설명으로 적절하지 않은 것은?
- 55.다음 <보기>는 신경망 출력층에서 얻은 실제값과 예측값이다. 이때 평균제곱오차(MSE, Mean Squared Error)의 값은? 보기 실제값(y)
- 56.자기상관함수(ACF, Autocorrelation Function)에 대한 설명으로 적절하지 않은 것은?
- 57.랜덤 포레스트(Random Forest)에 대한 설명으로 옳지 않은 것은?
- 58.심층 신경망(Deep Neural Network)의 역전파(Backpropagation) 과정에서, 출력층으로부터 멀어질수록 오차 정보가 점점 미미하게 전달되어
- 59.선형회귀분석이 성립하기 위한 기본 가정에 대한 설명으로 적절하지 않은 것은?
- 60.다중공선성(Multicollinearity)에 대한 설명으로 적절하지 않은 것은?
빅데이터 결과 해석
- 61.다음 중 데이터 누수(Data Leakage)가 발생한 사례로 가장 적절한 것은?
- 62.다음 <보기>의 혼동행렬(Confusion Matrix)을 이용하여 계산한 F1-Score의 값으로 옳은 것은? 보기 예측 Positive 예측 Neg
- 63.다음 <보기>와 같은 조건으로 그리드 서치(Grid Search)와 K-Fold 교차검증을 함께 수행할 때, 수행되는 전체 모델 학습 횟수는? 보기 하
- 64.데이터 불균형(Class Imbalance) 문제에 대한 설명으로 적절하지 않은 것은?
- 65.ROC 곡선(Receiver Operating Characteristic Curve)에 대한 설명으로 적절하지 않은 것은?
- 66.회귀(Regression) 문제와 분류(Classification) 문제에 대한 설명으로 적절하지 않은 것은?
- 67.하이퍼파라미터 최적화 기법에 대한 설명으로 적절하지 않은 것은?
- 68.홀드아웃(Hold-out)과 K-Fold 교차검증에 대한 설명으로 적절하지 않은 것은?
- 69.분석 모델의 리모델링(Remodeling) 시 고려해야 할 사항으로 옳지 않은 것은?
- 70.분석 결과에 대한 정량적 평가(Quantitative Evaluation)의 특징으로 적절하지 않은 것은?
- 71.분석 모형의 '전개(Deployment)' 단계에 대한 설명으로 가장 옳은 것은?
- 72.스태킹(Stacking)과 블렌딩(Blending)에 대한 설명으로 옳은 것은?
- 73.다음 중 연관분석(Association Analysis)의 적용 사례로 가장 적절하지 않은 것은?
- 74.다음 <보기>의 거래 데이터에서 '빵 → 우유' 연관 규칙의 신뢰도(Confidence)와 향상도(Lift)를 바르게 계산한 것은? 보기 구분 거래 건
- 75.박스-콕스(Box-Cox) 변환에 대한 설명으로 적절하지 않은 것은?
- 76.다음 <보기>는 포아송분포에 대한 설명이다. 이 중 옳은 것만을 모두 고른 것은? 보기 ㄱ. 포아송분포는 단위 시간 또는 단위 공간에서 어떤 사건이 발
- 77.인포그래픽(Infographic)에 대한 설명으로 적절하지 않은 것은?
- 78.비교 시각화(Comparison Visualization) 기법에 대한 설명으로 옳지 않은 것은?
- 79.히스토그램(Histogram)에 대한 설명으로 옳지 않은 것은?
- 80.데이터 시각화 유형과 그에 해당하는 기법을 짝지은 것으로 옳지 않은 것은?
꿈라CBT