빅데이터분석기사 필기 제7회 기출문제
80문항 · 회원가입 없이 무료 · 문제를 누르면 정답을 바로 확인할 수 있어요.
빅데이터 분석 기획
- 1.정형 데이터의 품질을 검증하는 방법에 관한 설명 중 옳지 않은 것은?
- 2.데이터 사이언티스트(Data Scientist)가 갖추어야 할 소프트 스킬(Soft Skill) 중 가장 필요한 것으로 옳은 것은?
- 3.기업의 데이터 분석 조직이 어느 정도 성숙했는지 평가할 때 활용하는 진단 항목으로 볼 수 없는 것은?
- 4.이른바 '데이터 3법'에 해당하지 않는 법률은 무엇인가?
- 5.빅데이터 분석 기획 업무를 진행할 때 주요하게 고려해야 할 요소로 볼 수 없는 것은?
- 6.다음 중 빅데이터가 가지는 대표적인 특징인 3V로 옳은 것은?
- 7.빅데이터 분석 기획 단계에서 수행하는 주요 업무에 해당하지 않는 것은 다음 중 무엇인가?
- 8.기업 내부에 데이터 거버넌스를 정착시키고자 할 때, CRISP-DM(Cross Industry Standard Process for Data Mining)의 올바
- 9.아래에 제시된 특징들을 지니는 데이터 저장 시스템으로 옳은 것은? 보기 분산확장을 위해 Auto-sharding(자동 샤딩)을 지원한다. Join이 필요없는 Em
- 10.수치로 된 개인정보를 임의의 수를 기준으로 올림하거나 내림 처리하는 데이터 비식별화 기법을 무엇이라고 부르는가?
- 11.아래 항목 가운데 계량적 변수에 해당하지 않는 것은?
- 12.하둡 분산 파일 시스템인 HDFS(Hadoop Distributed File System)에 관한 설명 중 옳은 것을 고르시오.
- 13.데이터 분석가(Data Analyst)가 갖추어야 할 역량에 대한 설명으로 적절하지 않은 것은?
- 14.데이터가 처리되는 동안 손상되거나 변경되지 않으며, 정확하고 신뢰 가능한 상태로 유지되는 것을 보장하는 특성을 무엇이라 하는가?
- 15.다음 보기 가운데 비정형 데이터에 해당한다고 보기 어려운 것은?
- 16.다음에 제시된 특징과 관련이 가장 적은 것은? 보기 정형 데이터와 비교하면 확장성이 더 유연하고 간단하다. 기존의 방식으로는 캡처되거나 형식이 지정되지 않은 데이
- 17.개인의 민감정보를 지키기 위한 비식별화 기법 중, 데이터의 전체 또는 일부를 삭제하거나 노이즈를 더하는 방식은 무엇인가?
- 18.데이터 사이언티스트가 수행하는 업무에 관한 설명 중 가장 적절하지 않은 것은 무엇인가?
- 19.빅데이터 분석 플랫폼에 관한 설명 중 옳지 않은 것을 고르시오.
- 20.데이터 품질을 점검할 때 누락된 값이나 결측치가 있는지를 확인하는 데 해당하는 품질 요소는 무엇인가?
빅데이터 탐색
- 21.다음 중 최빈값에 관한 설명으로 적절하지 않은 것은?
- 22.파생변수(Derived Variable)를 만드는 방식 중 가장 적절하지 않은 것은?
- 23.데이터 전처리 작업에 관한 설명 중 옳지 않은 것을 고르시오.
- 24.아래 확률분포 가운데 이산형 확률변수를 따르는 분포에 해당하는 것은?
- 25.분포가 한쪽 방향으로 치우쳐 있는 정도, 즉 비대칭성을 파악하기 위해 사용하는 기초통계량으로 옳은 것은?
- 26.두 모집단의 분포를 가정하기 어렵거나 표본 자료가 순위 형태로만 주어지는 경우에 적용할 수 있는 비모수 검정 방법으로 옳은 것은?
- 27.다음 표와 같이 고객이 구매한 상품(item)을 0과 1의 값으로 인코딩하는 기법을 무엇이라 부르는가? 보기 item_노트북 item_세탁기 item_청소기 it
- 28.중심극한정리(CLT, Central Limit Theorem)에 관한 설명 중 옳지 않은 것을 고르시오.
- 29.데이터 분석 시 변수를 선택하는 방법에 대한 설명으로 적절하지 않은 것은?
- 30.다음 보기 가운데 데이터 정제(Data Cleansing)에 해당하는 작업은 무엇인가?
- 31.차원 축소 기법 중 하나인 SVD(Singular Value Decomposition)에 관한 설명 가운데 옳지 않은 것은?
- 32.혈액형 조사 과정에서 발생한 결측값을 대체하려고 할 때 가장 적절한 방법은 무엇인가?
- 33.가설 검정에 관한 설명 중 옳지 않은 것을 고르시오.
- 34.데이터를 탐색하는 단계에서 명목형(또는 범주형) 자료의 요약에 활용되는 그래프로 적절하지 않은 것은?
- 35.아래는 어떤 모집단에서 뽑은 표본 X₁, X₂, X₃ 간의 공분산 행렬(Covariance Matrix)을 나타낸 것이다. 이에 대한 설명 중 옳지 않은 것을 고
- 36.모집단이 평균 60, 표준편차 10인 정규분포를 따를 때, 데이터값 70의 표준점수(Z-score, Standard Score)를 구하면 얼마인가?
- 37.다음 기술통계량 가운데 데이터의 중심경향을 보여주는 값에 해당하지 않는 것은?
- 38.독립변수 2개와 종속변수 1개로 구성된 일변량 분산분석을 수행하고자 데이터를 수집하였다. 이상치를 판단하는 방법으로 가장 적절하지 않은 것은 다음 중 무엇인가?
- 39.다음 중 시공간 데이터에 관한 설명 중 적절하지 않은 것은?
- 40.공기질(Air Quality) 측정 데이터를 분석한 결과가 아래와 같다. 이에 대한 설명으로 옳은 것은? 변수 X₁(Ozone, 오존량) > summary(
빅데이터 모델링
- 41.선형회귀분석에서 잔차(Residuals)와 관련된 가정 중 옳지 않은 설명은 무엇인가?
- 42.목표변수(종속변수)가 정의되지 않은 상황에서 활용하기에 가장 적합한 모델 유형은 무엇인가?
- 43.아래 조건의 인공신경망에서 출력되는 값은 무엇인가? 보기 입력 데이터 (X1, X2, X3) = (-1, 0, 1) 가중치 (W1, W2, W3) = (1, 1,
- 44.어느 지역의 주민 가운데 여성의 비율은 40%이며, 키가 180cm 이상인 비율은 남성의 경우 15%, 여성의 경우 2.5%로 나타났다. 키가 180cm 이상인
- 45.블로그와 SNS(페이스북, 인스타그램, 트위터 등)를 비롯한 여러 소셜 미디어 데이터를 분석하는 방법에 해당하지 않는 것은?
- 46.아래 보기에서 설명하고 있는 학습 방법과 데이터 분석 모형으로 옳은 것은? 보기 앙상블 분석 모형을 만들 때 학습 과정에서는 부트스트랩(Bootstrap Aggr
- 47.앙상블 기법 가운데 약한 학습자를 강한 학습자로 바꾸어 주는 기계학습 알고리즘으로, 복원 샘플링으로 여러 샘플을 생성해 순차적으로 학습을 진행하되 잘못 분류된 데
- 48.선형회귀분석에서 아래 식과 같이 실젯값과 예측값 간 차이를 최소화함과 동시에, 특징(가중치)에 대한 가중치(w)의 효과를 제어하며 최적의 모형을 탐색하는 방법은
- 49.K-겹 교차검증(K-fold Cross-validation)에 관한 설명 중 옳지 않은 것을 고르시오.
- 50.데이터 분석모형을 설계할 때 수행하는 업무로 다음 중 가장 적절하지 않은 것은?
- 51.데이터 분할 기법에 관한 설명 중 옳지 않은 것은?
- 52.훈련 데이터(Training Data)와 평가 데이터(Test Data)에 관한 설명 중 가장 옳지 않은 것은?
- 53.다음 분석모형 가운데 군집 수를 미리 정해주지 않아도 분석이 가능한 것은 무엇인가?
- 54.모수의 유의성을 검정하는 방법에 관한 설명 중 옳은 것은?
- 55.다음 빈칸에 들어갈 용어로 옳은 것은? 보기 딥러닝의 심층 인공신경망 구조에서는 비용함수(또는 손실함수)를 최소화하면서 가중치(Weights)를 조정하기 위해 경
- 56.비정형 데이터 분석에 활용되는 언어 모델(Language Model)에 해당하지 않는 것은 다음 중 무엇인가?
- 57.다음 중 자연어 처리에 사용되는 Transformer 구조의 구성 요소에 해당하지 않는 것은?
- 58.다음 빈칸에 들어갈 용어로 적절한 것은? 보기 seq2seq(sequence-to-sequence) 모델은 하나의 시퀀스를 또 다른 시퀀스로 바꾸는 작업을 수행하
- 59.다음 문제 상황 가운데 분류분석 모형의 적용이 가장 적절한 것은 무엇인가?
- 60.다음의 거래 데이터에서 연관규칙 '{사과} ⇒ {달걀, 오이}'의 향상도(Lift) 값을 계산하면 얼마인가? 보기 거래1 {사과, 달걀} 거래2
빅데이터 결과 해석
- 61.표본을 활용해 신뢰구간을 구하는 방법에 관한 설명으로 옳은 것은 무엇인가?
- 62.K-평균 군집분석(K-means Clustering) 모형을 설계할 때 최적의 군집 수(K)를 결정하기 위해 사용하는 방법으로 옳은 것은?
- 63.최근 출시된 신차의 성능 지표를 아래와 같이 표현하였다. 여기에 사용된 시각화 기법으로 알맞은 것은? 견고성 가격 디자인 편의성 창의성 0 2 4 6 8 10
- 64.분류분석 문제에서 성능 향상과 다양성 확보를 목적으로 앙상블 기법을 활용하고자 한다. 앙상블 기법 적용 방법에 대한 다음 설명 가운데 적절하지 않은 것을 모두 고
- 65.의사결정나무(Decision Tree) 모델의 과적합을 막기 위한 목적으로 적용하는 정지규칙(Stopping Rule)에 해당하지 않는 것은?
- 66.머신러닝을 활용한 데이터 분석 모형의 성능평가에 관한 설명 중 옳지 않은 것은?
- 67.비교 시각화에 관한 설명 중 가장 옳은 것은?
- 68.훈련 데이터와 평가 데이터를 활용해 데이터 분석모형을 만들고 정확도를 측정하였다. 과대적합(과적합, Overfitting)이 나타난 사례로 옳은 것은 다음 중 무
- 69.하이퍼파라미터(Hyper Parameter)에 관한 설명 중 옳지 않은 것을 고르시오.
- 70.다음 중 시간 시각화에 관한 설명으로 적절하지 않은 것은?
- 71.아래의 Q-Q(Quantile-Quantile) plot 및 회귀직선에 관한 설명 중 옳은 것을 모두 고르시오. 단, 시각화 분석 결과 Q-Q plot의 우측 위
- 72.다음 중 정준상관분석에 관한 설명으로 옳지 않은 것은?
- 73.데이터 분석모형에 관한 설명 중 옳지 않은 것은?
- 74.K-fold(K-겹) 교차검증에 관한 설명 중 옳지 않은 것을 고르시오.
- 75.다음의 혼동행렬(Confusion Matrix)로부터 계산한 성능평가 지표 값 중 옳지 않은 것은? 보기 실제 범주 값(Actual Class) \ 예측 범주 값
- 76.다음 중 적합도 검정에 관한 설명으로 옳지 않은 것은?
- 77.분석 모형의 성능 평가에 활용되는 F1-score(F-measure)의 계산식으로 올바른 것은? (단, precision은 정밀도, recall은 민감도(sens
- 78.데이터 분석결과를 해석하는 방법에 관한 설명 중 옳지 않은 것은?
- 79.다음 중 회귀분석 모형의 성능을 평가하는 지표로 사용하기에 부적절한 것은?
- 80.ROC(Receiver Operating Characteristic) 곡선에 관한 설명 중 옳지 않은 것을 고르시오.
꿈라CBT