빅데이터분석기사 필기 제7회 기출문제

80문항 · 회원가입 없이 무료 · 문제를 누르면 정답을 바로 확인할 수 있어요.

시험 모드로 풀기해설 모드로 풀기

빅데이터 분석 기획

  1. 1.정형 데이터의 품질을 검증하는 방법에 관한 설명 중 옳지 않은 것은?
  2. 2.데이터 사이언티스트(Data Scientist)가 갖추어야 할 소프트 스킬(Soft Skill) 중 가장 필요한 것으로 옳은 것은?
  3. 3.기업의 데이터 분석 조직이 어느 정도 성숙했는지 평가할 때 활용하는 진단 항목으로 볼 수 없는 것은?
  4. 4.이른바 '데이터 3법'에 해당하지 않는 법률은 무엇인가?
  5. 5.빅데이터 분석 기획 업무를 진행할 때 주요하게 고려해야 할 요소로 볼 수 없는 것은?
  6. 6.다음 중 빅데이터가 가지는 대표적인 특징인 3V로 옳은 것은?
  7. 7.빅데이터 분석 기획 단계에서 수행하는 주요 업무에 해당하지 않는 것은 다음 중 무엇인가?
  8. 8.기업 내부에 데이터 거버넌스를 정착시키고자 할 때, CRISP-DM(Cross Industry Standard Process for Data Mining)의 올바
  9. 9.아래에 제시된 특징들을 지니는 데이터 저장 시스템으로 옳은 것은? 보기 분산확장을 위해 Auto-sharding(자동 샤딩)을 지원한다. Join이 필요없는 Em
  10. 10.수치로 된 개인정보를 임의의 수를 기준으로 올림하거나 내림 처리하는 데이터 비식별화 기법을 무엇이라고 부르는가?
  11. 11.아래 항목 가운데 계량적 변수에 해당하지 않는 것은?
  12. 12.하둡 분산 파일 시스템인 HDFS(Hadoop Distributed File System)에 관한 설명 중 옳은 것을 고르시오.
  13. 13.데이터 분석가(Data Analyst)가 갖추어야 할 역량에 대한 설명으로 적절하지 않은 것은?
  14. 14.데이터가 처리되는 동안 손상되거나 변경되지 않으며, 정확하고 신뢰 가능한 상태로 유지되는 것을 보장하는 특성을 무엇이라 하는가?
  15. 15.다음 보기 가운데 비정형 데이터에 해당한다고 보기 어려운 것은?
  16. 16.다음에 제시된 특징과 관련이 가장 적은 것은? 보기 정형 데이터와 비교하면 확장성이 더 유연하고 간단하다. 기존의 방식으로는 캡처되거나 형식이 지정되지 않은 데이
  17. 17.개인의 민감정보를 지키기 위한 비식별화 기법 중, 데이터의 전체 또는 일부를 삭제하거나 노이즈를 더하는 방식은 무엇인가?
  18. 18.데이터 사이언티스트가 수행하는 업무에 관한 설명 중 가장 적절하지 않은 것은 무엇인가?
  19. 19.빅데이터 분석 플랫폼에 관한 설명 중 옳지 않은 것을 고르시오.
  20. 20.데이터 품질을 점검할 때 누락된 값이나 결측치가 있는지를 확인하는 데 해당하는 품질 요소는 무엇인가?

빅데이터 탐색

  1. 21.다음 중 최빈값에 관한 설명으로 적절하지 않은 것은?
  2. 22.파생변수(Derived Variable)를 만드는 방식 중 가장 적절하지 않은 것은?
  3. 23.데이터 전처리 작업에 관한 설명 중 옳지 않은 것을 고르시오.
  4. 24.아래 확률분포 가운데 이산형 확률변수를 따르는 분포에 해당하는 것은?
  5. 25.분포가 한쪽 방향으로 치우쳐 있는 정도, 즉 비대칭성을 파악하기 위해 사용하는 기초통계량으로 옳은 것은?
  6. 26.두 모집단의 분포를 가정하기 어렵거나 표본 자료가 순위 형태로만 주어지는 경우에 적용할 수 있는 비모수 검정 방법으로 옳은 것은?
  7. 27.다음 표와 같이 고객이 구매한 상품(item)을 0과 1의 값으로 인코딩하는 기법을 무엇이라 부르는가? 보기 item_노트북 item_세탁기 item_청소기 it
  8. 28.중심극한정리(CLT, Central Limit Theorem)에 관한 설명 중 옳지 않은 것을 고르시오.
  9. 29.데이터 분석 시 변수를 선택하는 방법에 대한 설명으로 적절하지 않은 것은?
  10. 30.다음 보기 가운데 데이터 정제(Data Cleansing)에 해당하는 작업은 무엇인가?
  11. 31.차원 축소 기법 중 하나인 SVD(Singular Value Decomposition)에 관한 설명 가운데 옳지 않은 것은?
  12. 32.혈액형 조사 과정에서 발생한 결측값을 대체하려고 할 때 가장 적절한 방법은 무엇인가?
  13. 33.가설 검정에 관한 설명 중 옳지 않은 것을 고르시오.
  14. 34.데이터를 탐색하는 단계에서 명목형(또는 범주형) 자료의 요약에 활용되는 그래프로 적절하지 않은 것은?
  15. 35.아래는 어떤 모집단에서 뽑은 표본 X₁, X₂, X₃ 간의 공분산 행렬(Covariance Matrix)을 나타낸 것이다. 이에 대한 설명 중 옳지 않은 것을 고
  16. 36.모집단이 평균 60, 표준편차 10인 정규분포를 따를 때, 데이터값 70의 표준점수(Z-score, Standard Score)를 구하면 얼마인가?
  17. 37.다음 기술통계량 가운데 데이터의 중심경향을 보여주는 값에 해당하지 않는 것은?
  18. 38.독립변수 2개와 종속변수 1개로 구성된 일변량 분산분석을 수행하고자 데이터를 수집하였다. 이상치를 판단하는 방법으로 가장 적절하지 않은 것은 다음 중 무엇인가?
  19. 39.다음 중 시공간 데이터에 관한 설명 중 적절하지 않은 것은?
  20. 40.공기질(Air Quality) 측정 데이터를 분석한 결과가 아래와 같다. 이에 대한 설명으로 옳은 것은? 변수 X₁(Ozone, 오존량) > summary(

빅데이터 모델링

  1. 41.선형회귀분석에서 잔차(Residuals)와 관련된 가정 중 옳지 않은 설명은 무엇인가?
  2. 42.목표변수(종속변수)가 정의되지 않은 상황에서 활용하기에 가장 적합한 모델 유형은 무엇인가?
  3. 43.아래 조건의 인공신경망에서 출력되는 값은 무엇인가? 보기 입력 데이터 (X1, X2, X3) = (-1, 0, 1) 가중치 (W1, W2, W3) = (1, 1,
  4. 44.어느 지역의 주민 가운데 여성의 비율은 40%이며, 키가 180cm 이상인 비율은 남성의 경우 15%, 여성의 경우 2.5%로 나타났다. 키가 180cm 이상인
  5. 45.블로그와 SNS(페이스북, 인스타그램, 트위터 등)를 비롯한 여러 소셜 미디어 데이터를 분석하는 방법에 해당하지 않는 것은?
  6. 46.아래 보기에서 설명하고 있는 학습 방법과 데이터 분석 모형으로 옳은 것은? 보기 앙상블 분석 모형을 만들 때 학습 과정에서는 부트스트랩(Bootstrap Aggr
  7. 47.앙상블 기법 가운데 약한 학습자를 강한 학습자로 바꾸어 주는 기계학습 알고리즘으로, 복원 샘플링으로 여러 샘플을 생성해 순차적으로 학습을 진행하되 잘못 분류된 데
  8. 48.선형회귀분석에서 아래 식과 같이 실젯값과 예측값 간 차이를 최소화함과 동시에, 특징(가중치)에 대한 가중치(w)의 효과를 제어하며 최적의 모형을 탐색하는 방법은
  9. 49.K-겹 교차검증(K-fold Cross-validation)에 관한 설명 중 옳지 않은 것을 고르시오.
  10. 50.데이터 분석모형을 설계할 때 수행하는 업무로 다음 중 가장 적절하지 않은 것은?
  11. 51.데이터 분할 기법에 관한 설명 중 옳지 않은 것은?
  12. 52.훈련 데이터(Training Data)와 평가 데이터(Test Data)에 관한 설명 중 가장 옳지 않은 것은?
  13. 53.다음 분석모형 가운데 군집 수를 미리 정해주지 않아도 분석이 가능한 것은 무엇인가?
  14. 54.모수의 유의성을 검정하는 방법에 관한 설명 중 옳은 것은?
  15. 55.다음 빈칸에 들어갈 용어로 옳은 것은? 보기 딥러닝의 심층 인공신경망 구조에서는 비용함수(또는 손실함수)를 최소화하면서 가중치(Weights)를 조정하기 위해 경
  16. 56.비정형 데이터 분석에 활용되는 언어 모델(Language Model)에 해당하지 않는 것은 다음 중 무엇인가?
  17. 57.다음 중 자연어 처리에 사용되는 Transformer 구조의 구성 요소에 해당하지 않는 것은?
  18. 58.다음 빈칸에 들어갈 용어로 적절한 것은? 보기 seq2seq(sequence-to-sequence) 모델은 하나의 시퀀스를 또 다른 시퀀스로 바꾸는 작업을 수행하
  19. 59.다음 문제 상황 가운데 분류분석 모형의 적용이 가장 적절한 것은 무엇인가?
  20. 60.다음의 거래 데이터에서 연관규칙 '{사과} ⇒ {달걀, 오이}'의 향상도(Lift) 값을 계산하면 얼마인가? 보기 거래1 {사과, 달걀} 거래2

빅데이터 결과 해석

  1. 61.표본을 활용해 신뢰구간을 구하는 방법에 관한 설명으로 옳은 것은 무엇인가?
  2. 62.K-평균 군집분석(K-means Clustering) 모형을 설계할 때 최적의 군집 수(K)를 결정하기 위해 사용하는 방법으로 옳은 것은?
  3. 63.최근 출시된 신차의 성능 지표를 아래와 같이 표현하였다. 여기에 사용된 시각화 기법으로 알맞은 것은? 견고성 가격 디자인 편의성 창의성 0 2 4 6 8 10
  4. 64.분류분석 문제에서 성능 향상과 다양성 확보를 목적으로 앙상블 기법을 활용하고자 한다. 앙상블 기법 적용 방법에 대한 다음 설명 가운데 적절하지 않은 것을 모두 고
  5. 65.의사결정나무(Decision Tree) 모델의 과적합을 막기 위한 목적으로 적용하는 정지규칙(Stopping Rule)에 해당하지 않는 것은?
  6. 66.머신러닝을 활용한 데이터 분석 모형의 성능평가에 관한 설명 중 옳지 않은 것은?
  7. 67.비교 시각화에 관한 설명 중 가장 옳은 것은?
  8. 68.훈련 데이터와 평가 데이터를 활용해 데이터 분석모형을 만들고 정확도를 측정하였다. 과대적합(과적합, Overfitting)이 나타난 사례로 옳은 것은 다음 중 무
  9. 69.하이퍼파라미터(Hyper Parameter)에 관한 설명 중 옳지 않은 것을 고르시오.
  10. 70.다음 중 시간 시각화에 관한 설명으로 적절하지 않은 것은?
  11. 71.아래의 Q-Q(Quantile-Quantile) plot 및 회귀직선에 관한 설명 중 옳은 것을 모두 고르시오. 단, 시각화 분석 결과 Q-Q plot의 우측 위
  12. 72.다음 중 정준상관분석에 관한 설명으로 옳지 않은 것은?
  13. 73.데이터 분석모형에 관한 설명 중 옳지 않은 것은?
  14. 74.K-fold(K-겹) 교차검증에 관한 설명 중 옳지 않은 것을 고르시오.
  15. 75.다음의 혼동행렬(Confusion Matrix)로부터 계산한 성능평가 지표 값 중 옳지 않은 것은? 보기 실제 범주 값(Actual Class) \ 예측 범주 값
  16. 76.다음 중 적합도 검정에 관한 설명으로 옳지 않은 것은?
  17. 77.분석 모형의 성능 평가에 활용되는 F1-score(F-measure)의 계산식으로 올바른 것은? (단, precision은 정밀도, recall은 민감도(sens
  18. 78.데이터 분석결과를 해석하는 방법에 관한 설명 중 옳지 않은 것은?
  19. 79.다음 중 회귀분석 모형의 성능을 평가하는 지표로 사용하기에 부적절한 것은?
  20. 80.ROC(Receiver Operating Characteristic) 곡선에 관한 설명 중 옳지 않은 것을 고르시오.

← 빅데이터분석기사 필기 다른 회차 보기