빅데이터분석기사 필기 제10회 기출문제

80문항 · 회원가입 없이 무료 · 문제를 누르면 정답을 바로 확인할 수 있어요.

시험 모드로 풀기해설 모드로 풀기

빅데이터 분석 기획

  1. 1.다음 보기 중에서 다른 정보와 결합할 경우 본래의 개인을 다시 식별해 낼 수 있는 정보에 해당하는 것은?
  2. 2.어떤 확률변수 X로부터 표본 데이터 (100, 200, 300)을 추출하였다. 이 데이터의 Z-score를 y=ax+b 형태의 그래프로 나타낼 때, a+b의 값을
  3. 3.빅데이터 시대에 나타나는 역기능 가운데 책임원칙 훼손의 사례로 볼 수 있는 것은 다음 중 무엇인가?
  4. 4.다음 중 데이터 유형에 관한 설명으로 옳지 않은 것은?
  5. 5.데이터 비식별화 기법 가운데 총계처리(Aggregation) 기법에 관한 설명 중 옳지 않은 것을 고르시오.
  6. 6.빅데이터 분석을 수행하기 위한 조직 구성 유형 가운데 집중형 구조에 관한 설명 중 옳지 않은 것은?
  7. 7.딥러닝 분야에서 널리 활용되는 학습 기법으로, 사전에 학습을 마친 모델이 갖고 있는 지식을 유사한 다른 문제 해결에 활용하는 방식을 가리키는 용어는?
  8. 8.데이터 분석 도구에 관한 다음 설명 중 가장 적절하지 않은 것은?
  9. 9.빅데이터 산업을 인프라 영역과 서비스 영역으로 구분할 때, 다음 중 서비스 영역에 속하는 것은?
  10. 10.빅데이터 분석 기획(Planning) 단계에서 업무를 진행하는 절차로 가장 적절한 것은 다음 중 무엇인가?
  11. 11.빅데이터 분석 환경에서 서버·스토리지·네트워크와 같은 자원의 배치, 분산 파일 시스템, 가상화 및 컨테이너 모듈(컴포넌트)로 이루어진 구성 요소는 다음 중 무엇인
  12. 12.데이터 품질관리를 구성하는 네 가지 핵심 요소에 관한 설명 중 가장 적절하지 않은 것은?
  13. 13.개인정보보호를 위해 지켜야 할 주요 가이드라인 업무에 해당하지 않는 것은 다음 중 무엇인가?
  14. 14.빅데이터 분석 기획 과정에서 WBS(Work Breakdown Structure)를 설계하는 작업은 다음 중 어떤 단계에 해당하는가?
  15. 15.사용자 요구사항을 파악하거나 창의적인 아이디어를 도출하기 위해 활용되는 아래 기법들에 관한 설명 중 가장 적절한 것은?
  16. 16.개인정보 보호법에 따른 개인정보 처리 방식에 관한 설명 중 옳지 않은 것은?
  17. 17.다음 중 인공지능에 관한 설명으로 적절하지 않은 것은?
  18. 18.데이터의 구조 및 성격 측면에서 살펴본 데이터웨어하우스(Data Warehouse)의 대표적인 특징에 해당하지 않는 것은 다음 중 무엇인가?
  19. 19.다음 보기 중에서 데이터 사이언티스트가 수행하는 주요 업무에 해당하지 않는 것은?
  20. 20.데이터 수집 기술과 그에 해당하는 데이터 유형을 짝지은 것 중 가장 적절하지 않은 것은?

빅데이터 탐색

  1. 21.Lasso 기법이 Ridge 기법과 비교했을 때 탐색할 수 있는 해가 희소(Sparse)하게 나타나는 주요한 이유로 옳은 것은 다음 중 무엇인가?
  2. 22.다음 중 상관계수에 관한 설명으로 적절하지 않은 것은?
  3. 23.데이터 정제(Data Cleaning)에 관한 설명 중 가장 적절한 것은 무엇인가?
  4. 24.수집한 데이터에 불균형(Imbalanced Data) 문제가 발생했을 때 적용하는 샘플링 기법에 관한 설명 중 가장 옳지 않은 것은?
  5. 25.어떤 시행에서 성공할 확률이 p인 베르누이 시행을 서로 독립적으로 n회 수행하고, 이때의 성공 횟수를 확률변수 X라 하면 X는 이항분포를 따른다. 이항분포에 관한
  6. 26.변수 선택(Variable Selection) 기법에 관한 설명 중 가장 적절하지 않은 것은?
  7. 27.확률변수 X가 P(X=1)=p, P(X=-1)=1-p를 따른다고 하자. 이 분포에서 샘플 2개 (x₁, x₂)를 무작위로 추출한 뒤 평균 y=(x₁+x₂)/2를
  8. 28.주성분 분석(PCA, Principal Component Analysis)에 관한 다음 설명 중 옳지 않은 것은 무엇인가?
  9. 29.다음 중 상자 그림에 관한 설명 가운데 옳지 않은 것은? (단, Q1은 1사분위수, Q2는 2사분위수(중앙값), Q3은 3사분위수를 의미한다)
  10. 30.초기하분포(Hypergeometric Distribution)에 관한 다음 설명 가운데 옳지 않은 것은?
  11. 31.확률분포의 왜도(Skewness)가 양수이면 분포의 꼬리는 오른쪽(값이 큰 방향)으로 길게 늘어진다. 이때 평균값, 중앙값, 최빈값 사이의 크기 관계로 옳은 것은
  12. 32.다음 그림은 나이(Chronological Age)에 따라 나타낸 평균 심장박동수(심박수, Pulse Rate)를 보여준다. 다음 설명 가운데 가장 적절하지 않은
  13. 33.표본의 크기가 n≥2인 경우, 아래 설명 가운데 옳지 않은 것을 고르시오.
  14. 34.다음은 직업 전환에 영향을 주는 변수들에 대해 가설검정을 실시하여 얻은 검정통계량과 유의확률 값을 정리한 것이다. 이에 관한 설명으로 가장 적절한 것은? (단,
  15. 35.점추정과 구간추정에 관한 설명 중 옳은 것을 고르시오.
  16. 36.변수에 관한 다음 설명 중 가장 적절하지 않은 것은?
  17. 37.다변량 분산분석(MANOVA)을 활용하기에 가장 알맞은 데이터는 다음 중 무엇인가?
  18. 38.확률변수 X와 Y의 공분산(Cov(X, Y)) 및 독립성에 관한 설명으로 가장 적절하지 않은 것은?
  19. 39.전체 모집단을 여러 개의 집단(군집)으로 구분한 뒤, 그중 일부 집단을 무작위로 뽑아 해당 집단의 구성원 전체(또는 일부)를 조사하는 확률적 표본추출방법은?
  20. 40.대형마트의 고객 데이터를 활용해 고객별 쇼핑금액을 분석하려고 한다. 다음 보기 가운데 파생변수에 해당하는 것은?

빅데이터 모델링

  1. 41.어떤 사건의 성공확률이 p일 때, 이를 log(p/(1-p)) 형태로 자연로그를 취해 변환하였다. 이와 같은 변환을 가리키는 용어는 무엇인가?
  2. 42.시계열 데이터 분석에 활용되는 ARIMA(Autoregressive Integrated Moving Average) 모형의 ARIMA(p, d, q)에 관한 설명
  3. 43.자연어처리 분야에서 활용되는 Attention 메커니즘에 관한 설명이 다음과 같다. 이 중 옳은 것을 모두 고르시오. 보기 (가) RNN에서 나타나는 기울기 소실
  4. 44.빅데이터 분석유형에 관한 설명 중 가장 적절하지 않은 것은 무엇인가?
  5. 45.다음 중 서포트벡터머신(Support Vector Machine) 분석모형에 관한 설명으로 옳은 것은?
  6. 46.아래 보기에서 설명하는 최적화 알고리즘으로 옳은 것은? 보기 경사하강법이 지닌 한계를 보완하기 위해 고안된 기법이다. 업데이트할 때마다 이전 기울기(변화량)의 영
  7. 47.딥러닝의 활성화 함수에 관한 다음 설명 중 가장 옳지 않은 것은?
  8. 48.다음 중 의사결정나무 분석 모델에 관한 설명으로 옳지 않은 것은 무엇인가?
  9. 49.다음 중 독립변수들 간 다중공선성 문제가 여전히 해소되지 않았을 때 나타나는 결과로 옳은 것은?
  10. 50.딥러닝에 관한 다음 설명 가운데 가장 적절하지 않은 것은?
  11. 51.앞선 모델이 잘못 예측한 데이터를 다음 모델이 더 잘 맞추도록 순차적으로 학습시키는 방식으로, 각 모델이 이전 모델의 오차를 보완해 나가며 정확도를 점진적으로 높
  12. 52.아래에 제시된 자연어 처리 기법 가운데 차원 축소를 위해 SVD(Singular Value Decomposition)를 활용하는 것은?
  13. 53.다음 덴드로그램을 참고할 때, 종속변수 값 y=5에서 형성되는 군집의 수는 몇 개인가? Q S P R y=2 y=3.5 y=5
  14. 54.의사결정나무 분석에서 가지치기(Pruning)를 수행하는 핵심 목적으로 가장 알맞은 것은?
  15. 55.앙상블 기법 중 배깅과 부스팅의 학습 방식에 관한 설명 가운데 가장 적절한 것은?
  16. 56.셋 이상의 집단들 사이에서 평균에 차이가 있는지를 검정하고자 할 때 이용하는 분석 방법은 무엇인가?
  17. 57.입력 데이터를 압축했다가 다시 복원하는 비지도학습 기반의 인공신경망으로, 차원축소나 노이즈 제거, 이상치 탐지 등에 활용되는 것은 무엇인가?
  18. 58.다음 중 로지스틱 회귀분석 모델에 관한 설명으로 옳지 않은 것을 고르시오.
  19. 59.변수 선택(Feature Selection) 기법에서 유의미한 변수를 골라낼 때 활용하는 통계량으로 보기 가장 어려운 것은 무엇인가?
  20. 60.확률적 경사하강법에 관한 설명 중 가장 적절하지 않은 것은 무엇인가?

빅데이터 결과 해석

  1. 61.데이터 품질이 데이터 분석모형의 성능에 미치는 영향에 관한 설명 중 가장 적절한 것은?
  2. 62.홀드아웃(Hold-out) 교차검증에 관한 설명 중 가장 적절하지 않은 것은?
  3. 63.다음 보기 가운데 과대적합을 방지하는 방법으로 보기 어려운 것은?
  4. 64.학습곡선(Learning Curve)을 통해 알 수 있는 학습 횟수와 데이터 분석 모델 성능 간의 관계에 대한 설명 중 옳은 것은?
  5. 65.F1-score를 산출할 때 근거가 되는 두 가지 핵심 지표로 옳은 것은?
  6. 66.그리드 탐색(Grid Search) 기법을 이용한 하이퍼파라미터 최적화에 관한 설명으로 가장 적절한 것은?
  7. 67.빅데이터 분석 과정에서 데이터 품질과 관련된 설명 중 가장 적절하지 않은 것은?
  8. 68.실젯값 x_i와 예측값 y_i 간의 오차를 측정하는 성능평가 지표 중 옳지 않은 것을 고르시오.
  9. 69.두 변수 혹은 여러 변수 간의 상호 관계를 파악하고자 할 때 활용하는 관계 시각화 도구로 보기 어려운 것은 다음 중 무엇인가?
  10. 70.인포그래픽(Infographics)에 관한 설명 중 옳지 않은 것을 고르시오.
  11. 71.이진분류 모델에서 실제 값이 참인 데이터 가운데 모델이 참으로 올바르게 예측한 비율을 나타내는 지표는 무엇인가?
  12. 72.아래 보기에서 설명하고 있는 시각화 기법으로 가장 적절한 것은? 보기 복잡한 통계 데이터를 직관적으로 파악할 수 있도록 돕는다. 데이터 값에 비례하도록 영역의 크
  13. 73.모델 성능 평가와 교차검증 기법에 관한 설명 중 옳지 않은 것은?
  14. 74.하이퍼파라미터가 10개이고 10-fold 교차검증 기법을 사용할 때, 아래의 각 분석모형과 그 학습 횟수가 바르게 연결된 것은? (단, 로지스틱 회귀분석과 QDA
  15. 75.공간 시각화에 관한 다음 설명 가운데 옳지 않은 것을 고르면?
  16. 76.다음 보기 중 데이터가 정규분포를 따르는지 확인하는 방법으로 가장 거리가 먼 것은?
  17. 77.과대적합과 과소적합에 관한 다음 설명 중 옳지 않은 것은?
  18. 78.LOOCV(Leave-one-out Cross Validation) 교차검증 기법에 관한 설명 중 옳은 것은 무엇인가?
  19. 79.다음 보기 가운데 하이퍼파라미터(초매개변수)에 해당하는 것은?
  20. 80.규제(Regularization)와 과대적합에 관한 설명 중 가장 옳지 않은 것을 고르시오.

← 빅데이터분석기사 필기 다른 회차 보기