이 회차는 실제 기출문제를 그대로 옮긴 것이 아니라, 기출 자료에서 확인한 출제 유형과 함정 패턴을 바탕으로 숫자·상황을 바꿔 새로 구성한 예상 문제입니다. 권장 풀이 시간은 90분이며, ADsP는 전체 60점 이상 합격에 더해 과목별 정답률이 40퍼센트(40%) 미만이면 과락으로 전체 불합격 처리됩니다. 이 회차는 3과목(데이터분석) 중에서도 데이터마이닝(분류, 군집, 연관규칙, 모형평가)의 계산형 문항 비중을 높여 구성했으니, 시간을 재고 풀어본 뒤 과목별 정답률을 반드시 따로 확인하세요.
문항 배분
| 과목 | 문항 수 | 문항 번호 | 과락 기준(정답 수) |
|---|---|---|---|
| 1과목: 데이터 이해 | 10 | 1–10 | 4문항 미만 정답 시 과락 |
| 2과목: 데이터분석 기획 | 10 | 11–20 | 4문항 미만 정답 시 과락 |
| 3과목: 데이터분석 | 30 | 21–50 | 12문항 미만 정답 시 과락 |
3과목은 40퍼센트(40%) 기준으로 계산하면 30문항 중 12문항입니다. 각 과목의 정답 수가 이 기준에 못 미치면 총점이 60점을 넘어도 불합격입니다.
마무리 복습
문제 14지선다
커피 원두 재고 관리와 관련된 다음 자료를 DIKW 위계에 맞게 연결한 것은?
문제 24지선다
정성적 데이터와 정량적 데이터에 대한 설명으로 옳지 않은 것은?
문제 34지선다
데이터베이스의 특징에 대한 설명으로 옳지 않은 것은?
문제 44지선다
OLTP와 OLAP에 대한 설명으로 옳은 것을 모두 고르면?
문제 54지선다
동영상 스트리밍 서비스가 매일 수십 테라바이트의 시청 로그, 실시간으로 발생하는 재생·정지 이벤트, 자막 텍스트와 썸네일 이미지와 시청 기록이 혼재된 데이터를 다룬다. 이 중 속도(Velocity)에 해당하는 것은?
문제 64지선다
빅데이터의 위기 요인과 그 통제 방안을 연결한 다음 설명 중 옳은 것을 모두 고르면?
문제 74지선다
데이터 관련 직군의 역할에 대한 설명으로 옳지 않은 것은?
문제 84지선다
다음 중 분석 기법 연결로 옳지 않은 것은?
문제 94지선다
빅데이터 시대에는 데이터 간의 (가) 관계보다 (나) 관계를 파악해 의사결정에 활용하는 경향이 강해졌다. 괄호에 들어갈 말로 옳은 것은?
문제 104지선다
ETL과 데이터 웨어하우스에 대한 설명으로 옳은 것을 모두 고르면?
문제 114지선다
콜센터가 상담 대기시간을 줄이고 싶다는 목표는 명확하지만, 어떤 분석 기법으로 접근해야 할지 방법을 모른다. 이 경우에 해당하는 분석 주제 유형은?
문제 124지선다
CRISP-DM의 데이터 이해(Data Understanding) 단계에서 수행하는 활동으로 가장 적절한 것은?
문제 134지선다
상향식 접근법과 하향식 접근법에 대한 설명으로 옳지 않은 것은?
문제 144지선다
분석 과제 정의서에 포함되는 항목으로 옳은 것을 모두 고르면?
문제 154지선다
난이도를 우선 기준으로 삼을 때, 아래 세 과제 중 가장 먼저 수행할 과제는? 과제A(난이도 낮음, 시급성 낮음), 과제B(난이도 낮음, 시급성 높음), 과제C(난이도 높음, 시급성 높음)
문제 164지선다
분석 준비도 평가 영역으로 옳은 것을 모두 고르면?
문제 174지선다
준비도(데이터, 인력, 기법 등)는 높지만 실제 분석 활용 수준(성숙도)은 아직 낮은 조직에 해당하는 분석 성숙도 사분면은?
문제 184지선다
데이터 거버넌스 체계 요소에 대한 설명으로 옳지 않은 것은?
문제 194지선다
집중형 조직 구조의 특징으로 옳지 않은 것은?
문제 204지선다
분석 마스터플랜 수립 시 우선순위 결정을 위한 고려 요소로 옳은 것을 모두 고르면?
문제 214지선다
어느 편의점의 하루 800건 거래 중 우산 구매 거래가 120건, 장화 구매 거래가 150건, 우산과 장화를 함께 구매한 거래가 60건이었다. (참고: 문항 22~25에서는 전체 거래를 500건으로 다시 설정한다) 우산과 장화를 함께 구매한 거래 60건, 전체 거래 500건, 우산 구매 120건, 장화 구매 150건일 때, 연관규칙 우산에서 장화로의 지지도(Support)는?
문제 224지선다
위 21번과 같은 거래 자료에서 연관규칙 우산에서 장화로의 신뢰도(Confidence)는?
문제 234지선다
위와 같은 거래 자료에서 연관규칙 장화에서 우산으로의 신뢰도(Confidence)는?
문제 244지선다
위와 같은 거래 자료에서 연관규칙 우산에서 장화로의 향상도(Lift)는? (우산을 구매한 거래 중 장화도 함께 구매한 비율은 0.5, 장화 구매 거래의 전체 비율은 0.3이다)
문제 254지선다
향상도(Lift)에 대한 설명으로 옳은 것을 모두 고르면?
문제 264지선다
어느 카페의 전체 거래 800건 중 커피 구매 400건, 베이글 구매 200건, 커피와 베이글을 함께 구매한 거래가 100건이었다. 연관규칙 커피에서 베이글로의 지지도(Support)는?
문제 274지선다
위 26번과 같은 거래 자료에서 연관규칙 베이글에서 커피로의 신뢰도(Confidence)는?
문제 284지선다
위와 같은 거래 자료에서 연관규칙 커피에서 베이글로의 향상도(Lift)는? (커피에서 베이글로의 신뢰도는 0.25, 베이글의 전체 구매 비율은 0.25이다)
문제 294지선다
어느 의사결정나무 노드에 20개의 샘플이 있고, 이 중 클래스 A가 12개, 클래스 B가 8개이다. 이 노드의 지니 지수(Gini Index)는?
문제 304지선다
위 29번과 같은 노드(클래스 A 12개, 클래스 B 8개, 전체 20개)의 엔트로피(Entropy)는? (로그는 밑이 2인 로그를 사용하며, 0.6의 로그2는 약 -0.737, 0.4의 로그2는 약 -1.322이다)
문제 314지선다
위 29~30번의 부모 노드(A 12개, B 8개, 전체 20개)를 어떤 기준으로 분할했더니 왼쪽 자식 노드에 14개(A 10개, B 4개)가, 오른쪽 자식 노드에 6개(A 2개, B 4개)가 배정되었다. 왼쪽 자식 노드의 지니 지수는?
문제 324지선다
위 31번의 오른쪽 자식 노드(A 2개, B 4개, 전체 6개)의 지니 지수는?
문제 334지선다
위 31~32번의 분할 결과(왼쪽 14개, 지니 지수 0.41 / 오른쪽 6개, 지니 지수 0.44)에서 분할 후 가중평균 지니 지수는?
문제 344지선다
위 문제들의 부모 노드 지니 지수(0.48)와 분할 후 가중평균 지니 지수(0.42)를 이용할 때, 이 분할의 지니 지수 기준 정보 이득(Information Gain)은?
문제 354지선다
지니 지수와 엔트로피에 대한 설명으로 옳지 않은 것은?
문제 364지선다
어느 노드에 10개의 샘플(A 7개, B 3개)이 있다. 이를 분할해 왼쪽 자식(A 6개, B 0개)과 오른쪽 자식(A 1개, B 3개)으로 나눴다. 분할 전 엔트로피는 약 0.881, 왼쪽 자식의 엔트로피는 0(완전히 순수), 오른쪽 자식의 엔트로피는 약 0.811이라고 할 때, 이 분할의 엔트로피 기준 정보 이득은?
문제 374지선다
어느 스팸메일 필터의 혼동행렬이 다음과 같다. 실제 스팸(양성) 100건 중 90건을 스팸으로, 10건을 정상으로 예측했다. 실제 정상(음성) 200건 중 20건을 스팸으로, 180건을 정상으로 예측했다. 전체 300건에 대한 정확도(Accuracy)는?
문제 384지선다
위 37번과 같은 혼동행렬(참양성 90, 거짓음성 10, 거짓양성 20, 참음성 180)에서 정밀도(Precision)는?
문제 394지선다
위와 같은 혼동행렬(참양성 90, 거짓음성 10, 거짓양성 20, 참음성 180)에서 재현율(Recall)은?
문제 404지선다
위와 같은 혼동행렬(참양성 90, 거짓음성 10, 거짓양성 20, 참음성 180)에서 특이도(Specificity)는?
문제 414지선다
위와 같은 혼동행렬(정밀도 약 0.818, 재현율 0.9)에서 F1-score는?
문제 424지선다
정확도, 정밀도, 재현율, F1-score에 대한 설명으로 옳은 것을 모두 고르면?
문제 434지선다
어느 의료 진단 모델의 혼동행렬이 다음과 같다. 실제 양성 50건 중 40건을 양성으로, 10건을 음성으로 예측했다. 실제 음성 150건 중 15건을 양성으로, 135건을 음성으로 예측했다. 이때 정밀도와 재현율을 각각 올바르게 계산한 것은?
문제 444지선다
위 43번과 같은 혼동행렬(정밀도 약 0.727, 재현율 0.8)에서 F1-score는?
문제 454지선다
2차원 평면 위의 두 점 A(2, 3)와 B(6, 7) 사이의 유클리드 거리는?
문제 464지선다
위 45번과 같은 두 점 A(2, 3)와 B(6, 7) 사이의 맨해튼 거리는?
문제 474지선다
3차원 공간의 두 점 C(1, 2, 2)와 D(4, 6, 2) 사이의 유클리드 거리는?
문제 484지선다
유클리드 거리와 맨해튼 거리에 대한 설명으로 옳은 것을 모두 고르면?
문제 494지선다
Apriori 알고리즘에 대한 설명으로 옳지 않은 것은?
문제 504지선다
군집 수 결정과 군집화 품질 평가에 대한 설명으로 옳은 것을 모두 고르면?
채점 후 복습 동선
아래 표는 틀린 문항의 번호대와 관련 개념, 그리고 돌아가서 복습할 편 번호를 정리한 것입니다. 합격 기준은 총점 60점 이상이면서 동시에 세 과목 모두 정답률 40퍼센트(40%) 이상이어야 합니다. 어느 한 과목이라도 40퍼센트 미만이면 총점과 무관하게 불합격이니, 과목별 정답 수를 먼저 확인하세요.
| 틀린 문항 번호 | 다루는 개념 | 복습할 편 |
|---|---|---|
| 1–2, 9 | DIKW 위계, 정성·정량 데이터, 산업 변화 | 02편, 04편 |
| 3, 10 | 데이터베이스 특징과 ETL·데이터 웨어하우스 | 03편 |
| 4–5 | OLTP·OLAP, 빅데이터 3V | 03–04편 |
| 6–8 | 위기 요인, 데이터 직군 역할, 분류·회귀 구분 | 04–05편, 20편 |
| 11 | 분석 주제 유형(4분면) | 06편 |
| 12 | CRISP-DM 단계 | 07편 |
| 13–14 | 상향식·하향식 접근, 과제 정의서 | 08편 |
| 15, 20 | 우선순위·로드맵 | 09편 |
| 16–19 | 분석 준비도·성숙도, 거버넌스, 조직 구조 | 06편, 09편 |
| 21–28 | 연관규칙: 지지도, 신뢰도, 향상도 | 24편 |
| 29–36 | 의사결정나무: 지니 지수, 엔트로피, 정보 이득 | 21편 |
| 37–44 | 혼동행렬 기반 정확도, 정밀도, 재현율, F1-score | 25편 |
| 45–48 | 거리 척도: 유클리드, 맨해튼 | 23편 |
| 49 | Apriori 알고리즘 | 24편 |
| 50 | K-means 절차와 군집 수 결정 | 23편 |
참고 자료
Last updated on