도수분포표를 작성할 때, 계급의 경계값을 '10-19', '20-29', '30-39'와 같이 설정한 경우,… | 마이메르시 MyMerci
마이메르시 — 문제와 상세 해설까지 전부 무료 무료로 시작하기
기술통계
문제

도수분포표를 작성할 때, 계급의 경계값을 '10-19', '20-29', '30-39'와 같이 설정한 경우, 측정값이 정수인 자료에서 값 20은 어느 계급에 속하는가?

해설
계급을 '10-19', '20-29'로 표기할 때, 일반적으로 '10-19'는 10 이상 20 미만, '20-29'는 20 이상 30 미만을 의미한다. 따라서 값 20은 '20-29' 계급에 속한다. 명확성을 위해 '10-19.9'와 같이 표기하기도 한다.
같은 주제 다음 문제다음 자료를 이용하여 도수분포표를 작성할 때, 계급의 수를 결정하는 가장 일반적인 방법은?

심화 해설

보건행정 핵심 해설 이 문제는 보건통계학의 기초인 도수분포표 작성 원칙을 묻고 있어요. 특히 핵심! 계급 경계값의 해석과 측정값의 포함 여부에 대한 규칙을 이해하는 것이 중요해요. 보건행정 현장에서는 건강검진 데이터, 의료비 지출 분석, 환자 만족도 조사 등 다양한 데이터를 정리할 때 이 원칙이 적용되거든요. 핵심 개념 분석 (Key Concept) 도수분포표(Histogram)는 연속형 또는 이산형 데이터를 몇 개의 구간(계급)으로 나누고, 각 구간에 속하는 데이터의 개수(도수)를 나타낸 표예요. 계급을 설정할 때 가장 중요한 것은 모든 데이터가 오직 하나의 계급에만 속하도록 경계를 명확히 하는 것이에요. "10-19", "20-29"와 같이 표기하는 것은 실제로는 "10 이상 20 미만", "20 이상 30 미만"을 의미하는 반개구간(半開區間, half-open interval) 표기법이에요. 정답 근거 (Answer Rationale) 정답은 ④번 '20-29' 계급에 속한다'입니다. 그 이유는 통계학의 일반적인 관례와 데이터의 무결성을 보장하기 위한 원칙 때문이에요. 1. 계급 경계의 해석: "10-19"는 실제로 [10, 20) 구간을, "20-29"는 [20, 30) 구간을 의미해요. 여기서 대괄호 [ 는 '이상(포함)', 소괄호 ) 는 '미만(불포함)'을 나타냅니다. 2. 값 20의 위치: 따라서 값 20은 [20, 30) 구간의 시작점, 즉 '20 이상'에 해당하므로 명확하게 "20-29" 계급에 속하게 돼요. 3. 데이터 중복 배제 원칙: 이 규칙을 따르지 않으면 값 20이 "10-19"와 "20-29" 두 계급에 동시에 속할 수 있는 모호성이 생겨, 데이터 집계 시 오류가 발생할 수 있어요. 오답 분석 (Distractor Analysis) 혼동 주의! 각 오답이 왜 틀린지, 어떤 오해에서 비롯되는지 분석해볼게요. * **①번 '10-19' 계급에 속한다**: 이는 계급을 "10-19"를 "10부터 19까지"로 해석하는 폐구간(閉區間) 관점에서의 오해예요. 만약 이렇게 적용한다면, 다음 계급 "20-29"는 "20부터 29까지"가 되어, 값 20은 어느 계급에도 속하지 않는 공백이 생기게 돼요. * **②번 '두 계급의 경계에 있으므로 포함되지 않는다'**: 데이터는 반드시 하나의 계급에 할당되어야 해요. 포함되지 않는다면 데이터가 누락되는 심각한 오류예요. 이는 계급 설정 자체의 실패를 의미해요. * **③번 '자료의 특성에 따라 임의로 결정한다'**: 통계 분석은 객관성과 재현성이 생명이에요. 분석자마다 임의로 결정하면 결과가 달라져 신뢰성을 완전히 잃게 돼요. 명확하고 일관된 규칙이 필수적이에요. * **⑤번 '반올림하여 20-29 계급에 포함시킨다'**: 원 데이터인 값 20은 이미 정수예요. 반올림할 필요가 없으며, 반올림은 주로 소수점이 있는 데이터를 처리할 때나 계급 중간값을 계산할 때 사용되는 개념이에요. 연관 개념 정리 (Related Concepts) * 계급의 수 결정: 스터지스의 법칙(Sturges' rule) 등으로 적절한 계급 수를 정할 수 있어요. (계급 수 ≈ 1 + 3.322 * log10(데이터 수)) * 계급폭(Class Width): 각 계급의 범위 크기예요. 위 예시에서는 계급폭이 10이에요. * 계급한계(Class Limit) vs 계급경계(Class Boundary): * 계급한계: "10-19"처럼 표면에 보이는 값. * 계급경계: 실제 수직선 상의 구분점 (예: 9.5, 19.5, 29.5). 연속형 데이터에서 모호함을 없애기 위해 사용해요. 개념 정리
용어의미본 문제 적용
도수분포표데이터를 계급으로 구분하고 각 계급의 빈도를 나타낸 표건강보험 청구 금액 분포, 병상 가동률 분석 등에 활용
계급 (Class)데이터를 묶은 구간 (예: 20-29)측정값 20이 속할 구간을 찾는 문제
반개구간 표기[a, b) : a 이상 b 미만. 데이터 중복/공백 방지"20-29"는 [20, 30)을 의미함 → 값 20 포함
계급한계표면에 명시된 계급의 최소/최대값명시된 "20"과 "29"
계급경계실제 계급을 구분하는 수직선 상의 점이 문제에선 명시되지 않았지만, 19.5와 29.5가 될 수 있음
한눈에 비교!
구간 표기 방식의미값 20의 소속문제점
폐구간 (10-19, 20-29)10~19까지, 20~29까지어느 계급에도 속하지 않음 (공백)데이터 누락 발생
반개구간 [10,20), [20,30)10이상 20미만, 20이상 30미만[20,30) 계급에 속함명확하고 일관된 규칙
개구간 (10-20), (20-30)10초과 20미만, 20초과 30미만어느 계급에도 속하지 않음 (공백)데이터 누락 발생
실무 포인트 * 병원 데이터 분석 시: 입원일수, 진료비, 검사 수치(예: 혈압, 혈당)를 분석할 때 도수분포표를 작성하게 돼요. 엑셀(Excel)의 히스토그램 기능이나 피벗 테이블(Pivot Table)을 사용할 때, 계급 범위를 설정하는 단계에서 이 원리를 반드시 적용해야 해요. "빈 구간(Bins)"을 설정할 때, "10, 20, 30..."으로 설정하면 엑셀은 자동으로 [10,20), [20,30) 구간을 생성해요. * 보고서 작성 시: 표나 그래프에 "20-29세" 연령대를 표기할 때, 실제로는 "20세 이상 30세 미만"을 의미한다는 점을 각주나 설명란에 명시하는 것이 좋아요. 암기 팁 "왼쪽은 닫고, 오른쪽은 연다" 또는 "시작은 포함, 끝은 제외"라고 기억하세요. "10-19"는 10(시작)은 포함하고, 19(끝)는 포함하지 않는 것이 아니라, 그 다음 경계인 20을 포함하지 않는 거예요. 값 20은 새로운 계급의 '시작'이므로 새 계급에 포함됩니다! 국시 빈출 포인트 보건의료정보관리사/병원행정사 시험에서 통계 파트는 계급 설정 원리, 대표값(평균, 중앙값, 최빈값)의 계산 및 해석, 표준편차의 의미가 단골 출제예요. 이 문제처럼 계급 경계 해석은 사소해 보이지만 데이터 처리의 기본 소양을 평가하는 좋은 소재예요. 기출 변형 주의! * 사례형: "혈압 데이터를 80-89, 90-99, 100-109 (mmHg) 구간으로 나누었을 때, 측정값 90은 어디에 속하는가?" * 역방향 질문: "값 30이 '20-29' 계급에 속하지 않도록 하려면 계급을 어떻게 표기해야 하는가?" (답: "20-30"이 아니라 "20-29"로 표기하고, 반개구간 원칙을 적용하면 됨. 또는 계급경계를 19.5-29.5로 설정)

임상 시나리오

보건행정 실무 가이드 실무 시나리오 (Clinical Scenario) "보건소에서 지역 주민 대상 만성질환 관리 프로그램을 운영하고 있어요. 참여자들의 공복 혈당 데이터를 수집해 '정상(100 미만)', '주의(100-125)', '당뇨병 의심(126 이상)' 구간으로 분류한 도수분포표를 만들어 홍보 자료에 사용하려고 해요. 그런데 데이터 중 정확히 100 mg/dL과 125 mg/dL인 측정값이 여러 건 있습니다. 이 값들을 어느 구간에 넣어야 할지 팀원들 사이에서 의견이 분분합니다." 행정 중재 전략 (Admin Intervention) 1. 상황 파악: 구간 설정의 모호성으로 인한 데이터 분류 불일치 문제가 발생했어요. 2. 법적/규정 검토: 통계학의 표준 원칙인 반개구간 적용을 기준으로 삼아요. 또한, 당뇨병 진단 기준과 같은 의학적 가이드라인이 우선 적용되는지 확인해야 해요 (예: 미국당뇨병학회(ADA) 기준은 공복 혈당 126 mg/dL *이상*을 당뇨병 위험으로 봄). 3. 대응 및 처리: * 원칙 적용: 반개구간 원칙을 적용하면, "100-125" 구간은 [100, 126)을 의미합니다. 따라서 값 100은 '주의' 구간에, 값 125도 '주의' 구간에 속합니다. 값 126은 '당뇨병 의심' 구간에 속합니다. * 명확화: 보고서나 홍보물에는 "주의: 100 mg/dL 이상 ~ 126 mg/dL 미만"과 같이 괄호 안에 정확한 범위를 명시하여 오해를 방지하는 것이 좋아요. 4. 사후 기록/보고: 데이터 분류 기준을 표준작업지침서(SOP)에 명문화하여 향후 유사한 업무에서 동일한 기준이 적용되도록 해요. 법적 안전 및 주의사항 (Precautions) * 데이터 왜곡 주의: 기준을 임의로 변경하면 (예: 125를 '당뇨병 의심' 구간에 넣음) 프로그램 성과 평가가 왜곡되거나, 주민들에게 잘못된 건강 정보를 제공할 수 있어요. * 투명성: 공공기관에서 생산하는 통계 자료는 분류 기준을 공개해야 신뢰성을 가져요. 업무 프로토콜 도수분포표 작성 시 계급 설정 프로토콜 1. 데이터 확인: 데이터의 최소값, 최대값, 유형(연속형/이산형) 확인. 2. 계급 수/계급폭 결정: 스터지스 법칙 등 참고. 보건 지표는 의학적/행정적 기준(예: 연령대, 혈압 단계)을 우선 적용. 3. 계급 경계 명시: 반개구간 원칙([a, b))을 기본으로 설정. 보고서에는 필요시 "a 이상 b 미만"으로 해석했음을 명시. 4. 도수 집계: 각 데이터를 설정된 규칙에 따라 엑셀 함수(COUNTIFS 등)나 통계 소프트웨어로 집계. 5. 검토: 모든 데이터가 계급에 할당되었는지, 공백이나 중복이 없는지 최종 확인. 선배의 한마디 "통계는 숫자 놀음이 아니라, 의사결정의 근거를 만들어주는 도구예요. 계급 하나 설정하는 작은 규칙이 전체 데이터 해석을 뒤바꿀 수 있다는 점을 명심하세요. 보건행정가로서 정책을 제안하거나 병원 경영 지표를 분석할 때, '이 숫자는 어떻게 만들어졌나?'를 항상 질문하는 습관이 전문성을 보여줍니다. 기본적인 도수분포표 작성 원칙은 그 출발점이에요!"
보건통계학 455 문제 · 로그인 없이 바로 볼 수 있어요

마이메르시로 국가고시 완벽 대비

기출문제와 상세 해설을 무료로. 내 약점을 분석하고 진도를 관리하며 더 똑똑하게 공부하세요.

무료로 시작하기

학습 참고용입니다. 실제 임상은 최신 지침과 소속 기관 프로토콜을 따르세요.