보건행정 핵심 해설
이 문제는 보건통계 분석에서 가장 기본적이면서도 중요한 데이터 전처리(Data Preprocessing) 과정 중 하나인
케이스 선택(Case Selection) 기능을 묻고 있어요. SPSS(Statistical Package for the Social Sciences)는 보건행정 연구에서 설문조사 분석, 의료 데이터 통계 처리에 필수적으로 사용되는 소프트웨어입니다.
핵심 개념 분석 (Key Concept): SPSS의
데이터 관리 기능은 크게
케이스(행, 관측치) 관리와
변수(열, 측정 항목) 관리로 나눌 수 있어요. '케이스 선택'은 특정 조건을 만족하는 관측치(예: 특정 연령대 환자, 특정 질환을 가진 환자)만을 선별하여 분석 범위를 제한하는 기능입니다. 이는 전체 데이터를 분석하기 전에 특정 하위 집단(Subgroup)에 초점을 맞추거나, 이상치(Outlier)를 제외하는 등 분석의 정확성과 목적성을 높이는 데 필수적이에요.
정답 근거 (Answer Rationale):
핵심! SPSS 메뉴에서
데이터(Data) → 케이스 선택(Select Cases...) 경로를 통해 이 기능에 접근할 수 있어요. 사용자는 "모든 케이스 선택", "조건 만족하는 케이스 선택", "랜덤 표본" 등 다양한 방식으로 데이터를 필터링할 수 있습니다. 조건을 지정하면 SPSS는 해당 조건을 만족하지 않는 케이스에 슬래시(/) 표시를 하고, 이후의 모든 분석(교차분석, t-검정, 회귀분석 등)은 선택된 케이스에 대해서만 수행하게 됩니다.
오답 분석 (Distractor Analysis):
-
혼동 주의! ②번 '변수 재코딩(Recode)': 이는
변수의 값 자체를 변경하는 기능이에요. 예를 들어, 연령을 '20-29', '30-39'와 같은 범주형 변수로 바꾸거나, '매우 만족=5' 점수를 '만족=1'로 역코딩(Reverse Coding)할 때 사용합니다. 케이스를 선택하는 것이 아니라 변수의 내용을 바꾸는 작업이죠.
- ③번 '가중 케이스(Weight Cases)': 이는 표본 데이터의 각 케이스에
가중치(Weight)를 부여하여, 분석 시 모집단을 더 잘 대표하도록 조정하는 기능입니다. 예를 들어, 성별 비율이 실제 모집단과 다를 때 가중치를 조정해 보정합니다. 케이스를 선별하는 기능이 아닙니다.
- ④번 '변수 계산(Compute Variable)': 이는
기존 변수들을 조합하여 새로운 변수를 생성하는 기능이에요. 예를 들어, '체질량지수(BMI) = 체중(kg) / (키(m))^2'라는 새 변수를 만드는 데 사용합니다. 역시 케이스 선택 기능과는 다릅니다.
- ⑤번 '데이터 정렬(Sort Cases)': 이는 데이터를 특정 변수(예: 환자 ID, 나이)를 기준으로
오름차순 또는 내림차순으로 정렬하는 기능입니다. 데이터를 보기 좋게 정리할 뿐, 특정 케이스를 선별하여 분석에서 제외하거나 포함시키지는 않아요.
연관 개념 정리 (Related Concepts): 데이터 전처리는 통계 분석의 신뢰도를 결정하는 핵심 단계입니다. '케이스 선택' 외에도 결측값(Missing Value) 처리, 이상치 탐지 및 처리, 데이터 변환(정규화 등) 과정이 중요해요. 또한, SPSS에서 '필터 변수(Filter Variable)'를 설정하는 것도 케이스를 선택하는 또 다른 방법입니다.
개념 정리
| 기능(메뉴) | 주요 목적 | 실제 적용 예시 |
| 케이스 선택 (Select Cases) | 특정 조건을 만족하는 관측치만 선별하여 분석 | “65세 이상 노인 환자”만을 대상으로 만성질환 유병률 분석 |
| 변수 재코딩 (Recode) | 기존 변수의 값을 새로운 값 또는 범주로 변경 | 연속형 '연령'을 범주형 '연령대'(청년, 중년, 노년)로 변환 |
| 가중 케이스 (Weight Cases) | 표본의 대표성을 높이기 위해 각 케이스에 가중치 부여 | 층화표본추출(Stratified Sampling) 후 각 층의 가중치 반영 |
| 변수 계산 (Compute) | 기존 변수들을 수식으로 조합해 새로운 변수 생성 | 총점 변수 = (문항1 + 문항2 + ... + 문항10) |
| 데이터 정렬 (Sort) | 특정 변수를 기준으로 데이터 행(케이스)을 정렬 | 환자 ID 순서대로, 또는 진료일자 순서대로 정렬 |
실무 포인트
-
분석 전 필수 체크리스트: 케이스 선택 조건을 적용한 후, 하단 상태 표시줄에 "필터 케이스 적용됨"이 표시되는지 꼭 확인하세요. 조건을 해제하지 않고 다른 분석을 하면 원하지 않는 결과가 나올 수 있어요.
-
조건식 작성 팁: 복잡한 조건(예: "여성이고, 20대이며, 만성질환 유무가 '있음'인 경우")은 논리 연산자 AND(&), OR(|), NOT(~)를 활용해 정확히 작성해야 합니다.
-
데이터 백업: 케이스 선택은 원본 데이터를 삭제하지 않고 일시적으로 필터링하는 것이므로 안전합니다. 하지만 중요한 분석 전에는 항상 원본 데이터 파일을 별도로 저장하는 습관을 들이세요.
암기 팁
-
선택(Select)은 '고르다': '케이스 선택' = '케이스(사람/관측치)를 고른다'로 연상하세요. 나머지 기능들은 변수를 다루거나(재코딩, 계산), 순서를 바꾸거나(정렬), 중요도를 조정(가중)하는 기능입니다.
국시 빈출 포인트
SPSS 기능은
핵심! 보건의료정보관리사 시험의 '보건정보학' 또는 '보건통계학' 영역에서 단순 기능 이름 맞추기 형태로 자주 출제됩니다. 각 기능의
정의와 목적을 명확히 구분하는 것이 중요해요. '케이스 선택'은 '조건부 분석', '하위 집단 분석'과 연결되는 개념으로 함께 출제될 수 있습니다.
기출 변형 주의!
-
사례형