# 가설검정 시 연구자가 설정하는, 귀무가설을 기각하게 되는 확률의 기준값은 무엇인가?

> source: MyMerci (mymerci.kr)  
> url: https://mymerci.kr/pages/nclex_q.php?qn_id=290991  
> language: ko  
> subject: 추론통계

## 문제

가설검정 시 연구자가 설정하는, 귀무가설을 기각하게 되는 확률의 기준값은 무엇인가?

## 보기

1. 효과크기
2. 자유도
3. 검정력
4. 신뢰구간
5. 유의수준 **✔ 정답**

**정답: 5**

## 해설

유의수준(α)은 귀무가설이 참일 때 이를 기각할 최대 허용 확률을 의미하며, 일반적으로 0.05 또는 0.01로 설정한다.

## 심화 해설

보건행정 핵심 해설
이 문제는 보건통계학 및 연구 방법론의 기초인 가설검정(Hypothesis testing)의 핵심 개념을 묻고 있어요. 특히, 연구 설계 단계에서 연구자가 직접 설정하는 기준값에 대한 이해가 필요합니다.

**핵심 개념 분석 (Key Concept)**
가설검정은 통계적 추론의 핵심 과정으로, 표본 데이터를 바탕으로 모집단에 대한 가설(주로 귀무가설(Null hypothesis, H₀)과 대립가설(Alternative hypothesis, H₁))의 진위를 판단하는 방법이에요. 이 과정에서 핵심! 유의수준(Significance level, α)은 연구자가 '얼마나 강한 증거가 있어야 귀무가설을 기각할 것인가'를 미리 정하는 기준값 역할을 합니다.

**정답 근거 (Answer Rationale)**
정답은 ⑤ '유의수준'입니다. 그 이유는 문제 문장 그대로, 유의수준이 "연구자가 설정하는, 귀무가설을 기각하게 되는 확률의 기준값"을 의미하기 때문이에요. 구체적으로, 유의수준 α는 0.05 또는 0.01로 흔히 설정되며, 이는 "귀무가설이 사실일 때, 그것을 잘못 기각할(제1종 오류를 범할) 최대 허용 확률"을 정의합니다. p-값(P-value)이 이 유의수준 α보다 작을 때, 우리는 귀무가설을 기각하는 통계적 결론을 내리게 됩니다.

**오답 분석 (Distractor Analysis)**
혼동 주의! 다른 선택지들은 모두 가설검정과 관련된 중요 개념이지만, 문제에서 묻는 '연구자가 설정하는 기준값'이라는 정의에는 부합하지 않아요.

① **효과크기(Effect size)**: 두 집단 간 차이의 크기나 관계의 강도를 나타내는 지표로, Cohen's d, odds ratio 등이 있습니다. 연구의 실질적 중요성을 평가할 때 사용되지만, 연구자가 '설정'하는 기준값이라기보다는 데이터에서 '계산'되는 결과값이에요.

② **자유도(Degrees of freedom, df)**: 표본 데이터에서 독립적으로 변할 수 있는 정보의 수를 의미합니다. 통계량(예: t-통계량)의 분포를 결정하는 매개변수이며, 표본 크기에 의해 결정되므로 연구자가 임의로 설정하는 값이 아닙니다.

③ **검정력(Power, 1-β)**: 귀무가설이 거짓일 때(즉, 대립가설이 참일 때) 이를 올바르게 기각할 확률입니다. 연구 설계 시 목표로 삼는 값(예: 0.8)이지만, 문제에서 묻는 '귀무가설을 기각하게 되는 확률의 기준값'은 귀무가설이 '참'일 때의 상황을 정의하는 유의수준(α)이에요.

④ **신뢰구간(Confidence Interval, CI)**: 모수(예: 평균, 비율)가 있을 것으로 예상되는 값의 범위를 제공합니다. 신뢰수준(예: 95%)은 연구자가 설정하지만, '귀무가설 기각 기준값'이라는 특정한 역할은 하지 않아요. (신뢰구간이 귀무가설값을 포함하는지 여부로 가설검정을 수행할 수는 있습니다.)

**연관 개념 정리 (Related Concepts)**
가설검정은 제1종 오류(Type I error, α)와 제2종 오류(Type II error, β)의 트레이드오프 관계 위에 성립해요. α(유의수준)를 낮추면 제1종 오류는 줄지만 검정력(1-β)이 낮아져 제2종 오류가 증가합니다. 반대로 검정력을 높이려면 표본 크기를 늘리는 것이 일반적인 해결책이에요.

개념 정리

| 용어 | 정의 | 역할 | 일반값 |
| --- | --- | --- | --- |
| 유의수준 (α) | 귀무가설(H₀)이 참일 때 이를 기각할 최대 허용 확률 (제1종 오류 확률) | 통계적 유의성 판단의 기준값 | 0.05, 0.01 |
| p-값 (P-value) | 귀무가설이 참이라는 가정 하에, 현재 표본 결과보다 더 극단적인 결과가 관찰될 확률 | 데이터로부터 계산된 증거의 강도 | 계산값 |
| 검정력 (1-β) | 대립가설(H₁)이 참일 때 이를 올바르게 기각할 확률 | 연구의 감도 또는 효율성 지표 | 목표 0.8 이상 |

한눈에 비교!

| 구분 | 제1종 오류 (Type I Error) | 제2종 오류 (Type II Error) |
| --- | --- | --- |
| 의미 | 귀무가설이 참인데 기각함 (False Positive) | 귀무가설이 거짓인데 기각하지 못함 (False Negative) |
| 확률 | 유의수준 α | β |
| 통제 방법 | α 값을 낮게 설정 (예: 0.01) | 표본 크기 증가, 효과크기 증가 |
| 보건의료 예시 | 실제로는 효과 없는 신약을 '효과 있다'고 잘못 결론 | 실제로 효과 있는 신약을 '효과 없다'고 잘못 결론 |

실무 포인트
보건행정 또는 의료연구 현장에서 논문을 읽거나 정책 효과를 평가할 때, 보고된 p-값이 0.05보다 작다고 해서 무조건 '의미 있다'고 받아들이면 안 돼요! 핵심! p-값은 유의수준 α와 비교하기 위한 도구일 뿐, 효과의 '실질적 중요성(Effect size)'이나 연구의 '검정력(Power)'을 반영하지는 않습니다. 예를 들어, 매우 큰 표본에서는 사소한 차이도 통계적으로 유의해질 수 있으므로, 항상 효과크기와 신뢰구간을 함께 확인하는 습관이 필요해요.

암기 팁
"**알파(α)는 기준, 베타(β)는 실력**"이라고 외우세요!
- α(유의수준): 연구자가 정하는 기준선 (예: 합격 커트라인 60점)
- β: 검정력(1-β)과 연결되어 연구의 실력(감도)을 나타냄 (검정력 높을수록 실력 좋음)
- p-값: 학생이 받은 실제 점수 (p-값 < α 면 합격=귀무가설 기각)

국시 빈출 포인트
보건의료정보관리사/병원행정사 시험에서는 통계 기본 개념이 자주 출제됩니다. 특히 핵심! '유의수준(α)', '제1종/제2종 오류', '검정력'의 정의와 상호관계를 묻는 문제가 많아요. '어떤 오류를 줄이기 위해 유의수준을 낮춰야 하는가?' 같은 적용 문제도 연습해두세요.

기출 변형 주의!
동일한 개념을 다음과 같이 변형하여 출제할 수 있어요:
1.  **사례형**: "어떤 연구에서 유의수준 α=0.05로 설정하고 검정 결과 p=0.03이 나왔다. 통계적 결론은?" → 귀무가설 기각.
2.  **역개념형**: "귀무가설이 거짓일 때 이를 기각하지 못하는 오류는?" → 제2종 오류(β).
3.  **관계형**: "표본 크기를 증가시키면 일반적으로 어떻게 되는가?" → 검정력(1-β) 증가, 제2종 오류(β) 감소.

## 임상 시나리오

보건행정 실무 가이드
**실무 시나리오 (Clinical Scenario)**
"병원 기획팀에서 신규 도입한 수술 후 감염 관리 프로토콜의 효과를 평가하는 연구를 진행 중입니다. 기존 방법 대비 감염률이 통계적으로 유의하게 감소했다(p=0.04)는 결과가 나왔지만, 의료진들은 '감염률이 2%에서 1.8%로 줄었는데 이게 정말 의미 있는 개선인가?'라고 의문을 제기합니다. 보건행정 담당자로서 어떻게 이 결과를 해석하고 보고서에 반영해야 할까요?"

**행정 중재 전략 (Admin Intervention)**
1.  **상황 파악**: p=0.04 (< α=0.05)이므로, 통계적 유의성은 인정됩니다. 하지만 의료진의 질문은 '실질적 중요성'에 대한 것임을 인지합니다.
2.  **법적/규정 검토**: 통계 보고 가이드라인(예: CONSORT, STROBE)은 p-값 뿐만 아니라 효과크기와 신뢰구간의 보고를 권장합니다.
3.  **대응 및 처리**:
*   핵심! 절대적 위험 감소율(Absolute Risk Reduction, ARR)을 계산합니다: 2% - 1.8% = 0.2%.
*   상대적 위험 감소율(Relative Risk Reduction, RRR)이나 필요 치료 환자 수(Number Needed to Treat, NNT)를 함께 제시합니다. (NNT = 1/ARR = 1/0.002 = 500명 → 500명을 치료해야 1명의 감염을 예방).
*   감염률 차이에 대한 95% 신뢰구간(Confidence Interval)을 제시하여, 효과 추정의 불확실성을 보여줍니다.
4.  **사후 기록/보고**: 최종 보고서에는 "새 프로토콜은 통계적으로 유의한 감염률 감소를 보였으나(p=0.04), 그 효과크기는 작아(ARR=0.2%, NNT=500) 비용-효과 분석을 통해 운영 지속 여부를 결정해야 함"과 같이 균형 잡힌 결론을 기재합니다.

**법적 안전 및 주의사항 (Precautions)**
연구 결과를 과장하거나 p-값만을 근거로 중요한 정책/예산 결정을 내리면 안 됩니다. 이는 연구 윤리 위반 및 잘못된 자원 배분으로 이어질 수 있어요. 특히, 혼동 주의! '통계적 유의성(Statistical significance)'과 '임상적/실무적 유의성(Clinical/Practical significance)'은 완전히 다른 개념임을 항상 명심하세요.

업무 프로토콜

| 단계 | 행동 | 확인 사항 | 산출물/도구 |
| --- | --- | --- | --- |
| 1. 연구 설계 | 유의수준(α), 검정력(1-β), 효과크기(ES) 기반 표본수 산정 | 제1종/제2종 오류 리스크 관리 | 표본수 계산기(G*Power 등) |
| 2. 데이터 분석 | 적절한 검정법 선택 후 p-값, 효과크기, 신뢰구간 계산 | 데이터 가정(정규성 등) 충족 여부 | 통계 소프트웨어(SPSS, R) |
| 3. 결과 해석 | p-값과 α 비교, 효과크기의 실질적 의미 평가 | 통계적 유의성 vs. 실무적 유의성 구분 | 효과크기 표(Cohen's 기준 등) |
| 4. 보고서 작성 | p-값, 효과크기, 신뢰구간을 모두 명시한 투명한 보고 | 보고 가이드라인 준수 | CONSORT/STROBE 체크리스트 |

선배의 한마디
"보건행정에서 통계는 단순한 숫자 놀이가 아니에요. 병원의 질 관리(QI) 데이터를 해석하거나, 새로운 의료서비스의 효과를 입증할 때, 올바른 통계적 사고는 의사결정의 빛나는 나침반이 돼요. '유의수준'이라는 기준을 어떻게 세우느냐에 따라 연구의 결론이 달라질 수 있다는 점을 기억하세요. 복잡해 보이는 통계 개념도 '왜 필요한가'부터 생각하면 훨씬 쉽게 다가올 거예요!"

## 핵심 개념

- **가설검정** — 표본 데이터를 바탕으로 모집단에 대한 가설(귀무가설/대립가설)의 진위를 통계적으로 판단하는 방법.
- **귀무가설 (Null Hypothesis, H₀)** — 검정의 대상이 되는, 효과나 차이가 '없다'는 기본 가설. 통계적 증거에 의해 기각될 수 있는 가설.
- **유의수준 (Significance Level, α)** — 연구자가 미리 정하는, 귀무가설이 참일 때 이를 잘못 기각할(제1종 오류) 최대 허용 확률. 일반적으로 0.05 또는 0.01.
- **p-값 (P-value)** — 귀무가설이 참이라는 가정 하에, 현재 표본 결과보다 더 극단적인 결과가 관찰될 확률. 유의수준(α)과 비교하여 통계적 결론을 내림.
- **검정력 (Power, 1-β)** — 대립가설이 참일 때, 이를 올바르게 기각할 확률. 표본 크기, 효과크기, 유의수준에 영향을 받으며, 연구의 감도를 나타냄.

## 같은 주제 문제

- [통계적 가설검정에서 귀무가설(H0)이 참인데 기각하는 오류는?](https://mymerci.kr/pages/nclex_q.php?qn_id=290960)
- [가설검정 시 사용하는 유의수준(α)의 일반적인 기준값은?](https://mymerci.kr/pages/nclex_q.php?qn_id=290961)
- [새로운 혈압약의 효과를 검증하기 위해 대조군과 비교하는 연구를 수행했다. 검정 결과 p-value가 0.03으로 나왔다. 이 결과의 해석으로 옳은 것은? (유의수…](https://mymerci.kr/pages/nclex_q.php?qn_id=290962)
- [가설검정에서 '검정력(power)'을 올바르게 정의한 것은?](https://mymerci.kr/pages/nclex_q.php?qn_id=290963)
- [단측 검정(one-tailed test)과 양측 검정(two-tailed test)을 구분하는 주요 기준은?](https://mymerci.kr/pages/nclex_q.php?qn_id=290964)
- [두 독립 표본의 평균을 비교하는 t-검정을 수행할 때, 먼저 확인해야 하는 전제 조건은?](https://mymerci.kr/pages/nclex_q.php?qn_id=290965)
- [카이제곱(χ²) 검정이 주로 사용되는 상황은?](https://mymerci.kr/pages/nclex_q.php?qn_id=290966)
- [가설검정에서 '귀무가설'에 대한 설명으로 옳은 것은?](https://mymerci.kr/pages/nclex_q.php?qn_id=290967)

---

More free questions: [기출문제](https://mymerci.kr/)

_학습 참고용입니다. 실제 임상은 최신 지침과 소속 기관 프로토콜을 따르세요._

