CHAPTER 04 · TOPIC 01
Z 檢定
Z 檢定(Z test)把樣本統計量與虛無假設所指定的母體參數相比,再用標準誤衡量兩者相差了多少個抽樣波動。完成標準化後,檢定統計量在 H₀ 成立時服從或近似標準常態分配,因此可以利用 Z 分配求臨界值與 p 值。
本頁內容
- 先分清楚:個別觀察值的 Z 分數與平均數的 Z 統計量
- Z 檢定為什麼會成立?
- 使用 Z 檢定的條件
- 單一樣本平均數的假設與裁決
- 兩個獨立樣本平均數的 Z 檢定
- 信賴區間:由同一個 Z 標準化式反推 μ
- 把 H₀ 與 H₁ 的分配放在一起
- 右尾檢定的 α:由 H₀ 決定臨界點
- 右尾檢定的 β:同一臨界點改由 H₁ 觀看
- 樣本數公式:保留 α,也要保留發現差異的能力
- 從公式看樣本數的關係
- 由同一推導得到 power
- 本頁公式的符號說明
Z 檢定(Z test)把樣本統計量與虛無假設所指定的母體參數相比,再用標準誤衡量兩者相差了多少個抽樣波動。完成標準化後,檢定統計量在 H₀ 成立時服從或近似標準常態分配,因此可以利用 Z 分配求臨界值與 p 值。
先分清楚:個別觀察值的 Z 分數與平均數的 Z 統計量
個別觀察值的 Z 分數,是描述某個 X 距離母體平均數 μ 有多少個母體標準差;Z 檢定平均數時,研究對象則是樣本平均數 X̄。因為 X̄ 的標準差是標準誤 σ/√n,所以兩個分母不同。
| 符號 | 代表意義 |
| X | 一個個別觀察值 |
| X̄ | 由 n 個觀察值計算出的樣本平均數;抽樣前應視為隨機變數 |
| μ | 母體平均數 |
| μ₀ | 虛無假設 H₀ 所指定的母體平均數 |
| σ | 已知的母體標準差 |
| n | 樣本數 |
| σ/√n | 樣本平均數的標準誤 |
Z 檢定為什麼會成立?
若母體為常態分配,樣本平均數本身就是常態分配;母體不完全常態時,在適當條件與足夠樣本數下,也可由中央極限定理得到近似常態的抽樣分配。前面抽樣章節得到 E(X̄)=μ 與 Var(X̄)=σ²/n,因此:
在 H₀: μ=μ₀ 成立時,把 X̄ 減去它在 H₀ 下的中心 μ₀,再除以 X̄ 的標準誤,就得到標準常態統計量:
| 符號 | 在這組公式中的意義 |
| μ | 母體平均數或隨機變數的期望值 |
| √ | 平方根;常用來把變異數轉成標準差 |
| ~ | 服從某個機率分配 |
| n | 本段使用的觀察數、樣本數或試驗次數;以公式前的研究設定為準 |
使用 Z 檢定的條件
- 研究的統計量具有常態抽樣分配,或在適當條件下可用常態分配近似。
- 觀察值來自隨機抽樣,且彼此獨立;若是配對或群聚資料,必須改用符合設計的方法。
- 平均數 Z 檢定的母體標準差 σ 已知。若 σ 未知而以樣本標準差 s 估計,原則上使用 t 檢定。
- 大樣本會使 t 分配接近 Z 分配,但『樣本大』本身不會讓未知的 σ 變成已知。
單一樣本平均數的假設與裁決
| 方向 | 顯著水準 α 下的拒絕條件 | p 值 |
| 雙尾 | |Zobs| ≥ z₁₋α⁄₂ | 2P(Z≥|Zobs|) |
| 右尾 | Zobs ≥ z₁₋α | P(Z≥Zobs) |
| 左尾 | Zobs ≤ zα | P(Z≤Zobs) |
兩個獨立樣本平均數的 Z 檢定
兩組獨立樣本比較時,研究的是平均數差 X̄₁−X̄₂。兩組母體變異數已知且樣本彼此獨立時,平均數差的變異數等於兩組變異數相加:
Δ₀ 是 H₀ 所指定的母體平均數差;檢定『兩組沒有差異』時,Δ₀=0。若資料相依或成對,兩個平均數之間的共變異數不能直接忽略,應改以每一對的差值分析。
信賴區間:由同一個 Z 標準化式反推 μ
雙尾 (1−α) 信賴區間不是另一套獨立公式,而是從標準常態中央面積為 1−α 的不等式,把未知的 μ 解出來。
例如 95% 信賴區間使用 z₀.₉₇₅=1.96,因此為 X̄±1.96σ/√n。信賴水準描述的是重複抽樣並以同一程序建構區間時,長期而言包含真實 μ 的區間比例;不是說固定完成的這一個區間有 95% 機率包含固定的 μ。
把 H₀ 與 H₁ 的分配放在一起
α 是 H₀ 為真時,樣本平均數越過臨界點而誤拒絕 H₀ 的面積;β 則是某個特定 H₁(例如 μ=μ₁)為真時,樣本平均數沒有越過同一臨界點的面積。兩者必須分別在 H₀ 與 H₁ 的抽樣分配下計算。
右尾檢定的 α:由 H₀ 決定臨界點
以下以 H₀: μ≤μ₀、H₁: μ>μ₀ 為例。在 H₀ 的邊界 μ=μ₀ 下,選擇臨界樣本平均數 c,使右尾面積等於 α。
右尾檢定的 β:同一臨界點改由 H₁ 觀看
假設真實平均數是 μ₁>μ₀。沒有越過 c 就無法拒絕 H₀,因此 H₁ 分配中 c 左側的面積是 β。
樣本數公式:保留 α,也要保留發現差異的能力
把同一個臨界點 c 分別代入 H₀ 與 H₁ 的標準化式,再相減,c 會消去。這正是原推導中最重要的技巧:兩個分配共用同一條裁決界線。
計算出的 n 若不是整數必須向上取整。這個公式適用於此處設定的單一樣本、單尾、已知 σ 的平均數 Z 檢定;雙尾規劃時,臨界值改為 z₁₋α⁄₂。
補充案例:用真實研究理解樣本數與可偵測差異
髖關節發育不良(developmental dysplasia of the hip, DDH)高風險嬰兒通常會在出生後約 6 週接受髖關節超音波篩檢。早產兒在相同出生後週數時,實際發育成熟度可能比足月兒低,因此 Hockett 等人想確認:中度早產或接近足月出生的嬰兒,是否需要依早產程度調整超音波篩檢時間。
研究將出生未滿 37 週的 premature cohort 與出生滿 37 週的 full-term cohort 比較,所有嬰兒都在未校正年齡 5–8 週接受超音波。主要比較包括 alpha angle、femoral head coverage、異常超音波比例與是否接受 Pavlik harness 治療;其中這個樣本數案例針對的是『兩組平均 alpha angle 相差多少度』。alpha angle 是超音波評估髖臼骨性覆蓋與髖關節成熟程度的量測指標,角度較小通常表示髖關節較不成熟。
研究的 power analysis 使用母體標準差估計值 4.9°、雙尾顯著水準 5% 與 power 80%,分別規劃偵測 premature 與 full-term 兩組平均 alpha angle 相差 3° 或 2° 時所需的樣本數。
| 輸入條件 | 本研究設定 |
| 比較 | Premature vs full-term infants |
| 母體標準差估計值 σ | 4.9° |
| 顯著水準 α | 0.05,雙尾 |
| Power 1−β | 0.80 |
| 標準常態分位數 | z₀.₉₇₅=1.96;z₀.₈₀≈0.842 |
希望偵測 3° 的差異
預期差異 δ=3°,相對於標準差 4.9°,標準化效果量約為 0.61。
論文的 power analysis 報告每組需要 43 hips。以精確的 two-sample t power calculation 計算時,會因使用 t 分配與整數取整而比上述常態近似略多;兩者的結果一致。
希望偵測 2° 的差異
若希望連 2° 的較小差異也能被偵測,效果量降為約 0.41,因此需要更多樣本。
論文的 power analysis 報告每組需要 96 hips,同樣與常態近似結果非常接近。
Reference: Hockett C, Mayfield LM, Gill CS, Kim HKW, Sucato DJ, Podeszwa DA, Jo CH, Morris WZ. Does screening ultrasound timing in developmental dysplasia of the hip need to be adjusted for moderate preterm and near-term infants: a prospective study. J Pediatr Orthop. 2024;44(1):e25–e29. doi:10.1097/BPO.0000000000002540. PubMed: https://pubmed.ncbi.nlm.nih.gov/37773040/
從公式看樣本數的關係
| 條件改變 | 所需 n | 原因 |
| α↓ | n↑ | 要求更少的型一誤差,裁決門檻更嚴格 |
| β↓(power↑) | n↑ | 要求更少漏失真實差異,需要更多資訊 |
| σ↑ | n↑ | 資料更分散,訊號較難從雜訊中辨認 |
| |μ₁−μ₀|↑ | n↓ | 預計辨認的差異越大,越容易被發現 |
由同一推導得到 power
| 條件改變 | power | 直覺 |
| n↑ | power↑ | 標準誤縮小,兩個假設較容易分辨 |
| |μ₁−μ₀|↑ | power↑ | 真實效果離 H₀ 更遠 |
| σ↑ | power↓ | 分配更寬、重疊更多 |
| α↓(其他條件固定) | power↓ | 拒絕門檻變嚴格,β 因而增加 |
本頁公式的符號說明
| 符號 | 代表意義 |
| zq | 標準常態分配的第 q 分位數,滿足 P(Z≤zq)=q |
| α | H₀ 為真時卻拒絕 H₀ 的機率(型一誤差) |
| β | 指定的 H₁ 為真時卻未拒絕 H₀ 的機率(型二誤差) |
| 1−β | 統計檢定力;指定差異存在時成功拒絕 H₀ 的機率 |
| μ₁ | 用來規劃或計算 power 的特定真實平均數 |
| c | 把拒絕區與不拒絕區分開的臨界樣本平均數 |
| Φ(z) | 標準常態分配在 z 左側的累積機率 |
| Δ₀ | 兩樣本檢定中 H₀ 指定的平均數差 |