術語

檢定力

效果真的存在時,這個研究抓得到它的機率。

又稱:statistical power、power、檢定力分析

本頁目次

它在說什麼

檢定力是:如果效果真的存在(而且大小是某個指定的值),這個研究把它抓出來的機率。它同時取決於三件事——效果多大、樣本多大、門檻多嚴。

檢定力是事前規劃的量,不是事後辯護的話術。研究做完才回頭算「觀察到的檢定力」,只是把 p 值換個寫法。

一個具體例子

:其中 70 篇有主要檢定。要抓一個中等大小的效果,這些研究的平均檢定力是 .48——比丟銅板還差一點。抓小效果只有 .18。

換句話說:即使那些假說全部是對的,也有一半的研究注定做不出顯著結果。這件事 1962 年就算清楚了,六十年後爆發,它才被重新讀懂。

為什麼它要緊

低檢定力不只是「比較容易漏抓」。在一個檢定力普遍偏低的領域裡,能被做出來的顯著結果會系統性地偏向高估效果——因為只有運氣特別好、雜訊剛好幫忙的那些樣本才過得了門檻。這條線直接接到

相鄰術語

  • 第一類與第二類錯誤——兩種錯法:虛無為真卻拒絕它(誤報),虛無為假卻沒拒絕(漏抓)。
  • 效果量——效果有多大,用一把不隨樣本數伸縮的尺量出來。
  • 陽性預測值——在所有「顯著」的結果裡,真的有效果的佔幾成。它取決於這個領域有多少假說本來就是對的。

出現在