陽性預測值
在所有「顯著」的結果裡,真的有效果的佔幾成。它取決於這個領域有多少假說本來就是對的。
又稱:positive predictive value、PPV、事後機率
本頁目次
它在說什麼
陽性預測值問的是讀者真正想知道的那件事:在所有被宣告「顯著」的結果裡,真的有效果的佔幾成?
它不是 p 值,也不是 。它取決於三個量:這個領域裡有多少假說本來就是對的(先驗機率)、檢定力有多高、門檻訂在哪。
一個具體例子
假設一個領域裡有 10% 的假說是對的,檢定力 0.5,門檻 0.05。跑 1,000 個研究:
- 100 個是真的:抓到 個顯著。
- 900 個是假的:誤報 個顯著。
顯著的一共 95 個,其中真的只有 50 個。陽性預測值 53%——擲銅板等級。 每一個檢定都做得正確無誤,沒有人犯規,結論卻有將近一半是假的。
把檢定力調到 0.2(這在Cohen 1962 算出的檢定力水準下並不誇張),真陽性只剩 20 個,陽性預測值掉到 31%。
它為什麼重要
Ioannidis 在 2005 年就是這樣算出「多數已發表的研究發現是假的」。他沒有指控任何人造假:這只是把上面那個數人頭的算術,套到整個科學文獻上。要提高陽性預測值,能動的手把只有三個——提高檢定力、挑更可能為真的假說、把門檻訂嚴一點(代價是漏抓更多)。