化學分析中的統計學

置信區間

/ KON-fi-dens IN-ter-val /

當天氣軟體說明天最高氣溫「大約 20 度」,你會本能地把它讀成一個區間,而不是承諾:大概在十幾到二十出頭之間。置信區間就是把這種留有餘地說得精確。它不假裝你測得的平均值就是確切的真相,而是給出一個真值極可能落在其中的範圍。

置信區間是圍繞你的樣本平均值建立的一個範圍,寬到足以保證:長遠來看,這類區間中有規定的比例——通常是 95%——會罩住真值。它的寬窄取決於你的測量有多散、做了多少次:方法越吵鬧、重複越少,區間就越寬、越謙虛;數據越緊、重複越多,區間就越窄。

它之所以重要,是因為它把一個孤零零的數變成一句誠實的「我有多大把握」,而這正是監管機構、期刊和客戶真正需要的。最常見的誤讀是說「真值有 95% 的機率落在這個特定區間裡」;更嚴謹地講,是這套做法有 95% 的時候會成功,而任何一個具體區間,要麼含著真值,要麼不含。

對水中鉛的四次測量平均為 11.2 微克每升。算出的 95% 置信區間是 11.2 加減 0.6,於是結果報告為 10.6 到 11.8 微克每升。

把平均值連同真值最可能所處的範圍一起報告。

對同一組數據,99% 區間比 95% 區間更寬:要求更高的把握,就得撒下更大的網。當測量次數很少時,區間用 t 分佈而非高斯分佈來構建。

又稱
CI信赖区间信賴區間置信区间