化學分析中的統計學
自由度
/ dee-GREEZ uv FREE-dum /
設想你必須挑四個數,使它們加起來等於一個固定的總和。前三個你可以隨意挑,可第四個就被鎖死了——它只能取那個讓總和對得上的值。於是,雖有四個數,真正能自由變化的只有三個。這個「可自由選取之值的個數」,正是自由度背後的想法。
在統計裡,自由度是當你用掉一部分數據去估計某個量之後,數據中剩下的相互獨立的信息條數。計算樣本標準偏差時,你得先有平均值;而算這個平均值用掉了一個自由度——這正是標準偏差要除以 n 減 1、而非除以 n 的原因。
它之所以重要,是因為自由度決定了你從 t 表、F 表或 Q 表裡查哪一個臨界值——弄錯了,檢驗就會給出錯誤的判定。但要坦誠一句:這個名字很抽象、容易記岔;一個可靠的習慣是:數一數測量次數,每用同一批數據估計了一個量,就減去一。
由五次重複滴定算出一個標準偏差。由於平均值正是從這同樣五個值估計而來,這個標準偏差帶有四個自由度——你要查的,是對應四而非五的 t 值。
五個測量減去一個被估計的平均值,餘下四個自由度。
隨著自由度變大,t 分佈會越來越貼近高斯分佈;這就是為什麼基於大量測量的檢驗,表現得幾乎像數據完全服從正態分佈一樣。
又稱
另見