化学分析中的统计学

自由度

/ dee-GREEZ uv FREE-dum /

设想你必须挑四个数,使它们加起来等于一个固定的总和。前三个你可以随意挑,可第四个就被锁死了——它只能取那个让总和对得上的值。于是,虽有四个数,真正能自由变化的只有三个。这个「可自由选取之值的个数」,正是自由度背后的想法。

在统计里,自由度是当你用掉一部分数据去估计某个量之后,数据中剩下的相互独立的信息条数。计算样本标准偏差时,你得先有平均值;而算这个平均值用掉了一个自由度——这正是标准偏差要除以 n 减 1、而非除以 n 的原因。

它之所以重要,是因为自由度决定了你从 t 表、F 表或 Q 表里查哪一个临界值——弄错了,检验就会给出错误的判定。但要坦诚一句:这个名字很抽象、容易记岔;一个可靠的习惯是:数一数测量次数,每用同一批数据估计了一个量,就减去一。

由五次重复滴定算出一个标准偏差。由于平均值正是从这同样五个值估计而来,这个标准偏差带有四个自由度——你要查的,是对应四而非五的 t 值。

五个测量减去一个被估计的平均值,余下四个自由度。

随着自由度变大,t 分布会越来越贴近高斯分布;这就是为什么基于大量测量的检验,表现得几乎像数据完全服从正态分布一样。

又称
df自由度数