大型語言模型是什麼

大型語言模型裡的參數(parameters)

參數就是模型學到的那些數字——訓練過程在轉動的旋鈕。現代的大型語言模型有數十億個參數,它們合起來編碼了模型所「知道」的一切:文法、事實、寫作風格、程式碼的套路。當有人說某個模型是「七百億參數」,講的就是它身上帶著多少個這種可調整的數字。

每個參數其實只是一個權重,當文字流經網路時,用來放大或縮小某個訊號。訓練會一次又一次地微調每一個參數,好讓模型對下一個詞元的預測更貼近真實文字。知識並不是存在一張你能翻閱的查詢表裡;它是同時抹散在所有參數之中的。參數愈多,通常代表學習的容量愈大,代價則是需要更多記憶體與運算。