大型語言模型是什麼
什麼是大型語言模型(large language model)
大型語言模型是一種電腦程式,它讀過極為龐大的文字——遠超過任何人一生能讀的量——並從中學會了詞與詞之間如何接續的統計規律。當你輸入一段文字,它就依照這些規律把文字接下去。整個把戲的核心就是這樣:它是一個非常厲害的「猜下一個詞」的機器。
「大型」指的是規模。模型內含數十億個可調整的數字,稱為參數,並用數兆個詞訓練而成。當規模大到這種程度,單純的「猜下一個詞」竟開始看起來像推理、翻譯與寫作——這些沒有人直接寫程式教它的能力,是從預測本身浮現出來的。
也別忘了它不是什麼。除非有人特地打造一套機制給它,否則大型語言模型在不同的對話之間並不記得你,它沒有感官、沒有身體,也不保證掌握真相。它產出流暢、聽起來合理的文字,但這跟正確的文字並不是同一回事——而正因為它講得這麼有把握,我們很容易忘了兩者的差別。
又称
另见