大型語言模型是什麼

大型語言模型的能力與限制概覽(capabilities and limits)

在狀態最好的時候,大型語言模型多才多藝得驚人:它能起草與潤飾文字、在語言之間翻譯、把概念講到任何深淺、寫程式也抓蟲、把長文件摘要、還能腦力激盪。因為它的介面就是日常語言,連外行人也能在幾秒內得到有用的結果——這份「人人都用得上」的特性,正是它擴散得這麼快的一大原因。

但同一台機器也有過不去的極限。它能一臉篤定地說出錯誤的事,這種毛病叫「幻覺(hallucination)」。它的知識停在訓練的那一刻,所以除非給它工具,否則它會錯過近期發生的事。它不擅長精確的算術與冗長的多步推理,對你怎麼措辭很敏感,也無法真正查證自己講的話。而且它還會反映出資料裡的偏見。

比較健康的心智模型,是把它想成一位才華洋溢、反應飛快、博覽群書的助理,但同時也「很有自信卻不可靠」。把它的輸出當成一份「很強、但要查證的草稿」,而不是最終的權威——尤其在事情後果、事實或數字真的要緊的時候。這樣使用,它的長處是真實的,而它的限制也是可以管理的。