侷限、幻覺與風險
捏造的引用來源(fabricated citations)
你要模型用來源佐證一項主張,它能產出看起來無懈可擊的東西:一個合理的論文標題、一份逼真的作者名單、一份期刊、一個年份,甚至頁碼範圍和一組 DOI。唯一的問題是,這些通通不存在。模型看過數百萬條真實引用、把它們的格式學得分毫不差,於是它能完美生成格式,而底下的那筆參考文獻卻是純粹的虛構。已有律師因為提交了建立在這種幽靈案例上的書狀而遭懲處。
教訓是:來自大型語言模型的引用,是一種格式上的把戲,而不是證據。「看起來對」正是模型最擅長的事,而一筆假來源恰好落在它最弱的地方——具體、可查證、且任何精確版本都很罕見。在你親自找到那份來源之前,永遠別相信模型報出的出處。如果扎根於事實很重要,就把文件交給模型,並要它只從文件裡引用。
另見