大型語言模型代理與工具使用
工具使用(tool use)
語言模型本身只能產生文字——它沒辦法真的查今天的天氣、做精確的算術,或寄出一封信。工具使用(tool use)給了它一雙手:一組它被允許呼叫的外部函式,像是「搜尋網路」「執行這個計算」或「查這位客戶」。模型寫出它想用哪個工具、用什麼輸入,程式去執行,真實世界的結果再回到對話裡。
模型自己從不執行工具。你描述每個可用的工具——它的名稱、做什麼、需要什麼輸入——模型學會在判斷某個工具有幫助時,發出一個符合該描述的請求。外層系統執行這個請求,把輸出當成新的脈絡回饋進來,讓模型在下一輪讀到。工具把一個封閉的文字產生器,變成能觀察並影響外在世界的東西。
這正是讓模型準確又即時、而不是憑記憶猜測的關鍵。但每多一個工具,也多一個出錯的面向——輸入錯誤、呼叫失敗,或行動太急——所以工具通常是謹慎地給出,並對它能碰的東西加上驗證與限制。
又稱
另見