大型語言模型代理與工具使用
程式碼直譯器工具(code interpreter)
語言模型在精確算術和一步步的邏輯上出了名地不穩——它預測的是看起來合理的文字,不是保證正確的數字。程式碼直譯器(code interpreter)工具解決了這點:讓模型寫一小段程式,真的在沙箱裡執行,再把真實的輸出讀回來。模型不必猜 4,817 乘以 263 是多少,而是把這個乘法寫成程式碼,由電腦精確算出,真正的答案再回傳。
就機制而言,它是代理工具箱裡一個強大的工具:一個沙箱環境,通常是 Python,模型可以在裡面執行程式碼、做數學、剖析檔案、畫圖表或轉換資料。結果——一個數字、一張表、一則錯誤訊息——會當成觀察回來,讓模型使用或除錯。因為做運算的是電腦、不是模型,答案就有一種純文字生成永遠給不了的可靠度。
它也擴大了可能出錯的範圍:程式碼可能無窮迴圈、當掉,或做出非預期的事,所以沙箱是隔離且受限的。模型仍得寫出正確的程式碼,但至少現在出錯會以一則它看得見、改得了的錯誤呈現,而不是一個很有自信的錯誤數字。
又称
另见