檢索增強生成
重排檢索結果(reranking retrieved documents)
第一階段的檢索是為速度打造的,所以它撒下大網,回傳例如前五十個候選——有些極佳,有些只是沾點邊。重排器(reranker)對這份候選名單做一次較慢、較仔細的第二眼審視並重新排序,讓真正最好的段落在抵達模型之前先浮到最上面。
重排器通常是交叉編碼器(cross-encoder):它在同一趟裡一起讀查詢和一段候選文字,輸出一個細緻的相關性分數。這種「一起讀」遠比比較兩個各自做好的嵌入要準確,但它太慢,無法跑遍整個語料庫。所以這條流程刻意分成兩段——便宜的檢索把數百萬筆縮到幾十筆,再由昂貴的重排器把那幾十筆排好——而你只留下最前面幾段放進提示。
又称
另见