路由器是判定,不是代理
路由器不隱藏背後有哪些供應商,也不該自己捏造一個。你提供的是真的能呼叫的候選,附上成本與延遲,以及這個任務真正在意的優先順序。回傳的是其中一個候選識別碼與機率,不是一段討論優缺點的文字。
準則要寫下來的理由,和分類標籤要寫下來一樣:同一個問題問兩次,不應該得到兩套政策。如果成本永遠優先,就寫成本優先;如果是品質優先、成本只用來打破平手,就照這樣寫。
語意路由其實就是換了名字的分類
語意路由把一句話對應到固定的幾條路之一,通常靠比對向量。這跟帶標籤的分類是同一件事,因此繼承同樣的失敗模式:看起來很精確的門檻、會漂移的向量模型,以及仍然落進最接近那一桶的範圍外訊息。
用你寫的準則做型別化判定,會讓路徑名稱與界線保持明確,並把機率跟選擇一起回傳。兩者都不是授權:路徑只說明哪條通道合適,不代表這位使用者有權走。
比較實際被接受的結果,而不是 token 單價
便宜但常常在某一路上失敗的模型,比你想省掉的那個更貴:工作得重做,或錯誤的答案送到客戶手上。請用同一批保留樣本分別評估每一條路,並在代價高的地方計算錯誤,而不是用平均值把它抹平。
值得追蹤的是「每個被接受結果」的成本與延遲,再加上門檻造成的覆核率。供應商公布的評測衡量的是他們的任務與他們的資料,不是你自己的流量。
保留退路與紀錄
未知或信心不足的路徑,應該走預設通道或交給人工。呼叫模型的程式要把「沒有可選候選」當成路由失敗,而不是拿來當成挑最大模型的許可。請把選中的候選、請求識別碼與模型版本和結果一起保存,否則日後無法稽核這個決定。
連線不確定時,用同一個請求識別碼與相同內容重試;真的是新任務才換新的識別碼。把任務路由給某個模型,不等於允許執行不可逆的動作——那道檢查留在原來的位置。
