把一致性視為資料契約,而不是翻譯問題
企業 AI 助手常同時讀取中文規章、英文技術文件、ERP 欄位與客服知識庫。若只要求模型「以使用者語言回答」,同一概念可能在不同回合被翻成不同名稱。例如「採購單」可能變成 purchase order、purchasing order 或 PO;內部產品名稱也可能被模型自行意譯。單句看起來都合理,但跨系統搜尋、報表比對與後續人工處理會因此失去穩定性。
工程上應先定義一份可執行的術語契約,為每個概念指定穩定識別碼、繁體中文名稱、英文名稱、允許縮寫、禁止用語、適用部門及來源。概念識別碼不隨顯示語言改變,API、檢索索引與評測資料都使用它;介面層再依語言顯示核准名稱。這能把「模型覺得怎麼翻比較自然」改成「系統知道這個概念應如何呈現」。
讓術語控制進入檢索與生成流程
術語庫若只放在提示詞末端,長對話或大量檢索內容很容易稀釋其影響。較可靠的做法是在查詢、檢索、生成與輸出驗證四個階段共同使用術語資料。查詢正規化先辨識別名並映射到概念識別碼;檢索時同時帶入中英文核准詞與常見縮寫;生成時只注入本次答案需要的術語;輸出後再檢查禁用翻譯、未展開縮寫與名稱漂移。
保留來源語言也很重要。法律條文、產品功能名稱或 ERP 欄位不一定適合翻譯;有些內容則適合採用「中文名稱(English term)」的首次出現格式。團隊應依內容類型制定規則,而不是要求所有詞一律雙語並列。雙語並列較精確,但會增加閱讀負擔;只顯示單一語言較流暢,卻可能讓使用者難以回到原始文件核對。
- 固定名稱:公司、產品、API、資料表與欄位名稱原樣保留,只在必要時補充說明。
- 受控翻譯:產業術語使用術語庫指定的中英文對應,首次出現可附縮寫。
- 語境翻譯:一般敘述可追求自然,但不得改變數值、條件、責任主體或否定語意。
- 未知術語:若文件沒有核准譯名,保留原文並標示待確認,不讓模型自行創造正式名稱。
引用必須指向證據,而不是只像引用
引用的一致性包含三件事:答案中的主張能否對應到來源、中文與英文答案是否指向相同證據,以及使用者能否重新開啟當時使用的內容。僅要求模型在句尾產生文件名稱並不可靠,因為它可能引用到相關但未支持該主張的段落,甚至組合出不存在的標題。引用標記應由檢索系統提供,模型只能選用已返回的來源識別碼,不能自行撰寫識別碼或網址。
資料切分時要保存文件識別碼、版本、章節、頁碼或段落定位、語言及存取權限。若中英文是同一文件的兩個版本,應建立共用文件族系與版本關係;若英文只是摘要而非正式譯本,也必須明確標記。回答時,事實性主張應靠近其引用;同一段包含多個來源時,要能看出哪一個來源支持哪一句。介面可顯示使用者熟悉的標題,但後端應保留不可變的來源鍵,以免文件改名後引用失效。
- 完整性:關鍵結論、限制條件、日期與操作要求都有來源支持。
- 精確性:引用片段直接支持相鄰主張,而不只是主題相似。
- 跨語一致:切換語言不應把正式文件換成較弱的二手摘要。
- 權限一致:答案與引用預覽都遵守同一套文件存取規則。
用可重現測試管理長期漂移
雙語品質不能只靠人工閱讀幾段示範答案。評測集應涵蓋中問中答、英問英答、中文提問英文文件、英文提問中文文件,以及同一對話中切換語言。每個測試除了判斷內容是否正確,也要檢查指定術語、禁止譯法、數值保真、來源識別碼、引用覆蓋與權限行為。對高風險內容,可先用規則驗證確定性條件,再由人工或模型評審檢查語意與可讀性。
術語庫、提示詞、嵌入模型、分段策略與來源文件都需要版本化。每次變更後重跑同一批代表性問題,才能分辨改善來自哪個環節。線上紀錄則應保留使用過的模型版本、術語庫版本、檢索來源與引用映射,但避免儲存不必要的敏感內容。當使用者回報錯誤時,團隊才能重現當時答案,而不是猜測模型為何改了說法。
- 先訂決策權:由產品負責語氣、領域專家核准術語、文件擁有者確認來源效力。
- 建立例外流程:新術語先進待審清單,不直接成為全域規則。
- 監控失敗模式:分開追蹤錯譯、術語漂移、引用錯配、來源過期與權限洩漏。
- 保留人工出口:證據不足或版本衝突時,助手應說明限制並請使用者確認,而非補完答案。
成熟的雙語助手不是永遠使用完全相同的句子,而是在兩種語言中維持相同概念、證據強度與操作含義。若系統還需串接 LINE、CRM、ERP 或雲端知識庫,術語與引用規則最好從整合架構初期就納入資料模型,避免日後在每個介面分別修補。