書譯
書譯

AI 書籍翻譯的人工作後編修:應先檢查什麼

以風險為基礎的 AI 書籍譯後編修工作流程,從遺漏與語意錯誤,到術語、文風、格式,以及發行核准。

BookTranslator

BookTranslator Team

15 min read

人工作後編修應先從可能使譯文失效的錯誤著手,而不是先處理那些只是讀起來不夠順的句子。確認完整的目標語書籍與已凍結的來源文本一致,接著檢查遺漏、增補、語意顛倒、名稱、術語、數字,以及交叉參照。只有在完成這些檢查之後,編輯才應把時間花在文風、節奏與潤飾上。

這個順序很重要,因為流暢的 AI 輸出仍可能包含缺失的段落,或看似篤定卻實為錯譯的內容。再完美的句子,也無法彌補缺少的一章。

請使用以下順序:

  1. 定義譯後書籍的用途。
  2. 凍結確切的來源檔案與目標檔案。
  3. 核對結構與完整性。
  4. 修正對語意至關重要以及受控資訊的內容。
  5. 檢查整本書的術語與前後一致性。
  6. 以連續段落為單位,編修文風與目標語的自然度。
  7. 測試匯出的檔案,並重新檢查每一項重大修正。

下載 AI 書籍譯後編修工作表 ,以記錄每個問題的決策、證據、嚴重程度、負責人,以及重新檢查狀態。

在編修前先決定所需的完成水準

「譯後編修」並不表示固定不變的工作量。私人閱讀用版本與商業版本的驗收門檻並不相同。

預定用途適當的審查目標不可接受
個人理解意思完整、可讀,且已核對重要段落缺漏章節、意思顛倒、檔案無法使用
內部研究可追溯的主張、數字、引文與術語某個結果或引用內容不再與來源一致
編輯草稿完整草稿,且名稱、術語與結構已穩定系統性偏移,導致後續編修不可靠
公開發表的非虛構作品完整雙語編修、母語文案編修、製作 QA重大語意、術語或格式缺陷未解決
文學出版由譯者/編輯主導語氣、歧義、節奏與文化層次把流暢的 AI 文句當作最終的文學判斷
安全、法律、臨床或受監管用途合格的領域審查與所需的正式流程未經驗證的指示、警告、義務、劑量或限制

ISO 18587:2017 涵蓋機器翻譯輸出的完整人工後編,以及後編人員的能力要求。它不是任何快速潤飾的標籤。若你的專案只需要一份可讀的草稿,應稱之為有限審查,並明確說明哪些內容未經檢查。

這也是在 AI 與人工書籍翻譯 中的區別真正落實到實務的地方:比起採用哪種方法,更重要的是由誰承擔那些尚未解決的風險。

在更動譯文前先凍結證據

請保留三個彼此分開的檔案:

  • 用於翻譯的確切原文;
  • 未經改動的 AI 輸出;以及
  • 作業中的後編版本。

請記錄來源檔名、修訂版本、語言、目標語言、翻譯日期、輸出格式、術語表版本,以及任何會改變結果的工作流程設定。若原文在審查期間發生變更,請建立新的原文修訂版本並評估該變更。不要在未加說明的情況下,悄悄混用兩個版本中的段落。

在編修文句之前,請比較:

  • 開頭與結尾內容;
  • 章節與小節數量;
  • 目錄順序;
  • 標題、清單、表格、圖說、註釋、附錄與書末資料;
  • 每個主要章節的第一段與最後一段;以及
  • 可能是刻意保留或意外未翻譯的來源語言文字。

更完整的 書籍與長篇文件的翻譯 QA 檢查清單 提供可用於發布層級的問題紀錄表。本文的後編修工作表則加入了是否保留、修正或重新翻譯 AI 輸出的判斷。

依會影響發布決策的順序進行審查

分四輪進行。每一輪都回答不同的問題。

第 1 輪:輸出是否完整,且是否對應到正確的來源內容?

先找出遺漏、重複、增補、截斷或順序錯置的內容。先確認章節邊界,再進行逐行編修。檢查圖說是否仍與對應圖像在一起,腳註是否仍指向原本要指涉的註解。

這些都是阻斷性問題,因為後續編修可能會讓不完整的譯文看起來像是已完成。

第 2 輪:譯文是否保留了原文意思?

優先檢查那些細微錯誤就會改變動作或主張的段落:

  • 否定: 相對於 不要;
  • 情態: 必須, 可能, 應該,以及 可以;
  • 方向: 增加 相對於 減少;
  • 順序: 之前 相對於 之後;
  • 範圍: 全部, 部分, ,以及 除了;
  • 數字、日期、單位、百分比、範圍與識別碼;以及
  • 歸屬:是誰說了、做了、相信了,或導致了某件事。

例如,如果原文說某個角色 差一點 就招供了,而 AI 譯文卻說該角色已經招供,這就是語義錯誤,即使句子讀起來很自然也是如此。如果維護指示寫的是要在打開面板 之前 先切斷電源,那麼更動這個順序就是阻斷性問題,而不是風格問題。

第 3 輪:受控決策是否一致?

請在整份譯文中搜尋:

  • 角色名與地名;
  • 頭銜與稱謂;
  • 產品名稱與組織名稱;
  • 已定義的技術術語;
  • 縮寫及其全稱;
  • 自造詞;
  • 引文與被引用的標題;以及
  • 不得翻譯的項目。

記錄核准的形式與被否決的變體。不要只改正一處出現就假設其餘地方都沒問題。使用 書籍翻譯術語範本 將一次性的編修轉化為可重複使用的決策。

第 4 輪:讀起來是否像預期的目標語言書籍?

現在,請在不要每看完一句就盯著原文的情況下,審閱各段落與場景。檢查語體、節奏、段落銜接、代名詞指涉、對話區辨、重複,以及類型慣例。接著再回到原文,確認風格上的編修沒有改變原意。

這種雙視角方法可避免兩種相反的失敗:當編輯從不獨立閱讀譯文時,譯文會帶有受原文形塑的翻譯腔;而當編輯停止與原文比對時,則可能出現看似優雅卻誤譯的內容。

用嚴重程度分類,而不是把所有內容一律平均潤飾

依據後果對每個問題分類。

嚴重程度典型範例必要處置
阻斷級章節缺失、原文版本錯誤、警告語意顛倒、匯出內容無法閱讀停止交付;修復原因並重新執行受影響的檢查
重大主張誤譯、名稱漂移反覆出現、數字錯誤、交叉參照失效在驗收前修正;搜尋其他地方是否也有相同模式
次要個別生硬措辭、局部標點、非關鍵空格問題依照約定的完成標準,採取整批處理或延後處理

所謂的 MQM 錯誤類型學 區分準確性、術語、語言慣例、風格、地區慣例、受眾適切性,以及設計/標記。只使用會改變你專案決策的類別。詳細的分類法很有用;但若一個會造成阻斷的問題能被數百個乾淨的段落淹沒,那樣的分數就沒有意義。

決定要繼續編修還是重新翻譯

後編修不一定比從頭開始更便宜。在承諾處理整本書之前,先測試具代表性的樣本:

  1. 選取開頭、一段對話密集的段落、一段術語密集的段落、一個表格或註釋,以及一個困難的後段章節。
  2. 記錄閱讀、查證、編修與複查所花的分鐘數。
  3. 統計阻斷問題與重複出現的重大模式。
  4. 評估同樣的修補是否會在全書反覆出現。

當編輯必須逐句重建意思、代名詞或主語無法可靠追溯、術語系統性錯誤,或輸出結構已不再對應原文時,應重新翻譯某個段落。當具代表性的樣本顯示,修復成本主要來自重譯而非修正時,就應切換整個工作流程。

不要公布像是「如果變動不到 20% 的字詞就編修」這種通用門檻。字詞變動百分比無法衡量,被改動的字究竟是把一則警告的意思顛倒了,還是只是改善了標點而已。

將修正與核准分開

進行編修的人可能會忽略產生這些問題的模式。加入最後一輪檢查,而且要從候選發布版本出發,而不是依賴編輯的工作記憶。

  • 對照原文重新檢查每一個阻斷問題與重大問題。
  • 在譯文中搜尋所有被否決的術語變體。
  • 再次比對最終的目錄與結構。
  • 在讀者實際會使用的應用程式中,開啟真正的 EPUB、PDF 或 DOCX。
  • 檢查中繼資料、連結、註釋、圖表與導覽。
  • 記錄由誰核准語言、主題內容與製作。

在評估中,整份文件的脈絡也很重要。一項針對機器翻譯的大型專業標註研究,給予審查者 用於 MQM 評估的完整文件脈絡;孤立句子的審查可能會掩蓋指代與連貫性問題。

BookTranslator 的定位

BookTranslator 可以從完整的 EPUB、PDF 或 DOCX 產生具結構的譯文草稿,套用自動詞彙表,並在支援時提供雙語輸出。這可以減少必須透過簡短文字方塊逐章處理內容的工作,並讓重要段落更容易比對。

它不能取代合格的編輯或領域審查者。請透過 書籍翻譯工作流程上傳乾淨的來源檔案,保留未經修改的輸出,並使用工作表判斷哪些地方需要人類判斷。對於以掃描為主的來源,請先修正擷取問題,再把目標文本視為可進行後編輯的候選。

最終後編輯關卡

在以下所有條件都成立之前,不要核准這本書:

  • 已保留精確的來源檔與未經修改的 AI 輸出;
  • 完整檔案的核對未發現任何尚未解決的阻斷性問題;
  • 已檢查影響語意的關鍵段落、數字、名稱、術語與參照;
  • 目標語言編修涵蓋了相互連接的段落,而不只是孤立句子;
  • 每一項重大修正都已搜尋是否可能是重複出現的模式;
  • 最終檔案已在其交付格式中完成測試;以及
  • 預期用途、審閱深度、審閱者責任歸屬,以及已知限制都有被記錄下來。

當人工後編把判斷力集中在 AI 草稿最薄弱之處時,就能發揮價值;但如果只是把「經人工審閱」當成一個模糊標籤,用來指稱某種未明確界定的清理程度,它就會失敗。

相關文章