如何為翻譯準備書籍檔案
透過鎖定來源版本、清除修訂、盤點資產、定義術語以及建立可驗證的驗收基準,準備好 EPUB、DOCX 或 PDF 以進行翻譯。

透過建立一個凍結、完整的來源套件與驗收基準來為翻譯準備書籍。解決修訂版本、確定哪些內容應該翻譯與不應翻譯、盤點章節與資產、定義名稱與術語,並選擇能夠在目標語言中保留您所需結構的來源格式。
請勿從名為 final-final-2.docx 的檔案開始,並在日後才解釋遺漏的決策。翻譯會將來源的模稜兩可性放大到每一個目標語言中。
請使用此行前檢查清單:
- 凍結確切的來源版本。
- 移除或刻意保留註解、修訂與隱藏內容。
- 選擇最佳的來源格式。
- 盤點前言、章節、後記、註解、圖片與表格。
- 標記可翻譯與不可翻譯的內容。
- 建立初始術語與實體清單。
- 封裝字型、圖片來源、參考資料與指示。
- 記錄字數統計與具代表性的測試段落。
- 定義使翻譯檔案可被接受的標準。
下載 書籍翻譯來源行前檢查範本,並在上傳完整檔案或交給翻譯人員之前填寫完畢。
凍結一個具有權威性的來源版本
建立包含以下內容的來源記錄:
- 書名與副標題;
- 作者與版本;
- 來源語言;
- 檔案名稱與修訂版本;
- 日期鎖定;
- 章節數量;
- 字數統計或其他穩定內容基準;
- 包含的前言與後記;以及
- 獲授權批准來源變更的負責人。
將後續更正記錄在變更日誌中。每個條目應識別來源位置、舊內容、新內容、原因、日期以及受影響的目標版本。在翻譯進行期間,請勿覆寫已鎖定的來源。
如果您無法說明哪個檔案具有權威性,請停止。翻譯團隊無法協調您未加區分的版本。
解決註解、追蹤修訂與隱藏內容
對於 DOCX 書稿,請決定是否接受或拒絕每個追蹤的插入或刪除,以及註解是否屬於翻譯套件的一部分。隱藏標記並不等於移除。微軟目前的 Word 指南指出,追蹤修訂必須接受或拒絕以將其移除;「無標記」檢視僅會暫時將其隱藏。
當編輯歷史記錄有用時,請建立兩個檔案:
- 一個包含已解析文字的乾淨翻譯來源;以及
- 一個保留註解或修訂歷史記錄的唯讀參考複本。
同時檢查隱藏文字、文件屬性、頁首、頁尾、腳註、尾註、文字方塊、替代文字以及嵌入物件。如果檔案包含私人或未發布的資料,請在分享或上傳之前執行文件翻譯隱私檢查清單。
根據結構而非便利性來選擇來源格式
| 可用來源 | 使用時機 | 翻譯前準備 | 主要限制 |
|---|---|---|---|
| EPUB | 書籍可重新排版且章節結構很重要 | 驗證套件、目錄、語言元資料、連結、註釋和圖片 | 固定版面或不尋常的 CSS 可能需要單獨測試 |
| DOCX | 手稿可編輯,且樣式、表格或註釋很重要 | 解決修訂、正規化樣式、檢查文字方塊和頁首頁尾 | 它不是最終的電子書閱讀器或印刷成品 |
| 文字型 PDF | PDF 是具權威性的固定版面來源 | 驗證可選取文字、閱讀順序、字型和頁面清單 | 編輯和圖片文字可能會很困難 |
| 掃描版 PDF | 沒有更好的來源可用 | 在具代表性的頁面上執行 OCR 並記錄辨識風險 | OCR 輸出會重建內容,而非確切的版面配置 |
請使用您獲授權使用的最上游可編輯來源,並保留顯示預期外觀的參考匯出檔。將乾淨的 EPUB 或 DOCX 轉換為 PDF 後再進行翻譯,通常會丟失有用的結構。
對於純圖片素材,請在使用 OCR 文字做為來源之前,先執行 掃描版 PDF 翻譯前置檢查。
盤點整本書,而不僅僅是內文章節
列出每個內容單元及其預期處理方式:
- 封面文字;
- 書名頁與版權頁;
- 題獻、卷首語與致謝;
- 目錄;
- 導言與序言;
- 正文章節;
- 表格、圖表、圖說與圖片內文;
- 腳註與尾註;
- 參考書目與引文;
- 附錄、詞彙表與索引;
- 作者簡介與行動呼籲;以及
- 在內部檔案之外處理的元資料與商店描述。
為每個章節、圖表、表格和註解指派一個穩定的識別碼。記錄它是可翻譯的、保留的、替換的、重新建立的或排除的。缺少的附錄應該在清單中可見,而不是在目標檔案中變成無聲的遺漏。
對於 EPUB,W3C 規範要求將出版資源列在封裝清單中,並使用封裝元資料來記錄標題和作者等資訊。這裡的 EPUB 3.3 specification 非常有用,因為封裝是一個結構化的出版品,而不是一堆可互換的文字檔案資料夾。
標記不應翻譯的內容
為以下項目建立「不翻譯」(do-not-translate)清單:
- 當作者與貢獻者的核准形式保持不變時的名字;
- 商標與產品名稱;
- 網址、電子郵件地址、識別碼與 ISBN;
- 程式碼、指令、檔案路徑與公式;
- 必須保留原始形式的引用標題;
- 等待編輯決定的自創字;以及
- 應使用現有授權翻譯的引文。
為每個項目新增原因與上下文。沒有解釋的「DNT」可能會保留錯誤的字串,或隱藏讀者實際需要翻譯的內容。
W3C 國際化標籤集(Internationalization Tag Set)包含關於內容是否應翻譯、術語和上下文資訊的資料類別。其 ITS 2.0 requirements說明基本原則:可翻譯性與上下文是明確的元資料,而不是交由每位譯者猜測。
建立第一個術語與實體清單
不要等到第 12 章才決定如何處理重複出現的名稱或概念。從以下項目開始:
- 角色、地點、組織與產品名稱;
- 稱謂與稱呼方式;
- 定義明確的技術或學術術語;
- 自創詞彙;
- 縮寫;
- 重複出現的介面或程序標籤;
- 單位與計量慣例;以及
- 根據上下文刻意變化的術語。
對於每個項目,請包含原文形式、定義或上下文、已知時的核准目標形式、拒絕的變體、大小寫或屈折變化規則、首次出現位置以及決策負責人。
初始清單不需要預測每一個術語。它需要防止明顯的偏差,並提供一個記錄後續決策的地方。使用 書籍術語一致性範本 作為工作資產。
打包外部資產與版權資訊
書籍檔案可能會依賴未完全嵌入的材料:
- 高解析度圖片來源;
- 可編輯的圖表;
- 字型檔案與授權記錄;
- 封面插圖與文字圖層;
- 連結的媒體;
- 現有的核准譯本;
- 引文、歌詞或圖片的許可權;以及
- 樣式指南或出版商規範。
切勿假設發行原文的授權會自動涵蓋各市場的翻譯版本。請記錄將重製或改編之素材的版權所有者與核准範圍。
針對字型,請在翻譯前確認目標語系文字系統。僅支援拉丁字母的字型在原文中可能看起來沒問題,但套用於阿拉伯文、日文或天城文輸出時則會完全失效。請提供授權字型或核准的替代字型,而不是讓製作團隊在翻譯後才臨時湊合。
建立基準以便偵測遺漏之處
在翻譯前記錄實際統計數量:
- 章節與主要區段;
- 各層級標題;
- 格式公開時的段落或文字區塊;
- 圖表、表格、說明文字、註解與連結;
- 目錄項目;
- 前言與後記元件;以及
- 原文單字數僅作為參考,而非目標語言的字數相等規則。
目標語言的字數會因語言而異,因此切勿僅因翻譯較長而予以拒絕。請利用字數統計來找出遺漏、重複或意外空白的結構。
針對 EPUB,請對來源執行一致性檢查。 EPUBCheck由 DAISY 聯盟代表 W3C 維護,用於檢查 EPUB 一致性。在翻譯前修正來源套件錯誤,可避免混淆翻譯過程是否為錯誤的根源。
在完整翻譯前選取具代表性的段落
選擇能突顯書籍真正困難度的小型測試包:
- 開場散文;
- 對話或語氣濃厚的段落;
- 專有名詞密集的區段;
- 表格、圖表、註腳或交互參照;
- 長段落與短碎化文字;
- 特定文化或含糊不清的段落;以及
- 後續章節可用於檢驗與先前決策的一致性。
使用相同的測試包來比較工作流程並建立樣式指南。不要讓供應商或工具僅透過最簡單的第一頁來證明品質。
這項測試並非聲稱整本書的表現會完全一致。這是一種在擴大規模之前,用來低成本淘汰不良來源格式、詞彙表或審查流程的方法。
在翻譯開始前定義驗收標準
記錄以下事項:
- 目標語言與地區;
- 預期用途:私人閱讀、編輯草稿、內部研究或出版;
- 輸出格式;
- 所需的雙語或僅目標語言版本;
- 核准的名稱與術語;
- 必須保持可用的結構;
- 預期的 人工審查;
- 缺陷嚴重性與升級規則;以及
- 誰負責核准語言、主題內容與最終製作。
如果目標是公開發行,請包含母語編輯與最終格式校對。如果目標是個人閱讀,完整性與可用的語意可能就足夠了。「書籍翻譯品質保證檢查清單」可以成為已完成之目標檔案的驗收記錄。
BookTranslator 的適用之處
一旦來源套件穩定後,即可透過 BookTranslator 工作流程上傳完整支援的檔案。EPUB、PDF 與 DOCX 需要不同的檢查,因此在承諾執行完整的審查計畫之前,請先翻譯具有代表性的測試包或檢視困難的區段。請使用自動詞彙表來處理重複出現的名稱與術語,並在支援的情況下使用雙語輸出以檢查重要段落。
BookTranslator 不負責解決來源模稜兩可的情況、批准版權、授權字型,或決定哪些修訂版應收錄於書中。這些都屬於來源準備決策。對於掃描版 PDF,OCR 模式會優先確保可恢復的翻譯內容,而非完美重現原始頁面。
最終來源套件閘道
書籍唯有在符合下列條件時才準備好進行翻譯:
- 單一權威來源版本已凍結;
- 修訂版本、評論、隱藏內容和排除項目均已解決;
- 已選擇最佳可用的 EPUB、DOCX、PDF 或 OCR 路徑;
- 每個章節、資產、筆記和後記項目都有相應的處理方式;
- DNT 與術語決策有專責負責人;
- 來源資產、字型、參考資料和權利資訊已打包完成;
- 結構統計與具代表性的段落已記錄;以及
- 目標地區、預期用途、輸出、審查深度和驗收標準皆已明確。
良好的來源準備無法保證翻譯品質完美,但能消除可避免的模稜兩可,並在遺漏某些內容時為審查人員提供佐證。





