书译
书译

AI 书籍翻译中的人工后期编辑:应先审查什么

一种基于风险的工作流程,用于对 AI 翻译的书籍进行后期编辑,涵盖从遗漏和意义错误到术语、文风、格式以及发布审批的各个方面。

BookTranslator

BookTranslator Team

15 min read

人工后期编辑应先从可能使译文失效的错误开始,而不是从那些只是读起来别扭的句子入手。确认完整的目标语书稿与已冻结的源文一致,然后审查遗漏、增补、意义颠倒、名称、术语、数字以及交叉引用。只有在完成这些检查之后,编辑才应把时间花在文风、节奏和润色上。

这种顺序很重要,因为流畅的 AI 输出仍然可能包含缺失的段落或看似笃定的误译。一个完美的句子无法弥补缺失的一章。

请使用以下顺序:

  1. 明确译书的用途。
  2. 冻结确切的源文件和目标文件。
  3. 核对结构和完整性。
  4. 修正对意义至关重要的信息和受控信息。
  5. 审查整本书中的术语和前后连贯性。
  6. 在连贯的段落中编辑文风以及目标语言的自然度。
  7. 测试导出的文件,并重新检查每一项重大修正。

下载 AI 书籍后期编辑工作表 ,用于记录每个问题的决策、证据、严重程度、责任人和复检状态。

编辑之前先确定所需的完成标准

“后期编辑”并不表示某一种固定工作量。私人阅读副本与商业版本具有不同的验收门槛。

预期用途适当的审校目标不可接受
个人理解含义完整且可读,并已核查重要段落内容缺失、意思颠倒、文件无法使用
内部研究可追溯的论断、数字、引文和术语某项结果或参考资料与源文不再一致
编辑草稿完整草稿,名称、术语和结构稳定系统性偏移,导致后续编辑不再可靠
面向公众的非虚构作品完整双语编辑、母语润色、制作质检存在未解决的重大含义、术语或格式缺陷
文学出版由译者/编辑主导语气、歧义、节奏和文化表达把流畅的 AI 文本当作最终的文学判断
安全、法律、临床或受监管用途具备资质的领域审校与所需的正式流程未经核实的指示、警告、义务、剂量或限值

ISO 18587:2017 涵盖对机器翻译输出进行完整人工后编辑以及后编辑人员能力。它并不是任何快速清理的标签。如果你的项目只需要一份可读的草稿,就应将其称为有限审校,并明确说明哪些内容未被检查。

这也是 AI 与人工图书翻译 之间的区别开始在实际中发挥作用的地方:与其说方法更重要,不如说关键在于由谁承担那些尚未解决的风险。

在修改译文之前,先冻结证据

保留三个相互独立的文件:

  • 用于翻译的确切源文件;
  • 未经改动的 AI 输出;以及
  • 正在进行后编辑的工作版本。

记录源文件名、修订版本、语言、目标语言、翻译日期、输出格式、术语表版本,以及任何改变结果的工作流设置。如果源文件在审校期间发生变化,请创建新的源文件修订版并评估该变更。不要在未作说明的情况下把两个版本中的段落混在一起。

在编辑正文之前,请比较:

  • 开头和结尾内容;
  • 章节和小节数量;
  • 目录顺序;
  • 标题、列表、表格、图注、注释、附录和书后内容;
  • 每个主要章节的首段和末段;以及
  • 可能被有意保留或意外未翻译的源语言文本。

更全面的 书籍和长篇文档翻译 QA 检查清单 提供了发布级问题日志。本文中的后编辑工作表则增加了一个判断:保留、修复,还是重新翻译 AI 输出。

按照会改变发布决策的顺序进行审校

使用四轮审校。每一轮回答一个不同的问题。

第 1 轮:输出是否完整,并且是否与正确的源文配对?

查找缺失、重复、添加、截断或重排的内容。在逐行编辑之前,先核实章节边界。检查图片说明是否仍与对应图像配套,脚注是否仍指向预期的注释。

这些都是阻断性问题,因为后续编辑可能会让不完整的译文看起来像是已经完成。

第 2 轮:译文是否保留了源文含义?

优先检查那些一个小错误就会改变操作或论断的段落:

  • 否定: dodo not;
  • 情态: must, 可以, 应该,以及 能够;
  • 方向: 增加减少;
  • 顺序: 之前之后;
  • 范围: 全部, 一些, ,以及 除……外;
  • 数字、日期、单位、百分比、范围和标识符;以及
  • 归属关系:是谁说了什么、做了什么、相信了什么,或导致了某事。

例如,如果原文说某个角色 差一点 就招供了,那么 AI 译文如果写成该角色已经招供了,即使句子读起来自然,也属于意义错误。如果维护说明要求在打开面板 之前 先断电,那么更改这一顺序就是阻断性问题,而不是风格问题。

第 3 轮:受控决策是否一致?

在整个译文中搜索以下内容:

  • 人物名和地名;
  • 头衔和称呼形式;
  • 产品名称和组织名称;
  • 已定义的技术术语;
  • 缩略语及其全称;
  • 创造词;
  • 引文和被引用的标题;以及
  • 禁止翻译项。

记录批准采用的形式和不接受的变体。不要只改正一处就认为其余部分都没问题。使用 图书翻译术语模板 ,将一次性编辑转化为可复用的决策。

第 4 轮:读起来是否像预期的目标语言图书?

现在,在不每读完一句都盯着源文看的情况下,审阅段落和场景。检查语体、节奏、段落衔接、代词指代、对话区分、重复以及体裁惯例。然后再回到源文,确认风格性编辑没有改变含义。

这种双视角方法可以防止两种相反的失败:如果编辑从不独立阅读译文,就会出现受源文结构影响的“翻译腔”;如果编辑不再与源文比对,则可能出现优雅但误译的文本。

使用严重程度,而不是同等地润色所有内容

按后果对每个问题进行分类。

严重程度典型示例必需操作
阻断性问题章节缺失、源文版本错误、警告含义颠倒、导出内容无法阅读停止交付;修复原因并重新执行受影响的检查
重大主张内容误译、名称持续漂移、数字错误、交叉引用失效在验收前修复;搜索其他位置是否存在相同模式
轻微孤立的别扭措辞、局部标点、非关键空格问题根据约定的完成标准,集中处理或延后处理

MQM 错误分类法 将准确性、术语、语言惯例、风格、本地化惯例、受众适配性以及设计/标记区分开来。只使用那些会改变你的项目决策的类别。详细的分类体系很有用;但那种让一个阻断性问题淹没在数百个干净片段中的评分,则没有用。

决定是继续编辑还是重新翻译

后期编辑并不一定比从头开始更便宜。在投入整本书之前,先对有代表性的样本进行测试:

  1. 选择开篇、一段对话密集的内容、一段术语密集的内容、一个表格或注释,以及一个较难的后期章节。
  2. 记录阅读、检索、编辑和复核所花费的分钟数。
  3. 统计阻断性问题和重复出现的重大模式。
  4. 估计同样的修复是否会在全书中反复出现。

如果编辑必须逐句重建含义、代词或主语无法可靠追溯、术语系统性错误,或者输出结构已不再与源文对应,就应重新翻译该部分。当有代表性的样本显示,修复成本主要来自重新翻译而非纠正时,就应切换整个工作流程。

不要发布一个通用阈值,例如“如果改动少于 20% 的词就进行编辑”。词语改动百分比并不能衡量,被改动的词究竟是颠倒了一条警告的含义,还是仅仅改进了标点。

将纠正与批准分开

进行编辑的人可能会忽略导致这些问题产生的模式。增加一次最终检查,并从候选发布版本出发,而不是依赖编辑的工作记忆。

  • 对照源文,重新检查每一个阻断性问题和重大问题。
  • 在译文中搜索所有被否决的术语变体。
  • 再次比对最终目录和整体结构。
  • 在读者将使用的应用程序中打开实际的 EPUB、PDF 或 DOCX。
  • 检查元数据、链接、注释、图表和导航。
  • 记录由谁批准了语言、主题内容和制作。

在评估中,整篇文档的上下文也很重要。一项关于机器翻译的大型专业标注研究为审校人员提供了 用于 MQM 评估的完整文档上下文;孤立地审查单句可能会掩盖指代和连贯性问题。

BookTranslator 的适用位置

BookTranslator 可以从完整的 EPUB、PDF 或 DOCX 创建结构化的译文草稿,应用自动术语表,并在支持的情况下提供双语输出。这可以减少通过简短文本框逐章处理内容的工作量,并使重要段落更易于对照比较。

它不能替代合格的编辑或领域审校人员。请通过 图书翻译工作流程上传干净的源文件,保留未经改动的输出,并使用工作表来判断哪些地方需要人工判断。对于扫描内容较多的来源,请先修复提取问题,再将目标文本视为可进行后编辑的候选稿。

后编辑最终关卡

在以下所有条件都为真之前,不要批准这本书:

  • 已保留确切的源文件和未经改动的 AI 输出;
  • 完整文件核对未发现任何未解决的阻断性问题;
  • 已检查影响意义的关键段落、数字、名称、术语和引用;
  • 目标语言编辑覆盖了连贯的段落,而不只是孤立的句子;
  • 每一项重大更正都已被检索,以确认是否属于可能反复出现的模式;
  • 最终文件已在其交付格式中完成测试;以及
  • 预期用途、审校深度、审校者责任归属以及已知局限性都有记录。

当人工后编辑把判断力集中用在 AI 草稿最薄弱的地方时,它才有价值。若把“human reviewed”当作一个含糊标签,用来指代未明确界定的清理工作量,它就会失效。

相关文章