书译
书译

如何在使用AI翻译小说时保持语调和角色一致性

一个可控的AI小说翻译工作流程,涵盖角色圣经、语调测试、章节级上下文、漂移检查以及基于风险的人工审校。

BookTranslator

BookTranslator Team

16 min read

要想在用AI翻译小说时避免语调扁平化,应将模型视为编辑系统中的初稿生成器。锁定源文本,定义旁白与角色语调,建立角色与术语圣经,翻译一段具有代表性的测试文本,利用可控上下文处理完整章节,并检查跨章节的语调漂移。

核心风险并非某处惊艳的误译,而是日积月累的不一致:角色的语气变得愈发正式、名字拼写发生变化、某个重复出现的笑话失去了铺垫,或者旁白与角色的距离在整本书的推进中逐渐发生偏移。

下载小说翻译角色圣经并在翻译完整手稿之前调整其栏目。

确定必须保持稳定的内容

"保持作者的语调"这一说法过于抽象,无法指导模型或审校人员。将其转化为可观测的约束条件。

对于旁白,需记录:

  • 视角以及与角色的距离;
  • 时态与时间转换;
  • 句子节奏与典型的段落长度;
  • 正式程度、遣词造句、幽默感以及对歧义的容忍度;
  • 重复使用的刻意程度;
  • 标点与对话惯例;以及
  • 应在各个章节中保持可识别的短语或修辞手段。

对于每个常驻角色,需记录:

  • 批准使用的姓名与别名;
  • 年龄、身份、人际关系以及会影响词语选择的事实;
  • 基准正式程度与社会语体;
  • 缩略语、方言、俚语、口头禅以及禁忌语;
  • 语调如何随对话对象或情感状态而变化;
  • 相关情况下的尊称、代词以及语法性别;以及
  • 拒绝那些以后会造成混淆的译文。

这是一份生产规范,而不是文学随笔。每条注释都应帮助译者在似是而非的选项中做出抉择。

根据证据构建角色圣经

阅读时要足够超前,以避免做出被后续章节矛盾掉的早期选择。在整个原文中搜索每个主要名称、昵称、头衔、自创术语、地点、物品和重复短语。

每个受控实体使用一行。例如:

字段实用条目
源形式确切的名称、头衔、短语或术语
批准的目标形式选定的翻译或音译形式
语调或语域直接、正式、幼稚、简练、含糊、古朴
关系/事实控制代词、尊称和指代的信息
首次出现该决定首次产生影响的章节和场景
请勿使用被拒绝的变体及其原因
决策来源作者注、往期版本、公司风格或审稿人决定
状态草稿、已批准、有争议或已更改

切勿让 AI 凭空捏造缺失的角色事实。请标记不确定性,并将其上报给作者或编辑。如果后文的揭示有意改变了对先前台词的理解,请记录下这一限制条件,同时不要在目标文本中过早泄露该秘密。

要实现更广泛的术语控制,请使用书籍翻译术语工作流。小说的“圣经”(即设定集)将这种方法延伸到了语气、人物关系、世界观和反复出现的意象上。

在翻译第一章之前进行语气测试

选择包含小说实际难度的 1,000–2,000 字测试包:

  1. 以旁白为主的段落。
  2. 两个语体风格不同的人物之间的对话。
  3. 包含幽默、习语或双关语的场景。当无法逐字理解比喻义时,请使用语境优先的习语翻译工作流
  4. 反复出现的术语、自创名称或世界观细节。
  5. 揭示早期选择是否保持连贯性的后文段落。

为最重要的行产出至少两个翻译变体。审校者应比较其含义、自然度、节奏、人物塑造和一致性,而不是挑选任何一个在孤立情况下听起来最美观的版本。

创建一个小型决策日志:

问题决策依据
旁白是亲近的还是疏离的?比较开篇与高潮情感场景中的旁白评论
某个角色的正式程度如何?比较其对上级、朋友和对手的讲话
是否应该翻译名字?检查含义、发音、后文的双关语以及作者现有的用法
重复是有意的吗?搜索重复出现的情况并检查其叙事功能

只有在目标语言的文学审稿人阅读了连贯的散文后,才能批准该风格。逐句评分无法证明一个章节具有稳定的语调。

翻译完整的叙事单元

为系统提供足够的上下文以解析指代并保持语调,但要使该单元保持可审核状态。一个章节或连贯的场景通常比任意大小相等的区块更有用。

对于每个单元,请提供:

  • 已批准的风格和人物设定集;
  • 上一章的收尾段落;
  • 当前场景的人物、地点及相关事实;
  • 已批准的常用术语和免翻译项目;
  • 关于保留分段、强调和场景转换的明确指令;以及
  • 完整单元的源文本。

不要不断地将整部翻译好的手稿添加到每个请求中。非常大的上下文并不能保证模型会遵守数百页前做出的决定。检索与当前场景相关的少量约束条件,然后根据完整的受控列表验证输出。

如果工作流拆分了一个章节,请让边界部分重叠以获取上下文,但要确保只有一个翻译副本进入最终书籍。重复的边界段落是常见的管线缺陷,而非艺术选择。

将起草与编辑决策分离开来

使用不同的阶段,以免一项任务掩盖另一项任务。

阶段 1:完整性与语义

比较源结构和目标结构。检查每个段落、对话轮次、场景转换、信件、题词、脚注和章节结尾是否都按顺序且完整地存在。在润色风格之前,先解决否定、主动性、时间顺序和事实关系。

阶段 2:名称与连贯性

在目标文本中搜索每一个受控的名称和术语。将拼写、代词、尊称、头衔、关系、年龄、地点、财产和时间线引用与设定集进行对比。

阶段 3:语调与语域

阅读每个主要角色在不相邻章节中的对话。角色在一个场景中可能听起来很一致,但在整本书中可能会漂移。将旁白与对话分开审查。

阶段 4:文学功能

检查反复出现的意象、笑话、线索、伏笔、歧义和刻意的重复。当同一个源短语被翻译成不同内容时,本地准确的翻译可能会破坏后期的呼应。

阶段 5:格式与最终文件质量保证

检查实际的 EPUB、PDF 或 DOCX。检查章节顺序、导航、强调、场景转换、注释、排版、标点符号以及每个章节的开头和结尾。

运行跨章节漂移测试

不要仅仅按顺序审核章节。创建旨在暴露出长期不一致性的搜索与样本。

角色语调样本

对于每个主要角色,提取开头、中间和结尾的简短对话段落。如果可行,移除章节标签,并询问审校者是否能识别出相同的语调,以及语调的变化是否有剧情动机支撑。

名称与术语搜索

在完整译文中搜索所有已批准和已拒绝的变体。一个被拒绝的拼写出现一次即为缺陷。如果目标语言会改变名称、头衔或名词,则需搜索其词形变化形式。

重复短语索引

列出主题、口头禅、书名字句、预言、线索、诗句或贯穿始终的笑话的每一次出现。在决定是否必须使用完全相同的措辞之前,请对比其在上下文中的功能。

边界审核

对照阅读前一章的最后两段和下一章的前两段。检查时态、视角、地点、名称,以及是否有重复或缺失的文本。

对话对象测试

对比某一角色如何称呼不同的人。当原文根据关系刻意改变语体时,千篇一律的说话方式和前后不一致一样是错误的。

采用基于风险的人工审校

每部公开出版的小说都需要目标语言的编辑判断,但并非每个句子的风险都相同。应将高级审校集中于:

  • 开头、结尾以及样读章节;
  • 首次登场以及受控术语的首次使用;
  • 对话密集且情感关键的场景;
  • 幽默、诗歌、方言、双关语和自创语言;
  • 暴力、亲密关系、同意、身份认同及其他对细微差别敏感的段落;
  • 线索、伏笔以及后文提及的段落;以及
  • 原文本身含糊不清的任何部分。

当缺陷重复出现时,应扩大样本范围。一个不一致的名字需要进行全书搜索。一个被扁平化的角色场景需要与其他场景进行比对。缺失的段落需要进行结构完整性检查,而不仅仅是重新插入检测到的段落。

ISO 5060:2024 概述》 描述了具有可配置错误类型的分析评估,并讨论了抽样。它不能使未经审查的 AI 小说合规,也不能替代小说所需的编辑流程。

了解 AI 在什么时候是不对的初步举措

在以下情况下,请勿启动整本图书的 AI 翻译:

  • 源稿件仍在发生实质性更改;
  • 该书严重依赖方言、诗歌或不可翻译的双关语,且没有合格的编辑可供协助;
  • 版权或合同禁止预期的处理方法;
  • 团队无法评估目标语言;
  • 必须匹配或修订现有的授权译本;或者
  • 错误带来的后果需要超出可用团队能力范围的可控专业工作流。

在这些情况下,请委托人工主导的测试、明确版权与编辑所有权,或者在扩大规模之前稳定源文。

小说最终发布关卡

仅在满足以下条件时发布:

  • 源版本已冻结且可追溯;
  • 旁白和主要角色语音规范已获批准;
  • 姓名、术语、关系和重复短语具有受控的格式;
  • 每个章节和叙事单元均按顺序出现一次;
  • 跨章节的姓名、声音、母题和边界测试已完成;
  • 具备资格的目标语言编辑已审核连贯的散文;
  • 所有阻碍性缺陷和重大缺陷均已修复并重新检查;
  • 最终排版的图书通过了导航以及设备或阅读器检查;以及
  • 内容简介(bible)和决策日志已妥善保存,以便日后更新或推出续集。

BookTranslator 可以为受支持的图书格式生成完整文件的 AI 翻译草稿,并在长内容中应用词汇表决策。将其用作文件处理阶段,然后应用上述连续性和编辑关卡。关于更广泛的成本和角色决策,请比较 AI 与人工图书翻译工作流;为了最终验收,请使用 书籍翻译 QA 检查清单.

相关文章