什么是好的翻译?准确性、流畅性、目的与证据
一个用于评估跨意义、语言、术语、受众、呈现形式和预期用途的翻译质量的实用框架。

好的翻译能保留原文的预期含义和效果,读起来符合目标语言的规范,并且符合其委托服务的受众和目的。它还必须在最终格式中保持完整、一致和可用。仅靠流畅性无法证明上述任何一点。
这一定义将翻译审查从一场主观审美的比赛转变为基于证据的决策。在审查之前,请明确使用场景和错误后果。然后评估不同的质量维度,按类型和严重程度记录缺陷,并应用反映风险的发布阈值。
下载翻译质量评分表,为您的项目定义标准、样本、证据和验收决策。
从目的出发,而非寻求一个通用评分
同一段目标文本对于某个目的可能足够好,但对另一个目的则可能无法接受。如果意思可以理解,私人阅读辅助工具可以容忍尴尬的措辞。公开的小说需要持续的文风和编辑的润色。一条安全说明可能会因为一个情态动词的改变而失效,即使每个句子听起来都很自然。
欧盟委员会将适合其用途的翻译描述为:既能传达相同的含义和效果,又能为目标读者带来自然的阅读体验。其当前的翻译质量指导原则也将审查的深度与错误的后果及发生概率联系在一起。
在评估之前,请写一份简短的质量规范:
| 决策 | 要回答的问题 | 证据示例 |
|---|---|---|
| 目的 | 读者将如何使用该翻译? | 个人阅读、内部研究、出版、受监管的使用 |
| 受众 | 谁会阅读它,在哪个地区? | 年龄、领域知识、地区、无障碍需求 |
| 内容风险 | 如果某段文字出错会发生什么? | 困惑、叙事线索丢失、经济损失、不安全的操作 |
| 必需的控制措施 | 哪些决策必须保持稳定? | 名称、术语表、正式程度、单位、引文、排版 |
| 验收规则 | 是什么导致接受、修改或拒绝? | 无阻塞性问题;重大问题已纠正并重新检查 |
如果没有这套规范,两位审校人员可能会得出相反的结论,因为他们 tacitly 在以不同的产品标准进行默默评判。
评估七个独立维度
The MQM 核心错误分类法 将翻译问题区分为术语、准确性、语言惯例、文体、本地惯例、受众适宜性以及设计和标记。这些是有用的审查视角,因为一个翻译可能在一个维度上通过,而在另一个维度上失败。
1. 准确性:目标文本是否保留了源语言的含义?
比较命题、关系、否定、情态、顺序、数量和指代。查找增译、漏译、走样和未翻译的内容。
考虑以下源语言指令:
The valve must remain closed until the pressure falls below 2 bar.
现在想象一个流畅的目标句子,经回译检查其含义为:
The valve may remain closed until the pressure falls below 2 bar.
语法可能无可挑剔,但翻译却无法使用。 Must 变成了 may,因此一项义务变成了一个选项。准确性审查必须对比源文本和目标文本;仅阅读目标文本无法暴露该缺陷。
2. 语言惯例:这是否是合规的目标语言书写?
检查语法、拼写、标点、句法、一致性以及机械正确性。然后阅读连贯的段落以检查衔接性。逐句审查可能会遗漏断裂的指代链、不一致的时态或不通顺的段落。
自然度是这一维度的证据,而非准确性的替代品。如果审校者只关注文字读起来是否地道,可能会批准那些看似自信的误译。
3. 术语:受控概念的命名是否正确且一致?
在整个译文中搜索名称、地点、标题、产品术语、领域词汇、缩写词和重复出现的短语。将每个变体与核准的术语表或项目决策进行对比。
一致性并非盲目重复。同一个原词在不同语境下可能需要不同的译词,而多个原文变体可能指向同一个受控概念。该图书翻译术语工作流解释了如何记录这些决策以及被拒绝的备选方案。
4. 风格与语域:语态是否符合原文和情境?
检查正式程度、语气、节奏、类型规范、句子密度、人物塑造、幽默感和编辑风格。在小说中,即使一行文字在语法上是正确的,但如果一个孩子突然听起来像在打官腔,或者两个截然不同的人物拥有了相同的语态,那么这行翻译仍然是失败的。
不要将风格审查简化为“我会用不同的方式表达”。只有当某种偏好违反了原文、约定的规范、目标语言习惯或既定的风格决策时,它才会成为缺陷。
5. 区域设置与受众:它对目标读者有效吗?
审查引号、日期和数字格式、单位、货币、地址、姓名顺序、方向性、文化知识、阅读水平和特定市场的惯例。受众审查还会询问是否缺失了解释,或者改编是否假设了目标读者并不具备的知识。
这是翻译与本地化重叠的地方,但测试标准依然具体:目标受众能否按照预期理解并使用交付的文本?
6. 完整性:每个要求的单元是否都按顺序出现了一次?
检查章节、标题、段落、表格行、图注、脚注、尾注、链接、引用、附录以及前言和后记。搜索原文残留、重复的边界文本以及截断的开头或结尾。
即使评估框架将遗漏归类在准确性下,完整性通常也值得拥有独立的发布门槛。缺失一个章节是无法通过其他地方成千上万个优秀的句子来弥补的。
7. 设计与标记:最终成品是否仍然可用?
打开实际的 PDF、EPUB、DOCX、字幕文件或网页。检查阅读顺序、导航、表格、插图、标题、链接、换行、嵌入字体、从右向左阅读行为以及文本裁剪。即使译词正确,如果表格变得无法阅读或 EPUB 注释无法链接回原文,产品依然是失败的。
这些真实翻译样本说明了为什么排版、脚本、表格和阅读顺序属于翻译质量的一部分,而不是事后的修饰。
区分错误类型与严重程度
错误类型告诉你哪里出了问题。严重程度告诉你该错误对预期用途的影响。请将这些判断分开。
| 严重程度 | 操作含义 | 示例 | 判定 |
|---|---|---|---|
| 严重 | 使交付物不符合用途或造成严重损害 | 颠倒的安全指令;暴露了机密内容 | 立即拒绝 |
| 主要 | 实质性地改变了含义、可靠性或可用性 | 段落缺失;名称错误频繁出现;表格损坏 | 接受前进行修改并排查该模式 |
| 次要 | 局部影响有限;仍可实现预期用途 | 孤立的标点符号或非关键的风格缺陷 | 必要时进行修正;跟踪重复出现的模式 |
| 中性 | 可接受的变体或审阅者备注 | 规范未禁止的可辩护替代方案 | 不作为失败计算 |
MQM 的评分指导利用错误类型和严重程度来表示风险并生成可配置的分数。有用的原则不是一个万能的魔术数字,而是不应让一个严重的缺陷在平均值中被掩盖。
以证据代印象进行评审
可辩护的评估会留下审计线索。对于每个抽样的段落或缺陷,请记录:
- 源文本和目标文本的位置;
- 准确的源文本和当前的目标文本;
- 错误类型和严重程度;
- 判定背后的规范或证据;
- 建议的修正方案及负责人;以及
- 最终修正是否经过独立复核。
至少进行两轮审核。第一轮对比源文本和目标文本的完整性与含义。第二轮将目标文本作为纯译文阅读,检查其连贯性、风格以及对受众的适用性。在整个交付成果中增加术语搜索和格式检查,而不仅仅局限于语言抽样。
这篇 ISO 5060:2024 概述 介绍了使用错误类型和扣分制的分析性评估,并讨论了评估者的能力和抽样方法。此处可下载的评分表将这些通用理念应用为轻量级的项目工具;使用该表并不代表符合 ISO 标准。
按风险抽样,当错误集中出现时扩大范围
当无法进行全面人工审核时,不要只选择简单的或随机的页面。务必将高难度内容纳入抽样范围:
- 开头、结尾以及每一个结构分界处。
- 姓名、术语、数字和引用最密集的段落。
- 对话、幽默、成语/习语、歧义句以及正式文体。
- 每一个特殊结构:表格、注释、插图、列表、公式和链接。
- 任何一旦出错就会产生实质性后果的指令或声明。
- 在不同设置、模型或源文本版本下翻译的章节。
当某个错误暗示存在系统性问题时,应扩大审核范围。一个角色名称错误应触发对该名称及其变体的全面搜索。一个段落缺失应触发对每个处理边界周围的结构对比。一个被平铺直叙处理的习语应触发针对习语的专项审核,而不仅仅是修正发现的那一行。
对于可操作的全文件流程,请使用 书籍和长文档 QA 清单。该清单回答了 如何检查交付成果;而本框架回答了 质量的定义以及证据是否充足 以供发布决策参考。
使用接受、修改或拒绝阈值
不要仅以百分比结束而不做决定。设定三个明确的结果:
- 接受: 无严重错误,无未解决的主要错误,通过了要求的全文件检查,且抽样结果支持预期用途。
- 修改: 交付物是可修复的,但实质性或系统性缺陷需要纠正并进行针对性的重新检查。
- 拒绝: 使用了错误的源文件或语言,大面积缺失必要内容,输出结果不可用,或者工作流无法提供与风险相匹配的证据。
对于公开、合同、财务、临床、法律或安全关键型内容,阈值应更加严格。自动评估指标的高分不能推翻已知的阻碍性问题。
实用的质量关卡
在接受翻译之前,请确认以下所有事项:
- 已记录源版本、目的、受众、语言区域和输出格式。
- 含义、完整性、术语、语言、风格、语言区域、受众和呈现方式已作为独立维度进行了审查。
- 每个严重或主要问题都有负责人、纠正措施和最终复核。
- 已在整个译文中检索受控名称、术语、数字和不翻译项。
- 最终产出物在受众将使用的阅读器或应用程序中运行正常。
- 抽样涵盖了高风险和结构复杂的内容。
- 决策应为接受、修改或拒绝,而不仅仅是“看起来不错”。
如果您在进行此审查之前需要一份完整的翻译初稿,BookTranslator 可以直接处理原始文件格式的书籍和文档。其上下文感知翻译和术语表控制功能有助于保持长篇内容决策的一致性,但它们不能取代源文比对、目标语言编辑或上述基于风险的发布关卡。





