书译
书译

如何翻译研究论文而不破坏其结构

翻译学术论文,同时保留公式、引文、表格、图表、专业术语以及多栏阅读顺序。

BookTranslator

BookTranslator Team

15 min read

简短回答

要翻译学术研究论文,请使用能够保留阅读顺序、公式、引文、表格、图表和专业术语的 PDF 工作流。除非你准备手动修复阅读顺序,否则不要从双栏 PDF 中复制文本。未经人工审核,切勿仅凭 AI 翻译做出临床、法律、监管或达到出版级别的决策。

最安全的工作流是:

  1. 确认 PDF 包含可选择的文本。
  2. 如果是扫描件,请先运行 OCR。
  3. 使用具备排版识别能力的 PDF 翻译器进行翻译。
  4. 对摘要、方法、结果和结论进行双语对照审核。
  5. 检查公式、引文、数字、表格和专业术语。
  6. 引用原始论文,而不是机器翻译的输出。

对于排版复杂的学术 PDF,请使用 PDF Translator。如果你的问题是一般的 PDF 格式问题,请阅读如何在不丢失格式的情况下翻译 PDF。如果论文是扫描件,请从扫描版 PDF 翻译指南开始。有关工具对比,请参阅最佳 PDF 翻译工具

为什么学术论文很难翻译

学术 PDF 并不是简单的文本文件。它们结合了排版、符号、元数据和领域词汇。

元素翻译风险优秀输出所保留的内容
双栏排版阅读顺序可能会被打乱左右两栏保持逻辑顺序
公式符号可能会损坏或被“翻译”数学符号保持不变
引文标记可能会被移动、翻译或重新编号引文格式和参考文献保持完整
表格单元格可能会合并或错位行、列、表头和单位保持可用
图表图注可能会与图像脱离图注进行翻译,同时图表位置保持清晰
专业术语相同的术语可能会被翻译成多种不同的方式核心术语保持一致
姓名与机构人员和机构可能会被篡改姓名、电子邮件、ORCID ID、DOI 和标识符保持稳定

这就是为什么生硬的复制粘贴往往会失败的原因。它可能会对打乱的文本产生流利的翻译。

第一步:识别 PDF 类型

在翻译之前,请回答一个问题:你可以在 PDF 中选择文本吗?

PDF 类型如何识别推荐工作流
文本型 PDF你可以高亮显示单个单词使用具备排版识别能力的 PDF 工作流直接翻译
扫描版 PDF你只能将整个页面选为图像运行 OCR,然后进行翻译
混合型 PDF某些页面可选中,某些页面是图像对扫描页面进行 OCR,或使用能够检测两者的工作流
导出的预印本文本可选中,但排版可能比较粗糙翻译,然后检查分栏、图表和参考文献

如果 PDF 是扫描件,翻译质量取决于 OCR 的质量。低分辨率扫描件、倾斜的页面、手写内容、印章和页边注都会损坏提取出的文本。在评判翻译模型之前,请先参考扫描版 PDF 指南

第二步:保护公式和符号

公式通常应保持不变。周边的说明性文字应当翻译,但数学表达式不应被重写。

检查:

  • 行内公式
  • 独立公式
  • 公式编号
  • 希腊字母
  • 矩阵和积分
  • 化学式
  • 单位和常数
  • 诸如“Eq. (3)”或“Figure 2”之类的引用

需要注意的失败示例:

  • 当符号应该保留时,alpha 被翻译成了一个单词
  • 公式编号被移除
  • 减号被更改或丢失
  • 公式跨行拆分不正确
  • 对公式的引用与论文不再匹配

对于高风险的技术工作,请在翻译后邀请领域专家检查公式和核心声明。

第三步:保留引文和参考文献

引文是导航工具。它们不应该被创造性地本地化。

引文元素首选处理方式
文中引文(作者-年份)保持作者姓名和年份完整
编号引文保持方括号或上标数字完整
参考文献列表通常保留原始书目详细信息
DOI、URL、PMID、arXiv ID精确保留
期刊名称除非你的风格指南另有要求,否则通常不进行翻译
“et al.”不要破坏作者归属

如果你在撰写自己的论文,请引用原始来源。如果你引用了机器翻译的内容,请根据你所在领域的规范,披露该翻译是机器辅助生成或机器生成的。

第四步:处理表格和图表

表格和图表承载了学术论文中的大部分证据。它们需要与正文不同的审核流程。

表格检查清单:

  • 所有行和列都存在吗?
  • 表头翻译了吗?
  • 单位是否仍然依附于数值?
  • 小数点、逗号、范围和置信区间是否保持正确?
  • 脚注是否保留在表格附近?

图表检查清单:

  • 图注翻译了吗?
  • 图像是否保留在正确的位置?
  • 图像内部的坐标轴标签保持不变还是进行了有意处理?
  • 正文中的图表引用是否仍然正确?
  • A、B、C 等多面板标签是否仍然可见? | 不要假定图像内部的文本会被翻译。如果图表标签嵌入在图像中,它可能需要单独的图像编辑或图表重建工作流。

第五步:建立专业术语对照表

对于学术翻译,一致性通常比优美的文笔更重要。

在审核之前,列出:

  • 核心概念
  • 方法名称
  • 生物名称
  • 化学名称
  • 疾病名称
  • 模型名称
  • 数据集名称
  • 缩写
  • 作者定义的术语

然后在翻译后的论文中搜索这些术语。如果同一个源术语出现了多种目标语言翻译,请决定保留哪一个并修改其余部分。

这在以下领域尤为重要:

  • 医学
  • 法律
  • 化学
  • 机器学习
  • 工程学
  • 经济学
  • 哲学
  • 文学理论

第六步:翻译并审核论文

使用这个实用的工作流:

  1. 将论文上传到 PDF Translator 或同等具备排版识别能力的工作流中。
  2. 选择正确的源语言和目标语言。
  3. 下载翻译后的 PDF。
  4. 并排打开源文件和译文进行比对。
  5. 审核摘要、引言、方法、结果和结论。
  6. 抽查每一个表格和图注。
  7. 检查公式、数字、引文和参考文献。
  8. 如有必要,建立专业术语纠错表。
  9. 使用原始引文详细信息保存翻译后的 PDF。

如果你需要的不是单篇论文,而是完整的书籍、学位论文或长篇学术专著,请使用翻译书籍并按章节应用相同的审核逻辑。

学术翻译 QA 检查清单

在依赖翻译后的论文之前,请使用此检查清单:

部分检查内容
标题和摘要研究问题、方法、核心结果和范围
引言先前的工作和引文含义
方法方案、变量、模型、数据集、仪器
结果数字、p 值、置信区间、表格、图表
讨论因果声明、局限性和对冲语言(谨慎措辞)
结论最终声明与原文相符
参考文献姓名、年份、期刊名称、标识符
补充材料如有必要,单独翻译和审核文件

不要跳过结论。一篇论文的正文可能大体可读,但最终声明却可能被误译。

对比:常见工作流

工作流优势劣势最佳用途
复制粘贴到大模型中段落翻译速度快丢失排版和上下文;容易漏掉部分检查某个段落
浏览器/文档翻译方便快捷可能会破坏分栏、表格和公式简单的单栏 PDF
具备排版识别能力的 PDF 翻译器保留文档结构仍需技术审核完整的研究论文
人工学术翻译置信度最高昂贵且较慢出版、法律、临床、受监管用途
AI 与专家审核相结合平衡性好需要审核流程文献综述、内部研究、会议筹备

有关更广泛的 PDF 工具选择,请在最佳 PDF 翻译工具中进行对比。

应用场景

文献综述

AI 翻译对于筛选你所不熟悉语言的论文非常有用。首先翻译摘要、结论和相关部分。如果该论文成为你工作的核心,请仔细阅读完整的翻译版本并引用原文。

系统评价

使用翻译来减少语言偏误,但要记录你的流程。保留源 PDF、翻译后的 PDF、翻译方法以及任何审阅者的笔记。如果纳入决策取决于翻译的段落,请尽可能让双语审阅者进行检查。

会议筹备

在活动开始前翻译其他发言者的论文。将审核重点放在问题陈述、方法、结果和局限性上,以便你能提出更好的问题。

学术合作

对于跨语言的研究团队,双语输出非常有用。它让团队成员能够讨论翻译后的论文,同时在需要时检查原始专业术语。

教材与课程讲义

教材具有许多学术论文共有的问题:公式、图表、表格、专业术语和长篇一致性。按章节进行翻译,建立词汇表,并为学生将要接受测试的章节配备学科审阅者。

已知的失败模式

故障表现形式为什么重要
分栏合并左右两栏的段落交织在一起论点变得无法阅读
公式损坏符号、正负号或公式编号发生变化技术含义可能会出错
引文损坏参考文献标记移动或消失无法追溯声明
表格漂移表头与数值不再匹配数据具有误导性
术语过度自信某个术语虽然流利,但对该领域而言并不准确读者会误解方法
对冲语义丢失“May(可能)”、“suggests(表明)”或“not significant(不显著)”变得过于绝对科学声明被夸大
图表文本未翻译图注翻译了,但嵌入的标签没有翻译读者可能会错过视觉证据
OCR 错误扫描文本在翻译前被错误识别翻译忠实地翻译了错误的输入

伦理与实践限制

AI 翻译适用于理解、文献综述、内部讨论和初步筛选。当输出结果影响出版、患者护理、法律索赔、监管决策、工程安全或公共政策时,请务必更加谨慎。

实用规则:

  • 引用原始论文。
  • 除非你拥有相关权利,否则不要重新发布翻译后的文本。
  • 如果你的上下文需要,在引用翻译段落时披露机器翻译情况。
  • 关键声明必须由合格的人工审阅者进行检查。
  • 将源文件与译文一同保留,以便读者能够核实重要段落。

相关文章