良い翻訳とは何か?精度、流暢さ、目的、そしてエビデンス
意味、言語、用語、オーディエンス、体裁、そして利用目的にわたる翻訳品質を判断するための実践的なフレームワーク。

優れた翻訳とは、原文の意図する意味と効果を保持し、ターゲット言語として自然に読め、依頼されたオーディエンスと目的に適合するものです。また、最終的な形式において完全性、一貫性、および実用性が維持されていなければなりません。流暢さだけでは、それらの要素のいずれも証明することはできません。
その定義により、翻訳のレビューは個人の好みを競うものから、エビデンスに基づく意思決定へと変化します。レビューを行う前に、ユースケースとエラーの影響を指定してください。その後、品質の個別ディメンションを評価し、不具合をタイプと重要度ごとに記録し、リスクを反映したリリース基準を適用します。
プロジェクト独自の基準、サンプル、エビデンス、および受け入れ判断を定義するために、翻訳品質スコアカードをダウンロードしてください。
普遍的なスコアではなく、目的から始める
同じターゲットテキストであっても、ある目的では十分であっても、別の目的では受け入れられない場合があります。個人的な読書補助であれば、意味が復元できる限り、不自然な言い回しは許容されるかもしれません。一般向けの小説には、持続するトーンと編集上の洗練が必要です。安全性の指示書は、すべての文が自然に聞こえたとしても、1つの助動詞が変わっただけで不合格になることがあります。
欧州委員会は、目的に適った翻訳を、対象読者にとって自然に読める状態を保ちながら、同じ意味と効果を伝えるものとして説明しています。その現在の翻訳品質ガイダンスでも、レビューの深さはエラーの結果と発生確率に結び付けられています。
評価を行う前に、短い品質仕様書を作成します:
| 決定事項 | 回答すべき質問 | エビデンスの例 |
|---|---|---|
| 目的 | 読者は翻訳をどのように使用しますか? | 個人での読書、社内調査、出版、規制対象の用途 |
| オーディエンス | 誰が、どのロケールで読みますか? | 年齢、専門知識、地域、アクセシビリティのニーズ |
| コンテンツのリスク | 一節に誤りがあった場合、どうなりますか? | 混乱、ストーリーの手がかりの喪失、金銭的損失、安全でない行為 |
| 必要な管理項目 | どの決定事項を維持すべきか? | 用語、用語集、敬語・丁寧さのレベル、単位、引用、レイアウト |
| 承認ルール | 何が承認、修正、または却下を引き起こすか? | ブロッカーなし。重大な問題は修正および再確認済み |
この仕様がない場合、2人のレビューアーがそれぞれ異なる基準で暗黙的に判断しているため、正反対の結論に達する可能性があります。
7つの独立した次元を評価する
「MQM Coreエラー分類法」は、翻訳の問題を用語、正確さ、言語表現の慣習、スタイル、地域的慣習、読者層への適切さ、デザインとマークアップに分類します。翻訳はある基準では合格しても別の基準では不合格になることがあるため、これらは有用なレビューの視点となります。
1. 正確さ:ターゲットはソースの意味を保持しているか?
命題、関係、否定、モダリティ、順序、数量、参照を比較します。追加、脱落、歪曲、未翻訳のコンテンツがないか確認します。
次のソースの指示を考えてみましょう:
The valve must remain closed until the pressure falls below 2 bar.
次に、検証のために逆翻訳された、意味が流暢なターゲット文を想像してください:
The valve may remain closed until the pressure falls below 2 bar.
文法が完璧であっても、翻訳が使い物にならないことがあります。Must が may になったため、義務がオプションになりました。正確さのレビューではソースとターゲットを比較する必要があり、ターゲットを読むだけではこの不具合を明らかにすることはできません。
2. 言語表現の慣習:ターゲット言語として自然で正しい文章か?
文法、スペル、句読点、構文、一致、および機械的な正しさを確認します。次に、つながった一節を読んで結束性を確かめます。文ごとの見直しだけでは、壊れた参照チェーン、不整合な時制、あるいは流れていない段落を見落とす可能性があります。
自然さはこの側面の証拠であり、正確さの代用品ではありません。プロセスの響きがネイティブ的かどうかだけを問うレビューアーは、自信に満ちた誤訳を承認してしまうかもしれません。
3. 用語:管理された概念が正しく一貫して命名されているか?
完成したターゲット全体で、名前、場所、タイトル、製品用語、ドメイン用語、頭字語、および繰り返し現れるフレーズを検索します。すべてのバリエーションを承認された用語集またはプロジェクトの決定と比較します。
一貫性は盲目的な繰り返しではありません。同じソース単語が異なる文脈では異なるターゲット単語を必要とする場合があり、一方で複数のソースバリエーションが1つの管理された概念を指すこともあります。book translation terminology workflow は、それらの決定や却下された代替案を記録する方法を説明しています。
4. スタイルとレジスター:声のトーンがソースと状況に適合しているか?
形式性、トーン、リズム、ジャンルの慣習、文の密度、キャラクター造形、ユーモア、および編集スタイルを確認します。フィクションでは、文法的に正しい行であっても、子供が突然官僚的に聞こえたり、2人の異なるキャラクターが同じ声を取得したりするために失敗することがあります。
スタイルのレビューを「私なら別の言い方をする」に還元しないでください。好みが欠陥になるのは、それがソース、合意された仕様、ターゲット言語の慣習、または確立されたスタイルの決定に違反する場合のみです。
5. ロケールとオーディエンス:意図された読者に対して機能しているか?
引用符、日付と数値のフォーマット、単位、通貨、住所、名前の順序、方向性、文化的な知識、読解レベル、および市場固有の慣習を確認します。オーディエンスレビューでは、説明が欠けているかどうか、またはターゲット読者が持っていない知識を適応が前提としていないかどうかも問われます。
これは翻訳とローカライズが重なり合う部分ですが、テストは具体的です:このオーディエンスは配信されたテキストを意図したとおりに理解し、使用できるか?
6. 完全性:必要なすべての単位が1回、順序通りに存在するか?
章、見出し、段落、表の行、キャプション、脚注、巻末注、リンク、引用、付録、および前付けと後付けを確認します。ソース言語の残骸、重複した境界テキスト、および切り詰められた冒頭や結びを検索します。
評価フレームワークが省略を正確さの下にグループ化する場合でも、完全性はしばしば独自のリリースゲートに値します。欠落した章は、他の場所での何千もの優れた文によって相殺されるわけではありません。
7. デザインとマークアップ:最終的な成果物が使用可能な状態を維持しているか?
実際のPDF、EPUB、DOCX、字幕ファイル、またはウェブページを開きます。読書順序、ナビゲーション、表、図、見出し、リンク、改行、埋め込みフォント、右から左への動作、およびテキストのクリッピングを検査します。表が読めなくなったり、EPUBの注釈がリンクバックしなくなったりしたために製品が失敗する一方で、ターゲットの単語は正しい場合があります。
real translation samplesreal translation samples は、レイアウト、スクリプト、表、および読書順序が、化粧品のような後付けではなく、翻訳品質に属する理由を示しています。
エラーの種類と重要度を分ける
エラーの種類は、何が失敗したかを教えてくれます。重要度は、その失敗が意図された使用に何をもたらすかを教えてくれます。それらの判断を分けておいてください。
| 重要度 | 運用の意味 | 例 | 判断 |
|---|---|---|---|
| 致命的 | 成果物を目的に不適合なものにする、または重大な害を引き起こす | 安全に関する指示の逆転、機密情報の漏洩 | 即座に却下 |
| 重大 | 意味、信頼性、または有用性を実質的に変更する | 段落の欠落、繰り返される誤った名前、壊れた表 | 承認前に修正し、パターンの有無を調査する |
| 軽微 | 局所的な影響が限定的であり、目的を達成できる | 孤立した句読点または重要ではないスタイルの欠陥 | 必要に応じて修正し、繰り返されるパターンを追跡する |
| 中立 | 許容可能なバリエーションまたはレビュアーのメモ | 仕様で禁止されていない擁護可能な代替案 | 不具合としてカウントしない |
MQMの採点ガイダンスは、エラーの種類と重要度レベルを使用してリスクを表現し、設定可能なスコアを生成します。有益な原則は、普遍的な魔法の数字ではありません。1つの重大な欠陥が平均の中に埋もれて消えないようにすることです。
印象ではなく証拠に基づいてレビューする
擁護可能な評価には監査証跡が残ります。サンプリングされた各パッセージまたは欠陥について、次を記録します。
- 翻訳元と翻訳先の場所、
- 正確な翻訳元テキストと現在の翻訳先テキスト、
- エラーの種類と重要度、
- 判定の根拠となる仕様または証拠、
- 提案された修正案と担当者、および
- 最終的な修正が独立して再確認されたかどうか。
少なくとも2回のパスを使用してください。1回目では、翻訳元と翻訳先を比較して網羅性と意味を確認します。2回目では、一貫性、スタイル、およびターゲット層への適合性を確認するために、翻訳先の言語のコンテンツとして読み込みます。用語検索や形式チェックを言語サンプルだけに限定せず、成果物全体に対して実施してください。
「ISO 5060:2024の概要」では、エラーの種類と減点方式を用いた分析的評価について説明し、評価者の適格性とサンプリングについて議論しています。ここでダウンロード可能なスコアカードは、そうした一般概念を軽量なプロジェクトツールとして応用したものであり、これを使用することはISOへの準拠を主張するものではありません。
リスクごとにサンプリングし、不具合が集中している場合は範囲を拡大する
完全な人間によるレビューが実用的でない場合、簡単またはランダムなページだけを選ばないでください。難しいコンテンツをサンプルに強制的に含めます:
- 冒頭、結び、およびすべての構造的境界。
- 固有名詞、用語、数値、引用が最も密集している箇所。
- 対話、ユーモア、慣用句、曖昧さ、および高レジスターの文章。
- 表、注記、図、リスト、数式、リンクなどのすべての特殊な構造。
- 失敗した場合に重大な結果をもたらす指示や主張。
- 異なる設定、モデル、または翻訳元のリビジョンで翻訳されたセクション。
エラーがシステム的な問題を示唆している場合は、レビューを拡大してください。1つの誤ったキャラクター名が見つかった場合、その名前とバリエーションの完全な検索がトリガーされます。1つの欠落したパラグラフは、すべての処理境界周辺の構造的比較をトリガーします。1つの平坦化された慣用句は、検出された行の修正にとどまらず、慣用句に焦点を当てたレビューをトリガーします。
運用上のファイル全体を処理するプロセスについては、書籍および長文ドキュメント向けQAチェックリストを使用してください。そのチェックリストには「成果物を検査する方法」が記載されており、このフレームワークには「品質が何を意味し、根拠が十分に揃っているかどうかの確認 リリースを判断します。
承認、修正、または却下の基準を使用します
結論の出ないパーセンテージで終わらせず、次の3つの明確な結果を設定します。
- 承認: 重大なエラーがなく、未解決の主要な問題もなく、必須のファイル完全性チェックに合格しており、サンプルが意図された用途をサポートしている場合。
- 修正: 成果物は回復可能であるものの、重大な欠陥や体系的な欠陥の修正と、対象を絞った再検査が必要な場合。
- 却下: 誤ったソースや言語が使用された、必要なコンテンツが大規模に欠落している、出力が使用不能である、またはワークフローがリスクに見合った根拠を提供できない場合。
公開、契約、財務、臨床、法務、または安全性が重要なコンテンツについては、基準をより厳しくする必要があります。自動評価指標による高いスコアは、既知のブロッカーを上書きするものではありません。
実用的な品質ゲート
翻訳を承認する前に、以下のすべてを確認してください。
- ソースバージョン、目的、対象読者、ロケール、出力形式が記録されていること。
- 意味、完全性、用語、言語、スタイル、ロケール、対象読者、表現が個別の観点としてレビューされていること。
- すべての重大または主要な問題に、担当者、修正内容、および最終再チェックが紐づいていること。
- 統制用語、専門用語、数値、翻訳除外項目がターゲット全体で網羅的に検索されていること。
- 最終的な成果物が、読者や対象読者が使用するアプリケーションで正しく機能すること。
- サンプリングが、高リスクなコンテンツおよび構造的に難易度の高いコンテンツをカバーしていること。
- 判断が単なる「良さそう」ではなく、承認、修正、または却下であること。
このレビューの前に完全な翻訳ドラフトが必要な場合は、BookTranslator を使用すると、元のファイルから書籍やドキュメントを処理できます。文脈を考慮した翻訳や用語集コントロールにより、長文における判断の一貫性を保つことができますが、これらは原文との比較、ターゲット言語の編集、または上記のリスクベースのリリースゲートに代わるものではありません。





