Контрольный список проверки качества перевода PDF: макет, таблицы, шрифты и пропущенный текст
Проверьте переведенный PDF-файл на наличие пропущенного текста, неправильного порядка чтения, сломанных таблиц, обрезанного макета, проблем со шрифтами, ссылок и дефектов при выпуске финального файла.

Переведенный PDF-файл проходит контроль качества только тогда, когда его текст полон и точен, логический порядок чтения по-прежнему работает, а каждая страница остается пригодной для использования на целевом экране или при печати. Файл, который открывается без ошибок, не прошел почти ни одну из этих проверок.
Используйте следующий порядок:
- Зафиксируйте исходный и целевой файлы.
- Сравните полноту страниц и контент-блоков.
- Проверьте порядок чтения и соответствие исходного и целевого смыслов.
- Проведите стресс-тестирование таблиц, шрифтов, иллюстраций, ссылок, колонтитулов и границ страниц.
- Изучите сложные страницы при обычном масштабе и при высоком зуме.
- Регистрируйте дефекты по степени серьезности и ищите те же шаблоны во всем PDF-файле.
- Повторно проверьте окончательный экспортированный файл после исправления ошибок.
Скачайте контрольный список проверки качества перевода PDF чтобы зафиксировать доказательства на уровне страниц и статус приемки.
Сначала установите целевой критерий приемки
PDF-файлы служат для разных задач. Определите предполагаемое использование, прежде чем оценивать результат.
| Предполагаемое использование | Минимальное ожидание | Типичная помеха |
|---|---|---|
| Личное чтение | Полный, читаемый текст в разумном порядке | Пропущенные страницы, нечитаемый текст или существенно искаженный смысл |
| Внутреннее использование | Проверяемые утверждения, цифры, таблицы, иллюстрации и цитаты | Номер, предупреждение или ссылка больше не соответствуют оригиналу |
| Передача клиенту | Согласованная терминология, стабильная верстка, работающие ссылки и документированная проверка | Повторяющиеся языковые ошибки или производственные дефекты без ответственного лица |
| Публичный цифровой релиз | Редакционная проверка, доступный порядок чтения, проверка на устройствах и финальная вычитка файла | Обрезка текста, пропавший контент, нарушенная навигация или нерешенные проблемы |
| Печать | Правильный обрезной формат, вылеты под обрез, поля, шрифты, качество изображений и тиражная проба | Текст за пределами печатной зоны либо замененные или отсутствующие глифы |
Визуальное факсимиле может быть приоритетом для бланка или дизайнерского буклета. Логический порядок чтения может преобладать в доступном отчете. И то и другое важно для многих электронных книг и публичных документов, но весовые коэффициенты приемки различаются.
Этап 1: подтвердите, что исходный и целевой файлы связаны друг с другом
Запишите имя исходного файла, версию, контрольную сумму или неизменяемую ссылку, количество страниц, язык и наличие в файле выделяемого текста. Запишите те же данные для переведенного PDF.
Затем сравните:
- первую и последнюю страницу;
- количество страниц и нумерацию страниц;
- последовательность разделов и заголовков;
- количество таблиц, рисунков, сносок, приложений и вложений;
- колонтитулы, водяные знаки, поля форм и аннотации;
- видимые ссылки и целевые адреса; а также
- контент, исключенный намеренно.
Разное количество страниц не обязательно означает ошибку: переведенный текст может перетекать или производственный процесс может добавлять страницы. Но каждое расхождение должно иметь объяснение. Если в целевом документе меньше страниц, не считайте его более эффективным — убедитесь, что контент не был утерян.
Для сканированных источников проверьте слой OCR перед оценкой перевода. В статье процесс перевода сканированных PDF охватывает перекос, качество изображений, выбор языка, подозрительные символы, рукописный текст и страницы со смешанным печатным и рукописным текстом.
Этап 2: обнаружение пропущенного и дублированного текста
Пропущенный текст часто менее заметен, чем неудачный перевод, так как ничто не привлекает к нему внимания проверяющего. Перед редактированием текста на уровне строк используйте структурные сравнения.
Проверьте:
- титульную страницу, подзаголовок, автора, данные о пересмотре и юридическую информацию;
- каждый заголовок и элемент списка;
- первый и последний абзацы на каждой странице;
- текст внутри фигур, диаграмм, врезок, подписей и боковых панелей;
- заголовки таблиц, ячейки, примечания и метки продолжения;
- маркеры сносок и текст сносок;
- перекрестные ссылки, цитаты, URL-адреса и ссылки на страницы;
- колонтитулы, штампы и краевой контент; а также
- приложения и страницы с малым количеством текста.
Выполните поиск повторяющихся вводных фраз, чтобы найти дублирующиеся фрагменты. Выполните поиск остатков исходного языка, но поддерживайте список исключений (do-not-translate) для имен, формул, кода, торговых марок и цитируемых материалов, которые должны оставаться без изменений.
Когда формат PDF позволяет извлекать текст, сравнивайте нормализованное количество блоков в исходном и целевом файлах как предупреждающий сигнал, а не как оценку качества. Языковое расширение, лигатуры, распознавание текста (OCR) и сегментация могут изменять количество блоков. Любое значительное или локализованное несоответствие должно направить проверяющего на соответствующую страницу.
Этап 3: проверка логического порядка чтения
Двухколоночный PDF-файл может выглядеть корректно, в то время как извлеченный из него текст чередуется между колонками. В этом случае программы экранного доступа, операции копирования и вставки, индексация для поиска и дальнейший перевод могут получить неверный порядок предложений.
Выполните следующие проверки:
- Выделите и скопируйте многоколоночный раздел в текстовый редактор без форматирования.
- Перемещайтесь по заголовкам, абзацам, спискам, иллюстрациям и примечаниям с помощью клавиатуры в программе чтения PDF, поддерживающей навигацию.
- Проверьте панель тегов или порядка чтения, если требуются функции доступности.
- Сравните порядок элементов вокруг плавающих изображений, боковых панелей и сносок.
- Повторите тест на переведенном PDF-файле; процесс реконструкции может создать новый дефект порядка даже тогда, когда в исходном файле все было верно.
Для каждого сбоя определите, где возник дефект: при извлечении исходного текста, сегментации при переводе или реконструкции целевого документа. Исправление визуальных координат не обязательно приведет к исправлению логического порядка.
Этап 4: проверка макета в точках напряжения
Не проверяйте только красивые страницы. Добейтесь проверки структур, которые наиболее склонны к сбоям.
Расширение и обрезка текста
Целевой текст может быть длиннее или короче исходного. Проверьте узкие колонки, кнопки, метки, ячейки таблиц, выноски на рисунках, нижние колонтитулы и заголовки рядом с границами страниц.
Отклонить:
- текст, обрезанный по краю фрейма;
- перекрывающиеся строки или объекты;
- заголовки, оторванные от своего первого абзаца;
- одиночную строку, перенесенную на пустую в противном случае страницу без осознанного дизайнерского решения;
- текст, уменьшенный ниже согласованного читаемого размера; и
- скрытое переполнение, которое становится видимым только при выделении или копировании.
Проверьте один раз при обычном размере чтения и еще раз при масштабе 200–400%. Обычный размер выявляет иерархию и удобство использования; высокий масштаб выявляет перекрытия, поврежденные глифы и растрированный текст.
Таблицы
Таблицы объединяют смысл и геометрию. Сравните заголовки строк и столбцов, порядок ячеек, единицы измерения, десятичные разделители, сноски, повторяющиеся заголовки и разрывы страниц.
Убедитесь, что:
- каждая исходная строка и столбец имеют целевой аналог;
- значения остаются привязанными к правильным меткам;
- знаки минус, диапазоны, проценты и единицы измерения сохранены;
- ячейки не переполняются, не исчезают и не закрывают границы;
- разделенные таблицы повторяют правильный заголовок; и
- логический порядок извлечения соответствует видимой таблице.
Красиво выровненная таблица с одним значением не под тем заголовком — это серьезный дефект содержимого.
Рисунки, диаграммы и подписи
Убедитесь, что каждый рисунок присутствует, читаем и связан с правильной подписью. Текст, встроенный в изображение, может быть опущен в рабочем процессе текстового перевода. Решите, должен ли он быть локализован, перестроен или явно оставлен на языке оригинала.
Проверьте перекрестные ссылки вроде «см. Рисунок 8» после изменения нумерации страниц. Убедитесь в наличии замещающего текста (alt text), если к доставке предъявляются требования по доступности; видимая подпись не заменяет полноценное описательное альтернативное описание.
Колонтитулы, нижние колонтитулы и служебные элементы страниц
Проверьте бегущие колонтитулы, номера страниц, даты, знаки версий, метки конфиденциальности, логотипы и нижние колонтитулы. Эти элементы часто обрабатываются отдельно от основного текста и могут исчезать, дублироваться или оставаться непереведенными.
Этап 5: тестирование шрифтов и письменностей
Проблемы со шрифтами включают в себя не только очевидные пустые квадраты. Проверьте:
- знаки с диакритическими и комбинируемыми знаками;
- арабскую и индийскую вязку (шейпинг);
- двунаправленное поведение иврита и арабского языка;
- пунктуацию и правила переноса строк для CJK (китайский, японский, корейский);
- математические символы, валюты, верхние и нижние индексы;
- жирное, курсивное, капитель и резервные (fallback) стили;
- скопированный текст в сравнении с видимыми глифами; а также
- статус внедрения шрифтов, если PDF предназначен для печати или распространения.
Резервный шрифт может сохранить читаемость символов, но изменить длину строки настолько, что это приведет к обрезке текста или переверстке страницы. Проверяйте каждый стиль, а не только основной текст. Выполните поиск по всему документу после обнаружения хотя бы одного отсутствующего или замененного глифа, так как этот же шрифт, скорее всего, используется повторно.
Для текстов на арабском языке и иврите переходите к проверкам перевода книг с письменностью справа налево (RTL); направление текста, числа, URL-адреса, таблицы, порядок обложки и порядок следования страниц требуют отдельной проверки.
Этап 6: проверка ссылок, форм и интерактивных элементов
Проверьте кликом каждый уникальный тип ссылки и выборочно — повторяющиеся ссылки по всему файлу:
- записи оглавления;
- внутренние ссылки на страницы и разделы;
- внешние URL-адреса;
- ссылки электронной почты;
- ссылки на сноски и обратно; а также
- закладок.
Убедитесь, что переведенный видимый текст по-прежнему описывает пункт назначения. Работающая гиперссылка с неверно переведенной меткой считается ошибкой.
Если исходный документ содержит формы, решите, должен ли переведенный результат оставаться интерактивным и доступным для заполнения. Проверьте порядок полей, метки, валидацию, флажки, подписи, вычисления и сохраненные значения. Объединение слоев (растрирование) может быть осознанным шагом, но это должно быть согласованным решением о доставке.
Классификация дефектов по степени влияния на релиз
| Критичность | Примеры в PDF | Требуемые действия |
|---|---|---|
| Блокер | Пропавшая страница; нечитаемый файл; неверный исходный файл; искаженное предупреждение; нарушенный обязательный порядок чтения | Остановить выпуск, устранить причину и повторно выполнить затронутые проверки |
| Мажорный | Пропущенный абзац; неверное значение в таблице; обрезанный текст; повторяющийся сбой шрифта; нарушенная навигация | Исправить до приемки и выполнить поиск аналогичных паттернов в других частях документа |
| Косметический | Локальные проблемы с интервалами, выравниванием, висячими строками или незначительное несоответствие стилю без искажения смысла | Исправить в соответствии с согласованным производственным порогом |
Стандарт ISO 5060:2024 охватывает оценку качества аналитического перевода с использованием типов ошибок, настраиваемых штрафов и рассматривает методы выборки. Контроль качества релизов PDF также включает в себя проверки производства, структуры, доступности и интерактивности, выходящие за рамки оценки результатов перевода.
Выполняйте выборку осознанно, затем эскалируйте
Даже если полный визуальный осмотр невозможен, не ограничивайтесь случайными страницами. Включите в проверку:
- Первую и последнюю страницы, оглавление и начало каждого раздела.
- Самую насыщенную текстом страницу и страницу с минимальным количеством текста.
- Каждую уникальную таблицу, рисунок, примечание, форму, колонку и структуру списка.
- Страницы с редкими письменностями, символами, именами, датами и числами.
- Страница до и после каждого крупного изменения макета.
- Любой фрагмент, где ошибка может нанести материальный ущерб.
Эскалируйте масштаб при скоплении дефектов:
- один косметический дефект: зафиксируйте в журнале и продолжайте;
- один крупный дефект: найдите такой же паттерн во всем PDF и проверьте соседние страницы;
- два крупных дефекта одного типа: рассматривайте проблему как системную, пока не доказано обратное; и
- любой блокирующий дефект: остановите приемку и повторите все проверки, затронутые причиной.
Финальный этап выпуска переведенного PDF
Принимайте PDF только тогда, когда:
- исходная и целевая версии однозначны;
- присутствуют все ожидаемые страницы и структуры контента;
- порядок чтения подходит для предполагаемого использования;
- таблицы сохраняют метки, значения, единицы измерения и структуру;
- никакой обязательный текст не обрезан, не накладывается друг на друга и не имеет нечитаемо мелкий размер;
- шрифты поддерживают все необходимые глифы и стили;
- иллюстрации, подписи, примечания, ссылки и закладки работают должным образом;
- каждый блокирующий и серьезный дефект исправлен и перепроверен;
- финальный экспорт — а не промежуточный файл — прошел последнюю проверку; и
- журнал проблем и решение о приемке сохранены вместе с готовым материалом.
Используйте более общий чек-лист контроля качества книг и длинных документов для правил определения смыслов, терминологии и выборки. Используйте перевод PDF с сохранением формата для выбора и тестирования производственного рабочего процесса. PDF-переводчик BookTranslator может сформировать переведенный PDF для поддерживаемых файлов; приведенные выше проверки на уровне страниц определяют, готов ли этот результат к использованию по назначению.
Похожие статьи





