BookTranslator
BookTranslator

Как подготовить файл книги к переводу

Подготовьте EPUB, DOCX или PDF к переводу, зафиксировав исходную версию, очистив правки, проинвентаризировав ресурсы, определив терминологию и создав проверяемую основу для приемки.

Подготовьте книгу к переводу, создав единый замороженный исходный пакет и основу для приемки. Урегулируйте правки, определите, что нужно и не нужно переводить, составьте опись глав и ресурсов, зафиксируйте имена и терминологию, а также выберите исходный формат, который сохранит необходимую структуру в целевом языке.

Не начинайте работу с файлом под названием final-final-2.docx и не откладывайте объяснения принятых решений на потом. Перевод многократно усиливает двусмысленность исходного текста для каждого нового целевого языка.

Используйте этот предполетный чек-лист:

  1. Зафиксируйте точное исходное издание.
  2. Удалите или осознанно оставьте комментарии, правки и скрытый контент.
  3. Выберите лучший исходный формат.
  4. Составьте опись предисловия, глав, послесловия, примечаний, изображений и таблиц.
  5. Пометьте контент, который нужно и не нужно переводить.
  6. Сформируйте первоначальный список терминологии и сущностей.
  7. Упакуйте шрифты, исходные изображения, ссылки и инструкции.
  8. Запишите количество знаков и контрольные фрагменты для тестирования.
  9. Определите критерии приемки переведенного файла.

Скачайте шаблон предполетной подготовки исходного файла книги и заполните его перед тем, как загружать полный файл или передавать его переводчику.

Зафиксируйте одну авторитетную исходную версию

Создайте учетную запись исходного материала, указав:

  • название и подзаголовок;
  • автора и издание;
  • исходный язык;
  • имя файла и номер ревизии;
  • зафиксированная дата;
  • количество глав и разделов;
  • количество слов или другая стабильная основа для контента;
  • включенные предисловия и послесловия; а также
  • владелец, уполномоченный утверждать изменения исходного текста.

Вносите последующие исправления в журнал изменений. Каждая запись должна указывать местоположение источника, старый контент, новый контент, причину, дату и затрагиваемые целевые редакции. Не перезаписывайте зафиксированный исходный текст во время выполнения перевода.

Если вы не можете объяснить, какой файл является авторитетным, остановитесь. Команда переводчиков не сможет сопоставить версии, которые вы не разделили.

Устранение комментариев, отслеживаемых изменений и скрытого контента

Для рукописей в формате DOCX решите, принимаются или отклоняются все отслеживаемые добавления или удаления и входят ли комментарии в пакет перевода. Скрытие разметки — это не ее удаление. Текущие рекомендации Microsoft по Word гласят, что отслеживаемые изменения должны быть приняты или отклонены для их удаления; режим отображения «Без разметки» лишь временно скрывает их.

Создавайте два файла, когда полезна история редактуры:

  • чистый исходный текст для перевода с устраненным текстом; и
  • справочная копия только для чтения, в которой сохраняются комментарии или история правок.

Также проверьте скрытый текст, свойства документа, колонтитулы, сноски, концевые сноски, текстовые поля, альтернативный текст и внедренные объекты. Если файл содержит конфиденциальный или не опубликованный материал, ознакомьтесь с контрольным списком конфиденциальности перевода документов перед его совместным использованием или выгрузкой.

Выбирайте исходный формат по структуре, а не по удобству

Доступный источникИспользуйте его, когдаПодготовка перед переводомОсновное ограничение
EPUBКнига имеет изменяемый формат, и структура глав имеет значениеПроверьте пакет, оглавление, языковые метаданные, ссылки, примечания и изображенияДля верстки с фиксированным макетом или необычных стилей CSS может потребоваться отдельное тестирование
DOCXРукопись доступна для редактирования, а стили, таблицы или комментарии имеют значениеПримите правки, нормализуйте стили, проверьте текстовые поля и колонтитулыЭто не финальный вариант для ридера или печати
Текстовый PDFPDF является авторитетным источником с фиксированным макетомПроверьте возможность выделения текста, порядок чтения, шрифты и состав страницРедактирование и текст на изображениях могут вызвать трудности
Сканированный PDFЛучшего источника не существуетЗапустите распознавание текста на репрезентативных страницах и зафиксируйте риски распознаванияРезультат OCR воссоздает контент, а не точный макет

Используйте наиболее исходный доступный вам редактируемый файл и сохраните эталонный экспорт, показывающий желаемый внешний вид. Конвертация чистого EPUB или DOCX в PDF перед переводом часто приводит к потере полезной структуры.

Для материалов, состоящих только из изображений, используйте предварительную проверку сканированного PDF прежде чем использовать текст после OCR в качестве исходного.

Проведите инвентаризацию всей книги, а не только основных глав

Перечислите каждую единицу контента и предполагаемый способ ее обработки:

  • текст обложки;
  • титульный лист и страница с информацией об авторских правах;
  • посвящение, эпиграф и выражения благодарности;
  • оглавление;
  • введения и предисловия;
  • основные главы;
  • таблицы, иллюстрации, подписи к ним и текст внутри изображений;
  • сноски и концевые сноски;
  • библиография и цитаты;
  • приложения, глоссарий и предметный указатель;
  • биография автора и призывы к действию; а также
  • метаданные и описание для магазинов, обрабатываемые вне основного файла.

Присвойте стабильный идентификатор каждой главе, иллюстрации, таблице и примечанию. Зафиксируйте, подлежит ли объект переводу, сохранению, замене, воссозданию или исключению. Отсутствующее приложение должно быть заметно в описи до того, как оно превратится в незаметный пропуск в целевом тексте.

Для формата EPUB спецификация W3C требует перечислять ресурсы публикации в манифесте пакета, а также использует метаданные пакета для такой информации, как название и автор. Спецификация EPUB 3.3 полезна здесь потому, что пакет представляет собой структурированную публикацию, а не папку с взаимозаменяемыми текстовыми файлами.

Отметьте то, что не следует переводить

Создайте список элементов, не подлежащих переводу, для таких объектов, как:

  • имена авторов и соавторов, если их утвержденная форма не меняется;
  • товарные знаки и названия продуктов;
  • URL-адреса, адреса электронной почты, идентификаторы и ISBN;
  • код, команды, пути к файлам и формулы;
  • цитируемые названия, которые должны сохранять исходную форму;
  • выдуманные слова, ожидающие редакционного решения; а также
  • цитаты, в которых следует использовать уже существующий авторизованный перевод.

Добавьте причину и контекст для каждого элемента. Метка DNT без пояснений может привести к сохранению неверной строки или подавлению контента, который действительно необходим читателям в переведенном виде.

Набор тегов международзации W3C включает категории данных для определения того, следует ли переводить контент, а также для терминологии и контекстной информации. Его требования ITS 2.0 иллюстрируют лежащий в основе принцип: переводимость и контекст представляют собой явные метаданные, а не догадки, оставляемые на усмотрение каждого переводчика.

Составьте первый инвентарь терминологии и сущностей

Не ждите двенадцатой главы, чтобы решить, как следует обрабатывать повторяющееся имя или концепцию. Начните со следующего:

  • имена персонажей, мест, организаций и продуктов;
  • титулы и формы обращения;
  • определенные технические или академические термины;
  • вымышленная лексика;
  • аббревиатуры;
  • повторяющиеся элементы интерфейса или процедурные метки;
  • единицы и соглашения об измерениях; а также
  • термины, которые намеренно меняются в зависимости от контекста.

Для каждой записи укажите исходную форму, определение или контекст, утвержденную целевую форму (если она известна), отклоненные варианты, правила написания с заглавной буквы или склонения, первое местоположение и лицо, принимающее решения.

Начальный список не должен предсказывать каждый термин. Он должен предотвратить очевидный разброс терминологии и предоставить место для записи последующих решений. Используйте шаблон согласованности терминологии книги в качестве рабочего ресурса.

Упакуйте внешние ресурсы и информацию о правах

Файл книги может зависеть от материалов, которые встроены не полностью:

  • источники изображений высокого разрешения;
  • редактируемые диаграммы;
  • файлы шрифтов и записи о лицензиях;
  • обложка и текстовые слои;
  • связанные медиафайлы;
  • существующие утвержденные переводы;
  • разрешения на цитаты, тексты песен или изображения; а также
  • стилистических руководств или требований издателя.

Не предполагайте, что разрешение на публикацию оригинала автоматически распространяется на переводное издание на каждом рынке. Зафиксируйте владельца прав и утвержденный объем для материалов, которые будут воспроизводиться или адаптироваться.

Что касается шрифтов, определите целевые системы письменности до начала перевода. Шрифт, содержащий только латиницу, может отлично выглядеть в оригинале и полностью не подходить для арабского, японского или девангари. Предоставьте лицензионный шрифт или утвержденный резервный вариант, а не оставляйте производственной группе возможность импровизировать после перевода.

Создайте базовую основу, которая позволит обнаруживать пропуски

Зафиксируйте практические показатели до перевода:

  • главы и основные разделы;
  • заголовки по уровням;
  • абзацы или текстовые блоки, если формат их отображает;
  • иллюстрации, таблицы, подписи к ним, примечания и ссылки;
  • записи в оглавлении;
  • компоненты предисловия и послесловия; а также
  • количество слов в исходном языке в качестве ориентира, а не правила равенства для целевого языка.

Количество слов в целевом языке будет отличаться в зависимости от языка, поэтому не отвергайте перевод только потому, что он длиннее. Используйте подсчеты для поиска пропущенных, дублированных или неожиданно пустых структур.

Для EPUB выполните проверку на соответствие стандартам для исходного файла. EPUBCheck поддерживается Консорциумом DAISY от имени W3C и проверяет соответствие стандарту EPUB. Устранение ошибок в исходном пакете до начала перевода предотвращает путаницу относительно того, были ли они созданы в процессе перевода.

Выберите репрезентативные отрывки перед полным переводом

Выберите небольшой тестовый пакет, который демонстрирует реальную сложность книги:

  • вводный текст;
  • диалог или отрывок с выраженным стилем речи;
  • насыщенный терминологией раздел;
  • таблица, иллюстрация, сноска или перекрестная ссылка;
  • длинный абзац и короткий фрагментированный текст;
  • культурно специфический или двусмысленный отрывок; а также
  • поздняя глава, которая проверяет преемственность с более ранними решениями.

Используйте тот же пакет для сравнения рабочих процессов и создания руководства по стилю. Не позволяйте поставщику или инструменту доказывать качество только на самой простой первой странице.

Тест не является утверждением, что вся книга будет вести себя одинаково. Это дешевый способ отсеять плохой исходный формат, глоссарий или процесс проверки до масштабирования.

Определите критерии приемки до начала перевода

Запишите:

  • целевой язык и локаль;
  • предполагаемое использование: личное чтение, редакторский черновик, внутреннее исследование или публикация;
  • формат вывода;
  • требуемая двуязычная версия или версия только на целевом языке;
  • утвержденные имена и терминологию;
  • структуры, которые должны оставаться пригодными для использования;
  • ожидаемую проверку человеком;
  • серьезность дефектов и правила эскалации; а также
  • кто утверждает язык, предметную область и финальное производство.

Если целью является публичный выпуск, включите редактирование на родном языке и проверку макета в финальном формате. Если целью является личное чтение, полнота и понятный смысл могут оказаться достаточными. контрольный список контроля качества перевода книг контрольный список контроля качества перевода книг может стать журналом приемки для готового перевода.

Где применяется BookTranslator

Как только исходный пакет стабилизируется, загрузите полностью поддерживаемый файл через рабочий процесс BookTranslator рабочий процесс BookTranslator. Форматы EPUB, PDF и DOCX требуют разных проверок, поэтому переведите репрезентативный тестовый пакет или изучите сложный раздел, прежде чем утверждать полный план проверки. Используйте автоматический глоссарий для повторяющихся имен и терминов, а также используйте двуязычный вывод там, где он поддерживается, для проверки важных отрывков.

BookTranslator не разрешает неоднозначность исходного текста, не утверждает права, не лицензирует шрифты и не решает, какие правки должны войти в книгу. Это решения по подготовке исходных материалов. Для сканированных PDF-файлов режим OCR отдает приоритет извлекаемому переведенному контенту, а не точному воспроизведению исходной страницы.

Финальный рубеж проверки исходного пакета

Книга готова к переводу только тогда, когда:

  • одна авторитетная версия исходного текста заморожена;
  • ревизии, комментарии, скрытый контент и исключения урегулированы;
  • выбран лучший доступный путь EPUB, DOCX, PDF или распознавания текста (OCR);
  • для каждой главы, ресурса, заметки и элемента послесловия определен план обработки;
  • назначены ответственные за решения по защите от перевода (DNT) и терминологии;
  • исходные ресурсы, шрифты, ссылки и сведения о правах упакованы;
  • структурные показатели и репрезентативные отрывки зафиксированы; а также
  • целевая локаль, предполагаемое использование, формат вывода, глубина проверки и критерии приемки четко определены.

Качественная подготовка исходного текста не гарантирует хороший перевод. Она устраняет избегаемую двусмысленность и предоставляет рецензентам доказательства, если что-то пропадет.

Похожие статьи