BookTranslator
BookTranslator

Lista kontrolna QA tłumaczenia PDF: układ, tabele, czcionki i brakujący tekst

Sprawdź przetłumaczony plik PDF pod kątem brakującego tekstu, nieprawidłowej kolejności czytania, uszkodzonych tabel, przyciętego układu, błędów czcionek, łączy oraz wad wydania ostatecznego pliku.

BookTranslator

BookTranslator Team

10 min read

Przetłumaczony plik PDF przechodzi kontrolę jakości tylko wtedy, gdy jego tekst jest kompletny i dokładny, logiczna kolejność czytania nadal działa, a każda strona pozostaje użyteczna w docelowym rozmiarze ekranu lub wydruku. Plik, który otwiera się bez błędu, nie przeszedł prawie żadnego z tych sprawdzianów.

Użyj następującej kolejności:

  1. Zablokuj dokładne pliki źródłowe i docelowe.
  2. Porównaj kompletność stron i bloków treści.
  3. Sprawdź kolejność czytania oraz znaczenie ze źródła do celu.
  4. Przeprowadź testy obciążeniowe tabel, czcionek, rycin, łączy, nagłówków i granic stron.
  5. Przejrzyj trudne strony w normalnym rozmiarze i przy dużym powiększeniu.
  6. Rejestruj wady według stopnia ich ważności i szukaj tego samego wzorca w całym pliku PDF.
  7. Sprawdź ponownie ostateczny wyeksportowany plik po wprowadzeniu poprawek.

Pobierz listę kontrolną QA tłumaczenia PDF, aby rejestrować dowody na poziomie stron i status akceptacji.

Najpierw ustal cel akceptacji

Pliki PDF służą do różnych zadań. Określ zamierzone zastosowanie przed oceną wyniku.

Zamierzone zastosowanieMinimalne oczekiwanieTypowa blokada
Czytanie prywatneKompletny, czytelny tekst w rozsądnej kolejnościBrakujące strony, nieczytelny tekst lub istotnie błędne znaczenie
Odniesienie wewnętrznePrzetracealne stwierdzenia, liczby, tabele, ryciny i cytatyNumer, ostrzeżenie lub odniesienie nie pasuje już do oryginału
Dostarczenie do klientaUzgodniona terminologia, stabilny układ, działające łącza i udokumentowana recenzjaPowtarzające się wady językowe lub produkcyjne bez przypisanego właściciela
Publiczna publikacja cyfrowaPrzegląd redakcyjny, dostępna kolejność czytania, kontrola urządzeń i ostateczna weryfikacja plikuPrzycięcie, brakująca treść, uszkodzona nawigacja lub nierozwiązane przeszkody
DrukPrawidłowy format, spady, marginesy, czcionki, jakość obrazu i dowód produkcyjnyTekst poza obszarem druku lub zastąpione/brakujące glify

Wizualne odwzorowanie może być priorytetem w przypadku formularza lub zaprojektowanej broszury. Logiczna kolejność czytania może dominować w dostępnym raporcie. Obie kwestie mają znaczenie w przypadku wielu e-booków i dokumentów publicznych, ale wagi akceptacji nie są identyczne.

Faza 1: udowodnienie, że tekst źródłowy i docelowy do siebie należą

Zapisz nazwę pliku źródłowego, wersję, sumę kontrolną lub niezmienne łącze, liczbę stron, język oraz informację, czy plik zawiera zaznaczalny tekst. Zapisz te same dane dla przetłumaczonego pliku PDF.

Następnie porównaj:

  • pierwszą i ostatnią stronę;
  • liczbę stron i etykiety stron;
  • sekwencję sekcji i nagłówków;
  • liczba tabel, rysunków, przypisów, aneksów i załączników;
  • nagłówki, stopki, znaki wodne, pola formularzy i adnotacje;
  • widoczne łącza i miejsca docelowe; oraz
  • celowo wykluczone treści.

Różna liczba stron nie oznacza automatycznie błędu: przetłumaczony tekst może ulec przelaniu lub przepływ produkcyjny może wstawić strony. Jednak każda różnica musi być wyjaśnialna. Jeśli wersja docelowa ma mniej stron, nie zakładaj, że jest wydajniejsza; udowodnij, że treść nie została pominięta.

W przypadku źródeł skanowanych zweryfikuj warstwę OCR przed oceną tłumaczenia. Zprzepływ pracy tłumaczenia skanowanych plików PDF obejmuje skos, jakość obrazu, wybór języka, podejrzane znaki, pismo odręczne oraz strony zawierające zarówno druk, jak i pisma odręczne.

Faza 2: wykrywanie brakującego i zduplikowanego tekstu

Brakujący tekst jest często mniej widoczny niż tekst niezręczny, ponieważ nic nie przyciąga uwagi recenzera. Przed edycją liniową należy skorzystać z porównań strukturalnych.

Sprawdź:

  • stronę tytułową, podtytuł, autora, wersję oraz strony prawne;
  • każdy nagłówek i element listy;
  • pierwszy i ostatni akapit na każdej stronie;
  • tekst wewnątrz kształtów, diagramów, wyróżnień, podpisów i paneli bocznych;
  • nagłówki tabel, komórki, przypisy i etykiety kontynuacji;
  • znaczniki przypisów i treść przypisów;
  • odesłania, cytaty, adresy URL i odnośniki do stron;
  • nagłówki, stopki, pieczęcie i zawartość marginesów; oraz
  • dodatki i strony zawierające niewiele tekstu.

Wyszukaj powtarzające się frazy początkowe, aby znaleźć zduplikowane segmenty. Poszukaj pozostałości języka źródłowego, ale zachowaj listę elementów niertłumaczonych dla nazw, wzorów, kodu, znaków towarowych i materiałów cytowanych, które powinny pozostać bez zmian.

Gdy plik PDF umożliwia wyodrębnianie tekstu, porównaj znormalizowane liczby bloków źródłowych i docelowych jako sygnał ostrzegawczy, a nie ocenę jakości. Rozszerzenie języka, ligatury, OCR i segmentacja mogą zmieniać liczby. Każda duża lub zlokalizowana rozbieżność powinna skierować recenzera do odpowiedniej strony.

Faza 3: weryfikacja logicznej kolejności czytania

Dwukolumnowy plik PDF może wyglądać poprawnie, podczas gdy jego wyodrębniony tekst przeplata się między kolumnami. Czytniki ekranu, funkcja kopiuj i wklej, indeksowanie wyszukiwania oraz dalsze tłumaczenie mogą wtedy otrzymać niewłaściwą kolejność zdań.

Wykonaj następujące sprawdzenia:

  1. Zaznacz i skopiuj sekcję wielokolumnową do edytora zwykłego tekstu.
  2. Poruszaj się po nagłówkach, akapitach, listach, rycinach i notatkach za pomocą klawiatury w czytniku PDF, który udostępnia nawigację.
  3. Sprawdź panel znaczników lub kolejności czytania, gdy wymagana jest dostępność.
  4. Porównaj kolejność wokół obiektów pływających, paneli bocznych i przypisów.
  5. Powtórz test na przetłumaczonym pliku PDF; rekonstrukcja może utworzyć nowy błąd kolejności, nawet jeśli plik źródłowy był poprawny.

W przypadku każdego błędu ustal, czy pochodził on z ekstrakcji źródła, segmentacji tłumaczenia czy rekonstrukcji docelowej. Poprawienie współrzędnych wizualnych niekoniecznie naprawi logiczną kolejność.

Faza 4: inspekcja układu w punktach krytycznych

Nie przeglądaj wyłącznie atrakcyjnych stron. Wymuś sprawdzenie struktur, które najprawdopodobniej ulegną uszkodzeniu.

Rozszerzanie i ucinanie tekstu

Tekst docelowy może być dłuższy lub krótszy niż źródłowy. Sprawdź wąskie kolumny, przyciski, etykiety, komórki tabel, odnośniki na rysunkach, stopki oraz nagłówki w pobliżu granic stron.

Odrzuć:

  • tekst ucięty na krawędzi ramki;
  • nakładające się linie lub obiekty;
  • nagłówki oddzielone od pierwszego akapitu;
  • pojedynczą linię przesuniętą na inaczej pustą stronę bez celowego zabiegu projektowego;
  • tekst pomniejszony poniżej uzgodnionego rozmiaru czytelnego; oraz
  • ukryte przepełnienie, które staje się widoczne dopiero po zaznaczeniu lub skopiowaniu.

Sprawdź raz w normalnym rozmiarze czytelniczym, a ponownie przy powiększeniu 200–400%. Normalny rozmiar ujawnia hierarchię i użyteczność; wysokie powiększenie ujawnia nakładanie się, uszkodzone glify oraz tekst rastrowany.

Tabele

Tabele łączą znaczenie i geometrię. Porównaj nagłówki wierszy i kolumn, kolejność komórek, jednostki, separator dziesiętny, przypisy, powtarzane nagłówki oraz podziały stron.

Sprawdź, czy:

  • każdy wiersz i kolumna źródłowa ma swój odpowiednik docelowy;
  • wartości pozostają przypisane do właściwych etykiet;
  • znaki minus, zakresy, procenty i jednostki zostały zachowane;
  • komórki nie przelewają się, nie znikają ani nie zasłaniają ramek;
  • podzielone tabele powtarzają właściwy nagłówek; oraz
  • logiczna kolejność ekstrakcji odpowiada widocznej tabeli.

Pięknie wyrównana tabela z jedną wartością pod niewłaściwym nagłówkiem stanowi poważną wadę merytoryczną.

Rysunki, diagramy i podpisy

Zweryfikuj, czy każdy rysunek jest obecny, czytelny i sparowany z właściwym podpisem. Tekst wtopiony w obraz może zostać pominięty w przepływie pracy opartym wyłącznie na tekście. Zdecyduj, czy musi zostać zlokalizowany, przebudowany, czy jawnie pozostawiony w języku źródłowym.

Sprawdź odesłania krzyżowe, takie jak „patrz Rysunek 8”, po zmianach paginacji. Potwierdź tekst alternatywny osobno, gdy dostarczenie wymaga dostępności; widoczny podpis nie jest automatycznie użytecznym opisem alternatywnym.

Nagłówki, stopki i elementy ozdobne strony

Sprawdź żywe paginy, numery stron, daty, oznaczenia wersji, etykiety poufności, logo i stopki. Elementy te są często przetwarzane oddzielnie od tekstu głównego i mogą znikać, duplikować się lub pozostawać nieprzetłumaczone.

Faza 5: testowanie czcionek i skryptów

Błędy czcionek obejmują więcej niż tylko oczywiste puste prostokąty. Sprawdź:

  • znaki akcentowane i znaki łączone;
  • kształtowanie znaków arabskich i indyjskich;
  • zachowanie dwukierunkowe języka hebrajskiego i arabskiego;
  • interpunkcję oraz łamanie wierszy w językach CJK;
  • symbole matematyczne, waluty, indeksy górne i dolne;
  • pogrubienie, kursywę, kapitaliki i style zastępcze;
  • skopiowany tekst w porównaniu z widocznymi glifami; oraz
  • status osadzenia, gdy plik PDF będzie drukowany lub dystrybuowany.

Czcionka zastępcza może zachować czytelne znaki, ale zmienić długość linii w stopniu wystarczającym do przycięcia lub przelania strony. Sprawdź każdy styl, nie tylko tekst główny. Przeszukaj cały dokument po znalezieniu jednego brakującego lub podstawionego glifu, ponieważ ta sama czcionka jest prawdopodobnie używana ponownie.

W przypadku tekstów w języku arabskim i hebrajskim przejdź do kontroli tłumaczeń książek w formacie RTL; kierunek, liczby, adresy URL, tabele, kolejność okładek i progresja stron wymagają dedykowanego przejścia.

Faza 6: weryfikacja łączy, formularzy i elementów interaktywnych

Kliknij każdy unikalny typ łącza i przetestuj próbkę powtórzonych łączy w całym pliku:

  • pozycje spisu treści;
  • wewnętrzne odniesienia do stron i sekcji;
  • zewnętrzne adresy URL;
  • łącza e-mail;
  • przypisy i łącza powrotne; oraz
  • zakładki.

Upewnij się, że przetłumaczony tekst widoczny nadal opisuje cel. Działający hiperłącze z błędnie przetłumaczoną etykietą nie jest poprawne.

Jeśli źródło zawiera formularze, zdecyduj, czy przetłumaczony produkt ma pozostać edytowalny. Przetestuj kolejność pól, etykiety, walidację, pola wyboru, podpisy, obliczenia i zapisane wartości. Spłaszczenie może być celowe, ale musi być wyraźną decyzją dotyczącą dostarczenia.

Klasyfikuj defekty według konsekwencji wydania

Stopień ważnościPrzykłady PDFWymagane działanie
BlokerBrakująca strona; nieczytelny plik; błędne źródło; odwrócone ostrzeżenie; zaburzona wymagana kolejność czytaniaWstrzymać wydanie, naprawić przyczymę i ponowić powiązane sprawdzenia
PoważnyBrakujący akapit; błędna wartość w tabeli; przycięty tekst; powtarzająca się awaria czcionki; uszkodzona nawigacjaNaprawić przed akceptacją i wyszukać ten sam wzorzec w innych miejscach
KosmetycznyIzolowane odstępy, wyrównanie, wdowa/sierota lub niekrytyczna niezgodność stylów przy zachowaniu znaczeniaNaprawić zgodnie z uzgodnionym progiem produkcyjnym

Dokument przegląd normy ISO 5060:2024 obejmuje analityczną ocenę tłumaczenia przy użyciu typów błędów oraz konfigurowalnych kar, a także omawia próbkowanie. Kontrola jakości wydań PDF obejmuje również sprawdzenia produkcji, struktury, dostępności oraz interakcji wykraczające poza ocenę wyników tłumaczenia.

Próbkuj celowo, a następnie eskaluj

Nawet jeśli pełny przegląd wizualny jest niemożliwy, nie wybieraj wyłącznie losowych stron. Uwzględnij:

  1. Pierwszą stronę, ostatnią stronę, spis treści oraz otwarcie każdej sekcji.
  2. Najgęstszą stronę oraz stronę z najmniejszą ilością tekstu.
  3. Każdą osobną tabelę, rysunek, notatkę, formularz, kolumnę oraz strukturę listy.
  4. Strony zawierające nietypowe alfabetu, symbole, nazwiska, daty i liczby.
  5. Strona przed i po każdej większej zmianie układu.
  6. Wszelkie fragmenty, w których błąd mógłby spowodować istotną szkodę.

Rozszerz zakres działań, gdy defekty się kumulują:

  • jeden defekt kosmetyczny: zarejestruj go i kontynuuj;
  • jeden poważny defekt: przeszukaj cały plik PDF pod kątem tego samego wzorca i sprawdź sąsiednie strony;
  • dwa poważne defekty tego samego typu: potraktuj problem jako systemowy, dopóki nie zostanie to udowodnione inaczej; oraz
  • jakikolwiek bloker: wstrzymaj akceptację i uruchom ponownie wszystkie sprawdzenia, na które wpłynęła przyczyna.

Końcowa brama wydania przetłumaczonego pliku PDF

Zaakceptuj plik PDF tylko wtedy, gdy:

  • wersja źródłowa i docelowa są jednoznaczne;
  • obecne są wszystkie oczekiwane strony i struktury treści;
  • kolejność czytania jest odpowiednia do zamierzonego zastosowania;
  • tabele zachowują etykiety, wartości, jednostki i strukturę;
  • żaden wymagany tekst nie jest obcięty, nałożony na inny ani nieczytelnie mały;
  • czcionki obsługują każdy wymagany glif i styl;
  • ryciny, podpisy, przypisy, linki i zakładki działają zgodnie ze specyfikacją;
  • każdy bloker i główny problem został naprawiony i zweryfikowany ponowanie;
  • ostateczny eksport — a nie plik pośredni — przeszedł ostatnią inspekcję; oraz
  • rejestr problemów i decyzja o akceptacji są przechowywane wraz z dostarczanym materiałem.

Skorzystaj z szerszej listy kontrolnej kontroli jakości książek i długich dokumentów pod kątem znaczenia, terminologii i zasad próbkowania. Użyj opcji przetłumacz plik PDF, zachowując jego format aby wybrać i przetestować proces produkcyjny. Tłumacz PDF BookTranslator może wygenerować przetłumaczony plik PDF dla obsługiwanych plików; powyższe kontrole na poziomie strony pozwalają określić, czy wynik jest gotowy do zamierzonego zastosowania.

Powiązane wpisy