PDF अनुवाद गुणवत्ता आश्वासन चेकलिस्ट: लेआउट, तालिकाएं, फ़ॉन्ट और गायब पाठ
गायब पाठ, गलत पढ़ने के क्रम, टूटी हुई तालिकाओं, कटे हुए लेआउट, फ़ॉन्ट विफलताओं, लिंक और अंतिम-फ़ाइल रिलीज़ दोषों के लिए एक अनूदित PDF का निरीक्षण करें।

एक अनूदित PDF तभी गुणवत्ता आश्वासन में सफल होती है जब उसका पाठ पूर्ण और सटीक हो, उसका तार्किक पढ़ने का क्रम अभी भी काम करता हो, और प्रत्येक पृष्ठ अभी भी लक्षित स्क्रीन या प्रिंट आकार पर उपयोग करने योग्य हो। बिना किसी त्रुटि के खुलने वाली फ़ाइल ने इनमें से लगभग किसी भी जाँच को पास नहीं किया है।
इस क्रम का उपयोग करें:
- सटीक स्रोत और लक्ष्य फ़ाइलों को फ़्रीज़ करें।
- पृष्ठ और सामग्री-ब्लॉक की पूर्णता की तुलना करें।
- पढ़ने के क्रम और स्रोत-से-लक्ष्य अर्थ का निरीक्षण करें।
- तालिकाओं, फ़ॉन्ट, आकृतियों, लिंक, शीर्षकों और पृष्ठ सीमाओं का तनाव परीक्षण करें।
- सामान्य आकार और उच्च ज़ूम पर कठिन पृष्ठों की समीक्षा करें।
- गंभीरता के आधार पर दोषों को लॉग करें और पूरे PDF में समान पैटर्न की खोज करें।
- सुधार के बाद अंतिम निर्यातित फ़ाइल की पुनः जाँच करें।
डाउनलोड करें PDF अनुवाद QA चेकलिस्ट पृष्ठ-स्तर के साक्ष्य और स्वीकृति स्थिति को रिकॉर्ड करने के लिए।
पहले स्वीकृति लक्ष्य स्थापित करें
PDF विभिन्न कार्य करते हैं। आउटपुट का न्याय करने से पहले इच्छित उपयोग को परिभाषित करें।
| इच्छित उपयोग | न्यूनतम अपेक्षा | विशिष्ट अवरोधक |
|---|---|---|
| व्यक्तिगत पढ़ना | एक समझदार क्रम में पूर्ण, पठनीय पाठ | गायब पृष्ठ, अपठनीय पाठ, या महत्वपूर्ण रूप से गलत अर्थ |
| आंतरिक संदर्भ | पता लगाने योग्य दावे, संख्याएँ, तालिकाएँ, आकृतियाँ और उद्धरण | एक नंबर, चेतावनी या संदर्भ अब स्रोत से मेल नहीं खाता है |
| क्लाइंट डिलीवरी | तय शब्दावली, स्थिर लेआउट, काम करने वाले लिंक और प्रलेखित समीक्षा | बिना किसी मालिक के दोहराई गई भाषा या उत्पादन दोष |
| सार्वजनिक डिजिटल रिलीज़ | संपादकीय समीक्षा, सुलभ पठन क्रम, डिवाइस जाँच और अंतिम-फ़ाइल प्रूफ | क्लिपिंग, गायब सामग्री, टूटी हुई नेविगेशन, या अनसुलझे अवरोधक |
| प्रिंट | सही ट्रिम, ब्लीड, मार्जिन, फ़ॉन्ट, छवि गुणवत्ता और उत्पादन प्रूफ | प्रिंट करने योग्य क्षेत्र के बाहर का पाठ या प्रतिस्थापित/गायब ग्लाइफ |
किसी फ़ॉर्म या डिज़ाइन किए गए ब्रोशर के लिए दृश्य फ़ैसमीले प्राथमिकता हो सकता है। किसी सुलभ रिपोर्ट के लिए तार्किक पठन क्रम हावी हो सकता है। कई ईबुक और सार्वजनिक दस्तावेजों के लिए दोनों मायने रखते हैं, लेकिन स्वीकृति भार समान नहीं हैं।
चरण 1: साबित करें कि स्रोत और लक्ष्य एक-दूसरे से संबंधित हैं
स्रोत फ़ाइल नाम, संशोधन, चेकसम या अपरिवर्तनीय लिंक, पृष्ठ संख्या, भाषा और यह रिकॉर्ड करें कि फ़ाइल में चयन योग्य पाठ है या नहीं। अनुवादित पीडीएफ के लिए भी यही विवरण रिकॉर्ड करें।
फिर तुलना करें:
- पहला और अंतिम पृष्ठ;
- पृष्ठ संख्या और पृष्ठ लेबल;
- खंड और शीर्षक अनुक्रम;
- तालिका, आकृति, फुटनोट, परिशिष्ट और संलग्नक गणना;
- शीर्षलेख, पादलेख, वॉटरमार्क, फ़ॉर्म फ़ील्ड और एनोटेशन;
- दृश्यमान लिंक और गंतव्य; और
- जानबूझकर बाहर की गई सामग्री।
विभिन्न पृष्ठ संख्याएँ स्वतः गलत नहीं होती हैं: अनुवादित पाठ का रीफ़्लो हो सकता है या उत्पादन वर्कफ़्लो पृष्ठ सम्मिलित कर सकता है। लेकिन हर अंतर स्पष्ट करने योग्य होना चाहिए। यदि लक्ष्य में कम पृष्ठ हैं, तो यह न मानें कि यह अधिक कुशल है; साबित करें कि सामग्री छोड़ी नहीं गई थी।
स्कैन किए गए स्रोतों के लिए, अनुवाद का मूल्यांकन करने से पहले ओसीआर लेयर को सत्यापित करें। स्कैन की गई पीडीएफ अनुवाद वर्कफ़्लो तिर, छवि गुणवत्ता, भाषा चयन, संदिग्द वर्ण, हस्तलेखन, और मुद्रित/हस्तलिखित मिश्रित पृष्ठों को कवर करता है।
चरण 2: गायब और दोहराए गए पाठ का पता लगाएं
गायब पाठ अक्सर अजीब पाठ की तुलना में कम दिखाई देता है क्योंकि समीक्षक का ध्यान आकर्षित करने के लिए कुछ भी नहीं होता है। पंक्ति संपादन से पहले संरचनात्मक तुलना का उपयोग करें।
जांचें:
- शीर्षक, उपशीर्षक, लेखक, संशोधन और कानूनी पृष्ठ;
- प्रत्येक शीर्षक और सूची आइटम;
- प्रत्येक पृष्ठ पर पहला और अंतिम अनुच्छेद;
- आकृतियों, आरेखों, कॉलआउट, कैप्शन और साइडबार के अंदर का पाठ;
- तालिका शीर्षलेख, सेल, नोट्स और निरंतरता लेबल;
- फुटनोट मार्कर और फुटनोट बॉडी;
- क्रॉस-रेफरेंस, उद्धरण, URL और पृष्ठ संदर्भ;
- शीर्षलेख, पाद लेख, स्टैम्प और हाशिए की सामग्री; और
- परिशिष्ट और ऐसे पृष्ठ जिनमें बहुत कम पाठ है।
दोहराए गए खंडों को खोजने के लिए बार-बार आने वाले शुरुआती वाक्यांशों की खोज करें। स्रोत-भाषा के अवशेषों की खोज करें, लेकिन नामों, सूत्रों, कोड, ट्रेडमार्क और उद्धृत सामग्री के लिए एक डू-नॉट-ट्रांसलेट सूची बनाए रखें जो अपरिवर्तित रहनी चाहिए।
जब PDF पाठ निष्कर्षण की अनुमति देता है, तो गुणवत्ता स्कोर के रूप में नहीं, बल्कि एक चेतावनी के रूप में सामान्यीकृत स्रोत और लक्ष्य ब्लॉक गणना की तुलना करें। भाषा विस्तार, लिगेचर, OCR और विभाजन गणना बदल सकते हैं। किसी भी बड़े या स्थानीयकृत अंतर से समीक्षक को संबंधित पृष्ठ पर जाना चाहिए।
चरण 3: तार्किक पठन क्रम सत्यापित करें
एक दो-स्तंभ वाली PDF सही लग सकती है जबकि इसका निकाला गया पाठ स्तंभों के बीच बदलता रहता है। स्क्रीन रीडर, कॉपी और पेस्ट, खोज अनुक्रमण, और डाउनस्ट्रीम अनुवाद तब गलत वाक्य क्रम प्राप्त कर सकते हैं।
इन जाँचों को चलाएँ:
- एक बहु-स्तंभ अनुभाग का चयन करें और उसे सादे पाठ संपादक में कॉपी करें।
- नेविगेशन दिखाने वाले PDF रीडर में कीबोर्ड के साथ शीर्षकों, अनुच्छेदों, सूचियों, आकृतियों और नोट्स के माध्यम से आगे बढ़ें।
- जब पहुंच की आवश्यकता हो तो टैग या पठन-क्रम पैनल का निरीक्षण करें।
- फ्लोटिंग छवियों, साइडबार और फुटनोट्स के आसपास के क्रम की तुलना करें।
- अनुदित PDF पर परीक्षण दोहराएँ; स्रोत सही होने पर भी पुनर्निर्माण से एक नया क्रम दोष पैदा हो सकता है।
प्रत्येक विफलता के लिए, पहचानें कि क्या दोष स्रोत निष्कर्षण, अनुवाद विभाजन, या लक्ष्य पुनर्निर्माण में उत्पन्न हुआ है। दृश्य निर्देशांक को ठीक करने से जरूरी नहीं कि तार्किक क्रम ठीक हो जाए।
चरण 4: स्ट्रेस पॉइंट पर लेआउट का निरीक्षण करें
केवल आकर्षक पृष्ठों की समीक्षा न करें। उन संरचनाओं की जाँच अनिवार्य करें जिनके टूटने की सबसे अधिक संभावना है।
टेक्स्ट का विस्तार और क्लिपिंग
लक्ष्य टेक्स्ट स्रोत की तुलना में लंबा या छोटा हो सकता है। संकीर्ण कॉलम, बटन, लेबल, टेबल सेल, फ़िगर कॉलआउट, फ़ुटर और पृष्ठ सीमाओं के पास की हेडिंग का निरीक्षण करें।
अस्वीकार करें:
- फ़्रेम के किनारे पर टेक्स्ट का कट जाना;
- ओवरलैपिंग लाइनें या ऑब्जेक्ट्स;
- हेडिंग का उनके पहले पैराग्राफ से अलग हो जाना;
- किसी जानबूझकर किए गए डिज़ाइन विकल्प के बिना, एक अकेली लाइन का अन्यथा खाली पृष्ठ पर धकेल दिया जाना;
- निर्धारित पठनीय आकार से छोटा किया गया टेक्स्ट; और
- छिपा हुआ ओवरफ़्लो जो केवल चुने जाने या कॉपी किए जाने पर दिखाई देता है।
सामान्य पठन आकार पर एक बार और 200–400% ज़ूम पर दोबारा समीक्षा करें। सामान्य आकार पदानुक्रम और प्रयोज्यता को उजागर करता है; उच्च ज़ूम ओवरलैप, टूटे हुए ग्लाइफ़ और रास्टरराइज़्ड टेक्स्ट को उजागर करता है।
टेबल
टेबल अर्थ और ज्यामिति को मिलाते हैं। पंक्तियों और कॉलम के हेडर, सेल ऑर्डर, इकाइयों, दशमलव विभाजकों, फ़ुटनोट, बार-बार आने वाले हेडर और पृष्ठ विभाजनों की तुलना करें।
जाँच करें कि:
- प्रत्येक स्रोत पंक्ति और कॉलम का एक लक्ष्य समकक्ष हो;
- मान सही लेबलों से जुड़े रहें;
- ऋणात्मक चिह्न, सीमाएं, प्रतिशत और इकाइयां सुरक्षित रहें;
- सेल ओवरफ़्लो न हों, गायब न हों, या सीमाओं को न ढकें;
- विभाजित टेबल सही हेडर को दोहराएं; और
- तार्किक निष्कर्षण क्रम दिखाई देने वाली टेबल से मेल खाता हो।
गलत हेडिंग के तहत एक मान वाली खूबसूरती से संरेखित टेबल एक बड़ा सामग्री दोष है।
फ़िगर, आरेख और कैप्शन
सत्यापित करें कि प्रत्येक फ़िगर मौजूद, पठनीय और सही कैप्शन के साथ जुड़ा हुआ है। किसी छवि में अंतर्निहित टेक्स्ट को केवल-टेक्स्ट अनुवाद वर्कफ़्लो से छोड़ा जा सकता है। तय करें कि इसे स्थानीयकृत किया जाना चाहिए, पुनर्निर्मित किया जाना चाहिए, या स्पष्ट रूप से स्रोत भाषा में छोड़ा जाना चाहिए।
पेजनेशन में बदलाव के बाद "चित्र 8 देखें" जैसे क्रॉस-संदर्भों की जाँच करें। डिलीवरी के लिए एक्सेसिबिलिटी की आवश्यकता होने पर ऑल्ट टेक्स्ट की अलग से पुष्टि करें; एक दृश्य कैप्शन अपने आप में एक उपयोगी वैकल्पिक विवरण नहीं होता है।
हेडर, फ़ुटर और पेज फ़र्नीचर
चल रहे शीर्षकों, पेज नंबर, तारीखों, संस्करण के निशानों, गोपनीयता लेबलों, लोगो और फ़ुटर का निरीक्षण करें। इन तत्वों को अक्सर मुख्य पाठ से अलग प्रोसेस किया जाता है और ये गायब हो सकते हैं, डुप्लीकेट हो सकते हैं, या अनूदित रह सकते हैं।
चरण 5: फ़ॉन्ट और स्क्रिप्ट का परीक्षण करें
फ़ॉन्ट विफलताओं में स्पष्ट खाली बक्सों से अधिक शामिल हैं। इनका निरीक्षण करें:
- उच्चारित अक्षर और संयोजन चिह्न;
- अरबी और भारतीय आकृतियाँ (शेपिंग);
- हिब्रू और अरबी द्वि-दिशात्मक (बाइडायरेक्शनल) व्यवहार;
- सीजेके विराम चिह्न और लाइन ब्रेकिंग;
- गणितीय प्रतीक, मुद्रा, सुपरस्क्रिप्ट और सबस्क्रिप्ट;
- बोल्ड, इटैलिक, स्मॉल कैप्स और फ़ॉलबैक शैलियाँ;
- दृश्य ग्लाइफ की तुलना में कॉपी किया गया पाठ; और
- एम्बेडिंग स्थिति जब पीडीएफ को प्रिंट या वितरित किया जाना हो।
एक फ़ॉलबैक फ़ॉन्ट पठनीय वर्णों को सुरक्षित रख सकता है लेकिन पेज को क्लिप या रीफ़्लो करने के लिए पर्याप्त रूप से लाइन की लंबाई बदल सकता है। केवल मुख्य पाठ ही नहीं, प्रत्येक शैली की जाँच करें। एक लापता या प्रतिस्थापित ग्लाइफ मिलने के बाद पूरे दस्तावेज़ की खोज करें क्योंकि उसी फ़ॉन्ट का फिर से उपयोग किए जाने की संभावना है।
अरबी और हिब्रू आउटपुट के लिए, इसके साथ जारी रखें RTL पुस्तक अनुवाद जाँच; दिशा, संख्या, URL, तालिकाएँ, कवर क्रम, और पेज प्रगति के लिए एक समर्पित पास की आवश्यकता होती है।
चरण 6: लिंक, फ़ॉर्म और इंटरैक्टिव तत्वों को सत्यापित करें
प्रत्येक अद्वितीय लिंक प्रकार पर क्लिक करें और फ़ाइल में दोहराए गए लिंक का नमूना लें:
- विषय-सूची प्रविष्टियाँ;
- आंतरिक पेज और अनुभाग संदर्भ;
- बाहरी URL;
- ईमेल लिंक;
- फुटनोट और रिटर्न लिंक; और
- बुकमार्क।
पुष्टि करें कि अनूदित दृश्यमान पाठ अभी भी गंतव्य का वर्णन करता है। गलत तरीके से अनूदित लेबल वाला कार्यशील हाइपरलिंक सही नहीं है।
यदि स्रोत में फ़ॉर्म शामिल हैं, तो तय करें कि क्या अनूदित डिलीवर योग्य को भरने योग्य रहना अपेक्षित है। फ़ील्ड क्रम, लेबल, सत्यापन, चेकबॉक्स, हस्ताक्षर, गणना और सहेजे गए मानों का परीक्षण करें। समतल करना जानबूझकर हो सकता है, लेकिन यह एक स्पष्ट डिलीवरी निर्णय होना चाहिए।
रिलीज़ परिणाम के अनुसार दोषों को वर्गीकृत करें
| गंभीरता | PDF उदाहरण | आवश्यक कार्रवाई |
|---|---|---|
| ब्लॉकर | गायब पृष्ठ; अपठनीय फ़ाइल; गलत स्रोत; उल्टी चेतावनी; टूटा हुआ आवश्यक पठन क्रम | रिलीज़ रोकें, कारण ठीक करें, और प्रभावित जाँच को फिर से चलाएँ |
| प्रमुख | गायब पैराग्राफ; गलत तालिका मान; काटा गया पाठ; बार-बार फ़ॉन्ट विफलता; टूटा हुआ नेविगेशन | स्वीकृति से पहले ठीक करें और अन्य जगहों पर उसी पैटर्न की खोज करें |
| कॉस्मेटिक | अलग-थलग रिक्ति, संरेखण, विडो/ऑर्फ़न, या अर्थ बरकरार रखते हुए गैर-महत्वपूर्ण शैली असंगति | सहमति प्राप्त उत्पादन सीमा के अनुसार ठीक करें |
यह ISO 5060:2024 अवलोकन त्रुटि प्रकारों और कॉन्फ़िगर करने योग्य दंड का उपयोग करके विश्लेषणात्मक अनुवाद मूल्यांकन को कवर करता है और नमूनाकरण पर चर्चा करता है। PDF रिलीज़ QA में अनुवाद-आउटपुट मूल्यांकन के अलावा उत्पादन, संरचना, पहुंच और सहभागिता जाँच भी शामिल हैं।
जानबूझकर नमूना लें, फिर आगे बढ़ाएँ
यहाँ तक कि जब संपूर्ण दृश्य समीक्षा असंभव हो, तब भी केवल यादृच्छिक पृष्ठों का चयन न करें। इसमें शामिल करें:
- पहला पृष्ठ, अंतिम पृष्ठ, विषय-सूची, और प्रत्येक अनुभाग की शुरुआत।
- सबसे सघन पृष्ठ और सबसे कम पाठ वाला पृष्ठ।
- प्रत्येक अलग तालिका, आकृति, नोट, फ़ॉर्म, कॉलम और सूची संरचना।
- असामान्य लिपियों, प्रतीकों, नामों, तिथियों और नंबरों वाले पृष्ठ।
- प्रत्येक प्रमुख लेआउट परिवर्तन से पहले और बाद का एक पृष्ठ।
- कोई भी गद्यांश जहाँ किसी त्रुटि से गंभीर नुकसान हो सकता है।
जब खराबी के मामले बढ़ें तो दायरे को बढ़ाएँ:
- एक कॉस्मेटिक खराबी: इसे लॉग करें और आगे बढ़ें;
- एक प्रमुख खराबी: उसी पैटर्न के लिए पूरी पीडीएफ को खोजें और आसपास के पृष्ठों की जाँच करें;
- एक ही प्रकार की दो प्रमुख खराबी: इस समस्या को तब तक व्यवस्थित मानें जब तक कि यह गलत साबित न हो जाए; और
- कोई भी अवरोधक: स्वीकृति रोक दें और इस कारण से प्रभावित सभी जाँचों को फिर से चलाएँ।
अंतिम अनुवादित-पीडीएफ रिलीज गेट
पीडीएफ तभी स्वीकार करें जब:
- स्रोत और लक्ष्य संस्करण स्पष्ट हों;
- सभी अपेक्षित पृष्ठ और सामग्री संरचनाएँ मौजूद हों;
- पढ़ने का क्रम इच्छित उपयोग के अनुसार काम करता हो;
- तालिकाएँ लेबल, मान, इकाइयाँ और संरचना को सुरक्षित रखती हों;
- कोई भी आवश्यक पाठ कटा हुआ, ओवरलैप या पढ़ने में अत्यधिक छोटा न हो;
- फ़ॉन्ट प्रत्येक आवश्यक ग्लाइफ और शैली को कवर करते हों;
- चित्रांकन, कैप्शन, नोट्स, लिंक और बुकमार्क बताए गए अनुसार काम करते हों;
- प्रत्येक अवरोधक और मुख्य समस्या को ठीक कर लिया गया हो और दोबारा जाँच लिया गया हो;
- अंतिम निर्यात—मध्यवर्ती फ़ाइल नहीं—की अंतिम जाँच की गई हो; और
- समस्या लॉग और स्वीकृति निर्णय को डिलीवर करने योग्य सामग्री के साथ संग्रहीत किया गया हो।
व्यापक बुक और लंबी-दस्तावेज़ क्यूए चेकलिस्ट का उपयोग अर्थ, शब्दावली और नमूनाकरण नियमों के लिए करें। उपयोग करें इसके प्रारूप को बनाए रखते हुए पीडीएफ का अनुवाद करें उत्पादन कार्यप्रवाह का चयन और परीक्षण करने के लिए। BookTranslator PDF Translator समर्थित फ़ाइलों के लिए अनुवादित PDF तैयार कर सकता है; उपर्युक्त पृष्ठ-स्तरीय जाँच यह निर्धारित करती है कि वह परिणाम अपने इच्छित उपयोग के लिए तैयार है या नहीं।
संबंधित लेख





