टाइमस्टैम्प बदले बिना SRT फ़ाइल का अनुवाद कैसे करें
क्यू नंबर और टाइमकोड को लॉक रखते हुए सबटाइटल टेक्स्ट का अनुवाद करें, फिर डिलीवरी से पहले क्रम, एन्कोडिंग और प्लेबैक की जाँच करें।

त्वरित उत्तर: क्यू टेक्स्ट का अनुवाद करें, ID और टाइमकोड लॉक रखें
SRT फ़ाइल एक समय-आधारित डेटा फ़ाइल होती है, सजावटी टाइमस्टैम्प वाला ट्रांसक्रिप्ट नहीं। केवल सबटाइटल टेक्स्ट का अनुवाद करें। हर क्यू नंबर, टाइमस्टैम्प, खाली विभाजक पंक्ति और समर्थित फ़ॉर्मैटिंग टैग को उसी जगह रखें, फिर वीडियो देखने से पहले स्रोत और लक्ष्य क्यू संरचनाओं की तुलना करें।
फ़ाइल-सचेत वर्कफ़्लो के लिए, कैप्शन को किसी असंरचित टेक्स्ट बॉक्स में कॉपी करने के बजाय मूल फ़ाइल को SRT Translator में अपलोड करें। फ़ाइल-सचेत प्रोसेस संरचनात्मक जोखिम को कम करती है, लेकिन फिर भी आपको आउटपुट को स्रोत और वीडियो के साथ सत्यापित करना चाहिए।
यहाँ कम स्पष्ट नियम यह है: टाइमकोड संरक्षित रखना ज़रूरी है, लेकिन केवल वही काफ़ी नहीं है। लक्ष्य क्यू बिल्कुल वही टाइमस्टैम्प रख सकता है और फिर भी विफल हो सकता है, क्योंकि अनुवादित वाक्य पढ़ने के लिए बहुत लंबा है, गलत वाक्यांश पर टूटता है, या ऐसे वक्ता का संदर्भ देता है जो अभी तक दिखाई ही नहीं दिया।
SRT फ़ाइल की संरचना कैसे होती है
एक सामान्य क्यू में चार भाग होते हैं:
17
00:00:41,500 --> 00:00:44,200
<i>MAYA:</i> The total is €1,249.50.
17क्यू नंबर है।00:00:41,500प्रारंभ समय है।00:00:44,200समाप्ति समय है।- बची हुई पंक्ति या पंक्तियाँ प्रदर्शित टेक्स्ट हैं।
SRT में आम तौर पर सेकंड और मिलीसेकंड के बीच कॉमा और शुरुआत व अंत के बीच --> का उपयोग होता है। एक खाली पंक्ति एक क्यू को अगले क्यू से अलग करती है। कुछ प्लेयर भिन्नताओं को सह लेते हैं; एक भरोसेमंद अनुवाद वर्कफ़्लो उस सहनशीलता पर निर्भर नहीं करता।
सिंथेटिक SRT अनुवाद स्ट्रेस टेस्ट डाउनलोड करें। इसमें संवाद, इटैलिक्स, वक्ता लेबल, तारीख, मुद्रा, CJK टेक्स्ट, अरबी, सिरिलिक और उच्चारण-चिह्न वाले लैटिन अक्षर शामिल हैं। सामग्री काल्पनिक है, इसलिए इसे पार्सर और एन्कोडिंग परीक्षणों के लिए सुरक्षित रूप से उपयोग किया जा सकता है।
कॉपी-पेस्ट अनुवाद SRT फ़ाइलों को क्यों तोड़ देता है
सामान्य प्रयोजन वाले टेक्स्ट वर्कफ़्लो संरचना को सामग्री समझने की गलती कर सकते हैं। सामान्य विफलताओं में शामिल हैं:
- क्यू ID का अनुवाद या पुनर्नंबरिंग करना;
- टाइमस्टैम्प विभाजक या दशमलव कॉमा बदल देना;
- दो छोटे क्यू को एक पैराग्राफ़ में मिला देना;
- दोहराए गए या देखने में खाली लगने वाले क्यू को हटा देना;
- फ़ाइल के चारों ओर Markdown fences लौटा देना;
- स्पीकर लेबल को गद्य के रूप में फिर से लिख देना;
<i>टैग हटाना या असमर्थित rich-text markup निकालना;- खाली क्यू विभाजकों को wrapped lines से बदल देना।
भाषाई दृष्टि से अच्छा अनुवाद भी बेकार हो जाता है जब प्लेयर फ़ाइल को पार्स ही न कर सके।
चरण-दर-चरण अनुवाद वर्कफ़्लो
1. मूल को सुरक्षित रखें
स्रोत SRT को बिना बदले रखें। interview.en.srt → interview.es.srt जैसी भाषा-लेबल वाली कॉपी पर काम करें।
2. पुष्टि करें कि स्रोत पार्स हो रहा है
अनुवाद से पहले स्रोत को किसी सबटाइटल एडिटर या प्लेयर में खोलें। यदि स्रोत में पहले से ओवरलैपिंग टाइमकोड, गायब विभाजक, या गलत वीडियो ऑफ़सेट है, तो पहले उन दोषों को ठीक करें या दस्तावेज़ित करें।
3. एन्कोडिंग पहचानें
जब तक डिलीवरी स्पेसिफ़िकेशन स्पष्ट रूप से कुछ और न माँगे, बहुभाषी आउटपुट के लिए UTF-8 का उपयोग करें। YouTube की ट्रांसक्रिप्ट गाइडेंस कहती है कि गैर-अंग्रेज़ी ट्रांसक्रिप्ट फ़ाइलें UTF-8 encoded होनी चाहिए, जो अंतरराष्ट्रीय सबटाइटल फ़ाइलों के लिए एक समझदारी भरी आधाररेखा है (YouTube Help).
4. संरचनात्मक फ़ील्ड फ़्रीज़ करें
क्यू नंबर और टाइमस्टैम्प पंक्तियों को संरक्षित सामग्री मानें। यदि कोई टूल उन्हें लॉक नहीं कर सकता, तो छोटे बैचों में अनुवाद करें और हर बैच के बाद सत्यापन करें।
5. पड़ोसी संदर्भ के साथ पूर्ण क्यू का अनुवाद करें
प्रदर्शित टेक्स्ट का अनुवाद करें, लेकिन संदर्भ के लिए पिछला और अगला क्यू भी दें। सबटाइटल अक्सर एक ही वाक्य को कई क्यू में बाँटते हैं; अलग-थलग अनुवाद काल, सर्वनाम या शब्दक्रम को असंगत बना सकता है।
6. लक्ष्य भाषा के लिए पुनः-खंडन करें
जब तक आपको retime करने की अनुमति न हो, क्यू टाइमिंग वही रखें, लेकिन क्यू के भीतर लक्ष्य लाइन ब्रेक समायोजित करें। ब्रेक प्राकृतिक वाक्यांश सीमाओं पर दें, articles, prepositions, names, या कसकर जुड़े verb phrases के बाद नहीं।
7. संरचनात्मक सत्यापन चलाएँ
स्रोत और लक्ष्य के क्यू की संख्या, ID, टाइमस्टैम्प, क्रम, टैग और खाली विभाजकों की तुलना करें। भाषाई समीक्षा से पहले यह करें ताकि समीक्षक ऐसी फ़ाइल पर समय बर्बाद न करें जो लोड ही नहीं हो सकती।
8. पूरा लक्ष्य ट्रैक देखें
स्वचालित जाँच यह नहीं बता सकती कि कोई सबटाइटल वक्ता के बोलने से पहले दिखाई देता है, आवश्यक ऑन-स्क्रीन टेक्स्ट को ढक देता है, या तेज़ संवाद के दौरान पढ़ने योग्य बना रहता है या नहीं।
लाइन ब्रेक, इटैलिक्स और स्पीकर लेबल सुरक्षित रखें
जब लक्ष्य सिंटैक्स बदलता है, तो स्रोत लाइन ब्रेक को यांत्रिक रूप से न बचाएँ। क्यू को सुरक्षित रखें, फिर लक्ष्य भाषा में पढ़ने योग्य लाइन ब्रेक चुनें।
उदाहरण के लिए, यह स्रोत ब्रेक खराब है:
We approved the proposal
after the final review.
यदि लक्ष्य भाषा शर्त को पहले रखती है, तो स्वाभाविक ब्रेक बदल सकता है। सही लक्ष्य अर्थ-समूह बनाना है, स्रोत की पंक्ति को पिक्सेल-दर-पिक्सेल मिलाना नहीं।
सार्थक इटैलिक्स तभी रखें जब गंतव्य उन्हें समर्थन देता हो और शैली-निर्देशिका उनकी माँग करती हो। स्पीकर लेबल को लगातार एक समान रखें। YouTube ट्रांसक्रिप्ट वर्कफ़्लो में ध्वनियों के लिए [music] जैसे क्यू और वक्ताओं की पहचान के लिए >> की सिफ़ारिश करता है (YouTube Help); अन्य क्लाइंट किसी अलग परंपरा की माँग कर सकते हैं।
क्यू संख्या और टाइमस्टैम्प क्रम सत्यापित करें
इस invariant तालिका का उपयोग करें:
| जाँच | अपेक्षित परिणाम | अवरोधक? |
|---|---|---|
| क्यू संख्या | स्रोत और लक्ष्य की संख्या मेल खाती है | हाँ, जब तक किसी अनुमोदित retime ने संख्या न बदली हो |
| क्यू ID | वही अद्वितीय ID उसी क्रम में | हाँ |
| टाइमस्टैम्प टेक्स्ट | टाइमिंग लॉक होने पर byte-for-byte मेल | हाँ |
| शुरुआत अंत से पहले | हर क्यू की अवधि धनात्मक है | हाँ |
| क्रम अनुक्रम | पीछे की ओर कोई आकस्मिक छलांग नहीं | हाँ |
| टैग | संतुलित और समर्थित | प्रायः |
| दृश्य टेक्स्ट | हर स्रोत क्यू का एक जानबूझकर बनाया गया लक्ष्य है | हाँ |
फ़ाइल आकार को प्रॉक्सी के रूप में उपयोग न करें। अनुवाद में विस्तार लक्ष्य को बड़ा बनाता है; समान byte count कुछ भी साबित नहीं करता।
वीडियो के साथ सबटाइटल की जाँच करें
सामान्य प्लेबैक गति पर समीक्षा करें और इन कठिन क्षणों को शामिल करें:
- सबसे तेज़ संवाद;
- दो वक्ता जो तेज़ी से बारी-बारी बोलते हैं;
- नाम, तारीखें, मुद्राएँ और माप;
- ऐसा संवाद जो scene cut के पार जाता हो;
- ऐसा टेक्स्ट जो signs या lower thirds से टकराता हो;
- गाने, sound effects, और off-screen voices;
- पहला और अंतिम क्यू;
- कम से कम एक ऐसा भाग जिसमें हर समर्थित formatting tag मौजूद हो।
संरचनात्मक सत्यापन के बाद पठनीयता और खंड-विभाजन का मूल्यांकन करने के लिए उपशीर्षक अनुवाद QA जाँच-सूची का उपयोग करें।
सामान्य SRT त्रुटियाँ और उनके समाधान
| लक्षण | संभावित कारण | समाधान |
|---|---|---|
| प्लेयर फ़ाइल अस्वीकार कर देता है | टूटा हुआ टाइमस्टैम्प सिंटैक्स या क्यू विभाजक | पहले विफल क्यू की स्रोत से तुलना करें |
| कैप्शन खिसकते हैं लेकिन टाइमकोड मेल खाते हैं | गलत स्रोत ट्रैक या वीडियो संपादन | स्रोत फ़ाइल को ठीक उसी वीडियो संस्करण से संरेखित करें |
| टेक्स्ट बॉक्सों या mojibake के रूप में दिखता है | एन्कोडिंग या फ़ॉन्ट समर्थन | UTF-8 के रूप में सहेजें और प्लेबैक परिवेश में परीक्षण करें |
| वाक्य गलत वक्ता के नीचे दिखाई देता है | क्यू merge या context-free translation | क्यू सीमाएँ पुनर्स्थापित करें और पड़ोसी क्यू की समीक्षा करें |
| दो-पंक्ति वाले क्यू टेक्स्ट की दीवार बन जाते हैं | लक्ष्य विस्तार | संक्षिप्त करें, फिर से लिखें, या retime की अनुमति लें |
| इटैलिक्स बाद के क्यू तक खुले रहते हैं | असंतुलित टैग | प्रति-क्यू टैग सत्यापित करें और उन्हें स्थानीय रूप से बंद करें |
कब हर टाइमस्टैम्प को बनाए नहीं रखना चाहिए
जब स्रोत टाइमिंग दोषपूर्ण हो, अनुवादित भाषा को वास्तव में अलग segmentation चाहिए, या वीडियो स्वयं फिर से संपादित किया गया हो, तब टाइमस्टैम्प संरक्षित रखने का वादा न करें। ऐसे मामलों में, स्रोत को audit reference के रूप में सुरक्षित रखें और स्पष्ट रूप से retimed लक्ष्य ट्रैक बनाएँ।
टाइमस्टैम्प लॉकिंग अनुवाद की बाध्यता है, सबटाइटल लेखन का विकल्प नहीं।
FAQ
क्या मैं SRT फ़ाइल में केवल टेक्स्ट का अनुवाद कर सकता हूँ?
हाँ। टेक्स्ट पंक्तियों का अनुवाद करें और क्यू नंबर, टाइमस्टैम्प और विभाजकों को सुरक्षित रखें। फिर सत्यापित करें कि हर स्रोत क्यू का अभी भी एक जानबूझकर बनाया गया लक्ष्य क्यू मौजूद है।
क्या अनुवादित सबटाइटल में क्यू की संख्या समान होनी चाहिए?
जब टाइमिंग लॉक हो, तब हाँ। अलग संख्या इस बात का मज़बूत संकेत है कि क्यू मिलाए गए, खो गए, या विभाजित हुए। एक पेशेवर retiming वर्कफ़्लो जानबूझकर संख्या बदल सकता है, लेकिन उसका दस्तावेज़ीकरण होना चाहिए।
क्या मैं टाइमस्टैम्प बदले बिना लाइन ब्रेक बदल सकता हूँ?
हाँ। लाइन ब्रेक प्रदर्शित टेक्स्ट का हिस्सा हैं, क्यू टाइमिंग का नहीं। उन्हें लक्ष्य भाषा में प्राकृतिक वाक्यांश सीमाओं पर ले जाएँ।
अनुवादित SRT फ़ाइलों के लिए मुझे कौन-सी एन्कोडिंग उपयोग करनी चाहिए?
बहुभाषी टेक्स्ट के लिए UTF-8 सबसे सुरक्षित डिफ़ॉल्ट है। legacy encoding का उपयोग केवल तभी करें जब कोई प्रलेखित डिलीवरी सिस्टम उसकी माँग करे।
मेरी अनुवादित SRT लोड तो हो जाती है, फिर भी गलत क्यों दिखती है?
पार्स करना और देखना अलग-अलग परीक्षण हैं। फ़ाइल संरचनात्मक रूप से वैध हो सकती है, जबकि उसके क्यू बहुत लंबे हों, खराब segmentation वाले हों, वीडियो संस्करण के लिए गलत समय पर हों, या प्लेयर के font stack द्वारा समर्थित न हों।
संबंधित लेख




