BookTranslator
BookTranslator

အချိန်တံဆိပ်များကို မပြောင်းဘဲ SRT ဖိုင်တစ်ခုကို ဘယ်လို ဘာသာပြန်မလဲ

cue နံပါတ်များနှင့် timecode များကို သော့ခတ်ထားပြီး subtitle စာသားကို ဘာသာပြန်ပါ၊ ထို့နောက် ပေးပို့မီ sequence၊ encoding နှင့် playback ကို စစ်ဆေးအတည်ပြုပါ။

အမြန်အဖြေ: Cue စာသားကို ဘာသာပြန်ပါ၊ ID များနှင့် Timecode များကို သော့ခတ်ထားပါ

SRT ဖိုင်သည် အလှဆင်ထားသော အချိန်တံဆိပ်များပါသည့် transcript မဟုတ်ဘဲ အချိန်သတ်မှတ်ထားသော ဒေတာဖိုင်တစ်ခုဖြစ်သည်။ subtitle စာသားကိုသာ ဘာသာပြန်ပါ။ cue နံပါတ်တိုင်း၊ timestamp တိုင်း၊ အလွတ်ခွဲမျဉ်းတိုင်းနှင့် ပံ့ပိုးထားသော formatting tag တိုင်းကို မူလနေရာတွင်ထားပြီး၊ ထို့နောက် ဗီဒီယိုကို မကြည့်မီ မူရင်းနှင့် ဘာသာပြန် cue ဖွဲ့စည်းပုံများကို နှိုင်းယှဉ်ပါ။

ဖိုင်ဖွဲ့စည်းပုံကို နားလည်သည့် workflow အတွက် caption များကို ဖွဲ့စည်းပုံမရှိသော စာသားအကွက်ထဲ ကူးထည့်မည့်အစား မူရင်းဖိုင်ကို SRT Translator သို့ upload လုပ်ပါ။ ဖိုင်ဖွဲ့စည်းပုံကို သိရှိခြင်းက တည်ဆောက်ပုံဆိုင်ရာ အန္တရာယ်ကို လျှော့ချပေးသော်လည်း output ကို မူရင်းဖိုင်နှင့် ဗီဒီယိုတို့အပေါ် ဆက်လက်စစ်ဆေးသင့်သည်။

မလွယ်ကူဘဲ လွယ်လွယ်နဲ့ မမြင်ရတဲ့ စည်းကမ်းက ဒီဟာပါ: timecode ကို ထိန်းသိမ်းထားခြင်းက လိုအပ်ပေမယ့် တစ်ခုတည်းနဲ့ မလုံလောက်ဘူး။ ဘာသာပြန်ထားသော cue တစ်ခုသည် timestamp အတိအကျကို ထိန်းထားနိုင်ပေမယ့် ဘာသာပြန်ဝါကျက ဖတ်ရန် အလွန်ရှည်နေခြင်း၊ စကားစုမတော်သော နေရာမှာ ဖြတ်ထားခြင်း၊ သို့မဟုတ် မပေါ်လာသေးသော speaker ကို ရည်ညွှန်းနေခြင်းကြောင့် မအောင်မြင်နိုင်သေးသည်။

SRT ဖိုင်၏ ဖွဲ့စည်းပုံ

ပုံမှန် cue တစ်ခုတွင် အစိတ်အပိုင်းလေးခု ပါသည်:

17
00:00:41,500 --> 00:00:44,200
<i>MAYA:</i> The total is €1,249.50.

  1. 17 သည် cue နံပါတ်ဖြစ်သည်။
  2. 00:00:41,500 သည် စတင်ချိန်ဖြစ်သည်။
  3. 00:00:44,200 သည် အဆုံးချိန်ဖြစ်သည်။
  4. ကျန်ရှိသော မျဉ်းတစ်ကြောင်း သို့မဟုတ် မျဉ်းများသည် ပြသမည့် စာသားဖြစ်သည်။

SRT သည် စက္ကန့်နှင့် milliseconds ကြားတွင် comma ကို အသုံးများပြီး စတင်ချိန်နှင့် အဆုံးချိန်ကြားတွင် --> ကို သုံးလေ့ရှိသည်။ cue တစ်ခုနှင့် နောက် cue တစ်ခုကြားကို အလွတ်မျဉ်းတစ်ကြောင်းက ခွဲထားသည်။ အချို့ player များက ကွဲပြားမှုအချို့ကို ခွင့်လွှတ်ပေးနိုင်သော်လည်း ယုံကြည်စိတ်ချရသော ဘာသာပြန် workflow သည် ထိုသို့သော ခွင့်လွှတ်မှုအပေါ် မမူတည်သင့်ပါ။

ဖန်တီးထားသော SRT ဘာသာပြန် stress test ကို download လုပ်ပါ။ ၎င်းတွင် dialogue၊ italics၊ speaker label တစ်ခု၊ date တစ်ခု၊ currency၊ CJK စာသား၊ Arabic၊ Cyrillic နှင့် accent ပါသော Latin အက္ခရာများ ပါဝင်သည်။ အကြောင်းအရာသည် စိတ်ကူးယဉ်ထားခြင်းသာဖြစ်သောကြောင့် parser နှင့် encoding စမ်းသပ်မှုများအတွက် လုံခြုံစွာ အသုံးပြုနိုင်သည်။

Copy-Paste ဘာသာပြန်မှုကြောင့် SRT ဖိုင်များ ဘာကြောင့် ပျက်သွားသလဲ

ယေဘုယျသုံး စာသား workflow များသည် ဖွဲ့စည်းပုံကို အကြောင်းအရာအဖြစ် မှားယွင်းယူဆနိုင်သည်။ တွေ့ရလေ့ရှိသော ပြဿနာများမှာ:

  • cue ID များကို ဘာသာပြန်ခြင်း သို့မဟုတ် နံပါတ်ပြန်တပ်ခြင်း;
  • timestamp ခွဲကိရိယာ သို့မဟုတ် decimal comma ကို ပြောင်းလဲခြင်း;
  • တိုတောင်းသော cue နှစ်ခုကို paragraph တစ်ပိုဒ်တည်းအဖြစ် ပေါင်းခြင်း;
  • ထပ်နေသော cue သို့မဟုတ် အလွတ်ဖြစ်နေသလို ထင်ရသော cue ကို ဖျက်ချခြင်း;
  • ဖိုင်အပေါ် Markdown fence များကို ပြန်ထုတ်ပေးခြင်း;
  • speaker label များကို prose အဖြစ် ပြန်ရေးခြင်း;
  • <i> tag များကို ဖျက်ခြင်း သို့မဟုတ် မပံ့ပိုးသော rich-text markup ကို ထုတ်ပေးခြင်း;
  • အလွတ် cue separator များကို wrap လုပ်ထားသော မျဉ်းများဖြင့် အစားထိုးခြင်း။

ဘာသာဗေဒပိုင်းကောင်းမွန်သည့် ဘာသာပြန်တစ်ခု ဖြစ်နေသော်လည်း player က parse မလုပ်နိုင်တော့ပါက ၎င်းကို အသုံးမပြုနိုင်တော့ပါ။

အဆင့်လိုက် ဘာသာပြန် Workflow

1. မူရင်းကို ထိန်းသိမ်းပါ

မူရင်း SRT ကို မပြောင်းလဲဘဲ ထားပါ။ interview.en.srtinterview.es.srt ကဲ့သို့ language label ပါသော copy ပေါ်တွင် အလုပ်လုပ်ပါ။

2. မူရင်းဖိုင်ကို parse လုပ်နိုင်ကြောင်း အတည်ပြုပါ

ဘာသာမပြန်မီ subtitle editor သို့မဟုတ် player ထဲတွင် မူရင်းဖိုင်ကို ဖွင့်ပါ။ မူရင်းဖိုင်တွင် timecode ထပ်နေခြင်း၊ separator ပျောက်နေခြင်း၊ သို့မဟုတ် video offset မှားနေခြင်း ရှိနေပါက ထိုချို့ယွင်းချက်များကို အရင်ပြင်ပါ သို့မဟုတ် မှတ်တမ်းတင်ထားပါ။

3. Encoding ကို ရှာဖွေပါ

ပေးပို့ရမည့် specification က တခြားအရာတစ်ခုကို ရှင်းရှင်းလင်းလင်း မတောင်းဆိုလျှင် ဘာသာစုံ output အတွက် UTF-8 ကို သုံးပါ။ YouTube ၏ transcript လမ်းညွှန်တွင် အင်္ဂလိပ်မဟုတ်သော transcript ဖိုင်များသည် UTF-8 encoding ဖြစ်ရမည်ဟု ဆိုထားပြီး ၎င်းသည် အပြည်ပြည်ဆိုင်ရာ subtitle ဖိုင်များအတွက် အခြေခံစံအဖြစ် သင့်လျော်သည် (YouTube Help).

4. ဖွဲ့စည်းပုံဆိုင်ရာ field များကို အအေးခဲထားပါ

cue နံပါတ်များနှင့် timestamp မျဉ်းများကို ကာကွယ်ထားသော အကြောင်းအရာအဖြစ် သဘောထားပါ။ tool တစ်ခုက ၎င်းတို့ကို lock မလုပ်နိုင်လျှင် batch အသေးများဖြင့် ဘာသာပြန်ပြီး batch တစ်ခုစီပြီးတိုင်း စစ်ဆေးအတည်ပြုပါ။

5. အနီးအနား context နှင့်အတူ cue အပြည့်အစုံကို ဘာသာပြန်ပါ

ပြသမည့်စာသားကို ဘာသာပြန်ပါ၊ သို့သော် context အတွက် ရှေ့ cue နှင့် နောက် cue ကိုပါ ထည့်ပေးပါ။ subtitle များသည် ဝါကျတစ်ကြောင်းကို cue မျိုးစုံအတွင်း ခွဲထားလေ့ရှိသောကြောင့် သီးသန့်ဘာသာပြန်ခြင်းက tense၊ pronoun သို့မဟုတ် word order ကို မညီမညာ ဖြစ်စေနိုင်သည်။

6. ဘာသာပြန်မည့် ဘာသာစကားအတွက် segmentation ကို ပြန်ချိန်ညှိပါ

retime လုပ်ရန် ခွင့်ပြုချက်မရှိလျှင် cue timing ကို ထိန်းထားပါ၊ သို့သော် cue အတွင်းရှိ target line break ကို ချိန်ညှိပါ။ article၊ preposition၊ name သို့မဟုတ် တင်းတင်းကျပ်ကျပ် ဆက်စပ်နေသော verb phrase များနောက်တွင် မဖြတ်ဘဲ သဘာဝကျသော စကားစုနယ်နိမိတ်များတွင် ဖြတ်ပါ။

7. ဖွဲ့စည်းပုံဆိုင်ရာ validation ကို လုပ်ဆောင်ပါ

မူရင်းနှင့် ဘာသာပြန် cue အရေအတွက်၊ ID များ၊ timestamp များ၊ အစဉ်လိုက်၊ tag များနှင့် အလွတ် separator များကို နှိုင်းယှဉ်ပါ။ reviewer များက load မရသော ဖိုင်ပေါ် အချိန်မဖြုန်းစေရန် ဘာသာဗေဒ review မတိုင်မီ ဒီအဆင့်ကို လုပ်ပါ။

8. ဘာသာပြန် target track တစ်ခုလုံးကို ကြည့်ပါ

automated check များက subtitle တစ်ခုသည် speaker မပြောခင် ပေါ်လာသလား၊ screen ပေါ်က အရေးကြီးစာသားကို ဖုံးကွယ်သလား၊ သို့မဟုတ် စကားလဲလှယ်မှု မြန်ဆန်နေစဉ်အတွင်း ဖတ်ရှုနိုင်သေးသလားကို မဆုံးဖြတ်နိုင်ပါ။

Line Break များ၊ Italics နှင့် Speaker Label များကို ထိန်းသိမ်းပါ

target syntax ပြောင်းသွားသည့်အခါ မူရင်း line break များကို စက်ရုပ်လို မကူးပါနှင့်။ cue ကို ထိန်းထားပြီးမှ target language အတွက် ဖတ်ရှုရလွယ်သော line break ကို ရွေးပါ။

ဥပမာအားဖြင့် ဤမူရင်း break သည် မကောင်းပါ:

We approved the proposal
after the final review.

target language က condition ကို အရင်တင်လိုက်လျှင် သဘာဝကျသော break သည် နေရာပြောင်းနိုင်သည်။ မှန်ကန်သော ရည်မှန်းချက်မှာ မူရင်းမျဉ်းကို pixel အတိအကျ လိုက်ညှိခြင်းမဟုတ်ဘဲ အဓိပ္ပာယ်အုပ်စုဖွဲ့ခြင်း ဖြစ်သည်။

destination က ပံ့ပိုးပေးပြီး style guide ကလည်း တောင်းဆိုမှသာ အဓိပ္ပာယ်ရှိသော italics များကို ထိန်းထားပါ။ speaker label များကိုလည်း တသမတ်တည်း ထိန်းပါ။ YouTube သည် transcript workflow များတွင် အသံများအတွက် [music] ကဲ့သို့သော cue များနှင့် speaker ကို ဖော်ထုတ်ရန် >> ကို အကြံပြုထားသည် (YouTube Help); အခြား client များက မတူညီသော convention ကို လိုအပ်နိုင်သည်။

Cue အရေအတွက်နှင့် Timestamp အစဉ်ကို စစ်ဆေးအတည်ပြုပါ

ဤ invariant table ကို အသုံးပြုပါ:

စစ်ဆေးချက်မျှော်မှန်းရလဒ်တားဆီးရမလား?
Cue အရေအတွက်မူရင်းနှင့် target အရေအတွက် တူညီသည်approved retime တစ်ခုက အရေအတွက်ကို ပြောင်းထားခြင်း မဟုတ်လျှင် ဟုတ်သည်
Cue ID များတူညီသော unique ID များကို တူညီသော အစဉ်အတိုင်း ရှိသည်ဟုတ်သည်
Timestamp စာသားtiming ကို lock လုပ်ထားလျှင် byte-for-byte တူညီသည်ဟုတ်သည်
အစသည် အဆုံးမတိုင်မီ ဖြစ်ရမည်cue တိုင်းတွင် positive duration ရှိသည်ဟုတ်သည်
အစဉ်လိုက် အစီအစဉ်မတော်တဆ နောက်ပြန်ခုန်ခြင်း မရှိဟုတ်သည်
Tagsဟန်ချက်ညီပြီး ပံ့ပိုးထားသည်များသောအားဖြင့်
မြင်ရသော စာသားမူရင်း cue တိုင်းတွင် ရည်ရွယ်ချက်ရှိသော target ရှိသည်ဟုတ်သည်

ဖိုင်အရွယ်အစားကို ကိုယ်စားလှယ်ညွှန်းကိန်းအဖြစ် မသုံးပါနှင့်။ ဘာသာပြန်မှုကြောင့် စာသားချဲ့ထွင်လာနိုင်သောကြောင့် target ဖိုင်က ပိုကြီးလာနိုင်ပြီး byte count ဆင်တူနေခြင်းက ဘာကိုမှ မသက်သေပြပါ။

Subtitle များကို ဗီဒီယိုနှင့် တိုက်စစ်ပါ

ပုံမှန် playback speed ဖြင့် review လုပ်ပြီး အောက်ပါ ခက်ခဲသည့် အချိန်ပိုင်းများကို ထည့်သွင်းပါ:

  • အမြန်ဆုံး dialogue;
  • speaker နှစ်ဦးက အမြန်အလှည့်ကျ ပြောသည့်နေရာ;
  • name များ၊ date များ၊ currency များနှင့် measurement များ;
  • scene cut ကို ဖြတ်ကျော်သည့် dialogue;
  • sign သို့မဟုတ် lower third များနှင့် ယှဉ်ပြိုင်နေသော စာသား;
  • သီချင်းများ၊ sound effect များနှင့် screen ပြင်ပ အသံများ;
  • ပထမ cue နှင့် နောက်ဆုံး cue;
  • ပံ့ပိုးထားသော formatting tag တစ်မျိုးစီ ပါဝင်သော အပိုင်း အနည်းဆုံးတစ်ခု။

ဖွဲ့စည်းပုံဆိုင်ရာ validation ပြီးနောက် ဖတ်ရှုရလွယ်ကူမှုနှင့် segmentation ကို အကဲဖြတ်ရန် subtitle ဘာသာပြန် QA checklist ကို အသုံးပြုပါ။

တွေ့ရလေ့ရှိသော SRT အမှားများနှင့် ပြင်ဆင်နည်းများ

လက္ခဏာဖြစ်နိုင်ခြေမြင့်သော အကြောင်းရင်းပြင်ဆင်နည်း
Player က ဖိုင်ကို ငြင်းပယ်သည်timestamp syntax သို့မဟုတ် cue separator များ ပျက်နေသည်ပထမဆုံး ပျက်သည့် cue ကို မူရင်းနှင့် နှိုင်းယှဉ်ပါ
timecode များ တူနေသော်လည်း caption များ လွဲသွားသည်မူရင်း track မှားနေခြင်း သို့မဟုတ် video edit ပြောင်းထားခြင်းမူရင်းဖိုင်ကို တိတိကျကျ တူညီသော video version နှင့် align လုပ်ပါ
စာသားသည် box များ သို့မဟုတ် mojibake အဖြစ် ပေါ်လာသည်encoding သို့မဟုတ် font supportUTF-8 အဖြစ် save လုပ်ပြီး playback environment ကို စမ်းသပ်ပါ
ဝါကျတစ်ကြောင်းသည် speaker မှားအောက်တွင် ပေါ်လာသည်cue ပေါင်းသွားခြင်း သို့မဟုတ် context မရှိသော ဘာသာပြန်မှုcue boundary များကို ပြန်ထားပြီး အနီးအနား cue များကို review လုပ်ပါ
နှစ်ကြောင်း cue များသည် စာသားနံရံများ ဖြစ်သွားသည်target စာသား ချဲ့ထွင်လာခြင်းချုံ့ပါ၊ စကားပြန်ဖွဲ့ပါ၊ သို့မဟုတ် retime လုပ်ရန် ခွင့်ပြုချက် ရယူပါ
italics သည် နောက် cue များထိ ဆက်ဖွင့်နေသည်tag များ မညီမျှခြင်းcue တစ်ခုချင်းစီအလိုက် tag များကို စစ်ပြီး local အတွင်း ပိတ်ပါ

Timestamp တိုင်းကို မထိန်းသင့်သော အချိန်

မူရင်း timing ပျက်နေခြင်း၊ ဘာသာပြန်မည့် ဘာသာစကားက သိသိသာသာ ကွဲပြားသော segmentation လိုအပ်ခြင်း၊ သို့မဟုတ် ဗီဒီယိုကိုယ်တိုင် ပြန်လည်တည်းဖြတ်ထားခြင်း ရှိပါက timestamp preservation ကို မကတိပေးပါနှင့်။ ထိုအခြေအနေများတွင် မူရင်းဖိုင်ကို audit reference အဖြစ် ထိန်းထားပြီး target track ကို retime လုပ်ထားကြောင်း ရှင်းလင်းစွာ ဖန်တီးပါ။

Timestamp lock လုပ်ခြင်းသည် ဘာသာပြန်ကန့်သတ်ချက်တစ်ခုသာဖြစ်ပြီး subtitle authorship ကို အစားထိုးမပေးနိုင်ပါ။

အမေးများသော မေးခွန်းများ

SRT ဖိုင်ထဲက စာသားကိုပဲ ဘာသာပြန်လို့ရသလား?

ရပါတယ်။ cue နံပါတ်များ၊ timestamp များနှင့် separator များကို ကာကွယ်ထားစဉ် စာသားမျဉ်းများကို ဘာသာပြန်ပါ။ ထို့နောက် မူရင်း cue တိုင်းတွင် ရည်ရွယ်ချက်ရှိသော target cue တစ်ခုစီ ဆက်ရှိနေကြောင်း စစ်ဆေးအတည်ပြုပါ။

ဘာသာပြန် subtitle များသည် cue အရေအတွက် တူရမလား?

timing ကို lock လုပ်ထားလျှင် တူရမည်။ အရေအတွက် မတူခြင်းသည် cue များ ပေါင်းသွားခြင်း၊ ပျောက်သွားခြင်း သို့မဟုတ် ခွဲသွားခြင်း၏ အားကောင်းသော အချက်ပြဖြစ်သည်။ ကျွမ်းကျင်သော retiming workflow တစ်ခုက အရေအတွက်ကို ရည်ရွယ်ချက်ရှိရှိ ပြောင်းနိုင်ပေမယ့် အဲဒါကို မှတ်တမ်းတင်ထားသင့်သည်။

Timestamp မပြောင်းဘဲ line break များကို ပြောင်းလို့ရသလား?

ရပါတယ်။ line break များသည် cue timing ၏ အစိတ်အပိုင်းမဟုတ်ဘဲ ပြသမည့် စာသား၏ အစိတ်အပိုင်းဖြစ်သည်။ ၎င်းတို့ကို target language ထဲရှိ သဘာဝကျသော စကားစု နယ်နိမိတ်များသို့ ရွှေ့ပါ။

ဘာသာပြန် SRT ဖိုင်များအတွက် ဘယ် encoding ကို သုံးသင့်သလဲ?

UTF-8 သည် ဘာသာစုံစာသားအတွက် အလုံခြုံဆုံး default ဖြစ်သည်။ မှတ်တမ်းတင်ထားသော delivery system တစ်ခုက တောင်းဆိုသည့်အခါမှသာ legacy encoding ကို သုံးပါ။

ကျွန်ုပ်၏ ဘာသာပြန် SRT သည် load လုပ်ရသော်လည်း ဘာကြောင့် မမှန်သေးသလို မြင်ရသနည်း?

parsing စမ်းသပ်မှုနှင့် viewing စမ်းသပ်မှုသည် မတူညီပါ။ ဖိုင်သည် ဖွဲ့စည်းပုံအရ မှန်ကန်နိုင်သော်လည်း cue များသည် အလွန်ရှည်လျားနေခြင်း၊ segmentation မကောင်းခြင်း၊ အသုံးပြုထားသော video version အတွက် timing မကိုက်ခြင်း၊ သို့မဟုတ် player ၏ font stack က မပံ့ပိုးခြင်းတို့ ဖြစ်နိုင်သည်။

ဆက်စပ် ဆောင်းပါးများ