BookTranslator
BookTranslator

چگونه یک فایل SRT را بدون تغییر دادن زمان‌مهرها ترجمه کنیم

متن زیرنویس را در حالی ترجمه کنید که شماره‌های cue و timecodeها قفل بمانند، سپس پیش از تحویل، توالی، encoding و پخش را اعتبارسنجی کنید.

BookTranslator

BookTranslator Team

8 min read

پاسخ سریع: متن Cue را ترجمه کنید، شناسه‌ها و Timecodeها را قفل نگه دارید

یک فایل SRT یک فایل داده زمان‌بندی‌شده است، نه یک رونوشت با زمان‌مهرهای تزئینی. فقط متن زیرنویس را ترجمه کنید. هر شماره cue، timestamp، خط جداکننده خالی، و تگ قالب‌بندی پشتیبانی‌شده را در جای خود نگه دارید، سپس پیش از تماشای ویدیو، ساختار cueهای مبدأ و مقصد را با هم مقایسه کنید.

برای یک فرایند آگاه از فایل، فایل اصلی را در SRT Translator آپلود کنید، به‌جای این‌که زیرنویس‌ها را در یک کادر متن بدون ساختار کپی کنید. آگاهی از فایل، ریسک ساختاری را کاهش می‌دهد، اما همچنان باید خروجی را در برابر فایل مبدأ و ویدیو اعتبارسنجی کنید.

قاعده غیربدیهی این است: حفظ timecode ضروری است، اما کافی نیست. یک cue مقصد می‌تواند دقیقاً همان timestampها را حفظ کند و باز هم ناموفق باشد، چون جمله ترجمه‌شده بیش از حد طولانی است و خوانده نمی‌شود، در محل نادرست شکسته شده، یا به گوینده‌ای اشاره می‌کند که هنوز ظاهر نشده است.

ساختار یک فایل SRT چگونه است

یک cue معمولی چهار بخش دارد:

17
00:00:41,500 --> 00:00:44,200
<i>MAYA:</i> The total is €1,249.50.

  1. 17 شماره cue است.
  2. 00:00:41,500 زمان شروع است.
  3. 00:00:44,200 زمان پایان است.
  4. خط یا خط‌های باقی‌مانده، متن نمایش‌داده‌شده هستند.

SRT معمولاً بین ثانیه و میلی‌ثانیه از ویرگول و بین زمان شروع و پایان از --> استفاده می‌کند. یک خط خالی، هر cue را از cue بعدی جدا می‌کند. بعضی پخش‌کننده‌ها تغییرات را تحمل می‌کنند؛ یک فرایند ترجمه قابل‌اعتماد به آن تحمل وابسته نیست.

آزمون فشاری مصنوعی ترجمه SRT را دانلود کنید. این فایل شامل دیالوگ، ایتالیک، برچسب گوینده، تاریخ، واحد پول، متن CJK، عربی، سیریلیک، و نویسه‌های لاتینِ دارای اعراب است. محتوا ساختگی است، بنابراین برای آزمون parser و encoding استفاده از آن بی‌خطر است.

چرا ترجمه با کپی-پیست فایل‌های SRT را خراب می‌کند

فرایندهای متنی عمومی ممکن است ساختار را با محتوا اشتباه بگیرند. خرابی‌های رایج شامل این موارد است:

  • ترجمه یا شماره‌گذاری دوباره شناسه‌های cue؛
  • تغییر جداکننده timestamp یا ویرگول اعشاری؛
  • ادغام دو cue کوتاه در یک پاراگراف؛
  • حذف یک cue تکراری یا ظاهراً خالی؛
  • برگرداندن حصارهای Markdown دور فایل؛
  • بازنویسی برچسب‌های گوینده به صورت نثر؛
  • حذف تگ‌های <i> یا تولید نشانه‌گذاری rich-text پشتیبانی‌نشده؛
  • جایگزین کردن جداکننده‌های خالی cue با خط‌های شکسته‌شده.

حتی یک ترجمه زبانی خوب هم زمانی بی‌استفاده است که پخش‌کننده دیگر نتواند آن را parse کند.

فرایند ترجمه گام‌به‌گام

1. نسخه اصلی را حفظ کنید

SRT مبدأ را بدون تغییر نگه دارید. روی یک کپی با برچسب زبان کار کنید، مانند interview.en.srtinterview.es.srt.

2. تأیید کنید که فایل مبدأ parse می‌شود

پیش از ترجمه، فایل مبدأ را در یک ویرایشگر زیرنویس یا پخش‌کننده باز کنید. اگر مبدأ از قبل timecodeهای هم‌پوشان، جداکننده‌های مفقود، یا offset اشتباه نسبت به ویدیو دارد، ابتدا آن ایرادها را اصلاح یا مستندسازی کنید.

3. encoding را تشخیص دهید

برای خروجی چندزبانه از UTF-8 استفاده کنید، مگر این‌که مشخصات تحویل صراحتاً چیز دیگری بخواهد. راهنمای رونوشت YouTube می‌گوید فایل‌های رونوشت غیرا انگلیسی باید با UTF-8 encoding شوند، که یک مبنای معقول برای فایل‌های زیرنویس بین‌المللی است (YouTube Help).

4. فیلدهای ساختاری را ثابت نگه دارید

با شماره‌های cue و خط‌های timestamp مثل محتوای محافظت‌شده برخورد کنید. اگر یک ابزار نمی‌تواند آن‌ها را قفل کند، در دسته‌های کوچک ترجمه کنید و بعد از هر دسته اعتبارسنجی انجام دهید.

5. cueهای کامل را با context مجاور ترجمه کنید

متن نمایش‌داده‌شده را ترجمه کنید، اما cue قبلی و بعدی را برای context ارائه دهید. زیرنویس‌ها اغلب یک جمله را بین چند cue تقسیم می‌کنند؛ ترجمه جداافتاده می‌تواند زمان، ضمیر، یا ترتیب واژه را به‌صورت ناسازگار تغییر دهد.

6. برای زبان مقصد دوباره بخش‌بندی کنید

زمان‌بندی cue را حفظ کنید مگر این‌که مجوز retime کردن داشته باشید، اما شکست خط مقصد را درون cue تنظیم کنید. در مرزهای طبیعی عبارت خط را بشکنید، نه بعد از حرف تعریف، حرف اضافه، نام‌ها، یا گروه‌های فعلیِ به‌هم‌پیوسته.

7. اعتبارسنجی ساختاری را اجرا کنید

تعداد cueهای مبدأ و مقصد، شناسه‌ها، timestampها، ترتیب، تگ‌ها، و جداکننده‌های خالی را مقایسه کنید. این کار را پیش از بازبینی زبانی انجام دهید تا بازبین‌ها وقت خود را روی فایلی که بارگذاری نمی‌شود تلف نکنند.

8. کل ترک مقصد را تماشا کنید

بررسی‌های خودکار نمی‌توانند تشخیص دهند آیا یک زیرنویس پیش از صحبت کردن گوینده ظاهر می‌شود، متن مهم روی صفحه را می‌پوشاند، یا در خلال یک گفت‌وگوی سریع همچنان خوانا می‌ماند.

شکست خط‌ها، ایتالیک، و برچسب‌های گوینده را حفظ کنید

وقتی نحو زبان مقصد تغییر می‌کند، شکست خط‌های مبدأ را به‌صورت مکانیکی حفظ نکنید. cue را حفظ کنید، سپس یک شکست خط خوانا برای زبان مقصد انتخاب کنید.

برای نمونه، این شکست خط در مبدأ ضعیف است:

We approved the proposal
after the final review.

اگر زبان مقصد شرط را در ابتدا قرار دهد، ممکن است شکست طبیعی جابه‌جا شود. هدف درست، گروه‌بندی معنایی است، نه تطبیق پیکسل‌به‌پیکسل با خط مبدأ.

فقط زمانی ایتالیک‌های معنادار را نگه دارید که مقصد از آن‌ها پشتیبانی کند و راهنمای سبک آن‌ها را لازم بداند. برچسب‌های گوینده را به‌شکل سازگار حفظ کنید. YouTube برای صداها cueهایی مانند [music] و برای شناسایی گویندگان در فرایندهای رونوشت از >> را توصیه می‌کند (YouTube Help); مشتریان دیگر ممکن است قرارداد متفاوتی بخواهند.

تعداد Cue و ترتیب Timestamp را اعتبارسنجی کنید

از این جدول ناوردا استفاده کنید:

Checkنتیجه مورد انتظارمانع؟
تعداد cueتعداد مبدأ و مقصد یکسان استبله، مگر این‌که یک retime تأییدشده تعداد را تغییر داده باشد
شناسه‌های cueهمان شناسه‌های یکتا با همان ترتیببله
متن timestampدر صورت قفل بودن زمان‌بندی، تطابق byte-for-byteبله
شروع قبل از پایانهر cue مدت‌زمان مثبت داردبله
ترتیب توالیهیچ پرش تصادفی به عقب وجود نداردبله
تگ‌هامتعادل و پشتیبانی‌شدهمعمولاً
متن قابل‌مشاهدههر cue مبدأ یک cue مقصد عمدی داردبله

از اندازه فایل به‌عنوان نماینده استفاده نکنید. انبساط ترجمه فایل مقصد را بزرگ‌تر می‌کند؛ تعداد byte مشابه هیچ چیز را ثابت نمی‌کند.

زیرنویس‌ها را در برابر ویدیو بررسی کنید

در سرعت پخش عادی بازبینی کنید و این لحظه‌های دشوار را هم بگنجانید:

  • سریع‌ترین دیالوگ؛
  • دو گوینده که سریع جابه‌جا می‌شوند؛
  • نام‌ها، تاریخ‌ها، واحدهای پول، و اندازه‌گیری‌ها؛
  • دیالوگی که از روی برش صحنه عبور می‌کند؛
  • متنی که با تابلوها یا زیرنویس‌های پایینی رقابت می‌کند؛
  • ترانه‌ها، جلوه‌های صوتی، و صداهای خارج از قاب؛
  • cue اول و آخر؛
  • دست‌کم یک بخش که شامل هر تگ قالب‌بندی پشتیبانی‌شده باشد.

از چک‌لیست QA ترجمه زیرنویس برای ارزیابی خوانایی و بخش‌بندی پس از اعتبارسنجی ساختاری استفاده کنید.

خطاهای رایج SRT و اصلاح آن‌ها

Symptomعلت محتملاصلاح
پخش‌کننده فایل را رد می‌کندنحو timestamp یا جداکننده‌های cue خراب هستندنخستین cue خراب را با مبدأ مقایسه کنید
زیرنویس‌ها جابه‌جا می‌شوند اما timecodeها مطابق‌اندترک مبدأ اشتباه یا ویرایش ویدیوفایل مبدأ را با نسخه دقیق ویدیو هم‌تراز کنید
متن به‌صورت مربع یا mojibake دیده می‌شودencoding یا پشتیبانی فونتفایل را با UTF-8 ذخیره کنید و محیط پخش را تست کنید
یک جمله زیر گوینده اشتباه ظاهر می‌شودادغام cue یا ترجمه بدون contextمرزهای cue را برگردانید و cueهای مجاور را بازبینی کنید
cueهای دوخطی به دیوارهای متن تبدیل می‌شوندانبساط متن مقصدمتن را فشرده کنید، بازنویسی کنید، یا برای retime مجوز بگیرید
ایتالیک برای cueهای بعدی باز می‌ماندتگ‌های نامتعادلتگ‌های هر cue را اعتبارسنجی کنید و آن‌ها را به‌صورت محلی ببندید

چه زمانی نباید هر Timestamp را حفظ کرد

وقتی زمان‌بندی مبدأ معیوب است، زبان ترجمه‌شده به بخش‌بندیِ به‌طور معنادار متفاوت نیاز دارد، یا خود ویدیو دوباره تدوین شده است، وعده حفظ timestampها را ندهید. در این موارد، مبدأ را به‌عنوان مرجع ممیزی حفظ کنید و یک ترک مقصد با retime صریح بسازید.

قفل کردن timestamp یک محدودیت ترجمه است، نه جایگزینی برای تألیف زیرنویس.

پرسش‌های متداول

آیا می‌توانم فقط متن یک فایل SRT را ترجمه کنم؟

بله. خط‌های متن را ترجمه کنید و در عین حال از شماره‌های cue، timestampها، و جداکننده‌ها محافظت کنید. سپس اعتبارسنجی کنید که هر cue مبدأ همچنان دقیقاً یک cue مقصد عمدی دارد.

آیا زیرنویس‌های ترجمه‌شده باید همان تعداد cue را داشته باشند؟

اگر زمان‌بندی قفل است، بله. تعداد متفاوت یک نشانه قوی است که cueها ادغام، حذف، یا شکسته شده‌اند. یک فرایند حرفه‌ای retiming ممکن است عمداً تعداد را تغییر دهد، اما این موضوع باید مستند شود.

آیا می‌توانم بدون تغییر timestampها شکست خط‌ها را عوض کنم؟

بله. شکست خط‌ها بخشی از متن نمایش‌داده‌شده هستند، نه زمان‌بندی cue. آن‌ها را به مرزهای طبیعی عبارت در زبان مقصد منتقل کنید.

برای فایل‌های SRT ترجمه‌شده باید از چه encoding استفاده کنم؟

UTF-8 امن‌ترین پیش‌فرض برای متن چندزبانه است. فقط زمانی از یک encoding قدیمی استفاده کنید که یک سامانه تحویل مستند آن را الزام کرده باشد.

چرا فایل SRT ترجمه‌شده من بارگذاری می‌شود اما باز هم نادرست به نظر می‌رسد؟

parse شدن و مشاهده کردن دو آزمون متفاوت هستند. ممکن است فایل از نظر ساختاری معتبر باشد، در حالی که cueهای آن بیش از حد طولانی‌اند، بد بخش‌بندی شده‌اند، برای نسخه ویدیو زمان‌بندی نادرست دارند، یا توسط پشته فونت پخش‌کننده پشتیبانی نمی‌شوند.

مطالب مرتبط