Как да преведете SRT файл, без да променяте времевите кодове
Преведете текста на субтитрите, като заключите номерата на репликите и времевите кодове, след което проверете последователността, кодирането и възпроизвеждането преди предаване.

Бърз отговор: Преведете текста на репликите, заключете ID-тата и времевите кодове
SRT файлът е файл с времеви данни, а не транскрипт с декоративни времеви отметки. Превеждайте само текста на субтитрите. Запазете всеки номер на реплика, времеви код, празен разделителен ред и всеки поддържан таг за форматиране на мястото му, след което сравнете структурата на репликите в изходния и целевия файл, преди да гледате видеото.
За работен процес, съобразен с файла, качете оригиналния файл в SRT Translator, вместо да копирате надписите в неструктурирано текстово поле. Съобразяването с файла намалява структурния риск, но все пак трябва да проверите изхода спрямо източника и видеото.
Неочевидното правило е следното: запазването на времевите кодове е необходимо, но не е достатъчно. Реплика в целевия файл може да запази точно същите времеви кодове и въпреки това да е неуспешна, защото преведеното изречение е твърде дълго за четене, прекъснато е на неправилно място или се отнася до говорител, който още не се е появил.
Как е структуриран един SRT файл
Типичната реплика съдържа четири части:
17
00:00:41,500 --> 00:00:44,200
<i>MAYA:</i> The total is €1,249.50.
17е номерът на репликата.00:00:41,500е началният момент.00:00:44,200е крайният момент.- Оставащият ред или редове са показваният текст.
SRT обикновено използва запетая между секундите и милисекундите и --> между началото и края. Един празен ред отделя една реплика от следващата. Някои плейъри търпят вариации; надеждният процес на превод не разчита на тази търпимост.
Изтеглете синтетичния стрес тест за превод на SRT. Той включва диалог, курсив, етикет за говорител, дата, валута, CJK текст, арабски, кирилица и латински символи с диакритични знаци. Съдържанието е измислено, така че е безопасно за използване при тестове на парсер и кодиране.
Защо преводът чрез copy-paste поврежда SRT файловете
Общите текстови работни процеси могат да вземат структурата за съдържание. Често срещаните повреди включват:
- превеждане или преномериране на ID-тата на репликите;
- промяна на разделителя във времевия код или на десетичната запетая;
- сливане на две кратки реплики в един абзац;
- изпускане на повторена или привидно празна реплика;
- връщане на Markdown ограждения около файла;
- пренаписване на етикетите на говорителите като проза;
- изтриване на таговете
<i>или извеждане на неподдържан rich-text markup; - замяна на празните разделители между репликите с пренесени редове.
Дори езиково добрият превод е неизползваем, когато плейърът вече не може да анализира файла.
Преводен работен процес стъпка по стъпка
1. Запазете оригинала
Оставете изходния SRT непроменен. Работете върху копие с означен език, например interview.en.srt → interview.es.srt.
2. Потвърдете, че източникът се анализира коректно
Отворете изходния файл в редактор за субтитри или в плейър, преди да го превеждате. Ако източникът вече има припокриващи се времеви кодове, липсващи разделители или грешно отместване спрямо видеото, първо поправете или документирайте тези дефекти.
3. Открийте кодирането
Използвайте UTF-8 за многоезичен изход, освен ако спецификацията за предаване изрично не изисква нещо друго. Указанията на YouTube за транскрипти казват, че файловете с транскрипти на езици, различни от английски, трябва да бъдат кодирани в UTF-8, което е разумна базова линия за международни файлове със субтитри (YouTube Help).
4. Замразете структурните полета
Третирайте номерата на репликите и редовете с времеви кодове като защитено съдържание. Ако даден инструмент не може да ги заключи, превеждайте на малки партиди и проверявайте след всяка партида.
5. Превеждайте цели реплики със съседен контекст
Превеждайте показвания текст, но осигурявайте предишната и следващата реплика за контекст. Субтитрите често разделят едно изречение в няколко реплики; изолираният превод може да промени време, местоимения или словоред непоследователно.
6. Пресегментирайте за целевия език
Запазете времето на репликата, освен ако нямате разрешение да я пренастроите по време, но коригирайте пренасянето на реда в целевата реплика. Разделяйте на естествени граници на фразите, а не след членове, предлози, имена или тясно свързани глаголни фрази.
7. Извършете структурна проверка
Сравнете броя на репликите, ID-тата, времевите кодове, реда, таговете и празните разделители в изходния и целевия файл. Направете това преди езиковата проверка, за да не губят рецензентите време по файл, който не може да се зареди.
8. Гледайте целия целеви трак
Автоматичните проверки не могат да кажат дали субтитърът се появява преди говорителят да започне да говори, закрива важен текст на екрана или остава четим по време на бърз обмен на реплики.
Запазвайте пренасянията на ред, курсива и етикетите на говорителите
Не запазвайте механично пренасянията на редове от източника, когато синтаксисът на целевия език се променя. Запазете репликата, след това изберете четимо пренасяне на реда на целевия език.
Например това пренасяне в източника е лошо:
We approved the proposal
after the final review.
Ако целевият език поставя условието на първо място, естественото пренасяне може да се премести. Правилната цел е смисловото групиране, а не съвпадение с изходния ред пиксел по пиксел.
Запазвайте значимия курсив само когато крайната среда го поддържа и стиловият наръчник го изисква. Запазвайте етикетите на говорителите последователно. YouTube препоръчва реплики като [music] за звуци и >> за обозначаване на говорители в работни процеси с транскрипти (YouTube Help); други клиенти може да изискват различна конвенция.
Проверете броя на репликите и реда на времевите кодове
Използвайте тази таблица с инварианти:
| Проверка | Очакван резултат | Блокиращо? |
|---|---|---|
| Брой реплики | Броят в източника и целта съвпада | Да, освен ако одобрено пренастройване не е променило броя |
| ID на реплики | Същите уникални ID-та в същия ред | Да |
| Текст на времето | Съвпадение байт по байт, когато времето е заключено | Да |
| Начало преди край | Всяка реплика има положителна продължителност | Да |
| Ред на последователността | Няма случайно връщане назад | Да |
| Тагове | Балансирани и поддържани | Обикновено |
| Видим текст | Всяка изходна реплика има целева реплика с ясен замисъл | Да |
Не използвайте размера на файла като заместител. Разширяването при превод прави целевия файл по-голям; сходният брой байтове не доказва нищо.
Проверете субтитрите спрямо видеото
Преглеждайте при нормална скорост на възпроизвеждане и включете тези трудни моменти:
- най-бързия диалог;
- двама говорители, които се редуват бързо;
- имена, дати, валути и мерни единици;
- диалог, който пресича смяна на сцена;
- текст, който се конкурира с табели или долни надписи;
- песни, звукови ефекти и гласове извън кадър;
- първата и последната реплика;
- поне един раздел, съдържащ всеки поддържан таг за форматиране.
Използвайте контролния списък за QA на превода на субтитри, за да оцените четимостта и сегментацията след структурната проверка.
Чести грешки в SRT и техните поправки
| Симптом | Вероятна причина | Поправка |
|---|---|---|
| Плейърът отхвърля файла | Счупен синтаксис на времевите кодове или разделителите между репликите | Сравнете първата проблемна реплика с източника |
| Надписите се разместват, но времевите кодове съвпадат | Грешен изходен трак или редакция на видеото | Подравнете изходния файл към точната версия на видеото |
| Текстът се показва като квадратчета или mojibake | Кодиране или поддръжка на шрифт | Запишете като UTF-8 и тествайте средата за възпроизвеждане |
| Изречение се появява под грешния говорител | Сливане на реплики или превод без контекст | Възстановете границите на репликите и прегледайте съседните реплики |
| Двуредовите реплики стават стени от текст | Разширяване в целевия език | Съкратете, преформулирайте или поискайте разрешение за пренастройване |
| Курсивът остава отворен в следващи реплики | Небалансирани тагове | Проверявайте таговете за всяка реплика и ги затваряйте локално |
Кога да не запазвате всеки времеви код
Не обещавайте запазване на времевите кодове, когато времето в източника е дефектно, преведеният език изисква съществено различна сегментация или самото видео е било монтирано наново. В такива случаи запазете източника като референтен запис за одит и създайте целеви трак с изрично пренастроено време.
Заключването на времевите кодове е ограничение при превода, а не заместител на авторската работа по субтитрирането.
FAQ
Мога ли да преведа само текста в SRT файл?
Да. Преведете текстовите редове, като защитите номерата на репликите, времевите кодове и разделителите. След това проверете дали всяка изходна реплика все още има точно една целева реплика с ясен замисъл.
Трябва ли преведените субтитри да имат същия брой реплики?
Когато времето е заключено, да. Различният брой е силен сигнал, че реплики са били слети, изгубени или разделени. Професионален работен процес за пренастройване на времето може умишлено да промени броя, но това трябва да бъде документирано.
Мога ли да променям пренасянията на ред, без да променям времевите кодове?
Да. Пренасянията на ред са част от показвания текст, а не от времето на репликата. Премествайте ги към естествени граници на фразите в целевия език.
Какво кодиране трябва да използвам за преведени SRT файлове?
UTF-8 е най-безопасната настройка по подразбиране за многоезичен текст. Използвайте старо кодиране само когато документирана система за предаване го изисква.
Защо моят преведен SRT се зарежда, но все пак изглежда грешно?
Анализирането и прегледът са различни тестове. Файлът може да е структурно валиден, докато репликите му са твърде дълги, лошо сегментирани, с неподходящо време за версията на видеото или неподдържани от шрифтовия стек на плейъра.
Свързани публикации




