BookTranslator
BookTranslator

Cum să traduci un fișier SRT fără să modifici marcajele temporale

Tradu textul subtitrărilor păstrând fixe numerele de cue și codurile de timp, apoi validează secvența, codarea și redarea înainte de livrare.

BookTranslator

BookTranslator Team

8 min read

Răspuns rapid: Tradu textul cue-urilor, păstrează fixe ID-urile și codurile de timp

Un fișier SRT este un fișier de date temporizate, nu o transcriere cu marcaje temporale decorative. Tradu doar textul subtitrărilor. Păstrează fiecare număr de cue, marcaj temporal, linie goală de separare și etichetă de formatare acceptată la locul ei, apoi compară structurile cue-urilor din sursă și din țintă înainte de a viziona videoclipul.

Pentru un flux de lucru care înțelege fișierele, încarcă fișierul original în SRT Translator în loc să copiezi subtitrările într-o casetă de text nestructurată. Înțelegerea structurii fișierului reduce riscul structural, dar tot ar trebui să validezi rezultatul față de sursă și față de videoclip.

Regula neintuitivă este aceasta: păstrarea codurilor de timp este necesară, dar nu este suficientă. Un cue din țintă poate păstra exact aceleași marcaje temporale și totuși să eșueze deoarece propoziția tradusă este prea lungă pentru a fi citită, se rupe într-un loc greșit sau se referă la un vorbitor care încă nu a apărut.

Cum este structurat un fișier SRT

Un cue tipic conține patru părți:

17
00:00:41,500 --> 00:00:44,200
<i>MAYA:</i> The total is €1,249.50.

  1. 17 este numărul cue-ului.
  2. 00:00:41,500 este momentul de început.
  3. 00:00:44,200 este momentul de sfârșit.
  4. Linia sau liniile rămase reprezintă textul afișat.

SRT folosește în mod obișnuit o virgulă între secunde și milisecunde și --> între început și sfârșit. O linie goală separă un cue de următorul. Unele playere tolerează variații; un flux de traducere fiabil nu depinde de această toleranță.

Descarcă testul sintetic de stres pentru traducerea SRT. Include dialog, italice, o etichetă de vorbitor, o dată, monedă, text CJK, arabă, chirilică și caractere latine accentuate. Conținutul este fictiv, deci este sigur de folosit pentru teste de parser și de codare.

De ce traducerea prin copy-paste strică fișierele SRT

Fluxurile generale de lucru pentru text pot confunda structura cu conținutul. Eșecurile obișnuite includ:

  • traducerea sau renumerotarea ID-urilor cue-urilor;
  • modificarea separatorului marcajelor temporale sau a virgulei zecimale;
  • combinarea a două cue-uri scurte într-un singur paragraf;
  • eliminarea unui cue repetat sau aparent gol;
  • returnarea de delimitatoare Markdown în jurul fișierului;
  • rescrierea etichetelor de vorbitor ca proză;
  • ștergerea etichetelor <i> sau generarea unui markup rich-text neacceptat;
  • înlocuirea separatoarelor goale dintre cue-uri cu linii împachetate.

Chiar și o traducere bună din punct de vedere lingvistic este inutilizabilă când playerul nu o mai poate parsa.

Flux de traducere pas cu pas

1. Păstrează originalul

Păstrează SRT-ul sursă neschimbat. Lucrează pe o copie etichetată cu limba, cum ar fi interview.en.srtinterview.es.srt.

2. Confirmă că sursa poate fi parsată

Deschide sursa într-un editor de subtitrări sau într-un player înainte de a o traduce. Dacă sursa are deja coduri de timp suprapuse, separatori lipsă sau decalaj greșit față de videoclip, remediază sau documentează mai întâi aceste defecte.

3. Detectează codarea

Folosește UTF-8 pentru ieșirea multilingvă, cu excepția cazului în care specificația de livrare cere explicit altceva. Ghidul YouTube pentru transcrieri spune că fișierele de transcriere non-engleze ar trebui să fie codate UTF-8, ceea ce este o bază rezonabilă pentru fișierele internaționale de subtitrări (Ajutor YouTube).

4. Îngheață câmpurile structurale

Tratează numerele cue-urilor și liniile de marcaj temporal ca pe un conținut protejat. Dacă un instrument nu le poate bloca, traduci în loturi mici și validezi după fiecare lot.

5. Tradu cue-uri complete cu contextul vecin

Tradu textul afișat, dar oferă cue-ul anterior și pe cel următor pentru context. Subtitrările împart frecvent o propoziție între mai multe cue-uri; traducerea izolată poate modifica incoerent timpul verbal, pronumele sau ordinea cuvintelor.

6. Resegmentează pentru limba țintă

Păstrează temporizarea cue-ului dacă nu ești autorizat să o refaci, dar ajustează ruptura de linie din țintă în interiorul cue-ului. Rupe la limite naturale de sintagmă, nu după articole, prepoziții, nume sau grupuri verbale strâns legate.

7. Rulează validarea structurală

Compară numărul cue-urilor, ID-urile, marcajele temporale, ordinea, etichetele și separatorii goi dintre sursă și țintă. Fă asta înainte de revizuirea lingvistică, astfel încât revizorii să nu piardă timp cu un fișier care nu se poate încărca.

8. Urmărește întreaga pistă țintă

Verificările automate nu pot spune dacă o subtitrare apare înainte ca vorbitorul să înceapă să vorbească, dacă acoperă un text esențial de pe ecran sau dacă rămâne lizibilă în timpul unui schimb rapid de replici.

Păstrează rupturile de linie, italicele și etichetele de vorbitor

Nu păstra mecanic rupturile de linie din sursă atunci când sintaxa țintă se schimbă. Păstrează cue-ul, apoi alege o ruptură de linie lizibilă în limba țintă.

De exemplu, această ruptură de linie din sursă este slabă:

We approved the proposal
after the final review.

Dacă limba țintă pune condiția pe primul loc, ruptura naturală se poate muta. Obiectivul corect este gruparea semantică, nu potrivirea pixel cu pixel a liniei sursă.

Păstrează italicele semnificative doar atunci când destinația le acceptă și ghidul de stil le cere. Păstrează consecvent etichetele de vorbitor. YouTube recomandă cue-uri precum [music] pentru sunete și >> pentru identificarea vorbitorilor în fluxurile de lucru de transcriere (Ajutor YouTube); alți clienți pot cere o convenție diferită.

Validează numărul cue-urilor și ordinea marcajelor temporale

Folosește acest tabel de invariabile:

VerificareRezultatul așteptatBlocant?
Număr de cue-uriNumărul din sursă și din țintă se potriveșteDa, cu excepția cazului în care o retemporizare aprobată a schimbat numărul
ID-uri cueAceleași ID-uri unice în aceeași ordineDa
Textul marcajului temporalPotrivire byte cu byte când temporizarea este blocatăDa
Început înainte de sfârșitFiecare cue are durată pozitivăDa
Ordinea secvențeiNiciun salt accidental înapoiDa
EticheteEchilibrate și acceptateDe obicei
Text vizibilFiecare cue din sursă are un cue țintă intenționatDa

Nu folosi dimensiunea fișierului ca indicator indirect. Extinderea prin traducere mărește fișierul țintă; un număr similar de octeți nu dovedește nimic.

Verifică subtitrările față de videoclip

Revizuiește la viteză normală de redare și include aceste momente dificile:

  • dialogul cel mai rapid;
  • doi vorbitori care alternează rapid;
  • nume, date, monede și măsurători;
  • dialog care trece peste o tăietură de scenă;
  • text care concurează cu indicatoare sau titluri inferioare;
  • cântece, efecte sonore și voci din afara cadrului;
  • primul și ultimul cue;
  • cel puțin o secțiune care conține fiecare etichetă de formatare acceptată.

Folosește checklistul QA pentru traducerea subtitrărilor pentru a evalua lizibilitatea și segmentarea după validarea structurală.

Erori comune SRT și remedieri

SimptomCauză probabilăRemediere
Playerul respinge fișierulSintaxă stricată a marcajelor temporale sau separatori între cue-uriCompară primul cue care eșuează cu sursa
Subtitrările se decalază, dar codurile de timp se potrivescPistă sursă greșită sau editare a videoclipuluiAliniază fișierul sursă la versiunea exactă a videoclipului
Textul apare ca pătrate sau mojibakeCodare sau suport pentru fontSalvează ca UTF-8 și testează mediul de redare
O propoziție apare sub vorbitorul greșitComasare de cue-uri sau traducere fără contextRestabilește limitele cue-urilor și revizuiește cue-urile vecine
Cue-urile pe două rânduri devin ziduri de textExtindere în limba țintăCondensează, reformulează sau obține permisiunea de a retemporiza
Italicele rămân deschise pentru cue-urile ulterioareEtichete dezechilibrateValidează etichetele pentru fiecare cue și închide-le local

Când să nu păstrezi fiecare marcaj temporal

Nu promite păstrarea marcajelor temporale atunci când temporizarea sursei este defectă, limba tradusă are nevoie de o segmentare material diferită sau videoclipul însuși a fost reeditat. În aceste cazuri, păstrează sursa ca referință de audit și creează o pistă țintă retemporizată în mod explicit.

Blocarea marcajelor temporale este o constrângere de traducere, nu un substitut pentru redactarea profesională a subtitrărilor.

Întrebări frecvente

Pot să traduc doar textul dintr-un fișier SRT?

Da. Tradu liniile de text protejând în același timp numerele cue-urilor, marcajele temporale și separatorii. Apoi validează că fiecare cue din sursă are încă un cue țintă intenționat.

Ar trebui ca subtitrările traduse să aibă același număr de cue-uri?

Când temporizarea este blocată, da. Un număr diferit este un semnal puternic că unele cue-uri au fost comasate, pierdute sau împărțite. Un flux profesionist de retemporizare poate schimba intenționat numărul, dar acest lucru ar trebui documentat.

Pot să schimb rupturile de linie fără să schimb marcajele temporale?

Da. Rupturile de linie fac parte din textul afișat, nu din temporizarea cue-ului. Mută-le la limite naturale de sintagmă în limba țintă.

Ce codare ar trebui să folosesc pentru fișierele SRT traduse?

UTF-8 este cea mai sigură alegere implicită pentru textul multilingv. Folosește o codare veche doar atunci când un sistem de livrare documentat o cere.

De ce se încarcă SRT-ul meu tradus, dar tot arată greșit?

Parsarea și vizualizarea sunt teste diferite. Fișierul poate fi valid din punct de vedere structural, în timp ce cue-urile sale sunt prea lungi, segmentate prost, temporizate greșit pentru versiunea videoclipului sau neacceptate de setul de fonturi al playerului.

Articole asociate