BookTranslator
BookTranslator

Hoe je een SRT-bestand vertaalt zonder de tijdstempels te wijzigen

Vertaal ondertiteltekst terwijl je cue-nummers en tijdcodes vergrendelt, en controleer daarna de volgorde, codering en weergave vóór levering.

BookTranslator

BookTranslator Team

7 min read

Snel antwoord: vertaal cuetekst, vergrendel ID's en tijdcodes

Een SRT-bestand is een getimed gegevensbestand, geen transcript met decoratieve tijdstempels. Vertaal alleen de ondertiteltekst. Laat elk cue-nummer, elke tijdstempel, elke lege scheidingsregel en elke ondersteunde opmaaktag op zijn plaats staan, en vergelijk daarna de cue-structuren van bron en doel voordat je de video bekijkt.

Voor een bestandsbewuste workflow upload je het originele bestand naar de SRT Translator in plaats van onderschriften naar een ongestructureerd tekstvak te kopiëren. Bestandsbewustzijn verlaagt het structurele risico, maar je moet de uitvoer nog steeds controleren aan de hand van de bron en de video.

De niet voor de hand liggende regel is deze: het behouden van tijdcodes is noodzakelijk, maar niet voldoende. Een doelcue kan exact dezelfde tijdstempels behouden en toch mislukken omdat de vertaalde zin te lang is om te lezen, op de verkeerde frase breekt, of verwijst naar een spreker die nog niet is verschenen.

Hoe een SRT-bestand is opgebouwd

Een typische cue bevat vier onderdelen:

17
00:00:41,500 --> 00:00:44,200
<i>MAYA:</i> The total is €1,249.50.

  1. 17 is het cue-nummer.
  2. 00:00:41,500 is de begintijd.
  3. 00:00:44,200 is de eindtijd.
  4. De resterende regel of regels zijn de weergegeven tekst.

SRT gebruikt doorgaans een komma tussen seconden en milliseconden en --> tussen begin en einde. Een lege regel scheidt de ene cue van de volgende. Sommige spelers verdragen variaties; een betrouwbare vertaalworkflow hangt niet van die tolerantie af.

Download de synthetische SRT-vertaalstresstest. Die bevat dialoog, cursief, een sprekerslabel, een datum, valuta, CJK-tekst, Arabisch, Cyrillisch en Latijnse tekens met accenten. De inhoud is fictief en dus veilig te gebruiken voor parser- en coderingstests.

Waarom kopieer-en-plakvertaling SRT-bestanden kapotmaakt

Algemene tekstworkflows kunnen structuur voor inhoud aanzien. Veelvoorkomende fouten zijn:

  • het vertalen of hernummeren van cue-ID's;
  • het wijzigen van het tijdstempelscheidingsteken of de decimale komma;
  • het samenvoegen van twee korte cues tot één alinea;
  • het weglaten van een herhaalde of ogenschijnlijk lege cue;
  • het teruggeven van Markdown-fences rond het bestand;
  • het herschrijven van sprekerslabels als proza;
  • het verwijderen van <i>-tags of het genereren van niet-ondersteunde rich-text-markup;
  • het vervangen van lege cuescheiders door afgebroken regels.

Zelfs een taalkundig goede vertaling is onbruikbaar wanneer de speler het bestand niet meer kan parseren.

Stapsgewijze vertaalworkflow

1. Bewaar het origineel

Laat de bron-SRT ongewijzigd. Werk op een kopie met taallabel, zoals interview.en.srtinterview.es.srt.

2. Controleer of de bron parseert

Open de bron in een ondertiteleditor of speler voordat je hem vertaalt. Als de bron al overlappende tijdcodes, ontbrekende scheidingen of de verkeerde video-offset heeft, los die gebreken dan eerst op of documenteer ze.

3. Detecteer de codering

Gebruik UTF-8 voor meertalige uitvoer, tenzij de leveringsspecificatie expliciet iets anders vereist. De transcriptierichtlijnen van YouTube zeggen dat transcriptbestanden in andere talen dan Engels UTF-8-gecodeerd moeten zijn, wat een verstandige basislijn is voor internationale ondertitelbestanden (YouTube Help).

4. Bevries structurele velden

Behandel cue-nummers en tijdstempelregels als beschermde inhoud. Als een tool ze niet kan vergrendelen, vertaal dan in kleine batches en valideer na elke batch.

5. Vertaal volledige cues met context van aangrenzende cues

Vertaal de weergegeven tekst, maar geef de vorige en volgende cue mee voor context. Ondertitels splitsen vaak één zin over meerdere cues; geïsoleerde vertaling kan tijd, voornaamwoorden of woordvolgorde inconsistent veranderen.

6. Segmenteer opnieuw voor de doeltaal

Behoud de cue-timing tenzij je bevoegd bent om opnieuw te timen, maar pas de doelregelafbreking binnen de cue aan. Breek op natuurlijke frasegrenzen, niet na lidwoorden, voorzetsels, namen of nauw verbonden werkwoordsgroepen.

7. Voer structurele validatie uit

Vergelijk het aantal bron- en doelcues, ID's, tijdstempels, volgorde, tags en lege scheidingsregels. Doe dit vóór de taalkundige review, zodat reviewers geen tijd verspillen aan een bestand dat niet kan worden geladen.

8. Bekijk het volledige doelspoor

Geautomatiseerde controles kunnen niet bepalen of een ondertitel verschijnt voordat de spreker praat, essentiële tekst op het scherm bedekt of leesbaar blijft tijdens een snelle uitwisseling.

Behoud regelafbrekingen, cursief en sprekerslabels

Behoud regelafbrekingen uit de bron niet mechanisch wanneer de syntaxis van de doeltaal verandert. Behoud de cue en kies daarna een leesbare regelafbreking in de doeltaal.

Dit bronregeleinde is bijvoorbeeld slecht:

We approved the proposal
after the final review.

Als de doeltaal de voorwaarde eerst plaatst, kan de natuurlijke afbreking verschuiven. Het juiste doel is semantische groepering, niet de bron pixel voor pixel laten overeenkomen.

Behoud betekenisvol cursief alleen als de bestemming dit ondersteunt en de stijlgids erom vraagt. Behoud sprekerslabels consequent. YouTube beveelt cues zoals [music] voor geluiden en >> om sprekers te identificeren in transcriptworkflows (YouTube Help); andere klanten kunnen een andere conventie vereisen.

Controleer het aantal cues en de volgorde van tijdstempels

Gebruik deze invariantentabel:

ControleVerwacht resultaatBlokkerend?
Aantal cuesAantallen van bron en doel komen overeenJa, tenzij een goedgekeurde retiming het aantal wijzigde
Cue-ID'sDezelfde unieke ID's in dezelfde volgordeJa
TijdstempeltekstByte-voor-byte gelijk wanneer timing is vergrendeldJa
Begin vóór eindeElke cue heeft een positieve duurJa
VolgordeGeen onbedoelde sprong terug in de tijdJa
TagsGebalanceerd en ondersteundMeestal
Zichtbare tekstElke broncue heeft een opzettelijke doelcueJa

Gebruik bestandsgrootte niet als proxy. Vertaalexpansie maakt het doel groter; een vergelijkbaar aantal bytes bewijst niets.

Controleer de ondertitels aan de hand van de video

Controleer op normale afspeelsnelheid en neem deze lastige momenten mee:

  • de snelste dialoog;
  • twee sprekers die elkaar snel afwisselen;
  • namen, datums, valuta en metingen;
  • dialoog die over een scènesnede heen loopt;
  • tekst die concurreert met borden of lower thirds;
  • liedjes, geluidseffecten en stemmen buiten beeld;
  • de eerste en laatste cue;
  • ten minste één sectie met elke ondersteunde opmaaktag.

Gebruik de QA-checklist voor ondertitelvertaling om leesbaarheid en segmentatie te beoordelen na structurele validatie.

Veelvoorkomende SRT-fouten en oplossingen

SymptoomWaarschijnlijke oorzaakOplossing
Speler weigert het bestandBeschadigde tijdstempelsyntaxis of cuescheidersVergelijk de eerste falende cue met de bron
Ondertitels lopen weg terwijl tijdcodes overeenkomenVerkeerd bronspoor of videobewerkingLijn het bronbestand uit met de exacte videoversie
Tekst verschijnt als blokjes of mojibakeCodering of lettertypeondersteuningSla op als UTF-8 en test de afspeelomgeving
Een zin verschijnt onder de verkeerde sprekerSamengevoegde cues of contextvrije vertalingHerstel cuegrenzen en controleer aangrenzende cues
Cues van twee regels worden muren van tekstDoelexpansieKort in, herformuleer of vraag toestemming om opnieuw te timen
Cursief blijft openstaan voor latere cuesOngebalanceerde tagsValideer tags per cue en sluit ze lokaal af

Wanneer je niet elke tijdstempel moet behouden

Beloof niet dat tijdstempels behouden blijven wanneer de brontiming defect is, de vertaalde taal wezenlijk andere segmentatie nodig heeft, of de video zelf opnieuw is gemonteerd. Behoud in die gevallen de bron als auditreferentie en maak een expliciet opnieuw getimed doelspoor.

Het vergrendelen van tijdstempels is een vertaalbeperking, geen vervanging voor het auteurschap van ondertitels.

FAQ

Kan ik alleen de tekst in een SRT-bestand vertalen?

Ja. Vertaal de tekstregels terwijl je cue-nummers, tijdstempels en scheidingsregels beschermt. Controleer daarna dat elke broncue nog steeds precies één opzettelijke doelcue heeft.

Moeten vertaalde ondertitels hetzelfde aantal cues hebben?

Wanneer de timing is vergrendeld: ja. Een ander aantal is een sterk signaal dat cues zijn samengevoegd, verloren zijn gegaan of zijn opgesplitst. Een professionele retimingworkflow kan het aantal bewust wijzigen, maar dat moet worden gedocumenteerd.

Kan ik regelafbrekingen wijzigen zonder tijdstempels te veranderen?

Ja. Regelafbrekingen zijn onderdeel van de weergegeven tekst, niet van de cue-timing. Verplaats ze naar natuurlijke frasegrenzen in de doeltaal.

Welke codering moet ik gebruiken voor vertaalde SRT-bestanden?

UTF-8 is de veiligste standaard voor meertalige tekst. Gebruik een verouderde codering alleen wanneer een gedocumenteerd leveringssysteem die vereist.

Waarom wordt mijn vertaalde SRT geladen maar ziet hij er nog steeds verkeerd uit?

Parseren en bekijken zijn verschillende tests. Het bestand kan structureel geldig zijn terwijl de cues te lang zijn, slecht gesegmenteerd zijn, verkeerd getimed zijn voor de videoversie, of niet worden ondersteund door de lettertypestack van de speler.

Gerelateerde berichten