BookTranslator
BookTranslator

Como traduzir um ficheiro SRT sem alterar os carimbos temporais

Traduza o texto das legendas enquanto bloqueia os números das cues e os códigos temporais, depois valide a sequência, a codificação e a reprodução antes da entrega.

BookTranslator

BookTranslator Team

9 min read

Resposta rápida: traduzir o texto das cues, bloquear IDs e códigos temporais

Um ficheiro SRT é um ficheiro de dados temporizados, não uma transcrição com carimbos temporais decorativos. Traduza apenas o texto das legendas. Mantenha cada número de cue, código temporal, linha separadora em branco e etiqueta de formatação suportada no respetivo lugar, e depois compare as estruturas de cues da origem e do destino antes de ver o vídeo.

Para um fluxo de trabalho orientado para ficheiros, carregue o ficheiro original no SRT Translator em vez de copiar as legendas para uma caixa de texto não estruturada. A perceção da estrutura do ficheiro reduz o risco estrutural, mas continua a ser necessário validar o resultado face à origem e ao vídeo.

A regra menos óbvia é esta: a preservação dos códigos temporais é necessária, mas não é suficiente. Uma cue de destino pode manter exatamente os mesmos carimbos temporais e ainda assim falhar porque a frase traduzida é demasiado longa para ser lida, é quebrada na expressão errada ou faz referência a um interveniente que ainda não apareceu.

Como está estruturado um ficheiro SRT

Uma cue típica contém quatro partes:

17
00:00:41,500 --> 00:00:44,200
<i>MAYA:</i> The total is €1,249.50.

  1. 17 é o número da cue.
  2. 00:00:41,500 é a hora de início.
  3. 00:00:44,200 é a hora de fim.
  4. A linha ou linhas restantes são o texto apresentado.

O SRT usa habitualmente uma vírgula entre os segundos e os milissegundos e --> entre o início e o fim. Uma linha em branco separa uma cue da seguinte. Alguns leitores toleram variações; um fluxo de trabalho de tradução fiável não depende dessa tolerância.

Descarregue o teste de stress sintético de tradução SRT. Inclui diálogo, itálico, uma etiqueta de interveniente, uma data, moeda, texto CJK, árabe, cirílico e caracteres latinos acentuados. O conteúdo é fictício, por isso é seguro utilizá-lo para testes de analisador e de codificação.

Porque é que a tradução por copiar e colar estraga ficheiros SRT

Os fluxos de trabalho de texto de uso geral podem confundir estrutura com conteúdo. As falhas comuns incluem:

  • traduzir ou renumerar IDs de cues;
  • alterar o separador do carimbo temporal ou a vírgula decimal;
  • fundir duas cues curtas num único parágrafo;
  • eliminar uma cue repetida ou aparentemente vazia;
  • devolver cercas Markdown à volta do ficheiro;
  • reescrever etiquetas de intervenientes como prosa;
  • apagar etiquetas <i> ou produzir marcação rich-text não suportada;
  • substituir separadores de cues em branco por linhas quebradas.

Mesmo uma tradução linguisticamente boa é inutilizável quando o leitor já não consegue analisar o ficheiro.

Fluxo de trabalho de tradução passo a passo

1. Preservar o original

Mantenha o SRT de origem inalterado. Trabalhe sobre uma cópia identificada com a língua, como interview.en.srtinterview.es.srt.

2. Confirmar que a origem é analisável

Abra a origem num editor de legendas ou leitor antes de a traduzir. Se a origem já tiver códigos temporais sobrepostos, separadores em falta ou o desfasamento errado em relação ao vídeo, corrija ou documente primeiro esses defeitos.

3. Detetar a codificação

Use UTF-8 para resultados multilingues, a menos que a especificação de entrega exija explicitamente outra coisa. As orientações de transcrição do YouTube dizem que os ficheiros de transcrição em línguas diferentes do inglês devem estar codificados em UTF-8, o que é uma base sensata para ficheiros internacionais de legendas (YouTube Help).

4. Congelar os campos estruturais

Trate os números das cues e as linhas de códigos temporais como conteúdo protegido. Se uma ferramenta não os conseguir bloquear, traduza em pequenos lotes e valide após cada lote.

5. Traduzir cues completas com contexto vizinho

Traduza o texto apresentado, mas forneça a cue anterior e a seguinte como contexto. As legendas dividem frequentemente uma frase por várias cues; uma tradução isolada pode alterar tempo verbal, pronomes ou ordem das palavras de forma inconsistente.

6. Re-segmentar para a língua de destino

Mantenha a temporização da cue, a menos que tenha autorização para a reajustar, mas ajuste a quebra de linha de destino dentro da cue. Quebre em limites naturais de expressão, não após artigos, preposições, nomes ou locuções verbais estreitamente ligadas.

7. Executar validação estrutural

Compare as contagens de cues da origem e do destino, IDs, códigos temporais, ordem, etiquetas e separadores em branco. Faça isto antes da revisão linguística, para que os revisores não percam tempo com um ficheiro que não pode ser carregado.

8. Ver a pista completa de destino

As verificações automáticas não conseguem dizer se uma legenda aparece antes de o interveniente falar, tapa texto essencial no ecrã ou continua legível durante uma troca rápida.

Preservar quebras de linha, itálico e etiquetas de intervenientes

Não preserve mecanicamente as quebras de linha da origem quando a sintaxe do destino muda. Preserve a cue e depois escolha uma quebra de linha legível na língua de destino.

Por exemplo, esta quebra de origem é fraca:

We approved the proposal
after the final review.

Se a língua de destino colocar a condição em primeiro lugar, a quebra natural pode mudar. O objetivo correto é o agrupamento semântico, não corresponder à origem pixel a pixel.

Conserve itálicos significativos apenas quando o destino os suportar e o guia de estilo os exigir. Preserve as etiquetas de intervenientes de forma consistente. O YouTube recomenda cues como [music] para sons e >> para identificar intervenientes em fluxos de trabalho de transcrição (YouTube Help); outros clientes podem exigir uma convenção diferente.

Validar a contagem de cues e a ordem dos códigos temporais

Use esta tabela de invariantes:

VerificaçãoResultado esperadoBloqueador?
Contagem de cuesA contagem da origem e do destino coincideSim, a menos que uma reajustação aprovada altere a contagem
IDs de cuesOs mesmos IDs únicos na mesma ordemSim
Texto do código temporalCorrespondência byte a byte quando a temporização está bloqueadaSim
Início antes do fimTodas as cues têm duração positivaSim
Ordem da sequênciaNenhum salto acidental para trásSim
EtiquetasEquilibradas e suportadasNormalmente
Texto visívelCada cue de origem tem uma cue de destino intencionalSim

Não use o tamanho do ficheiro como indicador. A expansão da tradução torna o destino maior; uma contagem de bytes semelhante não prova nada.

Verificar as legendas face ao vídeo

Reveja à velocidade normal de reprodução e inclua estes momentos difíceis:

  • o diálogo mais rápido;
  • dois intervenientes a alternar rapidamente;
  • nomes, datas, moedas e medidas;
  • diálogo a atravessar um corte de cena;
  • texto que compete com sinalética ou grafismos inferiores;
  • canções, efeitos sonoros e vozes fora de campo;
  • a primeira e a última cue;
  • pelo menos uma secção que contenha cada etiqueta de formatação suportada.

Use a checklist de QA de tradução de legendas para avaliar a legibilidade e a segmentação após a validação estrutural.

Erros comuns em SRT e correções

SintomaCausa provávelCorreção
O leitor rejeita o ficheiroSintaxe de código temporal ou separadores de cues danificadosCompare a primeira cue com falha com a origem
As legendas derivam mas os códigos temporais coincidemPista de origem errada ou edição do vídeoAlinhe o ficheiro de origem com a versão exata do vídeo
O texto aparece como quadrados ou mojibakeCodificação ou suporte de fonteGuarde em UTF-8 e teste o ambiente de reprodução
Uma frase aparece sob o interveniente erradoFusão de cues ou tradução sem contextoReponha os limites das cues e reveja as cues vizinhas
Cues de duas linhas tornam-se blocos de textoExpansão no destinoCondense, reformule ou obtenha permissão para reajustar a temporização
O itálico permanece aberto em cues posterioresEtiquetas desequilibradasValide as etiquetas por cue e feche-as localmente

Quando não deve manter todos os carimbos temporais

Não prometa preservação dos carimbos temporais quando a temporização da origem é defeituosa, a língua traduzida exige uma segmentação materialmente diferente ou o próprio vídeo foi reeditado. Nesses casos, preserve a origem como referência de auditoria e crie uma pista de destino explicitamente reajustada.

O bloqueio de carimbos temporais é uma restrição de tradução, não um substituto da autoria de legendas.

FAQ

Posso traduzir apenas o texto num ficheiro SRT?

Sim. Traduza as linhas de texto enquanto protege os números das cues, os códigos temporais e os separadores. Depois valide que cada cue de origem continua a ter uma cue de destino intencional.

As legendas traduzidas devem ter o mesmo número de cues?

Quando a temporização está bloqueada, sim. Uma contagem diferente é um forte sinal de que as cues foram fundidas, perdidas ou divididas. Um fluxo de trabalho profissional de reajustação de temporização pode alterar a contagem deliberadamente, mas isso deve ser documentado.

Posso alterar as quebras de linha sem alterar os carimbos temporais?

Sim. As quebras de linha fazem parte do texto apresentado, não da temporização da cue. Mova-as para limites naturais de expressão na língua de destino.

Que codificação devo usar para ficheiros SRT traduzidos?

UTF-8 é a predefinição mais segura para texto multilingue. Use uma codificação legada apenas quando um sistema de entrega documentado o exigir.

Porque é que o meu SRT traduzido carrega mas continua a parecer errado?

Analisar e visualizar são testes diferentes. O ficheiro pode ser estruturalmente válido enquanto as suas cues são demasiado longas, mal segmentadas, mal temporizadas para a versão do vídeo ou não suportadas pela pilha de tipos de letra do leitor.

Publicações relacionadas