Cara Menerjemahkan File SRT Tanpa Mengubah Timestamp
Terjemahkan teks subtitle sambil mengunci nomor cue dan timecode, lalu validasi urutan, encoding, dan pemutaran sebelum dikirimkan.

Jawaban Singkat: Terjemahkan Teks Cue, Kunci ID dan Timecode
File SRT adalah file data bertanda waktu, bukan transkrip dengan timestamp dekoratif. Terjemahkan hanya teks subtitle. Pertahankan setiap nomor cue, timestamp, baris pemisah kosong, dan tag pemformatan yang didukung tetap di tempatnya, lalu bandingkan struktur cue sumber dan target sebelum menonton videonya.
Untuk alur kerja yang memahami file, unggah file asli ke SRT Translator alih-alih menyalin caption ke kotak teks yang tidak terstruktur. Pemahaman terhadap file mengurangi risiko struktural, tetapi Anda tetap harus memvalidasi hasilnya terhadap sumber dan videonya.
Aturan yang tidak langsung terlihat adalah ini: mempertahankan timecode itu perlu, tetapi tidak cukup. Cue target bisa mempertahankan timestamp yang persis sama dan tetap gagal karena kalimat terjemahannya terlalu panjang untuk dibaca, terpotong pada frasa yang salah, atau merujuk ke pembicara yang belum muncul.
Bagaimana Struktur File SRT
Cue yang umum terdiri dari empat bagian:
17
00:00:41,500 --> 00:00:44,200
<i>MAYA:</i> The total is €1,249.50.
17adalah nomor cue.00:00:41,500adalah waktu mulai.00:00:44,200adalah waktu selesai.- Baris atau baris-baris sisanya adalah teks yang ditampilkan.
SRT biasanya menggunakan koma antara detik dan milidetik serta --> antara waktu mulai dan selesai. Satu baris kosong memisahkan satu cue dari cue berikutnya. Beberapa pemutar mentoleransi variasi; alur kerja terjemahan yang andal tidak bergantung pada toleransi itu.
Unduh stress test terjemahan SRT sintetis. Isinya mencakup dialog, huruf miring, label pembicara, tanggal, mata uang, teks CJK, Arab, Sirilik, dan karakter Latin beraksen. Kontennya fiktif, jadi aman digunakan untuk pengujian parser dan encoding.
Mengapa Terjemahan Salin-Tempel Merusak File SRT
Alur kerja teks tujuan umum bisa keliru menganggap struktur sebagai konten. Kegagalan yang umum meliputi:
- menerjemahkan atau menomori ulang ID cue;
- mengubah pemisah timestamp atau koma desimal;
- menggabungkan dua cue pendek menjadi satu paragraf;
- menghapus cue berulang atau yang tampak kosong;
- mengembalikan file dengan pagar Markdown di sekelilingnya;
- menulis ulang label pembicara menjadi prosa;
- menghapus tag
<i>atau menghasilkan markup rich-text yang tidak didukung; - mengganti pemisah cue kosong dengan baris terbungkus.
Bahkan terjemahan yang bagus secara linguistik menjadi tidak bisa dipakai ketika pemutar tidak lagi dapat mem-parsing-nya.
Alur Kerja Terjemahan Langkah demi Langkah
1. Pertahankan yang asli
Biarkan SRT sumber tidak berubah. Bekerjalah pada salinan yang diberi label bahasa seperti interview.en.srt → interview.es.srt.
2. Pastikan sumber dapat di-parse
Buka sumber di editor subtitle atau pemutar sebelum menerjemahkannya. Jika sumber sudah memiliki timecode yang saling tumpang tindih, pemisah yang hilang, atau offset video yang salah, perbaiki atau dokumentasikan cacat tersebut terlebih dahulu.
3. Deteksi encoding
Gunakan UTF-8 untuk output multibahasa kecuali spesifikasi pengiriman secara eksplisit mensyaratkan hal lain. Panduan transkrip YouTube menyatakan bahwa file transkrip non-Inggris harus dikodekan dalam UTF-8, dan itu adalah baseline yang masuk akal untuk file subtitle internasional (YouTube Help).
4. Bekukan field struktural
Perlakukan nomor cue dan baris timestamp sebagai konten yang dilindungi. Jika sebuah alat tidak dapat menguncinya, terjemahkan dalam batch kecil dan validasi setelah setiap batch.
5. Terjemahkan cue lengkap dengan konteks di sekitarnya
Terjemahkan teks yang ditampilkan, tetapi sertakan cue sebelumnya dan berikutnya untuk konteks. Subtitle sering membagi satu kalimat ke beberapa cue; terjemahan terisolasi dapat mengubah kala, pronomina, atau urutan kata secara tidak konsisten.
6. Segmentasikan ulang untuk bahasa target
Pertahankan timing cue kecuali Anda diberi wewenang untuk mengatur ulang waktu, tetapi sesuaikan pemenggalan baris target di dalam cue. Putuskan pada batas frasa yang alami, bukan setelah artikel, preposisi, nama, atau frasa verba yang terikat erat.
7. Jalankan validasi struktural
Bandingkan jumlah cue, ID, timestamp, urutan, tag, dan pemisah kosong antara sumber dan target. Lakukan ini sebelum tinjauan linguistik agar peninjau tidak membuang waktu pada file yang tidak bisa dimuat.
8. Tonton seluruh track target
Pemeriksaan otomatis tidak bisa menentukan apakah subtitle muncul sebelum pembicara berbicara, menutupi teks penting di layar, atau tetap mudah dibaca saat pertukaran dialog berlangsung cepat.
Pertahankan Pemenggalan Baris, Huruf Miring, dan Label Pembicara
Jangan mempertahankan pemenggalan baris sumber secara mekanis ketika sintaks target berubah. Pertahankan cue-nya, lalu pilih pemenggalan baris bahasa target yang mudah dibaca.
Sebagai contoh, pemenggalan sumber ini buruk:
We approved the proposal
after the final review.
Jika bahasa target menempatkan syarat di awal, pemenggalan yang alami mungkin berpindah. Tujuan yang benar adalah pengelompokan semantik, bukan mencocokkan piksel demi piksel pemenggalan baris sumber.
Pertahankan huruf miring yang bermakna hanya jika tujuan mendukungnya dan panduan gaya memang memerlukannya. Pertahankan label pembicara secara konsisten. YouTube merekomendasikan cue seperti [music] untuk suara dan >> untuk mengidentifikasi pembicara dalam alur kerja transkrip (YouTube Help); klien lain mungkin memerlukan konvensi yang berbeda.
Validasi Jumlah Cue dan Urutan Timestamp
Gunakan tabel invariant ini:
| Pemeriksaan | Hasil yang diharapkan | Penghalang? |
|---|---|---|
| Jumlah cue | Jumlah sumber dan target cocok | Ya, kecuali retiming yang disetujui mengubahnya |
| ID cue | ID unik yang sama dalam urutan yang sama | Ya |
| Teks timestamp | Cocok byte demi byte saat timing dikunci | Ya |
| Mulai sebelum akhir | Setiap cue memiliki durasi positif | Ya |
| Urutan sekuens | Tidak ada lompatan mundur yang tidak sengaja | Ya |
| Tag | Seimbang dan didukung | Biasanya |
| Teks terlihat | Setiap cue sumber memiliki target yang disengaja | Ya |
Jangan gunakan ukuran file sebagai proxy. Ekspansi terjemahan membuat target lebih besar; jumlah byte yang mirip tidak membuktikan apa pun.
Periksa Subtitle terhadap Video
Tinjau pada kecepatan pemutaran normal dan sertakan momen-momen sulit berikut:
- dialog tercepat;
- dua pembicara yang bergantian cepat;
- nama, tanggal, mata uang, dan ukuran;
- dialog yang melintasi pergantian adegan;
- teks yang bersaing dengan tanda atau lower third;
- lagu, efek suara, dan suara dari luar layar;
- cue pertama dan terakhir;
- setidaknya satu bagian yang memuat setiap tag pemformatan yang didukung.
Gunakan checklist QA terjemahan subtitle untuk mengevaluasi keterbacaan dan segmentasi setelah validasi struktural.
Kesalahan SRT Umum dan Perbaikannya
| Gejala | Penyebab yang mungkin | Perbaikan |
|---|---|---|
| Pemutar menolak file | Sintaks timestamp atau pemisah cue rusak | Bandingkan cue gagal pertama dengan sumber |
| Caption bergeser tetapi timecode cocok | Track sumber atau edit video salah | Selaraskan file sumber dengan versi video yang tepat |
| Teks tampil sebagai kotak atau mojibake | Encoding atau dukungan font | Simpan sebagai UTF-8 dan uji lingkungan pemutaran |
| Sebuah kalimat muncul di bawah pembicara yang salah | Penggabungan cue atau terjemahan tanpa konteks | Kembalikan batas cue dan tinjau cue di sekitarnya |
| Cue dua baris menjadi dinding teks | Ekspansi target | Ringkas, parafrase, atau dapatkan izin untuk retiming |
| Huruf miring tetap terbuka untuk cue berikutnya | Tag tidak seimbang | Validasi tag per cue dan tutup secara lokal |
Kapan Tidak Harus Mempertahankan Setiap Timestamp
Jangan menjanjikan pelestarian timestamp ketika timing sumber cacat, bahasa terjemahan membutuhkan segmentasi yang berbeda secara material, atau videonya sendiri sudah diedit ulang. Dalam kasus seperti itu, pertahankan sumber sebagai referensi audit dan buat track target yang secara eksplisit sudah di-retime.
Penguncian timestamp adalah kendala penerjemahan, bukan pengganti penulisan subtitle.
FAQ
Bisakah saya menerjemahkan hanya teks dalam file SRT?
Ya. Terjemahkan baris teks sambil melindungi nomor cue, timestamp, dan pemisah. Lalu validasi bahwa setiap cue sumber masih memiliki satu cue target yang disengaja.
Haruskah subtitle terjemahan memiliki jumlah cue yang sama?
Jika timing dikunci, ya. Jumlah yang berbeda adalah sinyal kuat bahwa cue digabungkan, hilang, atau dipecah. Alur kerja retiming profesional mungkin sengaja mengubah jumlahnya, tetapi hal itu harus didokumentasikan.
Bisakah saya mengubah pemenggalan baris tanpa mengubah timestamp?
Ya. Pemenggalan baris adalah bagian dari teks yang ditampilkan, bukan timing cue. Pindahkan ke batas frasa yang alami dalam bahasa target.
Encoding apa yang harus saya gunakan untuk file SRT terjemahan?
UTF-8 adalah default paling aman untuk teks multibahasa. Gunakan encoding lama hanya ketika sistem pengiriman yang terdokumentasi memang mensyaratkannya.
Mengapa SRT terjemahan saya dimuat tetapi tetap terlihat salah?
Parsing dan penayangan adalah dua pengujian yang berbeda. File tersebut შეიძლება valid secara struktural sementara cue-nya terlalu panjang, segmentasinya buruk, timing-nya tidak cocok dengan versi video, atau tidak didukung oleh tumpukan font pemutar.
Artikel Terkait




