BookTranslator
BookTranslator

Cum să citești cărți Aozora Bunko: Ediții, Ruby și fișiere text

Deschide cărți Aozora Bunko în browser, alege ediția japoneză potrivită, remediază afișarea textului Shift-JIS și înțelege ruby fără a șterge note utile.

BookTranslator

BookTranslator Team

10 min read

Pentru a citi o carte Aozora Bunko, deschide fișa lucrării și alege いますぐXHTML版で読む—linkul pentru a citi versiunea XHTML acum. Începe de acolo dacă vrei să citești în browser. Descarcă arhiva ZIP cu text doar atunci când ai nevoie de un fișier local sau de o aplicație de citire care acceptă textul Aozora. ghidul oficial de descărcare face distincția între aceste două formate.

O întrebare mai utilă este adesea la ce text japonez mă uit? O ediție în caractere moderne a unui clasic nu este neapărat prima ediție tipărită a autorului. O descărcare coruptă poate avea nevoie de codificarea corectă, nu de OCR. Iar parantezele dintr-un fișier text Aozora pot conține ajutoare de lectură în loc de text nedorit.

Începe de la fișa lucrării, nu de la o descărcare izolată

Fișa lucrării, sau 図書カード, leagă titlul, autorul, ediția sursă și fișierele disponibile. De exemplu, fișa pentru Kokoro de Natsume Sōseki are atât un link de citire XHTML imediat, cât și un tabel de descărcare mai jos.

Deschide mai întâi linkul XHTML. Ajustează zoomul browserului până când textul principal și micile ajutoare de lectură sunt confortabile. Citește câteva paragrafe înainte de a decide că ai nevoie de o altă aplicație. Dacă poți citi confortabil aici, poți lăsa conversia pentru altă zi.

Păstrează fișa lucrării la favorite, precum și pagina de lectură. Întrebările frecvente (FAQ) Aozora explică faptul că adresa unei fișe de lucru rămâne un punct de referință chiar și atunci când un fișier legat este înlocuit. Pentru poziția ta de lectură, notează și titlul secțiunii și o scurtă frază din paragraful unde te-ai oprit; un simplu marcaj de browser nu descrie în mod fiabil un loc dintr-o pagină lungă.

Dacă titlul sau limba este greșită, revino la selecția sursei înainte de a rezolva problemele de afișaj. Ghidul nostru pentru găsirea ediției potrivite de e-book din domeniul public acoperă această decizie mai amplă.

Verifică ediția înainte de a „repara” limba japoneză

Căutați 文字遣い種別, clasificarea caracterelor și kana a cardului. Citiți eticheta în două părți: 新字 / 旧字 se referă la forme de caractere mai noi sau mai vechi; 新仮名 / 旧仮名 se referă la scrierea kana modernă sau istorică. Acestea sunt opțiuni separate, nu o singură scară de la „text slab” la „text bun”. Liniile directoare privind ortografia ale Aozora permit în mod explicit modernizarea caracterelor, păstrând în același timp kana istorică.

Pentru citirea obișnuită, aș începe cu 新字新仮名 atunci când lucrarea o oferă și scrierea japoneză modernă este ceea ce cunoașteți. Dar acea etichetă nu promite un vocabular simplificat sau o poveste rescrisă. Pentru cercetarea literară, alegeți ediția sursă pe care o cere întrebarea dvs.; o etichetă de caractere vechi singură nu stabilește că aveți o facsimilă a primei tipăriri.

Trei fișe de lucru Sōseki ilustrează de ce detaliile ediției contează. Am verificat aceste înregistrări pe 10 septembrie 2026; toate cele trei își clasifică textul ca fiind 新字新仮名.

Lucrare și fișă oficialăEdiție tipărită numită 底本 sau text sursăData primei apariții a ediției sursă
Kokoro — こころ, Nr. 773Kokoro, Shueisha Bunko25 februarie 1991
Botchan — 坊っちゃん, Nr. 752Chikuma Nihon Bungaku Zenshū: Natsume Sōseki, Chikuma Shobō20 ianuarie 1992
Sunt o pisică — 吾輩は猫である, Nr. 789Natsume Sōseki Zenshū 1, Chikuma Bunko29 septembrie 1987

Aceste date aparțin edițiilor sursă listate, nu primei apariții a poveștilor. Kokoro, de exemplu, a apărut în Asahi Shimbun în 1914. Fișa sa identifică separat a zecea tipărire din 1995 folosită pentru introducere. Aceasta este o descriere mult mai precisă a sursei textului digital decât „cartea originală din 1914”.

Pentru citirea de plăcere, înregistrarea ediției sursă o singură dată este suficientă. Dacă comparați un citat cu o copie pe hârtie, verificați câmpul 入力に使用 — tipărirea utilizată pentru introducere — înainte de a presupune că o diferență de formulare este o eroare.

Dacă descărcați fișierul TXT, deschideți-l cu codificarea listată

În tabelul de descărcare, テキストファイル(ルビあり) înseamnă un fișier text cu instrumente de lectură ruby. 圧縮 identifică compresia; 文字集合/符号化方式 identifică setul de caractere și codificarea. Pentru cele trei fișiere de mai sus, fișa specifică JIS X 0208 / ShiftJIS. Aceste câmpuri, nu valoarea implicită a sistemului de operare, vă spun cum să interpretați fișierul. Consultați explicația oficială a coloanelor de descărcare.

Folosiți această secvență:

  1. Descărcați arhiva ZIP legată de fișa lucrării și extrageți-o. Păstrați arhiva ZIP originală neschimbată.
  2. Deschideți fișierul extras .txt într-un editor sau cititor care vă permite să alegeți codificarea. Pentru aceste trei fișiere, selectați Shift-JIS.
  3. Comparați un pasaj scurt cu XHTML-ul oficial. Dacă rezultatul este corupt, redeschideți fișierul neschimbat cu codificarea corectă înainte de a salva orice modificare.
  4. Dacă o altă aplicație necesită UTF-8, faceți o copie UTF-8 separată numai după ce sursa se afișează corect. Păstrați fișa sursă și detaliile ediției împreună cu aceasta.

Am preluat din nou toate cele trei fișiere ZIP oficiale pe 10 septembrie 2026. Fiecare a trecut de verificarea integrității ZIP, iar fișierul TXT s-a decodificat cu succes folosind Shift-JIS strict. Decodificarea UTF-8 strictă a eșuat pentru toate cele trei. Aceasta este o neconcordanță de codificare, nu o dovadă că aceste descărcări necesită OCR sau că romanele sunt deteriorate.

Fișierele din interior erau kokoro.txt, bocchan.txt, și wagahaiwa_nekodearu.txt. Ediția noastră cu trei lucrări și înregistrarea codificării (CSV) include linkurile sursă, datele, numele fișierelor și sumele de control ZIP. Aceasta înregistrează o verificare a fișierului—nu o conversie EPUB reușită sau un test pe dispozitivul tău. Niciun roman sursă nu este inclus în acea descărcare.

O distincție economisește muncă inutilă: dacă caracterele japoneze se afișează coerent, dar par necunoscute din punct de vedere istoric, inspectează eticheta ediției. Dacă textul se afișează ca șiruri lipsite de sens, investighează codificarea. Schimbarea fontului sau retranscrierea întregii cărți nu ar trebui să fie prima ta reacție la niciuna dintre probleme.

Citește ruby și notele fără a arunca textul util

Ruby este textul mic atașat unui cuvânt sau unei fraze, adesea pentru a arăta citirea acestuia. În Aozora TXT, apare în interiorul 《 》. Un cu lățime întreagă poate marca locul unde începe textul care primește acel ruby. Aozora documentează aceste convenții în referința sa pentru notația ruby.

Iată două propoziții scrise pentru acest ghid, nefiind citate dintr-un roman Aozora:

私は図書館《としょかん》で本を借りた。
|青い屋根《あおいやね》の家が見える。

În prima, としょかん oferă citirea lui 図書館: „Am împrumutat o carte la bibliotecă.” Nu este un cuvânt suplimentar de citit după substantiv. În a doua, bara începe fraza cu caractere mixte 青い屋根, „acoperiș albastru”, a cărei citire urmează între paranteze.

Alte paranteze au un alt rol. Acest al treilea exemplu original conține o instrucțiune de accentuare:

まだ間に合う[#「まだ間に合う」に傍点]。

Propoziția înseamnă „Încă mai este timp.” Partea dintre paranteze cere puncte de accentuare pe fraza precedentă; nu este o narațiune. Sintaxa provine din referința pentru notația de accentuarea celor de la Aozora. Poți descărca toate cele trei propoziții practice originale cu explicații (TXT UTF-8).

Nu rezolva parantezele care distrag atenția ștergând tot ceea ce se potrivește cu un șablon în toată cartea. Unele note descriu caractere din afara setului standard de caractere al fișierului; eliminarea notei poate anula informațiile necesare pentru identificarea caracterului. Referința pentru caractere externe a celor de la Aozora arată de ce acestea nu sunt toate instrucțiuni de formatare dispensabile.

Pentru lectură, revino la XHTML-ul oficial atunci când notația brută devine obositoare. Îți oferă o referință utilă pentru a distinge textul literar de reprezentarea sa în TXT.

Alege o setare de lectură confortabilă înainte de a converti întreaga carte

Dacă citirea în browser funcționează, următoarea îmbunătățire ar putea fi pur și simplu un text mai mare și o modalitate de a relua de la paragraful corect. Dacă căutările frecvente de cuvinte vă întrerup, încercați mai întâi fluxul de lucru cu dicționarul pe care îl utilizați deja pentru un pasaj scurt. Niciuna dintre sarcini nu necesită convertirea întregului roman.

Pentru un cititor offline sau o conversie EPUB, adresați o întrebare mai specifică decât „Se deschide TXT?”. Trebuie să știți ce se întâmplă cu codarea, ruby, notele și pauzele de secțiune ale acestui fișier . O importare de text simplu nu este o dovadă că o aplicație înțelege notația Aozora. Redenumirea .txt în .epub nu creează un EPUB.

Înainte de a vă angaja în această setare, comparați:

  • Un pasaj de început cu XHTML-ul oficial, pentru a depista devreme caracterele ilegibile.
  • Un pasaj care conține ruby și, atunci când este prezent, o notă de accentuare sau un caracter neobișnuit.
  • O secțiune de mijloc și secțiunea finală, pentru a căuta probleme de ordine sau de text lipsă departe de prima pagină.
  • Fluxul dvs. real de oprire și redeschidere, astfel încât să puteți relua fără a căuta din nou întregul roman.

Folosiți foaia de lucru pentru lectură goală (CSV) pentru acele observații. Păstrați elementele netestate marcate not_checked; deschiderea unui fișier nu reprezintă o etapă completă de corectură a cărții. Notele de descărcare și atribuirea sursei însoțitoare explică ce face și ce nu face verificarea noastră cu trei fișiere.

Nu am convertit aceste trei descărcări în EPUB și nici nu le-am testat într-un anumit cititor. Alegeți un instrument în funcție de suportul său actual și de propria comparație scurtă, nu în baza unei afirmații conform căreia fiecare fișier Aozora se va comporta la fel.

Când obstacolul rămas este limba

Odată ce limba japoneză se afișează corect, decideți de cât suport lingvistic aveți efectiv nevoie. Un dicționar poate fi suficient pentru cuvintele necunoscute ocazionale. O ediție tradusă existentă potrivită poate fi o alegere de lectură mai bună decât pregătirea unei traduceri noi. Niciuna nu înseamnă că fișierul sursă trebuie reparat.

Înainte de a încărca, adapta sau partaja o operă, verificați informațiile sale specifice privind drepturile și utilizarea prevăzută. Politica de utilizare a fișierelor a Aozora distinge lucrările cu drepturi de autor expirate de cele încă protejate, inclusiv traducerile ai căror traducători își păstrează drepturile. Disponibilitatea pe site nu este o declarație generală că fiecare operă se află în domeniul public la nivel mondial.

Dacă aveți nevoie de o copie tradusă integral, pregătiți cartea pentru traducere mai întâi: păstrați ediția sursă, stabiliți formatul și decideți cum trebuie gestionate ajutoarele de lectură și notele. Pentru un fișier EPUB permis și utilizabil, translatorul EPUB BookTranslator reprezintă o opțiune de traducere. Aceasta este o etapă separată de descărcarea unei arhive ZIP Aozora; acest ghid nu stabilește gestionarea automată a codificării sau a sintaxei sale de anotare.

Dacă doriți să continuați să verificați limba japoneză alături de o altă limbă, ghidul pentru EPUB-uri bilingve acoperă aspectele legate de machetă și deciziile de revizuire. În caz contrar, reveniți la pagina XHTML aleasă și continuați lectura. Un text sursă corect și confortabil reprezintă deja un rezultat reușit.

Articole asociate