BookTranslator
BookTranslator

Jak číst knihy z Aozora Bunko: Vydání, ruby a textové soubory

Otevřete si knihy z Aozora Bunko v prohlížeči, vyberte správné japonské vydání, opravte zobrazení textu v kódování Shift-JIS a pochopte ruby bez mazání užitečných poznámek.

BookTranslator

BookTranslator Team

9 min read

Chcete-li číst knihu z Aozora Bunko, otevřete její pracovní kartu a vyberte いますぐXHTML版で読む— odkaz pro okamžité čtení verze v XHTML. Začněte tam, pokud chcete číst v prohlížeči. ZIP archiv s textem stahujte pouze tehdy, když potřebujete lokální soubor nebo čtecí aplikaci, která podporuje texty z Aozora. Oficiální průvodce stahováním tyto dva formáty rozlišuje.

Užitečnější otázka často zní: na jaký japonský text se to vlastně dívám? Vydání klasického díla v moderních znacích nemusí nutně odpovídat autorovu prvnímu tištěnému vydání. Zkomolený stažený soubor může vyžadovat správné kódování, nikoli optické rozpoznávání znaků (OCR). A závorky v textovém souboru Aozora mohou obsahovat pomůcky pro čtení namísto nežádoucího textu.

Začněte u pracovní karty, nikoli u volného stahování

Pracovní karta neboli 図書カード, propojuje název, autora, zdrojové vydání a dostupné soubory. Například karta pro knihu Sóseki Nacumeho Kokoro obsahuje jak přímý odkaz pro čtení v XHTML, tak tabulku ke stažení umístěnou níže.

Nejprve otevřete odkaz na XHTML. Upravte přiblížení v prohlížeči tak, aby byl hlavní text i malé čtecí pomůcky dobře čitelné. Přečtěte si několik odstavců, než se rozhodnete, že potřebujete jinou aplikaci. Pokud se vám zde čte pohodlně, můžete převod odložit na jindy.

Uložte si do záložek jak pracovní kartu, tak stránku se čtením. Stránka s často kladenými dotazy (FAQ) projektu Aozora vysvětluje, že adresa pracovní karty zůstává referenčním bodem i v případě, že je propojený soubor nahrazen. Pro svou pozici při čtení si poznamenejte také nadpis sekce a krátkou frázi z odstavce, kde jste skončili; samotná záložka v prohlížeči spolehlivě nepopisuje místo v dlouhé stránce.

Pokud je název nebo jazyk nesprávný, vraťte se k výběru zdroje, než začnete řešit problémy se zobrazením. Náš průvodce vyhledáváním správné edice e-knihy v doméně veřejného vlastnictví se věnuje tomuto širšímu rozhodnutí.

Před „opravou“ japonštiny zkontrolujte vydání

Hledejte 文字遣い種別, klasifikaci znaků a kany na kartě. Přečtěte si štítek ve dvou částech: 新字 / 旧字 se týká novějších nebo starších forem znaků; 新仮名 / 旧仮名 se týká moderního nebo historického pravopisu kany. Jde o samostatné volby, nikoli o jedinou škálu od „špatného textu“ po „dobrý text“. Aozorovy pokyny pro pravopis výslovně umožňují modernizaci znaků při zachování historické kany.

Pro běžné čtení bych začal s 新字新仮名 , když ji dílo nabízí a moderní japonština je to, co znáte. Tento štítek však neslibuje zjednodušenou slovní zásobu ani přepsaný příběh. Pro literární výzkum zvolte zdrojové vydání, které vaše otázka vyžaduje; sám o sobě štítek se starými znaky nezaručuje, že máte faksimile prvního vydání.

Tři karty děl Sósekiho ilustrují, proč na podrobnostech vydání záleží. Tyto záznamy jsme zkontrolovali 10. září 2026; všechny tři klasifikují svůj text jako 新字新仮名.

Dílo a oficiální kartaTištěné vydání označené jako 底本 neboli zdrojový textDatum prvního vydání zdrojového vydání
Kokoro — こころ, č. 773Kokoro, Šueša Bunko25. února 1991
Botčan — 坊っちゃん, č. 752Čikuma Nihon Bungaku Zenshú: Natsume Sōseki, Čikuma Šobó20. ledna 1992
Jsem kočka — 吾輩は猫である, č. 789Sebrané spisy Natsume Sōsekiho 1, Čikuma bunkō29. září 1987

Tato data patří k uvedeným zdrojovým vydáním, nikoli k prvnímu vydání příběhů. Kokoro, například, vyšlo v Asahi Shimbun v roce 1914. Jeho karta zvlášť uvádí desátý dotisk z roku 1995 použitý jako vstup. To je mnohem přesnější popis zdroje digitálního textu než „původní kniha z roku 1914.“

Pro čtení pro potěšení stačí zaznamenat zdrojové vydání jednou. Pokud porovnáváte citaci s papírovou kopií, zkontrolujte pole 入力に使用 – tedy dotisk použitý jako vstup – než začnete předpokládat, že rozdíl ve formulaci je chyba.

Pokud stáhnete soubor TXT, otevřete jej s uvedeným kódováním

V tabulce stažení テキストファイル(ルビあり) označuje textový soubor s pomůckami pro čtení rubi. 圧縮 označuje kompresi; 文字集合/符号化方式 označuje znakovou sadu a kódování. U tří výše uvedených souborů karta určuje JIS X 0208 / ShiftJIS. Tato pole, nikoli výchozí nastavení vašeho operačního systému, vám řeknou, jak soubor interpretovat. Viz oficiální vysvětlení sloupců pro stažení.

Použijte tento postup:

  1. Stáhněte ZIP odkazovaný na kartě díla a rozbalte jej. Původní ZIP ponechte nezměněný.
  2. Otevřete rozbalený soubor .txt v editoru nebo čtečce, která vám umožňuje zvolit kódování. Pro tyto tři soubory vyberte Shift-JIS.
  3. Porovnejte krátkou pasáž s oficiálním XHTML. Pokud je výsledek zkomolený, otevřete nezměněný soubor znovu se správným kódováním, než uložíte jakékoli změny.
  4. Pokud jiná aplikace vyžaduje UTF-8, vytvořte samostatnou kopii v UTF-8 až poté, co se zdroj zobrazí správně. Ponechte u ní její zdrojovou kartu a podrobnosti o vydání.

Všechny tři oficiální soubory ZIP jsme znovu stáhli 10. září 2026. Každý prošel kontrolou integrity ZIP a jeho soubor TXT se úspěšně dešifroval pomocí přísného kódování Shift-JIS. Přísné dekódování UTF-8 u všech tří selhalo. Jde o nesoulad kódování, nikoli o důkaz, že tyto soubory ke stažení vyžadují OCR nebo že jsou romány poškozené.

Soubory uvnitř byly kokoro.txt, bocchan.txt, a wagahaiwa_nekodearu.txt. Naše vydání pro tři díla a záznam o kódování (CSV) obsahuje zdrojové odkazy, data, názvy souborů a kontrolní součty ZIP. Zaznamenává kontrolu souboru – nikoli úspěšný převod do EPUB nebo test na vašem zařízení. V tomto stažení nejsou obsaženy žádné zdrojové romány.

Jeden rozdíl vám ušetří zbytečnou práci: pokud se japonské znaky zobrazují smysluplně, ale vypadají historicky neznámě, zkontrolujte štítek vydání. Pokud se text zobrazuje jako nesmyslné řetězce, prověřte kódování. První reakcí na ani jeden problém by neměla být změna fontu ani přepisování celé knihy.

Čtěte ruby a poznámky bez vyhazování užitečného textu

Ruby je malý text připojený k sloveu nebo frázi, často pro zobrazení jeho čtení. V Aozora TXT se objevuje uvnitř 《 》. Plnošířkové může označovat, kde text přijímající toto ruby začíná. Aozora tyto konvence dokumentuje ve své příručce k zápisu ruby.

Zde jsou dvě věty napsané pro tuto příručku, které nejsou citovány z románu Aozora:

私は図書館《としょかん》で本を借りた。
|青い屋根《あおいやね》の家が見える。

V prvním případě としょかん doplňuje čtení 図書館: „Půjčil jsem si knihu v knihovně.“ Nejde o další slovo, které by se mělo číst za podstatným jménem. Ve druhém případě svislá čára zahajuje smíšenou frázi 青い屋根, „modrá střecha,“ jejíž čtení následuje v závorkách.

Jiné závorky plní jiný úkol. Tento třetí původní příklad obsahuje pokyn k zvýraznění:

まだ間に合う[#「まだ間に合う」に傍点]。

Věta znamená „Stále je čas.“ Část v závorkách žádá o tečky pro zvýraznění předcházející fráze; nejde o vyprávění. Syntaxe pochází z příručky k zápisu zvýrazněníspolečnosti Aozora. Můžete si stáhnout všechny tři původní cvičné věty s vysvětlivkami (UTF-8 TXT).

Neřešte matoucí závorky mazáním všeho, co odpovídá určitému vzoru v celé knize. Některé poznámky popisují znaky mimo standardní znakovou sadu souboru; odstranění poznámky může vyřadit informace potřebné k identifikaci znaku. Odkaz na externí znaky od Aozory ukazuje, proč to nejsou všechno jen postradatelné pokyny pro formátování.

Pro čtení se vraťte k oficiálnímu XHTML, jakmile vás surový zápis začne unavovat. Poskytne vám užitečnou referenci pro odlišení literárního textu od jeho reprezentace v TXT.

Vyberte si pohodlné nastavení čtení, než začnete převádět celou knihu

Pokud čtení v prohlížeči funguje, vaším dalším vylepšením může být jednoduše větší text a způsob, jak pokračovat u správného odstavce. Pokud vás časté vyhledávání slov ruší, vyzkoušejte nejprve slovníkový pracovní postup, který již používáte na krátké pasáži. Ani jeden úkol nevyžaduje převod celého románu.

V případě offline čtečky nebo konverze do formátu EPUB položit specifičtější otázku než „Otevře to TXT?“ Potřebujete vědět, co se stane s kódování tohoto souboru , rubínovým písmem, poznámkami a konci sekcí. Import prostého textu není důkazem toho, že aplikace rozumí notaci Aozora. Přejmenování .txt na .epub nevytvoří soubor EPUB.

Než se k tomuto nastavení zavážete, porovnejte:

  • Úvodní pasáž s oficiálním XHTML formátem pro včasné odhalení nečitelných znaků.
  • Pasáž obsahující rubínové písmo a případnou poznámku k důrazu nebo neobvyklým znakům.
  • Prostřední a závěrečnou část, abyste odhalili problémy s pořadím nebo chybějícím textem mimo první stránku.
  • Váš skutečný pracovní postup pro ukončení a opětovné otevření, abyste mohli pokračovat bez nového prohledávání celého románu.

Použijte prázdný čtecí pracovní list (CSV) pro tato pozorování. Netestované položky ponechte označené not_checked; otevření souboru nepředstavuje úplnou korekturu celé knihy. Přiložené poznámky ke stažení a připsání zdroje vysvětlují, co naše kontrola tří souborů prokazuje a co již nikoliv.

Tyto tři soubory ke stažení jsme nepřeváděli do formátu EPUB ani je netestovali v konkrétní čtečce. Nástroj si vyberte na základě jeho současné podpory a vlastního krátkého porovnání, nikoli na základě tvrzení, že se každý soubor Aozora bude chovat stejně.

Když je zbývající překážkou jazyk

Jakmile se japonština zobrazuje správně, rozhodněte se, jakou jazykovou podporu vlastně potřebujete. Slovník může stačit pro občasná neznámá slova. Vhodná již existující přeložená edice může být lepší volbou pro čtení než příprava nového překladu. Ani jedno ale neznamená, že zdrojový soubor vyžaduje opravu.

Než dílo nahrát, upravíte nebo budete sdílet, ověřte si jeho konkrétní informace o právech a zamýšlené použití. Zásady používání souborů Aozory rozlišují díla s vypršelou autorskou práva od děl, která jsou stále chráněná, včetně překladů, u nichž si překladatelé ponechávají práva. Dostupnost na webu není paušálním prohlášením, že každé dílo je celosvětově volným dílem.

Pokud opravdu potřebujete celou přeloženou kopii, připravte knihu na překlad jako první: zachovejte původní vydání, ujasněte si formát a rozhodněte se, jak naložit s pomůckami pro čtení a poznámkami. V případě povoleného a použitelného formátu EPUB je překladač formátu EPUB od BookTranslatoru jednou z možností překladu. Jedná se o samostatný krok nezávislý na stažení souboru ZIP z Aozory; tato příručka nezavádí automatické zpracování jeho kódování nebo syntaxe anotací.

Pokud chcete nadále kontrolovat japonštinu souběžně s jiným jazykem, příručka pro dvojjazyčné soubory EPUB se věnuje rozhodnutím ohledně rozvržení a kontroly. V opačném případě se vraťte na zvolenou stránku XHTML a pokračujte ve čtení. Správný a pohodlný zdrojový text je sám o sobě úspěšným výsledkem.

Související příspěvky