BookTranslator
BookTranslator

Jak czytać książki z Aozora Bunko: Wydania, rubiny i pliki tekstowe

Otwieraj książki z Aozora Bunko w przeglądarce, wybieraj odpowiednie japońskie wydanie, naprawiaj wyświetlanie tekstu w kodowaniu Shift-JIS i zrozum rubiny bez usuwania przydatnych notatek.

BookTranslator

BookTranslator Team

9 min read

Aby przeczytać książkę z Aozora Bunko, otwórz kartę dzieła i wybierz いますぐXHTML版で読む— link do czytania wersji XHTML w tej chwili. Zacznij od tego, jeśli chcesz czytać w przeglądarce. Pobieraj plik ZIP z tekstem tylko wtedy, gdy potrzebujesz pliku lokalnego lub aplikacji do czytania obsługującej tekst z Aozory. Oficjalny przewodnik pobierania rozróżnia te dwa formaty.

Bardziej przydatne pytanie brzmi często: jaki japoński tekst właściwie oglądam? Współczesne wydanie klasyka niekoniecznie jest pierwszym wydaniem drukowanym przez autora. Zniekształcone pobieranie może wymagać poprawnego kodowania, a nie OCR. Nawiasy w pliku tekstowym Aozory mogą zawierać pomoce w czytaniu, a nie niechciany tekst.

Zacznij od karty dzieła, a nie od przypadkowego pobrania

Karta dzieła, czyli 図書カード, łączy tytuł, autora, wydanie źródłowe i dostępne pliki. Na przykład karta utworu Sōsekiego Natsumego Kokoro ma zarówno bezpośredni link do czytania w formacie XHTML, jak i tabelę pobierania umieszczoną niżej.

Najpierw otwórz link XHTML. Dostosuj powiększenie w przeglądarce, aż główny tekst i małe pomoce w czytaniu będą czytelne. Przeczytaj kilka akapitów, zanim zdecydujesz, że potrzebujesz innej aplikacji. Jeśli możesz wygodnie czytać tutaj, możesz odłożyć konwersję na inny dzień.

Zachowaj w zakładkach zarówno kartę dzieła, jak i stronę do czytania. FAQ serwisu Aozora wyjaśnia, że adres karty dzieła pozostaje punktem odniesienia nawet wtedy, gdy powiązany plik zostanie zastąpiony. Zapamiętaj także nagłówek sekcji oraz krótką frazę z akapitu, w którym przerwano czytanie; sama zakładka w przeglądarce nie odzwierciedla rzetelnie miejsca na długiej stronie.

Jeśli tytuł lub język są niepoprawne, wróć do wyboru źródła przed rozwiązaniem problemów z wyświetlaniem. Nasz przewodnik po znajdowaniu odpowiedniego wydania e-booka domeny publicznej omawia tę szerszą decyzję.

Sprawdź wydanie przed „naprawianiem” japońskiego tekstu

Poszukaj 文字遣い種別, klasyfikacji znaków i kana karty. Przeczytaj etykietę w dwóch częściach: 新字 / 旧字 dotyczy nowszych lub starszych form znaków; 新仮名 / 旧仮名 dotyczy nowożytnej lub historycznej pisowni kana. Są to osobne wybory, a nie pojedyncza skala od „złego tekstu” do „dobrego tekstu”. Wytyczne Aozory dotyczące ortografii wyraźnie pozwalają na modernizację znaków przy jednoczesnym zachowaniu historycznej kany.

Do zwykłego czytania zacząłbym od 新字新仮名 , gdy dzieło je oferuje, a Ty znasz współczesną japońską pisownię. Jednak ta etykieta nie obiecuje uproszczonego słownictwa ani przepisanej na nowo historii. Do badań literackich wybierz edycję źródłową, jakiej wymaga Twoje pytanie; sama etykieta starego znaku nie dowodzi, że masz faksymile pierwszego wydania.

Trzy karty dzieł Sōsekiego ilustrują, dlaczego szczegóły edycji mają znaczenie. Sprawdziliśmy te wpisy 10 września 2026 r.; wszystkie trzy klasyfikują swój tekst jako 新字新仮名.

Dzieło i oficjalna kartaWydanie drukowane wskazane jako 底本, czyli tekst źródłowyData pierwszego wydania edycji źródłowej
Kokoro — こころ, nr 773Kokoro, Shueisha Bunko25 lutego 1991
Botchan — 坊っちゃん, nr 752Chikuma Nihon Bungaku Zenshū: Natsume Sōseki, Chikuma Shobō20 stycznia 1992
Jestem kotem — 吾輩は猫である, nr 789Natsume Sōseki Zenshū 1, Chikuma Bunko29 września 1987

Te daty odnoszą się do wymienionych wydań źródłowych, a nie do pierwszego ukazania się opowiadań. Kokoro, na przykład, ukazało się w dzienniku Asahi Shimbun w 1914 roku. Karta dzieła osobno wskazuje dziesiąty druk z 1995 roku, który posłużył za źródło danych wejściowych. Jest to znacznie dokładniejszy opis źródła tekstu cyfrowego niż „oryginalna książka z 1914 roku”.

Do czytania dla przyjemności wystarczy jednorazowe odnotowanie wydania źródłowego. Jeśli porównujesz cytat z kopią papierową, sprawdź pole 入力に使用 — czyli wersję użytą jako źródło — zanim uznasz różnicę w sformułowaniu za błąd.

Jeśli pobierasz plik TXT, otwórz go w kodowaniu określonym w opisie

W tabeli pobierania テキストファイル(ルビあり) oznacza plik tekstowy z przypisami fonetycznymi ruby. 圧縮 wskazuje kompresję; 文字集合/符号化方式 określa zestaw znaków i kodowanie. W przypadku trzech powyższych plików karta wskazuje standard JIS X 0208 / ShiftJIS. To te pola, a nie domyślne ustawienia Twojego systemu operacyjnego, informują, jak zinterpretować plik. Zobacz oficjalne wyjaśnienie kolumn pobierania.

Postępuj zgodnie z tą procedurą:

  1. Pobierz plik ZIP podlinkowany z karty dzieła i wypakuj go. Nie zmieniaj oryginalnego pliku ZIP.
  2. Otwórz wypakowany plik .txt w edytorze lub czytniku, który pozwala wybrać kodowanie. W przypadku tych trzech plików wybierz Shift-JIS.
  3. Porównaj krótki fragment z oficjalnym plikiem XHTML. Jeśli tekst jest zniekształcony, otwórz niezmieniony plik ponownie z poprawnym kodowaniem przed zapisaniem jakichkolwiek zmian.
  4. Jeśli inna aplikacja wymaga standardu UTF-8, utwórz osobną kopię w UTF-8 dopiero wtedy, gdy źródło wyświetli się poprawnie. Zachowaj wraz z nią kartę źródłową oraz szczegóły wydania.

Pobraliśmy ponownie wszystkie trzy oficjalne pliki ZIP w dniu 10 września 2026 roku. Każdy przeszedł pomyślnie test integralności ZIP, a jego plik TXT został poprawnie zdekodowany przy użyciu rygorystycznego kodowania Shift-JIS. Ścisłe dekodowanie UTF-8 zakończyło się niepowodzeniem dla wszystkich trzech plików. Jest to niezgodność kodowania, a nie dowód na to, że te pliki do pobrania wymagają OCR lub że powieści są uszkodzone.

Znajdujące się wewnątrz pliki to kokoro.txt, bocchan.txt, i wagahaiwa_nekodearu.txt. Nasz trzyutworowy rejestr wydania i kodowania (CSV) zawiera linki źródłowe, daty, nazwy plików oraz sumy kontrolne ZIP. Rejestruje on sprawdzenie pliku — a nie pomyślną konwersję do formatu EPUB czy test na Twoim urządzeniu. Pobranie to nie zawiera żadnych powieści źródłowych.

Jedno rozróżnienie oszczędza niepotrzebnej pracy: jeśli japońskie znaki wyświetlają się spójnie, ale wyglądają historycznie nieznajomo, sprawdź etykietę wydania. Jeśli tekst wyświetla się jako ciągi bezsensownych znaków, zbadaj kodowanie. Zmiana czcionki lub ponowna transkrypcja całej książki nie powinny być Twoją pierwszą reakcją na żaden z tych problemów.

Czytaj ruby i notatki bez pozbywania się użytecznego tekstu

Ruby to mały tekst dołączony do słowa lub frazy, często wskazujący ich sposób czytania. W plikach Aozora TXT pojawia się on wewnątrz 《 》. Znak o pełnej szerokości może oznaczać miejsce, w którym zaczyna się tekst otrzymujący to ruby. Aozora dokumentuje te konwencje w swoim przewodniku po zapisie ruby.

Oto dwa zdania napisane na potrzeby tego poradnika, niecytowane z powieści Aozora:

私は図書館《としょかん》で本を借りた。
|青い屋根《あおいやね》の家が見える。

W pierwszym としょかん podaje sposób odczytu 図書館: „Wypożyczyłem książkę w bibliotece”. To nie jest dodatkowe słowo do przeczytania po rzeczowniku. W drugim przypadku kreska rozpoczyna frazę złożoną z różnych znaków 青い屋根, „niebieski dach”, której odczyt następuje w nawiasach.

Inne nawiasy pełnią inną funkcję. Ten trzeci, oryginalny przykład zawiera instrukcję wyróżnienia:

まだ間に合う[#「まだ間に合う」に傍点]。

Zdanie oznacza „Czasu jest jeszcze sporo.” Część w nawiasie wymaga kropek wyróżniających nad poprzedzającą frazą; nie jest to narracja. Składnia pochodzi z przewodnika po zapisie wyróżnień. Możesz pobrać wszystkie trzy oryginalne zdania ćwiczeniowe z wyjaśnieniami (UTF-8 TXT).

Nie rozwiązuj problemu rozpraszających nawiasów poprzez usuwanie wszystkiego, co pasuje do danego wzorca w całej książce. Niektóre notatki opisują znaki spoza standardowego zestawu znaków pliku; usunięcie notatki może utracić informacje niezbędne do identyfikacji znaku. przewodnik po znakach zewnętrznych pokazuje, że nie są to wszystko jednorazowe instrukcje formatowania.

Do czytania wracaj do oficjalnego XHTML, gdy surowy zapis zaczyna męczyć. Daje on użyteczne odniesienie do odróżnienia tekstu literackiego od jego reprezentacji w pliku TXT.

Wybierz wygodną konfigurację do czytania przed przekonwertowaniem całej książki

Jeśli czytanie w przeglądarce działa, Twoim kolejnym ulepszeniem może być po prostu większy tekst i sposób na wznowienie lektury we właściwym akapicie. Jeśli częste sprawdzanie słów przeszkadza, wypróbuj najpierw na krótkim fragmencie taki przepływ pracy ze słownikiem, jakiego już używasz. Żadne z tych zadań nie wymaga konwertowania całej powieści.

W przypadku czytnika offline lub konwersji do formatu EPUB zadaj bardziej konkretne pytanie niż „Czy otwiera plik TXT?”. Musisz wiedzieć, co dzieje się z kodowaniem tego pliku , rubinami, notatkami i podziałami sekcji. Import pliku tekstowego nie jest dowodem na to, że aplikacja rozumie notację Aozora. Zmiana nazwy .txt na .epub nie tworzy pliku EPUB.

Zanim zdecydujesz się na tę konfigurację, porównaj:

  • Początkowy fragment z oficjalnym plikiem XHTML, aby wcześnie wychwycić nieczytelne znaki.
  • Fragment zawierający rubiny oraz, jeśli występują, notatki dotyczące akcentu lub nietypowych znaków.
  • Środkową sekcję oraz sekcję końcową, aby szukać problemów z kolejnością lub brakującym tekstem z dala od pierwszej strony.
  • Swój faktyczny przepływ pracy związany z zatrzymywaniem i ponownym otwieraniem, aby móc wznowić czytanie bez ponownego przeszukiwania całej powieści.

Skorzystaj z pustego arkusza do czytania (CSV) dla tych obserwowanych elementów. Nzetestowane pozycje zaznacz jako not_checked; otwarcie pliku nie jest pełnym sprawdzaniem korektorskim całej książki. Dołączone notatki do pobrania i atrybucja źródła wyjaśniają, co nasza weryfikacja obejmująca trzy pliki wykazuje, a czego nie.

Nie przekonwertowaliśmy tych trzech pobranych plików do formatu EPUB ani nie przetestowaliśmy ich w konkretnym czytniku. Wybierz narzędzie na podstawie jego bieżącej obsługi i własnego krótkiego porównania, a nie twierdzenia, że każdy plik Aozora zachowa się w ten sam sposób.

Kiedy pozostającą przeszkodą jest język

Gdy japoński wyświetla się poprawnie, zdecyduj, jak dużego wsparcia językowe faktycznie potrzebujesz. Słownik może wystarczyć do sporadycznych nieznanych słów. Odpowiednie istniejące wydanie w tłumaczeniu może być lepszym wyborem do czytania niż przygotowywanie nowego tłumaczenia. Żadne z tych rozwiązań nie oznacza, że plik źródłowy wymaga naprawy.

Przed przesłaniem, zaadaptowaniem lub udostępnieniem utworu sprawdź jego konkretne informacje o prawach autorskich oraz planowany sposób użytkowania. Zasady korzystania z plików serwisu Aozora odróżniają utwory z wygasłymi prawami autorskimi od utworów nadal chronionych, w tym tłumaczeń, do których prawa zachowują tłumaczki i tłumacze. Dostępność w witrynie nie jest jednoznaczna z deklaracją, że każdy utwór znajduje się w domenie publicznej na całym świecie.

Jeśli rzeczywiście potrzebujesz całej przetłumaczonej kopii, najpierw przygotuj książkę do tłumaczenia : zachowaj oryginalne wydanie, ustal format i zdecyduj, jak należy potraktować pomoce czytelnicze oraz przypisy. W przypadku dozwolonego, nadającego się do użytku pliku EPUB, translator EPUB BookTranslatora stanowi opcję tłumaczenia. Jest to osobny krok od pobierania archiwum ZIP z Aozora; ten przewodnik nie ustanawia automatycznej obsługi jego kodowania ani składni adnotacji.

Jeśli chcesz nadal sprawdzać japoński obok innego języka, przewodnik po dwujęzycznym formacie EPUB omawia kwestie układu i decyzje dotyczące weryfikacji. W przeciwnym razie wróc do wybranej strony XHTML i czytaj dalej. Poprawny, wygodny tekst źródłowy to już udany wynik.

Powiązane wpisy