Mengapa furigana dalam aplikasi anda tidak kelihatan seperti buku Jepun

Morfologi berbanding ortografi atau berasaskan unit kanji: dua pendekatan furigana bahasa Jepun

Ramai pelajar bahasa Jepun mula mengenali furigana dengan menganggapnya sekadar bacaan kana yang diletakkan di atas kanji. Anggapan itu tidak salah, tetapi mudah menimbulkan kekeliruan.

Bagi ayat yang sama, 昨日、学校へ行った。, satu alat automatik mungkin menghasilkan 昨日きのう学校がっこう行ったいった. Buku kanak-kanak, buku teks atau penerbitan yang ditaip dengan teliti pula mungkin memilih 昨日きのうがっこうった。.

Kedua-duanya membantu anda membaca bahasa Jepun, tetapi menjawab soalan yang berbeza. Cara pertama bertanya: bagaimanakah bunyi ayat ini? Cara kedua bertanya: bagaimanakah pembaca patut mengenali kanji yang tercetak?

Anggap ruby sebagai dua keputusan berasingan

Dalam tipografi bahasa Jepun, furigana biasanya dibincangkan sebagai ruby. Dalam tulisan mendatar, ruby lazimnya diletakkan di atas teks dasar; dalam tulisan menegak, ruby biasanya berada di sebelah kanan. W3C turut menyatakan bahawa saiz ruby secara lalai sering kira-kira separuh daripada saiz teks dasar. [1]

Namun, memilih teks yang menerima ruby dan menentukan cara ruby dilekatkan ialah dua keputusan yang berbeza. Adakah semua kanji memerlukan bantuan, atau hanya kanji sukar? Patutkah bacaan dilekatkan pada satu kanji, setiap kanji dalam kata majmuk atau seluruh perkataan?

JLREQ menerangkan tiga hubungan penting: mono-ruby, jukugo-ruby dan group-ruby. Mono-ruby memadankan satu aksara dasar dengan satu rentetan ruby. Jukugo-ruby mengekalkan kata majmuk sebagai satu unit sambil memelihara hubungan antara kanji dan bahagian bacaannya. Group-ruby memadankan beberapa aksara dasar dengan satu rentetan ruby. [2]

Pendekatan pertama: morfologi

Pendekatan morfologi bermula dengan analisis bahasa. Ia membahagikan ayat kepada perkataan atau morfem, kemudian menetapkan bacaan, golongan kata, lema dan maklumat perubahan bentuk.

Alat seperti MeCab memecahkan bahasa Jepun dan menghasilkan medan seperti bentuk permukaan, golongan kata, bentuk dasar, bacaan dan sebutan. UniDic juga direka khusus untuk analisis morfologi dan menggunakan unit pendek dengan lapisan seperti leksem, bentuk perkataan, bentuk tulisan dan bentuk sebutan. [3] [4]

Bagi 学校へ行った, pendekatan ini secara semula jadi menghasilkan 学校がっこう行ったいった. Yang penting baginya ialah perkataan 学校 dibaca がっこう dan bentuk berubah 行った dibaca いった.

Pendekatan ini sangat baik untuk automasi. Aplikasi pembelajaran, sambungan pelayar, teks kepada pertuturan, indeks carian, kamus dan sistem NLP semuanya mendapat manfaat daripada bacaan perkataan yang memahami konteks. Ia boleh membezakan 生物せいぶつ dalam konteks biologi daripada 生物なまもの apabila merujuk kepada makanan mentah.

Titik buta: bacaan perkataan tidak semestinya sama dengan ruby bercetak

Bentuk perkataan 行った dibaca いった, tetapi ruby gaya penerbitan lazimnya menulis った. Bahagian った sudah kelihatan dalam teks dasar, jadi tidak perlu diletakkan di atas kanji.

Begitu juga, 学校がっこう memadai untuk sebutan, tetapi konteks pembelajaran kanji mungkin memilih がっこう. Di sini, がっ bukan bacaan tunggal がく; ia ialah bahagian bacaan yang menjadi milik dalam kata majmuk selepas perubahan bunyi.

Bagi perkataan seperti 今日きょう, 大人おとな dan 小豆あずき, pemisahan aksara demi aksara tidak membantu. Sistem ortografi yang baik mengakui bahawa ini ialah bacaan berkumpulan.

Pendekatan kedua: ortografi atau berasaskan unit kanji

Pendekatan ortografi bermula daripada halaman bertulis. Di manakah kanji? Kata majmuk manakah yang mengandunginya? Aksara manakah memerlukan bantuan bagi pembaca sasaran? Jika ruby ditambah, patutkah ia menggunakan mono-ruby, jukugo-ruby atau group-ruby?

JLREQ turut membezakan ruby penuh, apabila semua kanji menerima ruby, dengan ruby separa, apabila hanya kanji terpilih menerimanya—kadangkala pada kemunculan pertama sahaja. [2] Inilah sebabnya bahasa Jepun bercetak kelihatan begitu terancang: ia menyokong sebutan sambil mengekalkan struktur perkataan bertulis.

Jukugo-ruby dan group-ruby

Jukugo-ruby ialah bentuk pertengahan yang mudah terlepas pandang. がっこう bukan sekadar dua anotasi ruby yang terpisah. Kata majmuk itu dibaca sebagai satu perkataan, tetapi setiap kanji masih menerima bahagian bacaan yang bermakna.

Group-ruby digunakan apabila bacaan perkataan tidak dapat diagihkan secara semula jadi: 今日きょう, 明日あした, 大人おとな dan 一昨日おととい. Kerangka Jōyō Kanji turut memperlakukan banyak bacaan ateji dan jukujikun sebagai bacaan pada peringkat perkataan dalam lampirannya; kerangka itu ialah panduan penulisan moden, bukannya senarai lengkap bagi setiap penggunaan. [5]

Perbezaan

DimensiPendekatan morfologiPendekatan ortografi atau unit kanji
Soalan utamaBagaimanakah ayat atau perkataan ini dibaca?Kanji bercetak yang manakah patut menerima bacaan tertentu?
Unit asasMorfem, perkataan, unit pendek, bentuk berubahTeks dasar, kanji, kata majmuk, seluruh perkataan
Hasil lazim学校がっこう, 行ったいったがっこう, った
KekuatanAutomasi, konteks, TTS, pembelajaran kosa kataKejelasan cetakan, pembelajaran kanji, buku teks, buku kanak-kanak
KelemahanMungkin tidak menunjukkan kanji yang membawa setiap bunyiLebih sukar diautomatikkan dan sering memerlukan peraturan atau semakan

Mengapa buku teks dan buku kanak-kanak memilih pendekatan tulisan

Buku-buku ini bukan sekadar membantu kanak-kanak menyebut teks; buku-buku ini juga mengajar kanji. Bahan sekolah Jepun menetapkan kanji mengikut tahun persekolahan, manakala bahan rasmi menerangkan pengagihan bacaan merentas peringkat sekolah berdasarkan perkembangan, beban pembelajaran, penggunaan harian dan pemahaman makna. [6] [7]

Oleh itu, 学校がっこう mungkin memadai untuk membaca dengan lantang, tetapi がっこう lebih baik untuk mengajar hubungan antara kata majmuk bertulis dengan bunyinya. 行ったいった memadai untuk sebutan, tetapi った lebih jelas menunjukkan cara kanji dan okurigana berfungsi bersama.

Empat contoh

学校. Morfologi: 学校がっこう. Ortografi: がっこう. Yang pertama sesuai untuk kosa kata; yang kedua sesuai untuk kanji dan bacaan gaya penerbitan.

行った. Morfologi: 行ったいった. Ortografi: った. Okurigana kekal kelihatan dalam teks dasar.

今日. Kedua-dua pendekatan sering menghasilkan 今日きょう, kerana memaksa pembahagian きょ akan mengajar gerak hati yang salah.

生物. Konteks amat penting. 生物を研究する biasanya dibaca 生物せいぶつ; 生物を冷蔵庫に入れる pula dibaca 生物なまもの. Sistem berasaskan tulisan mungkin memaparkan せいぶつ bagi bacaan pertama, tetapi mengekalkan 生物なまもの sebagai bacaan berkumpulan bagi bacaan kedua.

Yang manakah lebih baik?

Jika anda hanya perlu membaca ayat dengan lancar, pendekatan morfologi adalah langsung dan berguna. Jika anda mempelajari kanji, membaca buku kanak-kanak, meneliti teks dengan rapat atau menyediakan bahan pengajaran, pendekatan ortografi lebih setia kepada halaman bercetak.

Pengajaran terbaik sering menggunakan kedua-dua lapisan: ajar kosa kata sebagai 学校 = がっこう, ajar bacaan sebagai がっこう, dan terangkan bahawa 今日きょう ialah bacaan seluruh perkataan.

Untuk aplikasi dan alat pembelajaran: gunakan gabungan dua peringkat

Sistem furigana berkualiti tinggi patut menggunakan analisis morfologi terlebih dahulu untuk mengetahui bacaan perkataan, kemudian menggunakan peraturan gaya penerbitan untuk menentukan cara bacaan itu dilekatkan semula pada aksara bercetak. Peringkat kedua yang sukar bukan lagi sekadar NLP; ia menggabungkan linguistik, pendidikan kanji, tipografi bahasa Jepun dan reka bentuk untuk pembaca.

Dua pasang cermin mata

Pendekatan morfologi ialah cermin mata pendengaran. Ia melihat bahasa Jepun sebagai aliran bunyi dan bertanya: bagaimanakah ayat ini patut disebut?

Pendekatan ortografi ialah cermin mata tulisan. Ia melihat kanji, kana, kata majmuk, baris dan susun atur, lalu bertanya: bagaimanakah halaman ini dapat membantu pembaca membaca serta mempelajari tulisan?

Nota OCAT. Dalam OCAT, buka Tetapan → Pilihan Eksperimen untuk memilih furigana ortografi atau berasaskan unit kanji, ataupun furigana morfologi. Mod ortografi digunakan secara lalai. OCAT mungkin antara satu-satunya aplikasi pembelajaran bahasa Jepun yang menyokong pendekatan gaya penerbitan ini.

Rujukan

  1. Peraturan Peletakan Mudah Ruby bahasa Jepun
  2. Keperluan Susun Atur Teks bahasa Jepun 日本語組版処理の要件
  3. MeCab: Yet Another Part-of-Speech and Morphological Analyzer
  4. Glosari UniDic
  5. 文化庁 常用漢字表
  6. 学年別漢字配当表
  7. 文部科学省 音訓の小・中・高等学校段階別割り振り表

OCAT

Mempelajari ayat penuh lebih berkesan daripada menghafal perkataan satu demi satu!

OCAT ialah aplikasi yang membantu anda meningkatkan kemahiran bertutur dalam bahasa Jepun, Mandarin, Kantonis, bahasa Inggeris, Perancis, Jerman, Sepanyol, Korea dan Rusia dengan pantas melalui perbualan bersama AI.

Anda boleh mengumpulkan ayat semula jadi yang dilengkapi panduan sebutan dan audio dengan mudah untuk membina Koleksi ungkapan harian anda sendiri. Dengarkannya berulang kali, latih pendengaran anda dan sebut ayat dengan lebih lancar serta semula jadi sedikit demi sedikit.

Mempelajari ayat penuh lebih berkesan daripada menghafal perkataan satu demi satu!

Nama “OCAT” berasal daripada ungkapan bahasa Jepun “おしえてoshiete”, yang bermaksud “tolong ajar saya”.

Ciri utama