Bakit hindi kamukha ng nasa aklat sa Hapon ang furigana sa app mo
Maraming nag-aaral ng wikang Hapon ang unang nakakilala sa furigana at nag-aakalang paglalagay lamang ito ng kana sa ibabaw ng kanji. Hindi mali ang palagay na iyon, ngunit mabilis itong humahantong sa kalituhan.
Para sa parehong pangungusap na 昨日、学校へ行った。, maaaring gumawa ang isang awtomatikong tool ng 昨日、学校へ行った。. Maaaring piliin naman ng aklat pambata, textbook, o maingat na inilatag na publikasyon ang 昨日、学校へ行った。.
Pareho kang tinutulungan ng mga ito na bumasa sa wikang Hapon, ngunit magkaiba ang sinasagot nilang tanong. Ang una: ano ang tunog ng pangungusap na ito? Ang ikalawa: paano dapat makilala ng mambabasa ang nakalimbag na kanji?
Unawain ang Ruby Bilang Dalawang Magkahiwalay na Pasiya
Sa tipograpiyang Hapon, karaniwang tinatalakay ang furigana bilang ruby. Karaniwan itong nasa ibabaw ng base text sa pahalang na sulat at nasa kanan sa patayong sulat; binabanggit din ng W3C na madalas ay halos kalahati ng laki ng base text ang ruby bilang default. [1]
Ngunit magkaibang pasiya ang pagpili kung ano ang lalagyan ng ruby at kung paano ikakabit ang ruby. Dapat bang tulungan ang lahat ng kanji o ang mahirap lamang? Ikakabit ba ang pagbasa sa isang kanji, sa bawat kanji ng tambalan, o sa buong salita?
Inilalarawan ng JLREQ ang tatlong mahalagang ugnayan: mono-ruby, jukugo-ruby, at group-ruby. Itinatapat ng mono-ruby ang isang base character sa isang ruby string. Pinananatiling isang yunit ng jukugo-ruby ang tambalan habang iniingatan ang ugnayan ng bawat kanji at bahagi ng pagbasa. Itinatapat naman ng group-ruby ang ilang base character sa iisang ruby string. [2]
Unang Paraan: Morpolohikal
Nagsisimula ang morpolohikal na paraan sa pagsusuri ng wika. Hinahati nito ang pangungusap sa mga salita o morpema, saka naglalagay ng pagbasa, bahagi ng pananalita, lemma, at impormasyon sa inflection.
Hinahati ng mga tool gaya ng MeCab ang teksto sa wikang Hapon at naglalabas ng surface form, bahagi ng pananalita, base form, pagbasa, at pagbigkas. Sadyang ginawa rin ang UniDic para sa morpolohikal na pagsusuri at gumagamit ito ng maiikling yunit na may mga antas gaya ng lexeme, anyo ng salita, anyong nakasulat, at anyo ng pagbigkas. [3] [4]
Para sa 学校へ行った, natural na ibinibigay ng paraang ito ang 学校へ行った. Mahalaga rito na binabasa ang 学校 bilang がっこう at ang inflected form na 行った bilang いった.
Napakahusay nito para sa automation: nakikinabang ang learning app, browser extension, text-to-speech, search index, diksyunaryo, at NLP system sa pagbasa ng salita ayon sa konteksto. Halimbawa, nakikilala nito ang 生物 sa konteksto ng biology at ang 生物 kapag hilaw na pagkain ang tinutukoy.
Limitasyon: Hindi Laging Kapareho ng Nakaimprentang Ruby ang Pagbasa ng Salita
Binabasa ang anyong 行った bilang いった, ngunit karaniwang isinusulat ng ruby na pangpublikasyon ang 行った. Nakikita na sa base text ang った, kaya hindi na ito kailangang ulitin sa ibabaw ng kanji.
Gayundin, sapat ang 学校 para malaman ang pagbigkas, ngunit maaaring piliin sa pag-aaral ng kanji ang 学校. Dito, hindi hiwalay na pagbasa na がく ang がっ; ito ang bahaging nauukol sa 学 sa loob ng tambalan matapos ang pagbabago ng tunog.
Para sa mga salitang gaya ng 今日, 大人, at 小豆, hindi nakatutulong ang sapilitang paghahati ng pagbasa sa bawat character. Kinikilala ng mahusay na ortograpikong sistema na mga group reading ang mga ito.
Ikalawang Paraan: Ortograpiko o Batay sa Yunit ng Kanji
Nagsisimula ang ortograpikong paraan sa nakasulat na pahina. Nasaan ang kanji? Saang tambalan ito kabilang? Aling character ang kailangang tulungan para sa target na mambabasa? Kung maglalagay ng ruby, dapat ba itong mono-ruby, jukugo-ruby, o group-ruby?
Pinag-iiba rin ng JLREQ ang full ruby, na naglalagay ng ruby sa lahat ng kanji, at partial ruby, na sa piniling kanji lamang at kung minsan ay sa unang paglitaw lamang. [2] Kaya sadyang maingat ang anyo ng nakalimbag na teksto sa wikang Hapon: tinutulungan nito ang pagbigkas habang pinananatili ang estruktura ng nakasulat na salita.
Jukugo-ruby at Group-ruby
Madaling makaligtaan ang jukugo-ruby bilang nasa gitnang anyo. Ang 学校 ay hindi lamang dalawang hiwalay na ruby annotation. Binabasa bilang isang salita ang tambalan, ngunit may makabuluhang bahagi pa rin ang bawat kanji.
Group-ruby ang ginagamit kapag hindi natural na mahahati ang pagbasa ng salita: 今日, 明日, 大人, at 一昨日. Itinuturing din ng balangkas ng Jōyō Kanji ang maraming pagbasa ng ateji at jukujikun bilang pagbasa sa antas ng salita. Gabay ito sa makabagong pagsulat, hindi kumpletong talaan ng lahat ng gamit. [5]
Mga Pagkakaiba
| Aspekto | Morpolohikal na paraan | Ortograpiko o batay-sa-yunit-ng-kanji na paraan |
|---|---|---|
| Pangunahing tanong | Paano binabasa ang pangungusap o salitang ito? | Aling pagbasa ang dapat ilagay sa bawat nakalimbag na kanji? |
| Batayang yunit | Morpema, salita, maikling yunit, inflected form | Base text, kanji, tambalan, buong salita |
| Karaniwang resulta | 学校, 行った | 学校, 行った |
| Lakas | Automation, konteksto, TTS, pag-aaral ng bokabularyo | Linaw sa imprenta, pag-aaral ng kanji, textbook, aklat pambata |
| Limitasyon | Maaaring hindi makita kung aling kanji ang may taglay ng isang tunog | Mas mahirap i-automate at madalas nangangailangan ng tuntunin o pagsusuri |
Bakit Pinipili ng Textbook at Aklat Pambata ang Nakasulat na Paraan
Hindi lamang nila tinutulungan ang bata na bigkasin ang teksto; itinuturo rin nila ang kanji. Hinahati ng mga materyal sa paaralan sa Hapon ang kanji ayon sa baitang, at tinatalakay ng opisyal na materyal kung paano ipinamamahagi ang mga pagbasa sa bawat antas ayon sa pag-unlad, bigat ng pag-aaral, pang-araw-araw na gamit, at pag-unawa sa kahulugan. [6] [7]
Kaya maaaring sapat ang 学校 sa pagbasa nang malakas, ngunit mas malinaw na itinuturo ng 学校 ang ugnayan ng nakasulat na tambalan at tunog nito. Sapat ang 行った sa pagbigkas, ngunit mas malinaw sa 行った kung paano nagtutulungan ang kanji at okurigana.
Apat na Halimbawa
学校. Morpolohikal: 学校. Ortograpiko: 学校. Mainam ang una para sa bokabularyo; mainam ang ikalawa para sa kanji at estilong pangpublikasyon na pagbasa.
行った. Morpolohikal: 行った. Ortograpiko: 行った. Nananatiling nakikita ang okurigana sa base text.
今日. Karaniwang nagbibigay ang parehong paraan ng 今日, dahil maling kutob ang maituturo ng sapilitang 今日.
生物. Konteksto ang nagpapasiya sa pagbasa. Karaniwang 生物 ang 生物を研究する, samantalang 生物 ang 生物を冷蔵庫に入れる. Maaaring ipakita ng sistemang nakabatay sa sulat ang 生物 sa unang pagbasa, ngunit panatilihin bilang group reading ang 生物 sa ikalawa.
Alin ang Mas Mahusay?
Kung kailangan mo lamang bigkasin nang tuloy-tuloy ang pangungusap, tuwiran at kapaki-pakinabang ang morpolohikal na paraan. Kung nag-aaral ka ng kanji, nagbabasa ng aklat pambata, masusing sumusuri ng teksto, o gumagawa ng materyal sa pagtuturo, mas tapat sa nakalimbag na pahina ang ortograpikong paraan.
Madalas pagsamahin ng pinakamahusay na pagtuturo ang dalawang antas: ituro ang bokabularyo bilang 学校 = がっこう, ituro ang pagbasa bilang 学校, at ipaliwanag na buong-salitang pagbasa ang 今日.
Para sa App at Learning Tool: Gumamit ng Dalawang-yugtong Hybrid
Dapat munang gumamit ang de-kalidad na furigana system ng morpolohikal na pagsusuri upang malaman ang pagbasa ng salita, saka gumamit ng mga tuntuning pangpublikasyon upang magpasiyang paano ito ikakabit sa mga nakalimbag na character. Hindi na NLP lamang ang mahirap na ikalawang yugto; pinagsasama nito ang lingguwistika, edukasyon sa kanji, tipograpiyang Hapon, at disenyo para sa mambabasa.
Dalawang Lente
Lente sa pandinig ang morpolohikal na paraan. Tinitingnan nito ang wikang Hapon bilang daloy ng tunog at itinatanong: paano dapat bigkasin ang pangungusap na ito?
Lente sa nakasulat na teksto ang ortograpikong paraan. Nakikita nito ang kanji, kana, tambalan, linya, at layout at itinatanong: paano matutulungan ng pahinang ito ang mambabasa na bumasa at matutuhan ang sulat?
Tala ng OCAT. Sa OCAT, buksan ang Mga Setting → Mga Eksperimental na Opsiyon upang malayang pumili sa “Bawat Kanji” at “Bawat Morpema”. “Bawat Kanji” ang default. Maaaring isa ang OCAT sa kakaunting app sa pag-aaral ng wikang Hapon na sumusuporta sa paraang gaya ng nasa publikasyon.
Mga Sanggunian
- Mga Tuntunin sa Payak na Paglalagay ng Ruby sa Wikang Hapon
- Mga Kinakailangan sa Layout ng Teksto sa Wikang Hapon 日本語組版処理の要件
- MeCab: Part-of-Speech at Morpolohikal na Analyzer
- Glosaryo ng UniDic
- Talaan ng Jōyō Kanji ng Agency for Cultural Affairs 文化庁 常用漢字表
- Talaan ng Kanji Ayon sa Baitang 学年別漢字配当表
- Pamamahagi ng mga Pagbasang On at Kun Ayon sa Antas ng Paaralan
