Por qué el furigana de tu aplicación no se parece al de un libro japonés

Furigana por morfemas frente a furigana ortográfico o por kanji: dos formas de anotar la lectura del japonés

Muchos estudiantes conocen el furigana y suponen que consiste simplemente en colocar lecturas en kana sobre los kanji. No es incorrecto, pero enseguida surgen dudas.

Ante la misma frase, 昨日、学校へ行った。, una herramienta automática puede producir 昨日きのう学校がっこう行ったいった. Un libro infantil, un manual o una publicación cuidada puede preferir 昨日きのうがっこうった。.

Ambas opciones ayudan a leer japonés, pero responden a preguntas distintas. La primera pregunta: ¿cómo suena esta frase? La segunda: ¿cómo debe reconocer el lector estos kanji impresos?

Piensa en el ruby como dos decisiones diferentes

En tipografía japonesa, el furigana suele tratarse como ruby. En escritura horizontal se coloca normalmente sobre el texto base y, en escritura vertical, a la derecha; el W3C también señala que suele medir aproximadamente la mitad que el texto base. [1]

Pero elegir qué recibe ruby y decidir cómo se asocia son cuestiones distintas. ¿Todos los kanji necesitan ayuda o solo los difíciles? ¿La lectura debe asociarse a un kanji, a cada kanji de un compuesto o a toda la palabra?

JLREQ describe tres relaciones importantes: mono-ruby, jukugo-ruby y group-ruby. Mono-ruby vincula un carácter base a una cadena ruby. Jukugo-ruby mantiene el compuesto como unidad y conserva las relaciones internas entre kanji y lectura. Group-ruby vincula varios caracteres base a una sola lectura. [2]

Primer enfoque: morfológico

El enfoque morfológico parte del análisis lingüístico. Segmenta la frase en palabras o morfemas y asigna lecturas, categorías gramaticales, lemas e información de flexión.

Herramientas como MeCab segmentan el japonés y generan campos como forma superficial, categoría gramatical, forma base, lectura y pronunciación. UniDic también está diseñado expresamente para el análisis morfológico y emplea unidades cortas con capas como lexema, forma de palabra, forma escrita y forma de pronunciación. [3] [4]

Para 学校へ行った, este enfoque produce de manera natural 学校がっこう行ったいった. Lo importante es que 学校 se lee がっこう y que la forma flexionada 行った se lee いった.

Resulta excelente para automatizar aplicaciones educativas, extensiones del navegador, síntesis de voz, índices de búsqueda, diccionarios y sistemas de procesamiento del lenguaje natural. También distingue 生物せいぶつ en un contexto de biología de 生物なまもの cuando se habla de alimentos crudos.

El punto ciego: la lectura de una palabra no siempre coincide con el ruby impreso

La forma 行った se lee いった, pero el ruby editorial suele escribir った. El った ya está visible en el texto base, así que no hace falta repetirlo sobre el kanji.

Del mismo modo, 学校がっこう basta para conocer la pronunciación, pero para aprender kanji puede ser preferible がっこう. Aquí がっ no es la lectura aislada がく, sino el segmento que corresponde a dentro del compuesto tras el cambio fonético.

En palabras como 今日きょう, 大人おとな y 小豆あずき, una división fiel carácter por carácter no resulta útil. Un buen sistema ortográfico reconoce que son lecturas de grupo.

Segundo enfoque: ortográfico o por kanji

El enfoque ortográfico parte de la página escrita. ¿Dónde están los kanji? ¿De qué compuestos forman parte? ¿Qué caracteres necesitan ayuda para el lector previsto? Si se añade ruby, ¿debe ser mono-ruby, jukugo-ruby o group-ruby?

JLREQ también distingue el ruby completo, que anota todos los kanji, del ruby parcial, que solo anota algunos y a veces únicamente en su primera aparición. [2] Por eso el japonés impreso muestra una composición tan cuidada: ayuda a pronunciar sin perder la estructura de la palabra escrita.

Jukugo-ruby y group-ruby

Jukugo-ruby es la forma intermedia que suele pasarse por alto. がっこう no equivale a dos anotaciones ruby aisladas. El compuesto se lee como una palabra, pero cada kanji conserva un segmento significativo.

Group-ruby se usa cuando la lectura no puede repartirse de forma natural: 今日きょう, 明日あした, 大人おとな, 一昨日おととい. El marco japonés de kanji jōyō también trata muchas lecturas ateji y jukujikun como lecturas de palabra completa en un apéndice, y funciona como guía de escritura moderna, no como lista exhaustiva de todos los usos. [5]

Diferencias

DimensiónEnfoque morfológicoEnfoque ortográfico o por kanji
Pregunta principal¿Cómo se lee esta frase o palabra?¿Qué lectura debe recibir cada kanji impreso?
Unidad básicaMorfema, palabra, unidad corta, forma flexionadaTexto base, kanji, compuesto, palabra completa
Resultado típico学校がっこう, 行ったいったがっこう, った
VentajaAutomatización, contexto, síntesis de voz, aprendizaje de vocabularioClaridad impresa, aprendizaje de kanji, manuales, libros infantiles
LimitaciónPuede ocultar qué kanji porta cada sonidoEs más difícil de automatizar y suele requerir reglas o revisión

Por qué los manuales y libros infantiles prefieren el enfoque escrito

No solo ayudan a pronunciar el texto, también enseñan kanji. Los materiales escolares japoneses asignan kanji por curso, y los documentos oficiales explican cómo se distribuyen sus lecturas a lo largo de las etapas escolares según el desarrollo, la carga, el uso cotidiano y la comprensión semántica. [6] [7]

Por eso 学校がっこう puede bastar para leer en voz alta, mientras がっこう enseña mejor la relación entre el compuesto escrito y su sonido. 行ったいった basta para pronunciarla, pero った muestra mejor cómo colaboran el kanji y el okurigana.

Cuatro ejemplos

学校. Morfológico: 学校がっこう. Ortográfico: がっこう. El primero sirve para aprender vocabulario; el segundo, para estudiar kanji y leer como en una publicación.

行った. Morfológico: 行ったいった. Ortográfico: った. El okurigana permanece visible en el texto base.

今日. Ambos enfoques suelen dar 今日きょう, porque forzar きょ enseñaría una intuición equivocada.

生物. El contexto importa. 生物を研究する suele usar 生物せいぶつ; 生物を冷蔵庫に入れる usa 生物なまもの. Un sistema por kanji puede mostrar せいぶつ para la primera lectura, pero conservar 生物なまもの como lectura de grupo para la segunda.

¿Cuál es mejor?

Si solo necesitas leer una frase en voz alta con fluidez, el enfoque morfológico es directo y útil. Si estás aprendiendo kanji, leyendo libros infantiles, analizando textos en detalle o creando material didáctico, el enfoque ortográfico respeta mejor la página impresa.

La mejor enseñanza suele combinar ambas capas: aprender vocabulario como 学校 = がっこう, ver la lectura como がっこう y comprender que 今日きょう tiene una lectura de palabra completa.

Para aplicaciones y herramientas educativas: un sistema híbrido de dos fases

Un buen sistema de furigana debe usar primero el análisis morfológico para saber cómo se lee la palabra y después aplicar reglas editoriales que decidan cómo asociar esa lectura a los caracteres impresos. La segunda fase ya no es solo procesamiento del lenguaje natural: combina lingüística, enseñanza de kanji, tipografía japonesa y diseño para el lector.

Dos pares de gafas

El enfoque morfológico funciona como unas gafas para el oído. Ve el japonés como un flujo de sonidos y pregunta: ¿cómo debe pronunciarse esta frase?

El enfoque ortográfico funciona como unas gafas para la escritura. Ve kanji, kana, compuestos, líneas y composición, y pregunta: ¿cómo puede esta página ayudar a leer y aprender la escritura?

Nota de OCAT. En OCAT, abre Ajustes → Opciones experimentales y elige libremente «Por kanji» o «Por morfemas». De forma predeterminada se usa «Por kanji». OCAT podría ser una de las pocas aplicaciones para aprender japonés compatibles con este enfoque editorial.

Referencias

  1. Reglas para la colocación sencilla del ruby japonés
  2. Requisitos para la composición de texto japonés 日本語組版処理の要件
  3. MeCab: analizador morfológico y de categorías gramaticales
  4. Glosario de UniDic
  5. Lista de kanji de uso habitual de la Agencia de Asuntos Culturales 文化庁 常用漢字表
  6. Lista de kanji por curso escolar 学年別漢字配当表
  7. Distribución de lecturas on y kun por etapa educativa del Ministerio de Educación de Japón

OCAT

¡Aprender frases completas es más eficaz que memorizar palabras sueltas!

OCAT es una aplicación que te ayuda a mejorar rápidamente tu expresión oral en japonés, chino, cantonés, francés, alemán, español, coreano y ruso mediante conversaciones con IA.

Puedes guardar fácilmente frases auténticas con guías de pronunciación, reproducción de audio y marcadores para crear enseguida tu propio banco de frases cotidianas. Reprodúcelas una y otra vez, entrena el oído y gana confianza para hablar con naturalidad.

¡Aprender frases completas es más eficaz que memorizar palabras sueltas!

El nombre «OCAT» viene de la expresión japonesa «おしえてoshiete», que significa «enséñame, por favor».

Funciones principales