Un iūrei moji (幽霊文字? «caracter fantasma») es referix a la série de sinogramas japonesos (kanji) desconeguts que formen part de la codificació de caràcters JIS X 0208.[1][2] Estos caràcters varen escomençar a sorgir a partir de la década de 1970, per una mala digitalisació d'atres caràcters existents en documents escrits.[2] També són coneguts com iūrei kanji (幽霊漢字? «kanji fantasma»)[1] o iūrei-ji (幽霊字?).

Sorgiment

En 1978, el Ministeri d'Economia, Comerç i Indústries de Japó va establir l'estàndart JIS C 6226 (després renomenat a JIS X 0208) de tipos de lletra para computadora, com una preparació davant la digitalisació dels kanji.[2] Un total de 6349 caràcters varen ser establits com kanji de primer i segon nivell. Estos kanji es denominen colectivament com « bàsic JIS».

Els experts varen prendre al voltant de huit anys en triar els caràcters, en senyes extretes essencialment de quatre referències:[2][3]

  1. Kanji per al còdic estàndar (tentativo): per la Societat de Processament d'Informació de Japó (Jōhō Shori Gakkai, 1971)
  2. Kanji d'administració nacional de districtes: pel Centre de Senyes Geogràfiques de Japó (Kokudo Chiri Kyōka, 1970)
  3. Kanji de registre de noms: per Nippon Life (Nihon Seimei Shūiō Jinmei Kanji, 1973, actualment no existix)
  4. Kanji bàsic per al processament d'informació administrativa: per l'antiga Agència de Gestió Administrativa (Gyōsei Kanrichō, 1975)

Una volta que es va establir la codificació de caràcters com a estàndar, va ser revisat posteriorment en 1983, 1990 i 1997. No obstant, en 1979 l'erudit Kazuo Tajima va revelar que havia trobat en l'estàndart uns 63 caràcters d'orige desconegut que no apareixien en el Kadokawa Shinjigen (un gran diccionari de kanji) ni en el Dai Kan-Wa Jiten de Tetsuji Morohashi (considerat el diccionari més complet sobre kanji en Japó), ni tampoc eren caràcters shinjitai (caràcters creats en la posguerra), kokuji (caràcters d'orige japonés) o ryakuji (caràcters abreviats a mà), per lo que estos caràcters estaven sense llectura, significat i història alguna.

Si ben estos caràcters fantasma es varen convertir en tema de conversació per als erudits, per a la revisió de 1997 va ser considerat com un problema, per lo que un equip d'investigadors liderats per Kōji Shibano va investigar la causa de la seua aparició.[1][2] Segons l'investigació, molts dels caràcters fantasma provenien de les llistes d'administració nacional de districtes i del registre de noms. En el cas del registre de noms, no contava en un text original per a la seua creació, per lo que va ser substituït per bases de senyes de les guies telefòniques de la NTT com a referència més sòlida. En l'investigació, es va reduir a només 12 caràcters fantasma que no poden ser explicats per mig de referències.


Per eixemple, el caràcter 妛 no es troba en el Diccionari de Kangxi, considerat obra cim entre els diccionaris de caràcters chinencs, i els tècnics de el JIS no varen poder trobar lloc algun en Japó en dit caràcter, fins que varen observar una certa similitut en el caràcter 𡚴 usat en Akenbara (𡚴原?), una antiga localitat en el districte de Inukami, prefectura de Shiga.[2] En este cas es va descobrir que elllogarencs no imprimien directament el kanji, sino que usaven retallades en els caràcters 山 (montanya) i 女 (dòna) un sobre l'atre i ho fotocopiaven, per lo que en el procés de digitalisació molt possiblement es va prendre una mala retallada d'abdós que va derivar en una ombra que va crear el traç horisontal adicional i va generar un nou caràcter.[2][4]

Mentres que el cas de 彁 va ser documentat com «completament únic entre els caràcters codificats en estos estàndarts, i sense cap forma d'identificació», ya que no existix referència a ella abans de 1976.[1][2][5]

A pesar del descobriment, estos caràcters encara poden ser agregats en els processadors de text via Unicode.[2] La raó és que el JIS X 0208 va ser reformat per primera volta en 1983, quan es varen agregar més de 300 kanjis en formes simplificades o intercanviades a demanat del Ministeri d'Educació de Japó, pero els iūrei moji es varen mantindre inalterables.[2] No obstant, la poca funcionalitat tècnica de les computadores en la década de 1980, dites revisions varen causar alguns problemes en la codificació Unicode en computadores chinenques i coreanes. Aixina que quan es va concloure l'investigació en 1997, el comité de el JIS va determinar que lo millor era que els iūrei moji mantingueren la seua posició original i registrar la forma correcta en un nou valor Unicode.[2]

Llista de iūrei moji

Esta és la llista de caràcters fantasma segons la codificació JIS X 0208:1997.

Kanji Kuten Referència
墸 52-55 Font desconeguda.
壥 52-63 Font desconeguda. Possible error de 㕓.
妛 54-12 Kanji d'administració nacional de districtes (pero no es pot trobar). Possible error de &x216B4;.
彁 55-27 Sense resultats d'anàlisis de correspondència (referència desconeguda). Possible error de 彊, 謌 o uns atres.
挧 57-43 Kanji d'administració nacional de districtes (pero no es pot trobar). Possible error de 栩.
暃 58-83 Kanji d'administració nacional de districtes (pero no es pot trobar). Possible error de 杲.
椦 59-91 Kanji d'administració nacional de districtes (pero no es pot trobar). Possible error de 橳.
槞 60-57 Kanji d'administració nacional de districtes (pero no es pot trobar). Possible error de 橦.
蟐 74-12 Kanji bàsic per al processament d'informació administrativa (taula de còdics de kanji de la Meiji Yasuda Life), pero sense aplicació alguna.
袮 74-57 Kanji d'administració nacional de districtes (pero no es pot trobar). Possible error de 祢.
閠 79-64 Kanji d'administració nacional de districtes (pero no es pot trobar). Possible error de 閏.
駲 81-50 Kanji de registre de noms, pero sense aparéixer en el document original.

Antics iūrei moji

Estos caràcters varen ser catalogats per Tajima en 1979 com iūrei moji, pero en 1997 es va poder descobrir la seua referència. Esta llista està basada en la codificació JIS X 0208:1997.

Kanji Kuten Referència i eixemple d'us
垈 52-18 Kanji d'administració nacional de districtes.
藤垈 (Fujinuta), 相垈 (Ainuta), 大垈 (Onta); localitats de la prefectura de Yamanashi.
垉 52-21 Kanji d'administració nacional de districtes.
垉六 (Hōroku); localitat de la prefectura de Aichi.
岾 54-19 Kanji d'administració nacional de districtes, pero no existix en l'actualitat.
広岾町 (Hiroyama-chō) → 広帖町 (Kōchō-chō); localitat de la prefectura de Kyoto.
恷 55-78 Kanji de registre de noms. Substituït per la base de senyes telefònica de la NTT.
橸 60-81 Hi ha un eixemple en el diccionari Nihon Chimei Daijiten.
石橸 (Ishidaru); localitat de la prefectura de Shizuoka.
汢 61-73 Kanji d'administració nacional de districtes, pero en una errata en el text original.
汢の川 →  の川 (Nutanokawa); localitat de la prefectura de Kōchi.
碵 66-83 Kanji de registre de noms. Substituït per la base de senyes telefònica de la NTT.
穃 67-46 Kanji d'administració nacional de districtes, pero en un error tipogràfic.
穃原 → 榕原 (Iōbaru); localitat de la prefectura de Okinawa.
粐 68-68 Kanji d'administració nacional de districtes.
粐蒔沢 (Nukamakizawa); localitat de la prefectura de Akita.
粭 68-70 Kanji d'administració nacional de districtes.
粭島 (Sukumojima); localitat de la prefectura de Yamaguchi.
粫 68-72 Kanji d'administració nacional de districtes, pero en un error tipogràfic.
粫田 (Uruchida) → 糯田 (Mochida); localitat de la prefectura de Fukushima.
糘 68-84 Kanji d'administració nacional de districtes.
糘尻 (Sukumojiri); localitat de la prefectura de Hiroshima.
膤 71-19 Kanji d'administració nacional de districtes.
膤割 (Yukiwari); localitat de la prefectura de Kumamoto.
軅 77-32 Kanji d'administració nacional de districtes, pero no existix en l'actualitat.
軅飛 (Takatobu) → 鷹飛 (Takatobi); localitat de la prefectura de Fukushima.
鍄 78-93 Kanji d'administració nacional de districtes.
小鍄 (Kogasugai); localitat de la prefectura de Yamagata.
鵈 82-94 Kanji d'administració nacional de districtes, pero en un error tipogràfic.
鵈沢 → 鵃沢 (Misagosawa); localitat de la prefectura de Fukushima.

Notes

  1. ↑ 1,0 1,1 1,2 1,3 Ken Lunde (2009). CJKV Information Processing (en anglés), O'Reilly Mija, Inc., p. 178.
  2. ↑ 2,00 2,01 2,02 2,03 2,04 2,05 2,06 2,07 2,08 2,09 2,10 Paul Dargan (29 d'octubre de 2018). ‘Ghost kanji’ lurk in the Japanese lexicon (en anglés), The Japan Claves.
  3. ↑ JIS X 0208:1997 (1997). 7ビット及び8ビットの2バイト情報交換用符号化漢字集合 (7 Bitto Oyobi 8 Bitto no 2 Baito Jōhō Kōkanyō Fugōka Kanji Shūgō) (en japonés), Japanese Standards Association, p. 269f.
  4. ↑ JIS X 0208:1997 (1997). 7ビット及び8ビットの2バイト情報交換用符号化漢字集合 (7 Bitto Oyobi 8 Bitto no 2 Baito Jōhō Kōkanyō Fugōka Kanji Shūgō) (en japonés), Japanese Standards Association, p. 289-292.
  5. ↑ Naokazu Hiruma. «幽霊文字の読み、どこから ― 変換辞書のはなし5 (Iūrei moji no Yomi, Doko kara - Henkan Jisho no Hanashi 5)» (en japonés). Asahi Shimbun. Consultat el 2 de novembre de 2018.

Referències

753-761.


Referències