
En el ámbito de la internacionalización , los caracteres CJK son un término colectivo para los grafemas utilizados en los sistemas de escritura chino , japonés y coreano , que incluyen caracteres chinos . También se puede denominar CJKV para incluir Chữ Nôm , la escritura logográfica de origen chino que se utilizaba anteriormente para el idioma vietnamita , o CJKVZ para incluir también Sawndip , que se utiliza para escribir las lenguas Zhuang .
Repertorio de personajes
El mandarín estándar y el cantonés estándar se escriben casi exclusivamente con caracteres chinos . Se requieren más de 3000 caracteres para la alfabetización general, y hasta 40 000 para una cobertura razonablemente completa. El japonés utiliza menos caracteres: se puede esperar una alfabetización general en japonés con 2136 caracteres. El uso de caracteres chinos en Corea es cada vez menos frecuente, aunque el uso idiosincrásico de caracteres chinos en nombres propios requiere el conocimiento (y, por lo tanto, la disponibilidad) de muchos más caracteres. A partir de 2013, a algunos estudiantes surcoreanos todavía se les exigía aprender 1.800 caracteres . [ 1 ]
Otros sistemas de escritura utilizados para estos idiomas, como el bopomofo y el pinyin basado en el latín para el chino, el hiragana y el katakana para el japonés, y el hangul para el coreano, no son estrictamente "caracteres CJK", aunque los conjuntos de caracteres CJK casi invariablemente los incluyen por ser necesarios para una cobertura completa de los idiomas de destino.
El sinólogo Carl Leban (1971) elaboró un estudio inicial sobre los sistemas de codificación CJK.
Hasta principios del siglo XX, el chino clásico era la lengua escrita del gobierno y la erudición en Vietnam. La literatura popular en vietnamita se escribía en la escritura chữ Nôm , que consta de caracteres chinos con muchos caracteres creados localmente. Desde la década de 1920, la escritura utilizada para registrar la literatura ha sido el alfabeto vietnamita basado en el alfabeto latino . [ 2 ] [ 3 ]
Cuadruplicación
La cuadruplicación ( en chino :四叠字, literalmente "caracteres cuádruples") es un método para formar caracteres CJK mediante repetición ideográfica. Ken Lunde describe estos caracteres como "grupos de cuatro o más elementos idénticos, junto con tres elementos idénticos en fila dispuestos horizontal o verticalmente". [ 4 ] Estos caracteres se usaban principalmente en la escritura china antigua y ya no se usan comúnmente, excepto como componentes de algunos ideogramas Han modernos como 惙. [ 5 ]
Ejemplos
Codificación
La cantidad de caracteres necesarios para cubrir completamente las necesidades de todos estos idiomas no cabe en el espacio de código de 256 caracteres de las codificaciones de caracteres de 8 bits , lo que requiere al menos una codificación de ancho fijo de 16 bits o codificaciones de longitud variable de varios bytes. Las codificaciones de ancho fijo de 16 bits, como las de Unicode hasta la versión 2.0 inclusive, están ahora en desuso debido a la necesidad de codificar más caracteres de los que puede admitir una codificación de 16 bits (Unicode 5.0 tiene unos 70 000 caracteres Han) y al requisito del gobierno chino de que el software en China sea compatible con el conjunto de caracteres GB 18030 .
Aunque las codificaciones CJK comparten conjuntos de caracteres, las codificaciones que se suelen usar para representarlas han sido desarrolladas por separado por distintos gobiernos y empresas de software de Asia Oriental, y son incompatibles entre sí. Unicode ha intentado, con cierta controversia, unificar los conjuntos de caracteres en un proceso conocido como unificación Han .
Las codificaciones de caracteres CJK deben consistir como mínimo en caracteres Han más escrituras fonéticas específicas del idioma, como pinyin , bopomofo , hiragana, katakana y hangul. [ 6 ]
Las codificaciones de caracteres CJK incluyen:
- Big5 (el sistema de codificación más utilizado antes de la implementación de Unicode)
- CCCII
- CNS 11643 (norma oficial de la República de China )
- EUC-JP
- EUC-KR
- GB 2312 (subconjunto y predecesor de GB 18030)
- GB 18030 (norma obligatoria en la República Popular China )
- Conjunto de caracteres Giga (GCS)
- ISO-2022-JP
- ISO-2022-KR
- KS X 1001
- KPS 9566
- Turno-JIS
- TRON
- Unicode
Los conjuntos de caracteres CJK ocupan la mayor parte del espacio de código Unicode asignado . Existe mucha controversia entre los expertos japoneses en caracteres chinos sobre la conveniencia y el mérito técnico del proceso de unificación Han, utilizado para mapear múltiples conjuntos de caracteres chinos y japoneses en un único conjunto unificado.
Los tres idiomas se pueden escribir tanto de izquierda a derecha como de arriba abajo (de derecha a izquierda y de arriba abajo en documentos antiguos), pero generalmente se consideran sistemas de escritura de izquierda a derecha cuando se habla de cuestiones de codificación.
estatus legal
Las bibliotecas colaboraron en la definición de estándares de codificación para los caracteres JACKPHY a principios de la década de 1980. Según Ken Lunde , la abreviatura "CJK" era una marca registrada de Research Libraries Group [ 7 ] (que se fusionó con OCLC en 2006). La marca registrada que perteneció a OCLC entre 1987 y 2009 ya ha expirado. [ 8 ]
Véase también
- Lenguajes de descripción de caracteres chinos
- Codificación de caracteres chinos
- Métodos de entrada chinos para computadoras
- Ideogramas de compatibilidad CJK
- trazos de caracteres chinos
- Ideogramas unificados CJK
- Lenguajes de diseño de texto complejo (CTL)
- Editor de métodos de entrada
- Idioma japonés y computadoras
- Idioma coreano y computadoras
- Lista de fuentes CJK
- Sinoxénico
- Codificación de ancho variable
- Idioma vietnamita y computadoras
Referencias
- ↑ Lunde, Ken (2009). Procesamiento de información CJKV (2.ª ed.). Pekín, Boston, Farnham, Sebastopol, Tokio: O'Reilly. ISBN 978-0-596-51447-1.
- ↑ Coulmas (1991) , págs. 113–115.
- ↑ DeFrancis (1977) .
- ^ Lunde, Ken. "UTN n.º 43: Propiedad de la base de datos Unihan" kStrange"" . www.unicode.org .
- ↑ Yuan, Alex (11 de agosto de 2020). "Una discusión sobre el enfoque de las "conexiones" con los estudios de caracteres chinos en la enseñanza del chino como lengua extranjera" . Metodología y tecnología de la enseñanza del idioma chino . 3 (1): 46. ISSN 2572-1739 . Recuperado el 24 de diciembre de 2025 .
- ↑ Este artículo se basa en material tomado de CJK en el Free On-line Dictionary of Computing antes del 1 de noviembre de 2008 e incorporado bajo los términos de "relicencia" de la GFDL , versión 1.3 o posterior.
- ↑ Ken Lunde, 1996
- ↑ Listado de Justia
Obras citadas
Fuentes
- DeFrancis, John . El idioma chino: realidad y fantasía . Honolulu: University of Hawaii Press, 1990. ISBN 0-8248-1068-6.
- Hannas, William C. El dilema ortográfico de Asia . Honolulu: Prensa de la Universidad de Hawaii, 1997. ISBN 0-8248-1892-X(tapa blanda); ISBN 0-8248-1842-3(de tapa dura).
- Lemberg, Werner: El paquete CJK para LATEX2ε: soporte multilingüe más allá de Babel. TUGboat, Volumen 18 (1997), No. 3: Actas de la Reunión Anual de 1997.
- Leban, Carl. Sistemas ortográficos automatizados para lenguas de Asia Oriental (chino, japonés, coreano) , Informe sobre el estado del arte, Preparado para la Junta Directiva de la Asociación de Estudios Asiáticos. 1971.
- Lunde, Ken . Procesamiento de Información CJKV . Sebastopol, California: O'Reilly & Associates, 1998. ISBN 1-56592-224-7.
Enlaces externos
- CJKV: Una breve introducción
- Artículo de Lemberg CJK mencionado anteriormente, TUGboat18-3
- Sobre "Ideograma Unificado CJK" , de Wenlin.com
- FGA: Racionalización del conjunto de caracteres Unicode CJKV
- Codificaciones de lenguas asiáticas
- Lenguas del este de Asia
- Lenguaje natural e informática
- Informática en idioma chino
- Informática en idioma japonés
- Informática en idioma coreano
- Sistemas de escritura que utilizan caracteres chinos