Articulo de referencia

ISO/IEC 8859-8

{{Citation|title=Character Sets|url=https://www.iana.org/assignments/character-sets/character-sets.xhtml|publisher=[[Internet Assigned Numbers Authority]] (IANA)|date=2018-12-12...

ISO/IEC 8859-8 , Tecnología de la información — Conjuntos de caracteres gráficos codificados de un solo byte de 8 bits — Parte 8: Alfabeto latino/hebreo , forma parte de la serie ISO/IEC 8859 de codificaciones de caracteres estándar basadas en ASCII . ISO/IEC 8859-8:1999 de 1999 representa su segunda y actual revisión, precedida por la primera edición ISO/IEC 8859-8:1988 en 1988. Se le conoce informalmente como latino/hebreo . ISO/IEC 8859-8 cubre todas las letras hebreas , pero no los signos vocálicos hebreos . IBM le asignó la página de códigos 916 ( CCSID 916 y 5012). [ 2 ] [ 3 ] [ 4 ] Este conjunto de caracteres también fue adoptado por la norma israelí SI1311:2002, con algunas extensiones.

ISO-8859-8 es el nombre de conjunto de caracteres preferido por IANA para este estándar cuando se complementa con los códigos de control C0 y C1 de ISO/IEC 6429. El texto está (generalmente) en orden lógico, por lo que se requiere procesamiento bidireccional para su visualización. Nominalmente, ISO-8859-8 ( página de códigos 28598 ) es para "orden visual", e ISO-8859-8 -I ( página de códigos 38598 ) es para orden lógico. Pero generalmente en la práctica, y requerido para documentos XML, ISO-8859-8 también representa texto en orden lógico. El estándar de codificación WHATWG utilizado por HTML5 trata a ISO-8859-8 e ISO-8859-8- I como codificaciones distintas con el mismo mapeo debido a la influencia en la dirección del diseño, pero señala que esto ya no se aplica a ISO-8859-6 (árabe), sino solo a ISO-8859-8. [ 5 ]

También existe la norma ISO-8859-8-E , que supuestamente requiere que la direccionalidad se especifique explícitamente con caracteres de control especiales; esta última variante, en la práctica, no se utiliza.

La página de códigos de Microsoft Windows para el hebreo, Windows-1255 , es principalmente una extensión de ISO/IEC 8859-8 sin controles C1, salvo por la omisión del doble guion bajo y la sustitución del símbolo genérico de moneda ( ¤ ) por el símbolo del shekel (₪). Añade compatibilidad con los puntos vocálicos como caracteres combinatorios y algunos signos de puntuación adicionales.

Más de una década después de la publicación de ese estándar, Unicode es el preferido, al menos para Internet [ 6 ] (es decir, UTF-8 , la codificación dominante para páginas web). ISO-8859-8 es utilizado por menos del 0,1% de los sitios web. [ 7 ]

Diseño de página de código

  Diferente tanto del hebreo DEC (8 bits) como del ISO-8859-1 .

FD es una marca de izquierda a derecha (U+200E) y FE es una marca de derecha a izquierda (U+200F), como se especifica en una enmienda más reciente como ISO/IEC 8859-8:1999.

Extensiones de la norma israelí de 2002

La norma israelí SI1311:2002 coincide con la ISO/IEC 8859-8:1999, excepto por una serie de asignaciones de caracteres adicionales para el símbolo del euro , el nuevo símbolo del shekel y un formato bidireccional explícito más avanzado . [ 12 ]

  Ausente en la norma ISO/IEC 8859-8:1999, añadida en la norma SI1311:2002.

Véase también

Referencias

  1. Conjuntos de caracteres , Autoridad de Números Asignados de Internet (IANA), 12 de diciembre de 2018
  2. "Documento informativo de la página 916 del código" . Archivado del original el 16 de febrero de 2017.
  3. "Documento informativo CCSID 916" . Archivado del original el 29/11/2014.
  4. "Documento informativo CCSID 5012" . Archivado del original el 27 de marzo de 2016.
  5. van Kesteren, Anne . "9. Codificaciones heredadas de un solo byte" . Estándar de codificación . WHATWG . Nota: ISO-8859-8 e ISO-8859-8 -I son nombres de codificación distintos, porque ISO-8859-8 influye en la dirección de la disposición. Y aunque históricamente esto también pudo haber sido así para ISO-8859-6 e "ISO-8859-6- I ", ya no es cierto.
  6. John, Nicholas A. (2013). "La construcción de Internet multilingüe: Unicode, hebreo y globalización" . Journal of Computer-Mediated Communication . 18 (3): 321– 338. doi : 10.1111/jcc4.12015 . ISSN 1083-6101 . Antecedentes: el problema del hebreo e Internet. 
  7. "Estadísticas de uso de ISO-8859-8 para sitios web, enero de 2019" . w3techs.com . Consultado el 17 de enero de 2019 .
  8. Página de códigos CPGID 00916 (pdf) (PDF) , IBM
  9. Página de códigos CPGID 00916 (txt) , IBM
  10. Componentes internacionales para Unicode (ICU), ibm-916_P100-1995.ucm , 3 de diciembre de 2002
  11. Componentes internacionales para Unicode (ICU), ibm-5012_P100-1999.ucm , 3 de diciembre de 2002
  12. 1 2 Instituto de Normas de Israel . ISO-IR-234: Conjunto de caracteres latinos/hebreos para códigos de 8 bits (PDF) . ITSCJ/ IPSJ .
  • ISO/IEC 8859-8:1999
  • Conjuntos de caracteres gráficos codificados en un solo byte de 8 bits estándar ECMA-121 - Alfabeto latino/hebreo
  • Norma israelí SI1311:2002 archivada el 24/11/2005 en Wayback Machine (en hebreo).
  • Registros ISO-IR: