
ArmSCII o ARMSCII es un conjunto de codificaciones de caracteres de un solo byte obsoletas para el alfabeto armenio, definidas por la norma nacional armenia 166-9. ArmSCII es un acrónimo de Código Estándar Armenio para el Intercambio de Información, similar a ASCII para el estándar estadounidense. Ha sido reemplazado por el estándar Unicode .
Sin embargo, estas codificaciones no se utilizan ampliamente porque el estándar se publicó un año después de la publicación del estándar internacional ISO 10585 , que definía otra codificación de 7 bits, de la cual también se derivaron, unos años después, la codificación y la asignación a los estándares UCS (Conjunto de caracteres codificados universales ( ISO/IEC 10646 ) y Unicode ), y hubo una falta de apoyo en la industria informática para agregar ArmSCII.
Codificaciones definidas en el estándar ArmSCII
Muy pocos sistemas admiten estas codificaciones. Microsoft Windows , por ejemplo, no las admite. Generalmente es mejor usar Unicode para un intercambio adecuado de texto armenio en navegadores web y correo electrónico , ya que la mayoría de los ordenadores modernos no admiten ArmSCII de forma predeterminada.
Se definen las siguientes tres variantes principales:
- ArmSCII-7, definido en AST 34.005, es una codificación de 7 bits que no contiene caracteres latinos.
- ArmSCII-8 , definido en AST 34.002, es una codificación de 8 bits y un superconjunto de ASCII .
- ArmSCII-8A, definido en AST 34.002, es una codificación alternativa de 8 bits y también un superconjunto de ASCII.
Tenga en cuenta que cada codificación ArmSCII también tiene varias variantes menores, dependiendo de la revisión del estándar armenio correspondiente (que no se oficializó antes de 1997 y se definió informalmente antes de eso; esto ha causado diversas confusiones y las asignaciones que se describen a continuación son solo las mejores prácticas según la última revisión de 1997 del estándar armenio); lo que puede cambiar la asignación exacta y el uso de algunos caracteres y símbolos de puntuación.
Ninguna de las codificaciones ArmSCII ha alcanzado la aprobación internacional (a diferencia del estándar ISO 10585, a pesar de las críticas enviadas por el organismo oficial de normalización armenio a ISO/DIS JTC 1/SC 2/WG 2, que trabaja en conjuntos de caracteres codificados en un solo byte) porque todos los esfuerzos internacionales se han centrado desde entonces en trabajar con el UCS (en Unicode e ISO 10646).
ArmSCII-8 está diseñado para su uso en sistemas Unix y Windows, así como para el intercambio de información en la WWW y por correo electrónico. Sin embargo, Microsoft deseaba que los usuarios utilizaran Unicode y no introdujeran una gran cantidad de nuevas páginas de códigos, por lo que no es compatible de forma nativa con Windows. Simplemente consiste en reasignar ArmSCII-7 a un rango superior al rango ASCII estándar de EE. UU.
ArmSCII-8A está diseñado para su uso en sistemas DOS y Mac. Se trata de una reorganización de ArmSCII-8 para funcionar con el código existente de DOS y Mac, que reserva un rango de valores de código para caracteres no destinados a texto, sino a la maquetación, mediante fuentes modificadas. Sin embargo, se considera una modificación de las páginas de códigos sobre las que se aplica, ya que ni DOS (ni Windows en las páginas de códigos de compatibilidad "OEM" utilizadas por la consola de solo texto) ni macOS han admitido esta codificación de forma nativa, especialmente en su sistema de archivos (aunque esto también se aplica al estándar ISO 10585, ahora obsoleto). No obstante, esta codificación no puede representar todos los caracteres de puntuación necesarios para el armenio, por lo que los caracteres faltantes deben aproximarse mediante la representación alternativa de la puntuación ASCII (algunas fuentes armenias pueden mostrar esta puntuación ASCII utilizando la representación prevista para los caracteres armenios que se les asignan mediante esta representación alternativa).
ArmSCII-7
En esta tabla, el valor de código 21 es el signo de la eternidad , que tiene, desde 2013, un punto designado en Unicode U+058E (SIGNO DE LA ETERNIDAD ARMÉNIA ORIENTADO A LA IZQUIERDA) y otro para su variante orientada a la derecha: U+058D (SIGNO DE LA ETERNIDAD ARMÉNIA ORIENTADO A LA DERECHA). [ 1 ] Algunas asignaciones afirman erróneamente que tiene un punto de código de U+0530.
El valor de código 20 es el carácter ESPACIO normal; los valores de código 00–1F y 7F no están asignados a caracteres por AST 34.005, aunque pueden ser los mismos que los caracteres de control ASCII que se encuentran en esas posiciones.
El valor de código 22 se utiliza para codificar la ligadura armenia ew (և). [ 2 ] En algunas variantes, codifica el signo de sección (§) en su lugar. Se recomienda encarecidamente codificar esta ligadura con el par de letras minúsculas armenias normales ech ( yech ) y yiwn ( vyun ), ya que varios programas o fuentes la renderizarán de manera diferente según la versión de ArmSCII-7 que estén asumiendo, por lo que es mejor dejar que el renderizador genere la ligadura.
En ocasiones, el código 7F puede utilizarse como sustituto del espacio de no separación.
Tenga en cuenta que los caracteres codificados con los valores de código 2D y 7E (guion y apóstrofo armenios) pueden no ser visibles con todas las fuentes que admiten el armenio.
Esta tabla simplemente se reasigna a códigos superiores mediante un simple desplazamiento en ArmSCII-8 (abajo).
ArmSCII-8
En esta tabla, el valor de código 20 está reservado para el carácter ESPACIO regular, el valor de código A0 está reservado para el espacio de no separación y el valor de código A1 está asignado al signo de eternidad, que tiene, desde 2013, un punto designado en Unicode U+58E (SIGNO DE ETERNIDAD ARMÉNIA ORIENTADO A LA IZQUIERDA) y otro para su variante orientada a la derecha: U+58D (SIGNO DE ETERNIDAD ARMÉNIA ORIENTADO A LA DERECHA). [ 1 ] Algunas asignaciones afirman erróneamente que tiene un punto de código de U+0530.
Los códigos 00–1F y 7F–9F no están asignados a caracteres por AST 34.002, aunque pueden ser los mismos que los caracteres de control ISO-8859-1 que se encuentran en esas posiciones.
El valor de código A2 se utiliza para codificar la ligadura armenia ew (և). [ 2 ] En algunas variantes, codifica el signo de sección (§) en su lugar. Algunas fuentes armenias muestran esta ligadura en la posición del símbolo de ampersand ASCII, pero se recomienda encarecidamente codificarla utilizando las dos letras minúsculas armenias estándar que la componen.
El código FF puede contener el apóstrofo modificador de minúscula armenia (aunque no tiene correspondencia en Unicode y se muestra aquí con el apóstrofo ASCII; para una correcta representación con fuentes Unicode, se sugiere usar el código FE con control de ligadura para cambiar su posición, ya que solo aparece después de una minúscula armenia). El apóstrofo armenio codificado en FE solo aparece después de una mayúscula armenia. Por lo tanto, la mayoría de las implementaciones no codifican nada en el código FF.
Este estándar es el único que distingue claramente los paréntesis armenios "reflejados", ya que se creó simplemente reasignando el estándar ArmSCII-7. Sin embargo, muchos documentos no consideran esta distinción como productiva, y la puntuación habitual de paréntesis basada en ASCII se utiliza con mayor frecuencia en lugar de los paréntesis reflejados basados en ArmSCII-7, simplemente porque los teclados y editores armenios que utilizan ArmSCII-8 generan los códigos ASCII más bajos (cuyo uso se invierte en armenio clásico). Además, la duplicación de la coma ASCII en el código AB también es resultado de la simple reasignación de ArmSCII-7, por lo que no hay diferencia con la coma ASCII que utilizan la mayoría de los documentos ArmSCII-8.
Tenga en cuenta que los caracteres codificados en los valores de código AD y FE (guion y apóstrofo armenios) pueden no ser visibles con todas las fuentes que admiten el armenio. FreeDOS llama a esta página de códigos 65506. [ 3 ]
ArmSCII-8A
En esta tabla, el valor de código 20 es el carácter ESPACIO regular, y el valor de código DC es el signo de eternidad, que tiene, desde 2013, un punto designado en Unicode U+58E (SIGNO DE ETERNIDAD ARMÉNIA ORIENTADO A LA IZQUIERDA) y otro para su variante orientada a la derecha: U+58D (SIGNO DE ETERNIDAD ARMÉNIA ORIENTADO A LA DERECHA). [ 1 ] Algunas asignaciones afirman erróneamente que tiene un punto de código de U+0530.
Los códigos 00–1F, 7F y B0–DB no están asignados a caracteres por AST 34.002, aunque pueden ser los mismos que los utilizados en una página de códigos 437 de DOS/OEM heredada (caracteres de dibujo de cajas) o Macintosh Roman.
Tenga en cuenta que los caracteres codificados en los valores de código DD y FE (guion y apóstrofo armenios) pueden no ser visibles con todas las fuentes que admiten armenio. FreeDOS llama a esta página de códigos 899 (probablemente un error, ya que IBM usa este número de página de códigos para una codificación diferente. [ 4 ]
Compatibilidad con la escritura armenia en otros estándares.
ISO 10585:1996
A modo de comparación, esta es la codificación de 7 bits de la norma internacional ISO/IEC 10585 que se utilizaba antes de la revisión en la norma armenia AST34.002:1997 (ArmSCII-8).
En esta norma (así como en ISO/IEC 10646 y Unicode), solo hay una letra modificadora de apóstrofo armenio codificada en 0x49, mientras que el armenio utiliza dos letras modificadoras de apóstrofo que se distinguen entre mayúsculas y minúsculas (U+055A representa el apóstrofo en mayúscula, pero no se considera de doble mayúscula en Unicode y en esta norma ISO 15985; el apóstrofo en minúscula está ausente, pero generalmente se representa mediante el apóstrofo ASCII U+0027 en los documentos Unicode).
También faltan el signo de puntuación de medio anillo izquierdo (una letra modificadora) y el símbolo de eternidad, y solo se codifica una comilla doble (U+2033) en el valor de código 7A en lugar de las comillas dobles en las tres variantes de ArmSCII.
Sin embargo, este estándar asigna el punto armenio (cuyo glifo se parece mucho a los dos puntos ASCII) al valor de código 4C y la marca de abreviatura armenia (que se parece mucho a un acento grave angular) al valor de código 4F, ambos ausentes en todas las tablas de códigos ArmSCII.
Tenga en cuenta que los caracteres codificados con los valores de código 49 y 4A (apóstrofo y guion armenios) pueden no ser visibles con todas las fuentes que admiten el armenio.
Página de códigos de Windows Paratype, reemplazada por ArmSCII-8 en 2005.
Esta codificación es compatible con FontLab Studio 5. [ 5 ] Esta codificación fue utilizada anteriormente por Paratype, pero fue reemplazada por ARMSCII-8. [ 6 ]
ISO/IEC 10646-1 y Unicode
A modo de comparación, aquí están las tablas de puntos de código Unicode para el armenio.
Su codificación desde Unicode 1.1 (excepto el guion armenio U+058A, el último carácter añadido desde Unicode 3.0) se basó en el estándar internacional de codificación ISO 10585 de 7 bits, en lugar de en ArmsCII, al que le faltaban una docena de caracteres presentes en ISO 10585. Sin embargo, los caracteres que no eran letras se reorganizaron por tipo y se añadieron algunas extensiones para caracteres armenios poco comunes que faltaban en todos los estándares anteriores de 7 y 8 bits.
Las letras mayúsculas se codifican en la primera mitad del bloque (terminada por letras modificadoras).
Las letras minúsculas están codificadas en la segunda mitad del bloque (que termina con signos de puntuación armenios).
A diferencia de las codificaciones ArmSCII, esta codificación es estable y portable entre sistemas, y contiene todos los caracteres necesarios para el armenio (con la excepción del símbolo de la eternidad armenio). Algunas fuentes codificadas en Unicode para el armenio asignan el símbolo de la eternidad al punto de código U+0530. Esto es incorrecto, ya que ese punto de código se asignó en 2013 en U+58E, y otro para su variante orientada hacia la derecha: U+58D. [ 1 ]
Sin embargo, no se mantiene ninguna distinción para los paréntesis armenios (reflejados), por lo que debe utilizarse la puntuación estándar ASCII/Unicode según su representación habitual. El signo de medio anillo izquierdo (letra modificadora) está codificado aquí, y otros signos se unifican con otros alfabetos (en particular, las comillas, el punto central y los guiones).
Tenga en cuenta que los caracteres codificados en los puntos de código U+055A y U+058A (apóstrofe y guion armenios, como en las tablas de ArmsCII e ISO 10585), así como U+0559 (la marca modificadora para numérico, añadida específicamente en ISO 10646-1 y Unicode), pueden no ser visibles con todas las fuentes que admiten el armenio.
Mapeo y clasificación de códigos
Tenga en cuenta que a continuación se muestran algunas transcodificaciones entre paréntesis. Se trata únicamente de aproximaciones y no corresponden exactamente al carácter deseado.
Véase también
- alfabeto armenio
- idioma armenio
- Romanización del armenio (incluida la norma ISO 9985 )
- Ortografía armenia clásica
- Ortografía armenia reformada
- Calendario armenio
- Categoría: Normas ISO (646, 9985, 10585 y 10646-1)
Referencias
- 1 2 3 4 "ISO/IEC 10646:2012/Amd.1: 2013 (E)" (PDF) . Archivado del original (PDF) el 22 de septiembre de 2013. Recuperado el 4 de enero de 2021 .
- ^ " 34.002—98 " (PDF) . Consultado el 18 de julio de 2010 .
- ↑ "Cpi/CPIWIN/Codepage.TXT en master · FDOS/Cpi" . GitHub .
- ↑ "CPIDOS/codepage.txt" . Repositorio FDOS/cpi . GitHub . Consultado el 16 de junio de 2026 .
- ↑ "FontLab Studio 5. Editor de fuentes clásico profesional para Mac y Windows" . www.fontlab.com . Consultado el 4 de enero de 2021 .
- ↑ "Windows Armenian (PT 171)" . Archivado del original el 31 de octubre de 2007.
Lecturas adicionales
- [ArmSCII] Código estándar armenio para el intercambio de información—Centro de Tecnologías Humanas "Computadora Armenia", junio de 1991.
- [AST 34.001-97] Tecnologías de la información: conjunto de caracteres y codificación de información: conjunto de caracteres - Comité Estatal de Normalización de la República de Armenia, julio de 1997.
- [ArmSCII Versión 2] Código estándar armenio para el intercambio de información, versión 2—Grupo de trabajo de ArmSCII, mayo de 1999.
- ArmSCII - Código estándar armenio para el intercambio de información, enero de 1998
- ARMSCII-7.TXT Código estándar armenio para el intercambio de información de 1999, codificación de 7 bits para transmisión (13/11/2000)
- ARMSCII-8.TXT Código estándar armenio para el intercambio de información de 1999, codificación de 8 bits para Windows y Unix. (13/11/2000)
- ARMSCII-8A.TXT Código estándar armenio para el intercambio de información de 1999, codificación alternativa de 8 bits para DOS y Macintosh. (13/11/2000)
- AST166-7.TXT Norma nacional armenia AST166.1997, codificación de 7 bits para transmisión. (Sustituida por ARMSCII-7)
- AST166-8.TXT Estándar nacional armenio AST166.1997, codificación de 8 bits para Windows y Unix. (Sustituido por ARMSCII-8)
- AST166-A.TXT Estándar nacional armenio AST166.1997, codificación "A" para DOS y MacOS. (Sustituido por ARMSCII-8A)
- Savard, John JG (2018) [2005]. "Aritmética computacional" . quadibloc . Los primeros días del sistema hexadecimal. Archivado del original el 16 de julio de 2018. Recuperado el 16 de julio de 2018 .(Nota: Contiene información sobre ARMSCII.)
- Conjuntos de caracteres
- Normas ISO
- Comunicaciones en Armenia