El Código de escritura tamil para el intercambio de información ( TSCII ) es un esquema de codificación para representar la escritura tamil . Los 128 puntos de código inferiores son ASCII simple , los 128 puntos de código superiores son específicos del TSCII. Después de muchos años de ser utilizado en Internet solo mediante acuerdos privados, fue registrado con éxito ante la IANA en 2007. [1]
TSCII codifica los caracteres en orden visual (escrito), en paralelo al uso de la máquina de escribir tamil. Unicode , en cambio, utiliza la estrategia de codificación de orden lógico para tamil, siguiendo el ISCII , en contraste con el caso del tailandés , donde se adoptó la codificación de orden visual adoptada por TIS-620 .
El gobierno de Tamil Nadu respalda sus propios estándares TAB/TAM para codificación de 8 bits y otros esquemas de codificación más antiguos aún pueden encontrarse en la web.
La colección de texto electrónico gratuito del Proyecto Madurai utiliza la codificación TSCII , pero ya ha comenzado a proporcionar versiones Unicode .
Historia
A mediados de los años 90, los miembros de varios foros basados en listas de correo sintieron la necesidad de una codificación común para el tamil, ya que en esos foros prevalecían múltiples fuentes codificadas a medida. Si bien algunas de las codificaciones comerciales eran más populares que otras, no fueron aceptadas por la comunidad en general debido a intereses comerciales conflictivos. Si bien Unicode fue aceptado por la mayoría como el estándar futuro, la mayoría de los sistemas de escritorio en ese momento aún no eran capaces de manejar Unicode para el idioma tamil, y se requirió una codificación provisoria de 8 bits.
En 1997 se creó una lista de correo independiente para la discusión de dichas codificaciones (webmasters@tamil.net) con el fin de iniciar esta discusión, comenzando con un correo electrónico escrito por el Dr. K. Kalyanasundaram al popular autor tamil Sujatha , quien encabezaba el comité para la estandarización del teclado tamil. [2] Este foro atrajo rápidamente a participantes entusiastas de todo el mundo, incluidos varios académicos tamiles destacados. [ Se discute la neutralidad ] Los archivos de estas discusiones son mantenidos por INFITT . [3]
Después de publicar TSCII, la mayoría de los miembros de la lista de correo webmasters@tamil.net pasaron a formar parte de INFITT, que es una iniciativa más amplia para lograr la estandarización y el desarrollo continuo en varias áreas de la informática tamil.
Disposición de la página de códigos
- ^ U+0BE6 DÍGITO CERO TAMIL, que se agregó con la versión 4.1 de Unicode en marzo de 2005
Herramientas de conversión
El texto codificado en UTF-8 se puede convertir a TSCII utilizando las herramientas GNU iconv de la siguiente manera:
$ iconv -f utf-8 -t tscii hola.utf8 > hola.tscii
Mientras que la conversión de TSCII a UTF-8 se realiza intercambiando los indicadores -f y -t .
Aplicación visual
Hay un proyecto de código abierto disponible en AnyTaFont2UTF8 y lo mantiene Isaiyini Tamil Community
Véase también
- TACE16 (codificación de todos los caracteres tamil)
Referencias
- ^ https://www.iana.org/assignments/charset-reg/TSCII [ URL simple del archivo de texto sin formato ]
- ^ "Una propuesta para un esquema de codificación de fuentes para tamil".
- ^ "Discusión en tamil en webmasters@tamil.net".
Enlaces externos
- Página de inicio de TSCII
- Nota técnica Unicode n.° 15 Conversión de texto de TSCII 1.7 a Unicode
- INFITT (Foro internacional sobre tecnología de la información en tamil)
- Conversión de TSCII a Unicode en línea y en páginas web
- Padma: extensión de Mozilla para transformar TSCII a Unicode