Articulo de referencia

fuente Unicode

Una fuente Unicode es una fuente de computadora que asigna glifos a puntos de código definidos en el estándar Unicode . [ 1 ] El término se ha vuelto arcaico porque la gran mayo...

Una fuente Unicode es una fuente de computadora que asigna glifos a puntos de código definidos en el estándar Unicode . [ 1 ] El término se ha vuelto arcaico porque la gran mayoría de las fuentes de computadora modernas usan asignaciones Unicode, incluso aquellas fuentes que solo incluyen glifos para un solo sistema de escritura , o incluso solo admiten el alfabeto latino básico . La distinción es histórica: antes de Unicode, cuando la mayoría de los sistemas informáticos usaban solo bytes de ocho bits , no se podían codificar más de 256 caracteres (o códigos de control). Esto significaba que cada repertorio de caracteres tenía que tener sus propias asignaciones de puntos de código , y por lo tanto un punto de código dado podía tener múltiples significados. Al asegurar asignaciones únicas, Unicode resolvió este problema. 

Las fuentes que admiten una amplia gama de alfabetos y símbolos Unicode se denominan a veces "fuentes pan-Unicode". Sin embargo, dado que el número máximo de glifos que se pueden definir en una fuente TrueType está limitado a 65 535, no es posible que una sola fuente TrueType proporcione glifos individuales para todos los caracteres Unicode definidos ( 159 801 caracteres, con Unicode 17.0 ). Este artículo enumera algunas fuentes Unicode de uso común (incluidas en sistemas operativos o producidas por empresas de fuentes comerciales reconocidas) que admiten una cantidad relativamente grande y una amplia gama de caracteres Unicode.

Fondo

El estándar Unicode no especifica ni crea ninguna fuente ( tipografía ), una colección de formas gráficas llamadas glifos. En cambio, define los caracteres abstractos como un número específico (conocido como punto de código ) y también define los cambios de forma necesarios según el contexto en el que se utilice el glifo (por ejemplo, caracteres combinados , caracteres precompuestos y combinaciones de letras y diacríticos ). La elección de la fuente, que determina cómo se convierten los caracteres abstractos del Conjunto Universal de Caracteres Codificados (UCS) en una salida de mapa de bits o vectorial que luego se puede visualizar en una pantalla o imprimir, queda a criterio del usuario. Si se elige una fuente que no contiene un glifo para un punto de código utilizado en el documento, normalmente muestra un signo de interrogación, un cuadrado u otro carácter sustituto .

Las fuentes de computadora utilizan diversas técnicas para mostrar caracteres o glifos. Una fuente de mapa de bits contiene una cuadrícula de puntos, conocidos como píxeles, que forman una imagen de cada glifo en cada estilo y tamaño. Las fuentes de contorno (también conocidas como fuentes vectoriales) utilizan instrucciones de dibujo o fórmulas matemáticas para describir cada glifo. Las fuentes de trazo utilizan una serie de líneas específicas (para el borde del glifo) e información adicional para definir el perfil , es decir, el tamaño y la forma de la línea en un estilo y tamaño específicos, que en conjunto describen la apariencia del glifo.

Las fuentes también incluyen reglas ortográficas especiales integradas para generar ciertas combinaciones de formas de letras (y símbolos alternativos para la misma letra) que se combinan en ligaduras especiales (caracteres mixtos). Los sistemas operativos , los navegadores web ( agentes de usuario ) y otros programas que utilizan tipografía de forma intensiva, emplean una fuente para mostrar texto en pantalla o en medios impresos, y pueden programarse para usar esas reglas integradas. Alternativamente, pueden usar tecnologías externas de modelado de escritura (tecnología de renderizado o motor de " fuente inteligente "), y también pueden programarse para usar una fuente Unicode grande o varias fuentes diferentes para distintos caracteres o idiomas.

Ninguna fuente Unicode incluye todos los caracteres definidos en la revisión actual del estándar ISO 10646 (Unicode), ya que se añaden continuamente más idiomas y caracteres, y los formatos de fuente comunes no pueden contener más de 65 535 glifos (aproximadamente la mitad de los caracteres codificados en Unicode). Por consiguiente, los desarrolladores y las fundiciones tipográficas incorporan los nuevos caracteres en versiones o revisiones más recientes de una fuente, o en fuentes auxiliares independientes destinadas específicamente a idiomas concretos.

UCS cuenta con más de 1,1 millones de puntos de código, pero solo los primeros 65.536 (el Plano 0: Plano Multilingüe Básico , o BMP) se habían generalizado antes del año 2000.

Consulte el artículo sobre los planos Unicode para obtener más información sobre otros planos, incluidos: Plano 1 : Plano Multilingüe Suplementario (SMP), Plano 2: Plano Ideográfico Suplementario (SIP), Plano 14: Plano Especial Suplementario (SSP), Planos 15 y 16: reservados para Áreas de Uso Privado (PUA).

Las primeras fuentes Unicode (con conjuntos de caracteres muy amplios y compatibles con muchos bloques Unicode ) fueron Lucida Sans Unicode (lanzada en marzo de 1993), la fuente Unihan (1993) y Everson Mono (1995).

Asuntos

Existen ambigüedades tipográficas en Unicode, de modo que algunos caracteres Han unificados (presentes en chino, japonés y coreano) presentan diferencias tipográficas en distintas regiones. Por ejemplo, el punto Unicode U+9AA8CJK UNIFIED IDEOGRAPH-9AA8 difiere tipográficamente entre el chino simplificado y el chino tradicional. Esto tiene implicaciones para la idea de que una sola tipografía pueda satisfacer las necesidades de todas las regiones. [ 2 ] El diseño de Unicode garantiza que tales diferencias no generen ambigüedad semántica, pero el uso de formas incorrectas suele considerarse visualmente incómodo o estéticamente inapropiado para los hablantes nativos de lenguas de Asia Oriental.

Aplicación de fuentes Unicode

Unicode es ahora el estándar de codificación para muchos estándares y protocolos nuevos, y está integrado en la arquitectura de sistemas operativos ( Microsoft Windows , Apple Mac OS y muchas versiones de Unix y Linux ), lenguajes de programación ( Ada , Perl , Python , Java , Common LISP , APL ) y bibliotecas (IBM International Components for Unicode (ICU), junto con los motores de renderizado Pango , Graphite , Scribe , Uniscribe y ATSUI ), formatos de fuente ( TrueType y OpenType ), etc. Muchos otros estándares también se están actualizando para ser compatibles con Unicode.

Software de utilidad

Aquí tienes una selección de algunos programas de utilidad que pueden identificar los caracteres presentes en un archivo de fuente:

Lista de fuentes Unicode

De las numerosas fuentes Unicode disponibles, las que se enumeran a continuación son las más utilizadas en todo el mundo en las plataformas informáticas más comunes .

Nota
^‡ OTF+TTO:OpenTypeconTrueType.
^‡ Las fuentes OpenType a veces no contienen una tabla de pares de caracteres individuales, sino una tabla de espaciado por clases, donde grupos de caracteres similares se consideran un solo grupo de espaciado. Por ejemplo,la Vyla Wtienen una geometría izquierda y derecha casi idéntica. Por lo tanto, "0" no significa que no se admita ningún espaciado.
^⸶ Regístrese después de un período "razonable" (palabras del autor).
^⸷ Incluye más de 27.000 caracteres Hanzi de la fuente WenQuanYi Bitmap Song.
^⸸ Han Nom A cubre principalmente los ideogramas CJK U Ext A, y Han Nom B cubre principalmente Ext B.
Sun-Ext A cubre 102 bloques de diferentes idiomas. Sun-ExtB cubre principalmente el suplemento CJK, los ideogramas CJK U Ext B, C, TaiXuan Jing.
Zen Hei, Zen Hei Mono y Zen Hei Sharp coexisten en un único archivo TTC; también con mapas de bits integrados. Latín/Hangul derivado de UnDotum, Bopomofo derivado de cwTeX, latín monoespaciado de M+ M2 Light. Cobertura completa de CJK. Incluido en Fedora Linux y Ubuntu Linux .

Comparación de fuentes tipográficas

A continuación se muestra el número de caracteres incluidos en la versión anterior de las fuentes , para diferentes bloques Unicode . Latín básico (128: 0000–007F ) significa que en el rango denominado «Latín básico» hay 128 códigos asignados, numerados del 0 al 7F . Las celdas muestran la cantidad de esos códigos que abarca cada fuente. Los bloques Unicode enumerados son válidos para la versión 8.0 de Unicode .

Las celdas sombreadas en verde indican una cobertura completa.
Las celdas sombreadas en azul no están completas, pero son las fuentes más completas de las que se muestran.
Las celdas vacías indican que no existe ningún carácter en ese bloque.

0000–077F

0780–139F

13A0–1DBF

1DC0–257F

2580–2DFF

2E00–4DBF

4DC0–FAFF

FB00–FFFF

Lista de fuentes Unicode SMP

10000–1F9FF

Los bloques Unicode enumerados son válidos para la versión 8.0 de Unicode .

Lista de fuentes Unicode SIP

20000–2FFFF

Los bloques Unicode enumerados son válidos para la versión 8.0 de Unicode .

Lista de fuentes Unicode SSP

E0000–EFFFF

Los bloques Unicode enumerados son válidos para la versión 8.0 de Unicode .

Véase también

Referencias

  1. "Fuentes y teclados" . Consorcio Unicode. 28 de junio de 2017. Archivado del original el 18 de octubre de 2019. Consultado el 13 de octubre de 2019 .
  2. Ken Lunde, Procesamiento de información CJKV , O'Reilly Inc, 1999. Página 128, "Diferencias en la forma de los caracteres CJKV"
  3. "Arial Unicode MS" . Microsoft . Archivado del original el 8 de enero de 2010. Consultado el 15 de enero de 2010 .
  4. "Explicación de las empresas de publicación STI" . Fuentes STIX. Archivado del original el 13 de abril de 2012. Consultado el 21 de agosto de 2012 .
  5. "Fuentes TrueType principales de Microsoft para la web" . Archivado del original el 1 de junio de 2015. Consultado el 21 de abril de 2010 .
  6. "Wen Quan Yi – Chino de código abierto: BitmapSong en" . Wenq.org. 14 de mayo de 2012. Consultado el 21 de agosto de 2012 .
  7. "Wen Quan Yi – Chino de código abierto: MicroHei(en)" . Wenq.org . Consultado el 21 de agosto de 2012 .
  8. ^ "Wen Quan Yi - Chino de código abierto: ZenHei (en)" . Wenq.org . Consultado el 21 de agosto de 2012 .
  9. "Primero STIX y ahora XITS | خالد حسني" . Khaledhosny.org. Archivado del original el 25-03-2012 . Consultado el 21-08-2012 .
  • ISO/IEC JTC1/SC2/WG2 , el grupo de trabajo encargado de la norma ISO 10646.
  • Fuentes y teclados en Unicode.org
  • Guía de fuentes Unicode para sistemas operativos de código abierto gratuitos : un enorme índice de fuentes gratuitas de alta calidad.
  • Recursos Unicode de Alan Wood: fuentes Unicode para ordenadores Windows — Índice de fuentes Unicode gratuitas y comerciales.
  • Conjuntos de caracteres – Ken Fowles, Microsoft, 1997. — Habilitar Unicode para aplicaciones.
  • Tipografía de Microsoft: Fuentes y productos : Guía de referencia para determinar qué fuentes se incluyen con los productos de Microsoft.