Las marcas direccionales implícitas son caracteres no imprimibles que se utilizan en la composición tipográfica computarizada de texto bidireccional . Unicode define tres de estos caracteres: la marca de izquierda a derecha , la marca de derecha a izquierda y la marca de letra árabe .
Unicode
En Unicode, las tres marcas son U+061C MARCA DE LETRA ÁRABE , U+200E MARCA DE IZQUIERDA A DERECHA ( & lrm; ) y U+200F MARCA DE DERECHA A IZQUIERDA ( & rlm; ) . Su uso se prescribe en el Algoritmo Bidireccional Unicode . [ 1 ]
Ejemplos
Marca de izquierda a derecha
Supongamos que el autor desea utilizar texto en inglés (un alfabeto de izquierda a derecha) dentro de un párrafo escrito en árabe o hebreo (un alfabeto de derecha a izquierda) con caracteres no alfabéticos a la derecha del texto en inglés. Por ejemplo, el autor quiere traducir «El lenguaje C++ es un lenguaje de programación utilizado…» al árabe. Sin un carácter de control LRM, el resultado se ve así:
Estoy usando C ++ para usar el software...Con un LRM introducido en el HTML después del ++, se ve así, como pretende el autor:
Para C ++ هي لغة برمجة تستخدم...En el primer ejemplo, sin el carácter de control LRM, el navegador web mostrará el símbolo ++ a la izquierda de la "C" porque reconoce que el párrafo se escribe de derecha a izquierda ( árabe ) y aplica la puntuación, que es neutra en cuanto a su dirección, según la dirección del texto adyacente. El carácter de control LRM hace que la puntuación se sitúe junto al texto que se escribe de izquierda a derecha (la "C" y el LRM) y se posicione como si estuviera en un texto que se escribe de izquierda a derecha, es decir, a la derecha del texto precedente.
Marca de derecha a izquierda
Supongamos, en cambio, que el escritor desea insertar un fragmento de texto en árabe o hebreo (es decir, de derecha a izquierda) en un párrafo en inglés, con un signo de exclamación al final del fragmento en el lado izquierdo. «Disfruté mucho mi estancia —¡de verdad!— en su casa». Con el «¡de verdad!» en hebreo , la oración se traduce como sigue:
Disfruté mucho mi estancia —¡en su casa ! —.(Tenga en cuenta que en la memoria de una computadora, el orden de los caracteres hebreos es ב, א, מ, ת. )
Si se añade un RLM después del signo de exclamación, se muestra de la siguiente manera:
Disfruté mucho mi estancia -- ¡ en su casa!
(Standards-compliant browsers will render the exclamation mark on the right in the first example, and on the left in the second.)
This happens because the browser recognizes that the paragraph is in a LTR script (Latin), and applies punctuation, which is neutral as to its direction, in coordination with the surrounding (left-to-right) text. The RLM causes the punctuation to be surrounded by only RTL text—the Hebrew and the RLM—and hence be positioned as if it were in right-to-left text, i.e., to the left of the preceding text.
Arabic Letter Mark
Similar to the right-to-left mark (RLM), it is used to change the way adjacent characters are grouped with respect to text direction, with some difference on how it affects the bidirectional level resolutions for nearby characters.
See also
References
- ↑UNICODE 12.0 Standard, http://www.unicode.org/versions/Unicode12.0.0/UnicodeStandard-12.0.pdf, p. 880
External links
- Proposal to encode the Arabic Letter Mark (ALM)
- Unicode standard annex #9: The bidirectional algorithm
- Unicode character (U+061C)
- Unicode character (U+200F)
- Unicode character (U+200E)
- Control characters
- Digital typography
- Unicode formatting code points