Articulo de referencia

Orden alfabético

Banderas de algunos países en el Palacio del Elíseo en París para una conferencia de paz sobre Libia, 2011. Las banderas nacionales (excepto las del país anfitrión, Francia, Eur...

Banderas de algunos países en el Palacio del Elíseo en París para una conferencia de paz sobre Libia, 2011. Las banderas nacionales (excepto las del país anfitrión, Francia, Europa a su izquierda y la ONU a su derecha, que están en el centro) están ordenadas alfabéticamente en francés: Allemagne , Belgique , Canada , Danemark , Émirats Arabes Unis , Espagne , États-Unis , Grèce , Irak , Italie , Jordanie , Maroc , Norvège , Pays-Bas , Pologne , Qatar , Royaume-Uni . La última, Ligue Arabe , está en una posición lateral porque no es un país.

El orden alfabético es un sistema mediante el cual las cadenas de caracteres se ordenan según la posición de los caracteres en un orden específico del alfabeto . Es uno de los métodos de intercalación . En matemáticas , el orden lexicográfico es la generalización del orden alfabético a otros tipos de datos, como secuencias de números u otros objetos matemáticos ordenados .

Cuando se aplica a cadenas o secuencias que pueden contener dígitos, números o tipos de elementos más elaborados, además de caracteres alfabéticos, el orden alfabético se denomina generalmente orden lexicográfico .

Para determinar cuál de dos cadenas de caracteres va primero al ordenarlas alfabéticamente, se comparan sus primeras letras . Si son diferentes, la cadena cuya primera letra aparece antes en el alfabeto va antes que la otra. Si las primeras letras son iguales, se comparan las segundas, y así sucesivamente. Si se llega a una posición donde una cadena ya no tiene letras para comparar, mientras que la otra sí, la cadena más corta se considera la primera en orden alfabético.

En general, las letras mayúsculas se consideran idénticas a sus correspondientes minúsculas a efectos de ordenación alfabética, aunque pueden adoptarse convenciones para situaciones en las que dos cadenas solo difieren en el uso de mayúsculas. También existen diversas convenciones para el manejo de cadenas que contienen espacios , letras modificadas, como las que tienen diacríticos , y caracteres que no son letras, como los signos de puntuación .

Al ordenar alfabéticamente un conjunto de palabras o cadenas de caracteres, se agrupan todas las cadenas que comienzan con la misma letra; dentro de cada grupo, se agrupan todas las palabras que comienzan con la misma secuencia de dos letras; y así sucesivamente. De esta manera, el sistema tiende a maximizar el número de letras iniciales comunes entre palabras adyacentes.

Historia

El orden de las letras del alfabeto está documentado desde el siglo XIV a. C. en la ciudad de Ugarit , en la costa norte de Siria . [ 1 ] Las tablillas encontradas allí contienen más de mil signos cuneiformes, pero estos signos no son babilónicos y solo hay treinta caracteres distintos. Aproximadamente doce de las tablillas tienen los signos dispuestos en orden alfabético. Se han encontrado dos órdenes, uno de los cuales es casi idéntico al orden utilizado para el hebreo , el griego y el latín , y un segundo orden muy similar al utilizado para el ge'ez . [ 2 ] 

Se desconoce cuántas letras tenía el alfabeto protosinaítico y cuál era su orden alfabético. Entre sus descendientes, el alfabeto ugarítico tenía 27 consonantes, los alfabetos del sur de Arabia 29 y el alfabeto fenicio 22. Estas escrituras se organizaban en dos órdenes: un orden ABGDE en el fenicio y un orden HLĦMQ en el sur; el ugarítico conservó ambos. Ambas secuencias demostraron ser notablemente estables entre los descendientes de estas escrituras.

Aplicado a las palabras, el orden alfabético se utilizó por primera vez en el primer milenio a. C. por escribas semíticos noroccidentales que empleaban el sistema abjad . [ 3 ] Sin embargo, durante siglos se prefirieron otros métodos de clasificación y ordenación de material, como el geográfico, el cronológico , el jerárquico y el por categorías , al orden alfabético. [ 4 ]

Algunos pasajes de la Biblia datan de los siglos VII-VI a. C. En el Libro de Jeremías , el profeta utiliza el cifrado de sustitución Atbash , basado en el orden alfabético. De manera similar, los autores bíblicos emplearon acrósticos basados ​​en el alfabeto hebreo (ordenado) . [ 5 ]

El primer uso efectivo del orden alfabético como dispositivo de catalogación entre los eruditos pudo haber ocurrido en la antigua Alejandría, [ 6 ] en la Gran Biblioteca de Alejandría , fundada alrededor del año 300 a. C. Se cree que el poeta y erudito Calímaco , quien trabajó allí, creó el primer catálogo de biblioteca del mundo , conocido como el Pinakes , con rollos ordenados alfabéticamente según la primera letra de los nombres de los autores. [ 4 ]

En el siglo I a. C., el escritor romano Varrón compiló listas alfabéticas de autores y títulos. [ 7 ] En el siglo II d. C., Sexto Pompeyo Festo escribió un epítome enciclopédico de las obras de Verrio Flaco , De verborum significatu , con entradas en orden alfabético. [ 8 ] En el siglo III d. C., Harpocración escribió un léxico homérico alfabético por todas las letras. [ 9 ]

El siglo X vio surgir importantes léxicos alfabéticos del griego (la Suda ), el árabe ( al-Mujmal fī al-Lugha de Ibn Faris ) y el hebreo bíblico ( Mahberet de Menahem ben Saruq ). El orden alfabético como ayuda para la consulta floreció en la Italia del siglo XI, que aportó obras sobre latín ( Elementarium de Papías ) y arameo talmúdico ( Arukh de Nathan ben Jehiel ). [ a ]

En la segunda mitad del siglo XII, los predicadores cristianos adoptaron herramientas alfabéticas para analizar el vocabulario bíblico . Esto llevó a la compilación de concordancias alfabéticas de la Biblia por los frailes dominicos de París en el siglo XIII, bajo la dirección de Hugo de Saint Cher . Obras de referencia más antiguas, como las Interpretaciones de los nombres hebreos de San Jerónimo , se ordenaron alfabéticamente para facilitar su consulta. El uso del orden alfabético fue inicialmente rechazado por los eruditos, quienes esperaban que sus estudiantes dominaran su área de estudio según sus propias estructuras racionales; su éxito se debió a herramientas como el índice de Robert Kilwardby a las obras de San Agustín , que ayudó a los lectores a acceder al texto original completo en lugar de depender de las compilaciones de extractos que se habían vuelto prominentes en la escolástica del siglo XII . La adopción del orden alfabético formó parte de la transición de la primacía de la memoria a la de las obras escritas. [ 10 ] La idea de ordenar la información según el orden alfabético también encontró resistencia entre los compiladores de enciclopedias de los siglos XII y XIII, quienes eran todos clérigos devotos. Preferían organizar su material teológicamente , en el orden de la creación de Dios, comenzando con Deus (que significa Dios). [ 4 ]

En 1604, Robert Cawdrey tuvo que explicar en Table Alphabeticall , el primer diccionario monolingüe de inglés : «Ahora bien, si la palabra que deseas encontrar comienza con (a), entonces busca al principio de esta tabla; pero si comienza con (v), busca hacia el final». [ 11 ] Aunque ya en 1803 Samuel Taylor Coleridge condenaba las enciclopedias con «una disposición determinada por el azar de las letras iniciales», [ 12 ] muchas listas se basan hoy en día en este principio.

Ordenación en escritura latina

Orden básico y ejemplos

El orden estándar del alfabeto latino básico ISO moderno es:

ABCDEFGHIJKLMNOPQRSTU-VWXYZ

A continuación se muestra un ejemplo de ordenación alfabética sencilla:

  • Como; Aster; Astrolabio; Astronomía; Astrofísica; En; Atamán; Ataque; Baa

Otro ejemplo:

  • Percebe; Ser; Haber; Beneficio; Inclinado

Las palabras anteriores están ordenadas alfabéticamente. As va antes que Aster porque empiezan con las mismas dos letras y As no tiene más letras después de eso, mientras que Aster sí. Las siguientes tres palabras van después de Aster porque su cuarta letra (la primera que difiere) es r , que va después de e (la cuarta letra de Aster ) en el alfabeto. Esas palabras a su vez están ordenadas según sus sextas letras ( l , n y p respectivamente). Luego viene At , que difiere de las palabras anteriores en la segunda letra ( t va después de s ). Ataman va después de At por la misma razón que Aster iba después de As . Attack sigue a Ataman según la comparación de sus terceras letras, y Baa va después de todas las demás porque tiene una primera letra diferente.

Tratamiento de cadenas de varias palabras

Cuando algunas de las cadenas que se ordenan constan de más de una palabra, es decir, contienen espacios u otros separadores como guiones , se pueden adoptar dos enfoques básicos. En el primer enfoque, todas las cadenas se ordenan inicialmente según su primera palabra, como en la siguiente secuencia:

  • Roble; Colina de Roble; Cresta de Roble; Parque Oakley; Río Oakley
    donde todas las cadenas que comienzan con la palabra separada Oak preceden a todas las que comienzan con Oakley , porque Oak precede a Oakley en orden alfabético.

En el segundo enfoque, las cadenas se ordenan alfabéticamente como si no tuvieran espacios ni guiones, [ b ] dando como resultado la secuencia:

  • Roble; Colina de Roble; Parque Oakley; Río Oakley; Cresta de Roble
    donde Oak Ridge ahora viene después de las cuerdas de Oakley , como sucedería si estuviera escrito "Oakridge".

El segundo enfoque es el que se suele adoptar en los diccionarios, y por ello los editores suelen llamarlo orden de diccionario . [ c ] El primer enfoque se ha utilizado a menudo en los índices de libros , aunque cada editor tradicionalmente establecía sus propios estándares sobre qué enfoque utilizar; no existía una norma ISO para índices de libros ( ISO 999 ) antes de 1975.

Casos especiales

Letras modificadas

En francés, las letras modificadas (como las que llevan diacríticos ) se tratan igual que la letra base a efectos de ordenación alfabética. Por ejemplo, rôle se sitúa entre rock y rose , como si se escribiera role . Sin embargo, los idiomas que utilizan sistemáticamente estas letras suelen tener sus propias reglas de ordenación. Véase la sección «  Convenciones específicas de cada idioma» más adelante.

Ordenar por apellido

En la mayoría de las culturas donde los apellidos se escriben después de los nombres de pila , se sigue deseando ordenar las listas de nombres (como en las guías telefónicas) por apellido. En este caso, es necesario reordenar los nombres para que se ordenen correctamente. Por ejemplo, Juan Hernández y Brian O'Leary deberían ordenarse como "Hernandes, Juan" y "O'Leary, Brian", aunque no se escriban así. Capturar esta regla en un algoritmo de cotejo informático es complejo, y los intentos sencillos fracasarán. Por ejemplo, a menos que el algoritmo disponga de una lista extensa de apellidos, no hay forma de decidir si "Gillian Lucille van der Waal" es "van der Waal, Gillian Lucille", "Waal, Gillian Lucille van der" o incluso "Lucille van der Waal, Gillian".

La ordenación por apellido es frecuente en contextos académicos. En un mismo artículo con varios autores, ordenarlos alfabéticamente por apellido, en lugar de utilizar otros métodos como la antigüedad inversa o el grado subjetivo de contribución al artículo, se considera una forma de «reconocer contribuciones similares» o «evitar la discordia en grupos colaboradores». [ 13 ] Se ha observado que la práctica en ciertos campos de ordenar las citas en las bibliografías por el apellido de sus autores crea un sesgo a favor de los autores cuyos apellidos aparecen primero en el alfabeto, mientras que este efecto no se observa en campos donde las bibliografías se ordenan cronológicamente. [ 14 ]

El y otras palabras comunes

Si una frase comienza con una palabra muy común (como "the", "a" o "an", llamadas artículos en gramática), a veces se ignora o se coloca al final de la frase, pero no siempre es así. Por ejemplo, el libro " The Shining " podría tratarse como "Shining" o "Shining, The" y, por lo tanto, antes del título del libro " Summer of Sam ". Sin embargo, también podría tratarse simplemente como "The Shining" y después de "Summer of Sam". De manera similar, " A Wrinkle in Time " podría tratarse como "Wrinkle in Time", "Wrinkle in Time, A" o "A Wrinkle in Time". Los tres métodos de ordenación alfabética son bastante fáciles de crear mediante algoritmos, pero muchos programas se basan en un ordenamiento lexicográfico simple .

prefijos de Mac

Los prefijos M y Mc en los apellidos irlandeses y escoceses son abreviaturas de Mac y a veces se ordenan alfabéticamente como si la ortografía completa fuera Mac . Así, McKinley podría aparecer antes que Mackintosh (como ocurriría si se hubiera escrito "MacKinley"). Desde la llegada de las listas ordenadas por ordenador, este tipo de ordenación alfabética es menos frecuente, aunque todavía se utiliza en las guías telefónicas británicas.

prefijo St

El prefijo St o St. es una abreviatura de "Saint" (San) y tradicionalmente se ordena alfabéticamente como si se escribiera completo como Saint . Así, en un nomenclátor geográfico, St John's podría aparecer antes que Salem (como si se hubiera escrito "Saint John's"). Desde la llegada de las listas ordenadas por ordenador, este tipo de ordenación alfabética es menos frecuente, aunque todavía se utiliza ocasionalmente.

Ligaduras

Las ligaduras (dos o más letras fusionadas en un solo símbolo) que no se consideran letras distintas, como Æ y Œ en inglés, se suelen ordenar como si fueran independientes: «æther» y «aether» se ordenarían igual con respecto a las demás palabras. Esto se aplica incluso cuando la ligadura no es puramente estilística, como en los préstamos lingüísticos y las marcas comerciales.

Puede que sea necesario adoptar reglas especiales para clasificar cadenas que solo se diferencian por si dos letras están unidas por una ligadura.

Tratamiento de los numerales

Cuando algunas de las cadenas contienen números (u otros caracteres que no son letras), existen varios enfoques posibles. A veces, estos caracteres se tratan como si estuvieran antes o después de todas las letras del alfabeto. Otro método consiste en ordenar los números alfabéticamente como se escribirían: por ejemplo, 1776 se ordenaría como si se escribiera "diecisiete setenta y seis", y 24 heures du Mans como si se escribiera "vingt-quatre..." (veinticuatro en francés). Cuando los números u otros símbolos se utilizan como formas gráficas especiales de letras, como 1337 para leet o la película Seven (que se estilizó como Se7en ), pueden ordenarse como si fueran esas letras. El orden de clasificación natural ordena las cadenas alfabéticamente, excepto que los números de varias cifras se tratan como un solo carácter y se ordenan según el valor del número codificado por los dígitos.

En el caso de los monarcas y los papas , aunque sus números están en números romanos y se parecen a letras, normalmente se ordenan numéricamente: así, por ejemplo, aunque V viene después de I, el rey danés Christian IX viene después de su predecesor Christian VIII .

convenciones específicas de cada idioma

Las lenguas que utilizan un alfabeto latino extendido generalmente tienen sus propias convenciones para el tratamiento de las letras adicionales. Además, en algunas lenguas ciertos dígrafos se tratan como letras individuales para fines de cotejo. Por ejemplo, el alfabeto español trata la ñ como una letra básica que sigue a la n , y anteriormente trataba los dígrafos ch y ll como letras básicas que siguen a la c y la l , respectivamente. Ahora ch y ll se alfabetizan como combinaciones de dos letras. La nueva regla de alfabetización fue publicada por la Real Academia Española en 1994. Estos dígrafos todavía se designaban formalmente como letras, pero ya no lo son desde 2010. Por otro lado, el dígrafo rr sigue a rqu como se esperaba (y lo hacía incluso antes de la regla de alfabetización de 1994), mientras que las vocales con acento agudo ( á, é, í, ó, ú ) siempre se han ordenado en paralelo con sus letras base, al igual que la letra ü .

En algunos casos, como el árabe y el kiowa , el alfabeto ha sido completamente reordenado.

A continuación se enumeran las reglas de ordenación alfabética que se aplican en varios idiomas.

  • En árabe , existen dos órdenes principales del alfabeto de 28 letras que se utilizan actualmente. El estándar y más común es el orden hijāʾī , creado por el lingüista árabe Nasr ibn 'Asim al-Laythi , que se caracteriza por un método de ordenación visual donde las letras se ordenan según su forma. Por ejemplo, bāʾ (ب), tāʾ (ت) y thāʾ (ث) se agrupan porque tienen la misma forma base o rasm (ٮ) y se diferencian únicamente por la marcación consonántica conocida como iʻjām . El orden ʾabjadī original , que fonéticamente se asemeja al de otras lenguas semíticas y al latín, todavía se utiliza hoy en día, generalmente limitado a la ordenación de listas en un documento, de forma análoga a los números romanos . Cuando se utiliza el orden ʾabjadī para numerar, las letras se escriben de una forma modificada para distinguirlas de las letras utilizadas en palabras y de los números. Por ejemplo, ʾalif (ا), que se ve idéntico al número uno arábigo oriental (١), un pequeño bucle ovalado se extiende en el sentido de las agujas del reloj desde la parte inferior de la letra, seguido de una cola corta (𞺀). Aunque estos caracteres rara vez se usan digitalmente, están codificados en Unicode bajo Símbolos Alfabéticos Matemáticos Árabes . [ 15 ] Un orden menos común, el orden ṣawtī , se coteja fonéticamente y fue creado por al-Khalil ibn Ahmad al-Farahidi .
  • En azerbaiyano , hay ocho letras adicionales al alfabeto latino estándar. Cinco de ellas son vocales: i, ı, ö, ü, ə y tres son consonantes: ç, ş, ğ. El alfabeto es el mismo que el turco , con los mismos sonidos escritos con las mismas letras, excepto por tres letras adicionales: q, x y ə para sonidos que no existen en turco. Aunque todas las "letras turcas" se cotejan en su orden alfabético "normal" como en turco, las tres letras adicionales se cotejan arbitrariamente después de letras cuyos sonidos se aproximan a los suyos. Así, q se coteja justo después de k, x (que se pronuncia como una ch alemana) se coteja justo después de h y ə (que se pronuncia aproximadamente como una a corta inglesa ) se coteja justo después de e.
  • En bretón , no existen las letras "c", "q" ni "x", pero sí los dígrafos "ch" y "c'h", que se combinan entre "b" y "d". Por ejemplo: «  buzhugenn, chug, c'hoar, daeraouenn  » (lombriz, jugo, hermana, lágrima).
  • En checo y eslovaco , las vocales acentuadas tienen un peso de cotejo secundario: en comparación con otras letras, se tratan como sus formas sin acento (en checo, A-Á, E-É-Ě, I-Í, O-Ó, U-Ú-Ů, Y-Ý, y en eslovaco, A-Á-Ä, E-É, I-Í, O-Ó-Ô, U-Ú, Y-Ý), pero luego se ordenan después de las letras sin acento (por ejemplo, el orden lexicográfico correcto es baa, baá, báa, báá, bab, báb, bac, bác, bač, báč [en checo] y baa, baá, baä, báa, báá, báä, bäa, bäá, bää, bab, báb, bäb, bac, bác, bäc, bač, báč, bäč [en eslovaco]). Las consonantes acentuadas tienen peso de cotejo primario y se cotejan inmediatamente después de sus contrapartes no acentuadas, con excepción de Ď, Ň y Ť (en checo) y Ď, Ĺ, Ľ, Ň, Ŕ y Ť (en eslovaco), que nuevamente tienen peso secundario. CH se considera una letra separada y va entre H e I. En eslovaco, DZ y también se consideran letras separadas y se colocan entre Ď y E.
  • En los alfabetos danés y noruego , también están presentes las mismas vocales adicionales que en sueco (véase más abajo), pero en un orden diferente y con glifos distintos (..., X, Y, Z, Æ , Ø , Å ). Además, "Aa" se agrupa como equivalente a "Å". Tradicionalmente, el alfabeto danés ha considerado la "W" como una variante de la "V", pero hoy en día se la considera una letra independiente.
  • En neerlandés, la combinación IJ (que representa IJ ) se solía escribir como Y (o a veces como una letra separada: Y < IJ < Z), pero actualmente se escribe mayoritariamente como 2 letras (II < IJ < IK). Las excepciones son las guías telefónicas; IJ siempre se escribe como Y porque en muchos apellidos neerlandeses se usa Y donde la ortografía moderna requeriría IJ. Nótese que una palabra que empieza por ij y se escribe con I mayúscula también se escribe con J mayúscula, por ejemplo, la ciudad de IJmuiden , el río IJssel y el país de IJsland ( Islandia ).
  • En esperanto , las consonantes con acento circunflejo ( ĉ , ĝ , ĥ , ĵ , ŝ ), así como ŭ (u con breve ), se cuentan como letras separadas y se cotejan por separado (c, ĉ, d, e, f, g, ĝ, h, ĥ, i, j, ĵ ... s, ŝ, t, u, ŭ, v, z).
  • En estonio , õ , ä , ö y ü se consideran letras separadas y se colocan después de la w . Las letras š , z y ž aparecen solo en préstamos lingüísticos y nombres propios extranjeros y siguen a la letra s en el alfabeto estonio , que por lo demás no difiere del alfabeto latino básico.
  • El alfabeto feroés también incluye algunas letras adicionales del danés, noruego y sueco, concretamente Æ y Ø . Además, el alfabeto feroés utiliza la eth islandesa, que sigue a la D. Cinco de las seis vocales A , I , O , U e Y pueden llevar acento y, a partir de entonces, se consideran letras independientes. Las consonantes C , Q , X , W y Z no se encuentran. Por lo tanto, las primeras cinco letras son A , Á , B , D y Ð , y las últimas cinco son V , Y , Ý , Æ y Ø.
  • En filipino (tagalo) y otras lenguas filipinas, la letra Ng se trata como una letra independiente. Se pronuncia como en sing , ping-pong , etc. Por sí sola, se pronuncia nang , pero en la ortografía filipina general , se escribe como si fueran dos letras separadas (n y g). Además, los derivados de letras (como Ñ ) siguen inmediatamente a la letra base. El filipino también se escribe con diacríticos, pero su uso es muy raro (excepto la tilde ).
  • El alfabeto finlandés y sus reglas de intercalación son los mismos que los del sueco.
  • Para el francés , el último acento en una palabra dada determina el orden. [ 16 ] Por ejemplo, en francés, las siguientes cuatro palabras se ordenarían de esta manera: cote < côte < coté < côté. La letra e se ordena como e é è ê ë (œ considerada como oe), lo mismo para o como ô ö.
  • En alemán, las letras con diéresis ( Ä , Ö , Ü ) se tratan generalmente igual que sus versiones sin diéresis; ß siempre se ordena como ss. Esto hace que el orden alfabético sea Arbeit, Arg, Ärgerlich, Argument, Arm, Assistent, Aßlar, Assoziation. Para las guías telefónicas y listas de nombres similares, las diéresis se cotejan como las combinaciones de letras "ae", "oe", "ue" porque varios apellidos alemanes aparecen tanto con diéresis como en la forma sin diéresis con "e" (Müller/Mueller). Esto hace que el orden alfabético sea Udet, Übelacker, Uell, Ülle, Ueve, Üxküll, Uffenbach.
  • Las vocales húngaras tienen acentos, diéresis y acentos dobles, mientras que las consonantes se escriben con caracteres simples, dobles (dígrafos) o triples (trígrafos). En la cotejación, las vocales acentuadas son equivalentes a sus contrapartes no acentuadas y los caracteres dobles y triples siguen a sus originales simples. El orden alfabético húngaro es: A=Á, B, C, Cs, D, Dz, Dzs, E=É, F, G, Gy, H, I=Í, J, K, L, Ly, M, N, Ny, O=Ó, Ö=Ő, P, Q, R, S, Sz, T, Ty, U=Ú, Ü=Ű, V, W, X, Y, Z, Zs. (Antes de 1984, dz y dzs no se consideraban letras individuales para la intercalación, sino dos letras cada una, d+z y d+zs). Esto significa que, por ejemplo, nádcukor debe preceder a nádcsomó (aunque normalmente s precede a u ), ya que c precede a cs en la intercalación. La diferencia en la duración de la vocal solo debe tenerse en cuenta si las dos palabras son idénticas en lo demás (por ejemplo, egér, éger ). Los espacios y guiones dentro de las frases se ignoran en la intercalación. Ch también aparece como dígrafo en ciertas palabras, pero no se considera un grafema por derecho propio en términos de intercalación.
    Una característica particular de la cotejación húngara es que las formas contraídas de dígrafos y trígrafos dobles (como ggy de gy  +  gy o ddzs de dzs  +  dzs ) deben cotejarse como si estuvieran escritas completas (independientemente del hecho de la contracción y de los elementos de los dígrafos o trígrafos). Por ejemplo, kaszinó debe preceder a kassza (aunque el cuarto carácter z normalmente iría después de la s en el alfabeto), porque el cuarto "carácter" ( grafema ) de la palabra kassza se considera una segunda sz (descomponiendo ssz en sz  +  sz ), que sí sigue a la i (en kaszinó ).
  • En islandés , se añade Þ , y a la D le sigue Ð . Cada vocal (A, E, I, O, U, Y) va seguida de su correspondiente con acento agudo : Á, É, Í, Ó, Ú, Ý. No hay Z, por lo que el alfabeto termina en: ... X, Y, Ý, Þ , Æ , Ö.
    • Ambas letras también fueron utilizadas por los escribas anglosajones, quienes también usaban la letra rúnica Wynn para representar /w/.
    • Þ (llamada espina; þ minúscula) también es una letra rúnica.
    • Ð (llamada eth; minúscula ð) es la letra D con un trazo añadido.
  • El kiowa se ordena según principios fonéticos, como las escrituras bráhmicas , en lugar de seguir el orden histórico latino. Primero van las vocales, luego las consonantes oclusivas ordenadas desde la parte anterior a la posterior de la boca y desde el inicio de la sonoridad negativa a la positiva , y finalmente las africadas, fricativas, líquidas y nasales.
A, AU, E, I, O, U, B, F, P, V, D, J, T, TH, G, C, K, Q, CH, X, S, Z, L, Y, W, H, M, N
  • En lituano , específicamente las letras lituanas van después de sus originales latinas. Otro cambio es que la Y va justo antes de la J : ... G, H, I, Į, Y, J, K...
  • En el alfabeto maltés, los dígrafos GĦ e IE se tratan como letras individuales y se colocan después del primer carácter del par. Las letras con punto (Ċ Ġ Ż) se colocan antes de sus originales, mientras que Ħ se coloca después de H. Los acentos, apóstrofes y guiones se ignoran. Sin embargo, cuando dos palabras se ordenan de forma idéntica, estos diacríticos se tienen en cuenta, de modo que las letras acentuadas siguen a las no acentuadas.
  • En polaco , específicamente las letras polacas derivadas del alfabeto latino se cotejan según sus originales: A, Ą, B, C, Ć, D, E, Ę, ..., L, Ł, M, N, Ń, O, Ó, P, ..., S, Ś, T, ..., Z, Ź, Ż. Los dígrafos para fines de cotejo se tratan como si fueran dos letras separadas.
  • En el orden alfabético del pinyin , donde las palabras tienen las mismas letras básicas en pinyin y difieren solo en los diacríticos modificadores, la letra sin modificar va antes que la letra modificada. Por ejemplo, ⟨e⟩ va antes que ⟨ê⟩ (額 (è) antes que 欸 (ê̄)), y ⟨u⟩ va antes que ⟨ü⟩ (() antes que( ) y() antes que女 ( ) ). Los caracteres con las mismas letras pinyin (incluidas las letras modificadas ⟨ê⟩ y ⟨ü⟩ ) se organizan según sus tonos en el orden de "primer tono (es decir, "tono plano"), segundo tono (tono ascendente), tercer tono (tono descendente-ascendente), cuarto tono (tono descendente), quinto tono (tono neutro)", por ejemplo "媽 ( ) ,( ), 馬 ( ), 罵 ( ), 嗎 ( ma )". [ d ]
  • En portugués , el orden de clasificación es igual que en inglés: A, B, C, D, E, F, G, H, I, J, K, L, M, N, O, P, Q, R, S, T, U, V, W, X, Y, Z. Los dígrafos y las letras con diacríticos no se incluyen en el alfabeto.
  • En rumano , los caracteres especiales derivados del alfabeto latino se cotejan según sus originales: A, Ă, Â, ..., I, Î, ..., S, Ș, T, Ț, ..., Z.
  • En serbocroata y otras lenguas eslavas meridionales relacionadas, los cinco caracteres acentuados y los tres caracteres unidos se ordenan según los originales: ..., C, Č, Ć, D, DŽ, Đ, E, ..., L, LJ, M, N, NJ, O, ..., S, Š, T, ..., Z, Ž.
  • Español trataba (hasta 1994) "CH" y "LL" como letras individuales, dando un orden de cinco , credo , chispa y lomo , luz , llama . Esto ya no es cierto desde que en 1994 la RAE adoptó el uso más convencional, y ahora LL se coteja entre LK y LM, y CH entre CG y CI. Los seis caracteres con diacríticos Á, É, Í, Ó, Ú, Ü se tratan como las letras originales A, E, I, O, U, por ejemplo: radio , ráfaga , rana , rápido , rastrillo . La única cuestión de cotejo específica del español es Ñ ( eñe ) como una letra diferente cotejada después de N.
  • En el alfabeto sueco , hay tres vocales adicionales colocadas al final (..., X, Y, Z, Å , Ä , Ö ), similar a los alfabetos danés y noruego, pero con glifos diferentes y un orden de intercalación distinto. La letra "W" se ha tratado como una variante de la "V", pero en la 13.ª edición de Svenska Akademiens ordlista (2006) la "W" se consideró una letra independiente.
  • En el alfabeto turco hay seis letras adicionales: ç, ğ, ı, ö, ş y ü (pero no q, w ni x). Se colocan con ç después de c, ğ después de g, ı antes de i, ö después de o, ş después de s y ü después de u. Originalmente, cuando se introdujo el alfabeto en 1928, ı se colocaba después de i, pero el orden se cambió posteriormente para que las letras con formas que contienen puntos, cedillas u otros adornos siempre sigan a las letras con formas sin puntos correspondientes. Nótese que en la ortografía turca la letra I es la mayúscula de ı sin punto, mientras que İ es la mayúscula de i con punto.
  • En muchas lenguas túrquicas (como el azerí o la ortografía Jaꞑalif del tártaro ), existía la letra Gha (Ƣƣ), que se ubicaba entre la G y la H. Actualmente está en desuso.
  • En vietnamita , hay siete letras adicionales: ă , â , đ , ê , ô , ơ , ư, mientras que f , j , w , z están ausentes, aunque todavía se usan en algunos casos (como en direcciones de Internet o préstamos lingüísticos). La "f" se reemplaza por la combinación "ph". Lo mismo ocurre con la "w", que se reemplaza por "qu".
  • En Volapük , ä , ö y ü se cuentan como letras separadas y se cotejan por separado (a, ä, b ... o, ö, p ... u, ü, v), mientras que q y w están ausentes. [ 17 ]
  • En galés, los dígrafos CH, DD, FF, NG, LL, PH, RH y TH se tratan como letras individuales, y cada una se enumera después del primer carácter del par (excepto NG, que se enumera después de G), produciendo el orden A, B, C, CH, D, DD, E, F, FF, G, NG, H, y así sucesivamente. Sin embargo, a veces puede ocurrir que la composición de palabras dé como resultado la yuxtaposición de dos letras que no forman un dígrafo. Un ejemplo es la palabra LLONGYFARCH (compuesta por LLON + GYFARCH). Esto da como resultado un orden como, por ejemplo, LAWR, LWCUS, LLONG, LLOM, LLONGYFARCH (NG es un dígrafo en LLONG, pero no en LLONGYFARCH). La combinación de letras R+H (a diferencia del dígrafo RH) puede surgir de manera similar por yuxtaposición en palabras compuestas, aunque esto no suele producir pares en los que una identificación errónea pueda afectar el orden. Para las demás combinaciones de letras que pueden generar confusión, como D+D y L+L, se utiliza un guion en la ortografía (por ejemplo, AD-DAL, CHWIL-LYS).

Automatización

Los algoritmos de intercalación (en combinación con algoritmos de ordenación ) se utilizan en programación informática para ordenar cadenas alfabéticamente. Un ejemplo estándar es el algoritmo de intercalación Unicode , que se puede utilizar para ordenar alfabéticamente (o una extensión de este) las cadenas que contienen cualquier símbolo Unicode . [ 16 ] Se puede adaptar a la mayoría de las convenciones específicas de cada idioma descritas anteriormente modificando su tabla de intercalación predeterminada. Varias de estas adaptaciones se encuentran recopiladas en el Repositorio de Datos de Localización Común .

Pedidos similares

El principio que rige el orden alfabético aún puede aplicarse en lenguas que, estrictamente hablando, no utilizan un alfabeto —por ejemplo, pueden escribirse utilizando un silabario o un abugida— siempre que los símbolos utilizados tengan un orden establecido.

En los sistemas de escritura logográficos , como los caracteres chinos hanzi o los japoneses kanji , el método de clasificación por radicales y trazos se utiliza con frecuencia para definir un orden en los símbolos. El japonés a veces utiliza el orden de pronunciación, generalmente el orden Gojūon , pero también el antiguo orden Iroha .

En matemáticas, el orden lexicográfico es un medio para ordenar secuencias de manera análoga a la que se utiliza para producir el orden alfabético. [ 18 ]

Algunas aplicaciones informáticas utilizan una versión del orden alfabético que se puede lograr mediante un algoritmo muy simple , basado únicamente en los códigos ASCII o Unicode de los caracteres. Esto puede tener efectos no estándar, como colocar todas las letras mayúsculas antes que las minúsculas. Véase Orden alfabético ASCII .

Un diccionario de rimas se basa en ordenar las palabras alfabéticamente, comenzando por la última letra de la palabra y terminando con la primera.

Véase también

Notas

  1. El Arukh de Nathanpuede que no haya sido el primer diccionario talmúdico alfabético, pero alcanzó una popularidad sin precedentes y sigue utilizándose hoy en día. Un posible antecedente es el Alfa-Beta perdido de Machir ben Yehuda .
  2. En el caso de MS Explorer, el espacio, el apóstrofo (U+0027) y todos los caracteres similares a guiones (U+002D y U+2010 a U+2014, ambos inclusive) se omiten de la clave de ordenación principal.
  3. Por ejemplo, el Harrap's Shorter Dictionnaire Anglais-Français/ Français-Anglais , ISBN 0-245-60660-2, página 640, tiene el orden oil, oil-bearing, oilcan, hulecloth, oil-cooled, oiled […] oiliness, oil lamp, oil paint, oil painting, oilpaper .
  4. Hay una excepción: en el diccionario chino-inglés ABC, el orden de los tonos es "tono cero (tono neutro), primer tono (tono plano), segundo tono (tono ascendente), tercer tono (tono descendente-ascendente) y cuarto tono (tono descendente)".

Referencias

  1. Robinson, Andrew (2007) [1995]. La historia de la escritura (2.ª  ed.). Londres: Thames & Hudson. pág.  162. ISBN 978-0-500-28660-9.
  2. Millard, AR (1986). "La infancia del alfabeto". World Archaeology . 17 (3): 390– 398. doi : 10.1080/00438243.1986.9979978 . JSTOR 124703 . 
  3. Reinhard G. Lehmann: "27-30-22-26. ¿Cuántas letras necesita un alfabeto? El caso del semítico", en: La idea de la escritura: escribir a través de las fronteras , editado por Alex de Voogt y Joachim Friedrich Quack, Leiden: Brill 2012, pp. 11–52.
  4. 1 2 3 Street, Julie (10 de junio de 2020). "De la A a la Z: la sorprendente historia del orden alfabético" (texto y audio) . ABC News (ABC Radio National) . Australian Broadcasting Corporation. Archivado del original el 2 de julio de 2020. Recuperado el 6 de julio de 2020 .
  5. Por ejemplo, los Salmos 25, 34, 37, 111, 112, 119 y 145 de la Biblia Hebrea.
  6. Daly, Lloyd. Contribuciones a la historia de la alfabetización en la Antigüedad y la Edad Media . Bruselas, 1967. pág. 25.
  7. ^ O'Hara, James (1989). "Messapus, Cycnus y el orden alfabético del catálogo de héroes italianos de Virgilio". Fénix . 43 (1): 35– 38. doi : 10.2307/1088539 . JSTOR 1088539 . 
  8. LIVRE XI – texte latin – traduction + commentaires . Archivado del original el 9 de junio de 2012. Consultado el 8 de mayo de 2012 .
  9. Gibson, Craig (2002). Interpretando un clásico: Demóstenes y sus antiguos comentaristas .
  10. Rouse, Mary A.; Rouse, Richard M. (1991), " Statim invenire : Escuelas, predicadores y nuevas actitudes hacia la página", Authentic Witnesses: Approaches to Medieval Texts and Manuscripts , University of Notre Dame Press, pp. 201–219 , ISBN  0-268-00622-9
  11. Cawdrey, Robert (1604). Una tabla alfabética . Londres. pág. [A4]v. 
  12. Cartas de Coleridge, n.º 507. Archivado del original el 13 de julio de 2011.
  13. Tscharntke, Teja; Hochberg, Michael E; Rand, Tatyana A; Resh, Vincent H; Krauss, Jochen (enero de 2007). " Secuencia de autores y reconocimiento de contribuciones en publicaciones con múltiples autores" . PLOS Biol . 5 (1): e18. doi : 10.1371/journal.pbio.0050018 . PMC 1769438. PMID 17227141 .  
  14. Stevens, Jeffrey R.; Duque, Juan F. (2018). "El orden importa: la alfabetización de las citas en el texto influye en las tasas de citación" ( PDF) . Psychonomic Bulletin & Review . 26 (3): 1020– 1026. doi : 10.3758/s13423-018-1532-8 . PMID 30288671. S2CID 52922399. Archivado (PDF) del original el 10 de noviembre de 2018. Recuperado el 10 de noviembre de 2018 .  
    • Resumen divulgativo en: Colleen Flaherty (22 de octubre de 2018). "Argumentos en contra de la nomenclatura alfabética de los autores" . Inside Higher Ed .
  15. "Símbolos alfabéticos matemáticos árabes" (PDF) . El estándar Unicode. Archivado (PDF) del original el 30 de octubre de 2022. Recuperado el 26 de noviembre de 2022 .
  16. 1 2 "Estándar técnico Unicode n.° 10: algoritmo de intercalación Unicode" . Unicode, Inc. (unicode.org). 20 de marzo de 2008. Archivado del original el 27 de agosto de 2008. Recuperado el 27 de agosto de 2008 .
  17. Midgley, Ralph. "Diccionario Volapük-Inglés" (PDF) . Archivado del original (PDF) el 1 de septiembre de 2012. Consultado el 24 de septiembre de 2019 .
  18. Franz Baader; Tobias Nipkow (1999). Term Rewriting and All That . Cambridge University Press. págs. 18–19 . ISBN  978-0-521-77920-3.

Lecturas adicionales

  • Chauvin, Yvonne. Práctica de clasificación alfabética . 4ª edición. París: Bordas, 1977. ISBN 2-04-010155-1
  • Flanders, Judith . Un lugar para todo: La curiosa historia del orden alfabético . Nueva York: Basic Books / Hatchette Books, 2020. ISBN 978-1-5416-7507-0