Una clasificación es una relación entre un conjunto de elementos, a menudo registrados en una lista , de tal manera que, para cualesquiera dos elementos, el primero está "clasificado por encima", "clasificado por debajo" o "clasificado igual" al segundo. [ 1 ] En matemáticas , esto se conoce como orden débil o preorden total de objetos. No es necesariamente un orden total de objetos porque dos objetos diferentes pueden tener la misma clasificación. Las clasificaciones en sí mismas están totalmente ordenadas. Por ejemplo, los materiales están totalmente preordenados por dureza , mientras que los grados de dureza están totalmente ordenados. Si dos elementos tienen la misma clasificación, se considera un empate.
Al reducir las medidas detalladas a una secuencia de números ordinales , las clasificaciones permiten evaluar información compleja según ciertos criterios. Así, por ejemplo, un motor de búsqueda de Internet puede clasificar las páginas que encuentra según una estimación de su relevancia , lo que permite al usuario seleccionar rápidamente las páginas que probablemente desee ver.
El análisis de datos obtenidos mediante clasificación suele requerir estadísticas no paramétricas .
Estrategias para gestionar los lazos
No siempre es posible asignar clasificaciones de forma unívoca. Por ejemplo, en una carrera o competición, dos (o más) participantes podrían empatar en la clasificación. [ 2 ] Al calcular una medida ordinal , dos (o más) de las cantidades que se clasifican podrían tener el mismo valor. En estos casos, se puede adoptar una de las estrategias que se describen a continuación para asignar las clasificaciones.
Una forma abreviada común de distinguir estas estrategias de clasificación es mediante los números de clasificación que se producirían para cuatro elementos, con el primer elemento clasificado por delante del segundo y el tercero (que se comparan por igual) y ambos clasificados por delante del cuarto. [ 3 ] Estos nombres también se muestran a continuación.
Clasificación estándar de la competición (clasificación "1224")
En la clasificación de competencias, los elementos que se comparan de forma equivalente reciben el mismo número de clasificación, y luego se deja un espacio en los números de clasificación. El número de números de clasificación que quedan en este espacio es uno menos que el número de elementos que se compararon de forma equivalente. De forma equivalente, el número de clasificación de cada elemento es 1 más el número de elementos clasificados por encima de él. Esta estrategia de clasificación se adopta con frecuencia en competencias, ya que significa que si dos (o más) competidores empatan en una posición en la clasificación, la posición de todos los que se clasifican por debajo de ellos no se ve afectada (es decir, un competidor solo queda segundo si exactamente una persona obtiene una mejor puntuación que él, tercero si exactamente dos personas obtienen una mejor puntuación que él, cuarto si exactamente tres personas obtienen una mejor puntuación que él, etc.).
Por lo tanto, si A se clasifica por delante de B y C (que se comparan por igual) que están ambos clasificados por delante de D, entonces A obtiene la clasificación número 1 ("primero"), B obtiene la clasificación número 2 ("segundo compartido"), C también obtiene la clasificación número 2 ("segundo compartido") y D obtiene la clasificación número 4 ("cuarto").
Este método se denomina "Low" por IBM SPSS [ 4 ] y "min" por el lenguaje de programación R [ 5 ] en sus métodos para manejar empates.
Clasificación de la competencia modificada (clasificación "1334")
En ocasiones, la clasificación de la competición se realiza dejando espacios en blanco en los números de clasificación antes de los conjuntos de elementos con la misma clasificación (en lugar de después, como en la clasificación estándar). El número de números de clasificación que quedan en este espacio es uno menos que el número de elementos que obtuvieron la misma clasificación. De forma equivalente, el número de clasificación de cada elemento es igual al número de elementos clasificados igual o superior. Esta clasificación garantiza que un competidor solo quede en segundo lugar si obtiene una puntuación superior a la de todos sus oponentes excepto uno, en tercer lugar si obtiene una puntuación superior a la de todos sus oponentes excepto dos, etc.
Así, si A se sitúa por delante de B y C (que se comparan en igualdad de condiciones), y ambos se sitúan por delante de D, entonces A obtiene el puesto número 1 ("primero"), B el puesto número 3 ("tercero compartido"), C también el puesto número 3 ("tercero compartido") y D el puesto número 4 ("cuarto"). En este caso, nadie obtendría el puesto número 2 ("segundo"), quedando así un hueco.
Este método se llama "High" por IBM SPSS [ 4 ] y "max" por el lenguaje de programación R [ 5 ] en sus métodos para manejar empates.
Clasificación densa (clasificación "1223")
En la clasificación densa, los elementos que se comparan de forma similar reciben el mismo número de clasificación, y los siguientes elementos reciben el número de clasificación inmediatamente posterior. De forma equivalente, el número de clasificación de cada elemento es 1 más el número de elementos clasificados por encima de él que son distintos con respecto al orden de clasificación.
Por lo tanto, si A se clasifica por delante de B y C (que se comparan por igual) que están ambos clasificados por delante de D, entonces A obtiene la clasificación número 1 ("primero"), B obtiene la clasificación número 2 ("segundo compartido"), C también obtiene la clasificación número 2 ("segundo compartido") y D obtiene la clasificación número 3 ("tercero").
Este método se denomina "secuencial" por IBM SPSS [ 4 ] y "denso" por el lenguaje de programación R [ 6 ] en sus métodos para manejar empates.
Clasificación ordinal (clasificación "1234")
En la clasificación ordinal, todos los elementos reciben números ordinales distintos, incluso aquellos que se comparan como iguales. La asignación de números ordinales distintos a los elementos que se comparan como iguales puede hacerse de forma aleatoria o arbitraria, pero generalmente es preferible utilizar un sistema arbitrario pero consistente, ya que esto proporciona resultados estables si la clasificación se realiza varias veces. Un ejemplo de un sistema arbitrario pero consistente sería incorporar otros atributos al orden de clasificación (como el orden alfabético del nombre del competidor) para garantizar que no haya dos elementos que coincidan exactamente.
Con esta estrategia, si A se clasifica por delante de B y C (que se comparan por igual) que están ambos clasificados por delante de D, entonces A obtiene la clasificación número 1 ("primero") y D obtiene la clasificación número 4 ("cuarto"), y o B obtiene la clasificación número 2 ("segundo") y C obtiene la clasificación número 3 ("tercero") o C obtiene la clasificación número 2 ("segundo") y B obtiene la clasificación número 3 ("tercero").
En el procesamiento de datos informáticos, la clasificación ordinal también se conoce como "numeración de filas".
Este método corresponde a los métodos "first", "last" y "random" del lenguaje de programación R [ 5 ] para manejar empates.
Clasificación fraccionaria (clasificación "1 2.5 2.5 4")
Los elementos que se comparan de forma equivalente reciben el mismo número de clasificación, que es la media de los que tendrían en una clasificación ordinal; es decir, el número de clasificación de 1 más el número de elementos clasificados por encima de él más la mitad del número de elementos iguales. Esta estrategia tiene la propiedad de que la suma de los números de clasificación es la misma que en una clasificación ordinal. Por este motivo, se utiliza para calcular los recuentos de Borda y en pruebas estadísticas (véase más adelante).
Por lo tanto, si A se clasifica por delante de B y C (que se comparan por igual) que están ambos clasificados por delante de D, entonces A obtiene la clasificación número 1 ("primero"), B y C obtienen cada uno la clasificación número 2.5 (promedio de "segundo/tercero compartido") y D obtiene la clasificación número 4 ("cuarto").
Aquí hay un ejemplo: Supongamos que tiene el conjunto de datos 1.0, 1.0, 2.0, 3.0, 3.0, 4.0, 5.0, 5.0, 5.0.
Los rangos ordinales son 1, 2, 3, 4, 5, 6, 7, 8, 9.
Para v = 1,0, el rango fraccional es el promedio de los rangos ordinales: (1 + 2) / 2 = 1,5. De manera similar, para v = 5,0, el rango fraccional es (7 + 8 + 9) / 3 = 8,0.
Por lo tanto, los rangos fraccionarios son: 1.5, 1.5, 3.0, 4.5, 4.5, 6.0, 8.0, 8.0, 8.0
Este método se denomina "Media" por IBM SPSS [ 4 ] y "promedio" por el lenguaje de programación R [ 5 ] en sus métodos para manejar empates.
Estadística
En estadística , la clasificación es la transformación de datos en la que los valores numéricos u ordinales se reemplazan por su rango cuando los datos se ordenan.
Por ejemplo, las posiciones de los datos numéricos 3.4, 5.1, 2.6, 7.3 son 2, 3, 1, 4.
Como otro ejemplo, los datos ordinales caliente, frío, tibio se reemplazarían por 3, 1, 2. En estos ejemplos, los rangos se asignan a los valores en orden ascendente, aunque también se pueden usar rangos descendentes.
Las clasificaciones están relacionadas con la lista indexada de estadísticas de orden , que consiste en el conjunto de datos original reordenado en orden ascendente.
Deportes

En el ámbito deportivo , las clasificaciones o tablas de liga agrupan a los equipos de una liga, conferencia o división en particular, según su desempeño en una temporada específica de una liga o competición. Estas listas suelen publicarse en periódicos y otros medios de comunicación, así como en los sitios web oficiales de las ligas y competiciones deportivas.
Educación
Las tablas de clasificación se utilizan para comparar los logros académicos de diferentes instituciones. Las clasificaciones de colegios y universidades ordenan a las instituciones de educación superior según combinaciones de factores. Además de las instituciones completas, se clasifican programas, departamentos y escuelas específicos. Estas clasificaciones suelen ser realizadas por revistas, periódicos, gobiernos y académicos. Por ejemplo, las tablas de clasificación de las universidades británicas son publicadas anualmente por The Independent , The Sunday Times y The Times . [ 7 ] El objetivo principal de estas clasificaciones es informar a los posibles solicitantes sobre las universidades británicas basándose en una variedad de criterios. De manera similar, en países como India, se están desarrollando tablas de clasificación y una revista popular, Education World, las publicó basándose en datos de TheLearningPoint.net .
Se critica que la clasificación de las escuelas de Inglaterra según criterios rígidos que no tienen en cuenta las condiciones sociales más amplias empeora aún más la situación de las escuelas con bajo rendimiento. Esto se debe a que los padres más implicados evitan dichas escuelas, dejando solo a los hijos de padres con pocas aspiraciones. [ 8 ]
Negocio
En el ámbito empresarial, las tablas de clasificación enumeran a los líderes de la actividad comercial dentro de una industria específica, clasificando a las empresas en función de diferentes criterios, incluidos los ingresos, las ganancias y otros indicadores clave de rendimiento relevantes (como la cuota de mercado y la satisfacción de las expectativas del cliente), lo que permite analizar rápidamente datos significativos. [ 9 ]
Aplicaciones
La metodología de clasificación basada en índices específicos es uno de los sistemas más comunes utilizados por los responsables políticos y las organizaciones internacionales para evaluar el contexto socioeconómico de los países. Algunos ejemplos notables incluyen el Índice de Desarrollo Humano (Naciones Unidas), el Índice Doing Business ( Banco Mundial ), el Índice de Percepción de la Corrupción (Transparencia Internacional) y el Índice de Libertad Económica (Fundación Heritage). Por ejemplo, el Indicador Doing Business del Banco Mundial mide las regulaciones empresariales y su aplicación en 190 países. Los países se clasifican según diez indicadores que se sintetizan para producir la clasificación final. Cada indicador se compone de subindicadores; por ejemplo, el Indicador de Registro de la Propiedad se compone de cuatro subindicadores que miden el tiempo, los procedimientos, los costos y la calidad del sistema de registro de tierras. Este tipo de clasificaciones se basan en criterios subjetivos para asignar la puntuación. En ocasiones, los parámetros adoptados pueden producir discrepancias con las observaciones empíricas, por lo que pueden surgir sesgos y paradojas potenciales de la aplicación de estos criterios. [ 10 ]
Otros ejemplos
- En política, las clasificaciones pueden centrarse en la comparación del desempeño económico, social, ambiental y de gobernanza de los países. Los propios políticos también han sido clasificados, según el alcance de sus actividades. [ 11 ]
- En lo que respecta a la solvencia crediticia , la prelación de un valor se refiere a la posición que ocuparía dicho valor en caso de liquidación de la empresa emisora, es decir, su antigüedad en la estructura de capital de la empresa . Por ejemplo, los bonos de capital son valores subordinados; en caso de liquidación, tendrían una prelación inferior a la de la deuda preferente. En otras palabras, los tenedores de deuda preferente recibirían el pago antes que los tenedores de deuda subordinada .
- Los motores de búsqueda clasifican las páginas web según su relevancia esperada para la consulta de un usuario mediante una combinación de métodos dependientes e independientes de la consulta. Los métodos independientes de la consulta intentan medir la importancia estimada de una página, independientemente de cualquier consideración sobre qué tan bien coincide con la consulta específica. La clasificación independiente de la consulta generalmente se basa en el análisis de enlaces; ejemplos incluyen el algoritmo HITS , PageRank y TrustRank . [ 12 ] Los métodos dependientes de la consulta intentan medir el grado en que una página coincide con una consulta específica, independientemente de la importancia de la página. La clasificación dependiente de la consulta generalmente se basa en heurísticas que consideran el número y las ubicaciones de coincidencias de las diversas palabras de la consulta en la propia página, en la URL o en cualquier texto de anclaje que haga referencia a la página.
- En webometría , es posible clasificar las instituciones según su presencia en la web (número de páginas web) y el impacto de estos contenidos, como por ejemplo el Ranking Webométrico de Universidades del Mundo .
- En los videojuegos , a los jugadores se les puede asignar una clasificación. Subir de rango significa alcanzar una posición más alta en relación con otros jugadores, especialmente con estrategias que no dependen de la habilidad del jugador.
- El sistema de clasificación TrueSkill es un sistema de clasificación basado en habilidades para Xbox Live, desarrollado en Microsoft Research.
- Un bibliograma clasifica las frases nominales más comunes en un texto.
- En el lenguaje, el estatus de un elemento (generalmente a través de lo que se conoce como "descenso de rango" o "cambio de rango") en relación con el rango más alto en una cláusula; por ejemplo, en la oración "Quiero comer el pastel que hiciste hoy", "comer" está en el rango más alto, pero "hiciste" está en un rango inferior como parte del grupo nominal "el pastel que hiciste hoy"; este grupo nominal se comporta como si fuera un solo sustantivo (es decir, quiero comerlo ) , y por lo tanto el verbo dentro de él ("hiciste") tiene un rango diferente al de "comer".
- Las revistas académicas a veces se clasifican según su factor de impacto ; es decir, el número de artículos posteriores que citan artículos de una revista determinada.
Véase también
Referencias
- ↑ "Definición de CLASIFICACIÓN" .
- ↑ Sulich, Adam. "El mercado laboral de los jóvenes y la crisis de integración en la Unión Europea" . Consultado el 4 de marzo de 2017 .
- ↑ "The Data School - Cómo clasificar por grupo en Alteryx - Parte 1 - Competición estándar, densa, clasificación ordinal" . www.thedataschool.co.uk . Consultado el 23 de julio de 2023 .
- 1 2 3 4 "Casos de clasificación: Empates" . www.ibm.com . Consultado el 23 de julio de 2023 .
- 1 2 3 4 "función rank - RDocumentation" . www.rdocumentation.org . Consultado el 23 de julio de 2023 .
- ↑ "R: Clasificación rápida de muestras" . search.r-project.org . Consultado el 23 de julio de 2023 .
- ↑ "Clasificación de universidades en el Reino Unido" , Wikipedia , 5 de junio de 2024 , consultado el 15 de junio de 2024.
- ↑ Chris Roberts, Heavy Words Lightly Thrown: The Reason Behind Rhyme, Thorndike Press, 2006 ( ISBN) 0-7862-8517-6)
- ↑ Clasificación empresarial anual . Gale Research International, Limited. Octubre de 2000. pág. 740. ISBN 9780787640255.
- ↑ RIEDS, Revista Italiana de Economía, Demografía y Estadística (2014). "Proyecto Doing Business del Banco Mundial y los métodos estadísticos basados en rangos: la paradoja del indicador temporal" . Rieds - Rivista Italiana di Economia, Demografia e Statistica - Revista Italiana de Estudios Económicos, Demográficos y Estadísticos . 68 (1): 79–86 .
- ↑ Tofallis, Chris (2022). "Clasificación multidimensional de los miembros del Parlamento" (PDF) . Radical Statistics (133): 3–29 .
- ↑ Brin, Sergey; Page, Lawrence. "La anatomía de un motor de búsqueda web hipertextual a gran escala" (PDF) . Stanford InfoLab .
Enlaces externos
- RANKNUM, una función de Matlab para calcular los cinco tipos de rangos.
- Caja de herramientas de Matlab con funciones para calcular rangos
- Sistema de clasificación TrueSkill
- Biblioteca de clasificación escrita en Ruby
- Lista de índices y clasificaciones de desarrollo global
- estadística no paramétrica
- Clasificaciones
- Comparación (matemática)