El análisis factorial es un método estadístico que se utiliza para describir la variabilidad entre variables observadas y correlacionadas en términos de un número potencialmente menor de variables no observadas llamadas factores . Por ejemplo, es posible que las variaciones en seis variables observadas reflejen principalmente las variaciones en dos variables no observadas (subyacentes). El análisis factorial busca tales variaciones conjuntas en respuesta a variables latentes no observadas . Las variables observadas se modelan como combinaciones lineales de los factores potenciales más términos de " error ", por lo que el análisis factorial puede considerarse un caso especial de modelos de errores en las variables . [ 1 ]
La correlación entre una variable y un factor dado, denominada carga factorial de la variable, indica el grado de relación entre ambos. [ 2 ]
Una justificación común para los métodos de análisis factorial es que la información obtenida sobre las interdependencias entre las variables observadas puede utilizarse posteriormente para reducir el conjunto de variables en un conjunto de datos. El análisis factorial se utiliza comúnmente en psicometría , psicología de la personalidad , biología, marketing , gestión de productos , investigación operativa , finanzas y aprendizaje automático . Puede ser útil para trabajar con conjuntos de datos donde hay un gran número de variables observadas que se cree que reflejan un número menor de variables subyacentes o latentes. Es una de las técnicas de interdependencia más utilizadas y se emplea cuando el conjunto relevante de variables muestra una interdependencia sistemática y el objetivo es descubrir los factores latentes que crean una característica común.
Modelo estadístico
Definición
El modelo intenta explicar un conjunto deobservaciones en cada uno deindividuos con un conjunto defactores comunes () donde hay menos factores por unidad que observaciones por unidad (). Cada individuo tienede sus propios factores comunes, y estos están relacionados con las observaciones a través de la matriz de cargas factoriales (), para una sola observación, según
dónde
- es el valor de lala observación de laindividuo,
- es la media de observación para lala observación,
- es la carga para ella observación de lafactor th,
- es el valor de lafactor º delindividuo, y
- es elel término de error estocástico no observado con media cero y varianza finita.
En notación matricial
donde matriz de observación, matriz de carga, matriz de factores, matriz de términos de errory matriz mediapor lo cual elEl elemento es simplemente.
Además, impondremos las siguientes suposiciones sobre:
- yson independientes.
- ; dónde es Expectativa
- dónde es la matriz de covarianza , para asegurar que los factores no estén correlacionados yes la matriz identidad .
Suponer. Entonces
y por lo tanto, de las condiciones 1 y 2 impuestas enarriba,y, donación
o, estableciendo :=\mathrm {Cov} (\varepsilon )} ,
Para cualquier matriz ortogonal, si establecemosy, los criterios para ser factores y cargas factoriales siguen vigentes. Por lo tanto, un conjunto de factores y cargas factoriales es único salvo una transformación ortogonal .
Ejemplo
Supongamos que un psicólogo plantea la hipótesis de que existen dos tipos de inteligencia : «inteligencia verbal» e «inteligencia matemática», ninguna de las cuales se observa directamente. [ nota 1 ] Se busca evidencia para esta hipótesis en las calificaciones de los exámenes de 10 áreas académicas diferentes de 1000 estudiantes. Si cada estudiante se elige al azar de una población grande , entonces las 10 calificaciones de cada estudiante son variables aleatorias. La hipótesis del psicólogo puede afirmar que, para cada una de las 10 áreas académicas, la calificación promedio del grupo de todos los estudiantes que comparten un par común de valores para las «inteligencias» verbal y matemática es una constante multiplicada por su nivel de inteligencia verbal más otra constante multiplicada por su nivel de inteligencia matemática; es decir, es una combinación lineal de esos dos «factores». La hipótesis postula que los números para una materia en particular, por los cuales se multiplican los dos tipos de inteligencia para obtener la calificación esperada, son los mismos para todos los pares de niveles de inteligencia y se denominan «carga factorial» para esa materia. Por ejemplo, la hipótesis puede sostener que la aptitud promedio prevista del estudiante en el campo de la astronomía es
- {10 × la inteligencia verbal del estudiante} + {6 × la inteligencia matemática del estudiante}.
Los números 10 y 6 representan las cargas factoriales asociadas a la astronomía. Otras disciplinas académicas pueden tener cargas factoriales diferentes.
Dos estudiantes que se supone que tienen el mismo grado de inteligencia verbal y matemática pueden tener aptitudes diferentes en astronomía debido a que las aptitudes individuales difieren de las aptitudes promedio (predichas anteriormente) y al propio error de medición. Estas diferencias conforman lo que se denomina colectivamente "error", un término estadístico que indica la magnitud en la que un individuo, según las mediciones, difiere del promedio o de lo que se predice según su nivel de inteligencia (véase errores y residuos en estadística ).
Los datos observables que se utilizan en el análisis factorial serían 10 puntuaciones de cada uno de los 1000 estudiantes, lo que suma un total de 10 000 números. A partir de estos datos, se deben inferir las cargas factoriales y los niveles de los dos tipos de inteligencia de cada estudiante.
Modelo matemático del mismo ejemplo
En lo sucesivo, las matrices se indicarán mediante variables indexadas. Los índices de "Asignatura académica" se indicarán mediante letras.,y, con valores que van desdealo cual es igual aEn el ejemplo anterior, los índices de "factor" se indicarán mediante letras.,y, con valores que van desdealo cual es igual aEn el ejemplo anterior, los índices de "instancia" o "muestra" se indicarán mediante letras.,y, con valores que van desdea. En el ejemplo anterior, si una muestra deLos estudiantes participaron en ellos exámenes, ella puntuación del estudiante para elEl examen es administrado porEl objetivo del análisis factorial es caracterizar las correlaciones entre las variables.de los cuales elson un caso particular, o un conjunto de observaciones. Para que las variables estén en igualdad de condiciones, se normalizan en puntuaciones estándar.:
donde la media de la muestra es:
y la varianza muestral viene dada por:
El modelo de análisis factorial para esta muestra en particular es, por lo tanto:
o, más brevemente:
dónde
- es ella "inteligencia verbal" del estudiante,
- es ella "inteligencia matemática" del estudiante,
- son las cargas factoriales para eltema, para.
En notación matricial , tenemos
Observe que al duplicar la escala en la que la "inteligencia verbal" (el primer componente en cada columna de—se mide, y simultáneamente reducir a la mitad las cargas factoriales para la inteligencia verbal no hace ninguna diferencia en el modelo. Por lo tanto, no se pierde generalidad al suponer que la desviación estándar de los factores para la inteligencia verbal es. Lo mismo ocurre con la inteligencia matemática. Además, por razones similares, no se pierde generalidad al suponer que los dos factores no están correlacionados entre sí. En otras palabras:
dóndees el delta de Kronecker (cuandoycuando). Se supone que los errores son independientes de los factores:
Dado que cualquier rotación de una solución también constituye una solución, esto dificulta la interpretación de los factores. Véanse las desventajas a continuación. En este ejemplo concreto, si desconocemos de antemano que los dos tipos de inteligencia no están correlacionados, no podemos interpretar los dos factores como dos tipos de inteligencia diferentes. Incluso si no están correlacionados, no podemos determinar qué factor corresponde a la inteligencia verbal y cuál a la inteligencia matemática sin un argumento externo.
Los valores de las cargas, los promediosy las variaciones de los "errores"debe estimarse dados los datos observadosy(la suposición sobre los niveles de los factores es fija para un valor dado). El "teorema fundamental" puede derivarse de las condiciones anteriores:
El término de la izquierda es el-término de la matriz de correlación (unmatriz derivada como producto de lamatriz de observaciones estandarizadas con su transpuesta) de los datos observados y suLos elementos diagonales seránEl segundo término de la derecha será una matriz diagonal con términos menores que la unidad. El primer término de la derecha es la "matriz de correlación reducida" y será igual a la matriz de correlación, excepto por sus valores diagonales, que serán menores que la unidad. Estos elementos diagonales de la matriz de correlación reducida se denominan "comunalidades" (que representan la fracción de la varianza en la variable observada que se explica por los factores):
Los datos de muestrano obedecerá exactamente la ecuación fundamental dada anteriormente debido a errores de muestreo, insuficiencia del modelo, etc. El objetivo de cualquier análisis del modelo anterior es encontrar los factoresy cargasque proporcionan un "mejor ajuste" a los datos. En el análisis factorial, el mejor ajuste se define como el mínimo del error cuadrático medio en los residuos fuera de la diagonal de la matriz de correlación: [ 3 ]
Esto equivale a minimizar los componentes fuera de la diagonal de la covarianza del error que, en las ecuaciones del modelo, tienen valores esperados de cero. Esto contrasta con el análisis de componentes principales, que busca minimizar el error cuadrático medio de todos los residuos. [ 3 ] Antes de la llegada de las computadoras de alta velocidad, se dedicó un esfuerzo considerable a encontrar soluciones aproximadas al problema, particularmente en la estimación de las comunalidades por otros medios, lo que luego simplifica considerablemente el problema al producir una matriz de correlación reducida conocida. Esta se usaba luego para estimar los factores y las cargas. Con la llegada de las computadoras de alta velocidad, el problema de minimización se puede resolver iterativamente con la velocidad adecuada, y las comunalidades se calculan en el proceso, en lugar de ser necesarias de antemano. El algoritmo MinRes es particularmente adecuado para este problema, pero no es el único medio iterativo para encontrar una solución.
Si se permite que los factores de la solución estén correlacionados (como en la rotación 'oblimin', por ejemplo), entonces el modelo matemático correspondiente utiliza coordenadas sesgadas en lugar de coordenadas ortogonales.
Interpretación geométrica

Los parámetros y variables del análisis factorial pueden recibir una interpretación geométrica. Los datos (), los factores () y los errores () pueden verse como vectores en unEspacio euclidiano de -dimensiones (espacio muestral), representado como,yrespectivamente. Dado que los datos están estandarizados, los vectores de datos tienen una longitud unitaria (). Los vectores de factores definen unSubespacio lineal de dimensión (es decir, un hiperplano) en este espacio, sobre el cual se proyectan ortogonalmente los vectores de datos. Esto se deduce de la ecuación del modelo.
y la independencia de los factores y los errores:En el ejemplo anterior, el hiperplano es simplemente un plano bidimensional definido por los dos vectores factoriales. La proyección de los vectores de datos sobre el hiperplano viene dada por
y los errores son vectores desde ese punto proyectado hasta el punto de datos y son perpendiculares al hiperplano. El objetivo del análisis factorial es encontrar un hiperplano que sea un "mejor ajuste" a los datos en algún sentido, por lo que no importa cómo se elijan los vectores factoriales que definen este hiperplano, siempre que sean independientes y se encuentren en el hiperplano. Somos libres de especificarlos como ortogonales y normales () sin pérdida de generalidad. Una vez encontrado un conjunto adecuado de factores, estos pueden rotarse arbitrariamente dentro del hiperplano, de modo que cualquier rotación de los vectores de factores definirá el mismo hiperplano y también será una solución. En consecuencia, en el ejemplo anterior, en el que el hiperplano de ajuste es bidimensional, si no sabemos de antemano que los dos tipos de inteligencia no están correlacionados, no podemos interpretar los dos factores como los dos tipos de inteligencia diferentes. Incluso si no están correlacionados, no podemos determinar qué factor corresponde a la inteligencia verbal y cuál a la inteligencia matemática, ni si los factores son combinaciones lineales de ambos, sin un argumento externo.
Los vectores de datostienen longitud unitaria. Las entradas de la matriz de correlación para los datos vienen dadas porLa matriz de correlación puede interpretarse geométricamente como el coseno del ángulo entre los dos vectores de datos.y. Los elementos diagonales serán claramentes y los elementos fuera de la diagonal tendrán valores absolutos menores o iguales a la unidad. La "matriz de correlación reducida" se define como
- .
El objetivo del análisis factorial es elegir el hiperplano de ajuste de tal manera que la matriz de correlación reducida reproduzca la matriz de correlación lo más fielmente posible, excepto por los elementos diagonales de la matriz de correlación, que se sabe que tienen valor unitario. En otras palabras, el objetivo es reproducir con la mayor precisión posible las correlaciones cruzadas en los datos. Específicamente, para el hiperplano de ajuste, el error cuadrático medio en los componentes fuera de la diagonal
debe minimizarse, y esto se logra minimizándolo con respecto a un conjunto de vectores factoriales ortonormales. Se puede observar que
El término de la derecha es simplemente la covarianza de los errores. En el modelo, se establece que la covarianza del error es una matriz diagonal, por lo que el problema de minimización anterior producirá, de hecho, un "mejor ajuste" al modelo: producirá una estimación de muestra de la covarianza del error que tiene sus componentes fuera de la diagonal minimizadas en el sentido de la media cuadrática. Se puede ver que dado queson proyecciones ortogonales de los vectores de datos, su longitud será menor o igual a la longitud del vector de datos proyectado, que es la unidad. El cuadrado de estas longitudes son simplemente los elementos diagonales de la matriz de correlación reducida. Estos elementos diagonales de la matriz de correlación reducida se conocen como "comunalidades":
Los valores elevados de las comunalidades indicarán que el hiperplano de ajuste reproduce con bastante precisión la matriz de correlación. Los valores medios de los factores también deben ser cero, por lo que los valores medios de los errores también serán cero.
Implementación práctica
Tipos de análisis factorial
Análisis factorial exploratorio
El análisis factorial exploratorio (AFE) se utiliza para identificar interrelaciones complejas entre ítems y agrupar ítems que forman parte de conceptos unificados. [ 4 ] El investigador no hace suposiciones a priori sobre las relaciones entre los factores. [ 4 ]
Análisis factorial confirmatorio
El análisis factorial confirmatorio (AFC) es un enfoque más complejo que pone a prueba la hipótesis de que los ítems están asociados con factores específicos. [ 4 ] El AFC utiliza el modelado de ecuaciones estructurales para probar un modelo de medición, donde la carga factorial en los factores permite evaluar las relaciones entre variables observadas y variables no observadas. [ 4 ] Los enfoques de modelado de ecuaciones estructurales pueden acomodar el error de medición y son menos restrictivos que la estimación por mínimos cuadrados . [ 4 ] Los modelos hipotetizados se prueban con datos reales, y el análisis demostraría las cargas factoriales de las variables observadas en las variables latentes (factores), así como la correlación entre las variables latentes. [ 4 ]
Tipos de extracción de factores
El análisis de componentes principales (ACP) es un método ampliamente utilizado para la extracción de factores, que constituye la primera fase del análisis factorial exploratorio (AFE). [ 4 ] Se calculan los pesos de los factores para extraer la máxima varianza posible, y la factorización sucesiva continúa hasta que no queda más varianza significativa. [ 4 ] El modelo factorial debe luego rotarse para su análisis. [ 4 ]
El análisis factorial canónico, también llamado factorización canónica de Rao, es un método diferente para calcular el mismo modelo que el PCA, que utiliza el método de ejes principales. El análisis factorial canónico busca los factores que presentan la mayor correlación canónica con las variables observadas. Este método no se ve afectado por el reescalamiento arbitrario de los datos.
El análisis de factores comunes, también llamado análisis de factores principales (AFP) o factorización de ejes principales (FAP), busca la menor cantidad de factores que puedan explicar la varianza común (correlación) de un conjunto de variables.
El análisis factorial de imágenes se basa en la matriz de correlación de las variables predichas en lugar de las variables reales, donde cada variable se predice a partir de las demás mediante regresión múltiple .
El método de factorización alfa se basa en maximizar la fiabilidad de los factores, asumiendo que las variables se seleccionan aleatoriamente de un universo de variables. Todos los demás métodos asumen que los casos se seleccionan mediante muestreo y que las variables son fijas.
El modelo de regresión factorial es un modelo combinatorio de modelo factorial y modelo de regresión; o alternativamente, puede verse como el modelo factorial híbrido, [ 5 ] cuyos factores se conocen parcialmente.
Terminología
- Cargas factoriales
- La comunalidad es el cuadrado de la carga externa estandarizada de un ítem. De forma análoga al coeficiente de determinación (r²) de Pearson , la carga factorial al cuadrado representa el porcentaje de varianza de la variable indicadora explicado por el factor. Para obtener el porcentaje de varianza de todas las variables explicado por cada factor, se suman las cargas factoriales al cuadrado de dicho factor (columna) y se divide el resultado entre el número de variables. (El número de variables es igual a la suma de sus varianzas, ya que la varianza de una variable estandarizada es 1). Esto equivale a dividir el autovalor del factor entre el número de variables.En el análisis factorial confirmatorio, una regla general para la interpretación de los datos es que las cargas factoriales deben ser de 0,7 o superiores para confirmar que las variables independientes identificadas a priori están representadas por un factor específico. Esto se basa en la premisa de que el nivel de 0,7 corresponde a aproximadamente la mitad de la varianza del indicador explicada por dicho factor. Sin embargo, el estándar de 0,7 es elevado y es posible que los datos reales no cumplan este criterio. Por ello, algunos investigadores, sobre todo con fines exploratorios, utilizan niveles inferiores, como 0,4 para el factor central y 0,25 para otros factores. En cualquier caso, las cargas factoriales deben interpretarse a la luz de la teoría, no mediante umbrales arbitrarios.En la rotación oblicua , se pueden examinar tanto una matriz de patrones como una matriz de estructura. La matriz de estructura es simplemente la matriz de cargas factoriales, como en la rotación ortogonal, que representa la varianza de una variable medida explicada por un factor, tanto en función de contribuciones únicas como comunes. La matriz de patrones, en cambio, contiene coeficientes que solo representan contribuciones únicas. Por lo general, cuantos más factores haya, menores serán los coeficientes de patrón, ya que habrá más contribuciones comunes a la varianza explicada. Para la rotación oblicua, el investigador considera tanto los coeficientes de estructura como los de patrón al asignar una etiqueta a un factor. Los principios de la rotación oblicua se pueden derivar tanto de la entropía cruzada como de su entropía dual. [ 6 ]
- Comunalidad
- La suma de las cargas factoriales al cuadrado de todos los factores para una variable dada (fila) representa la varianza de dicha variable explicada por todos los factores. La comunalidad mide el porcentaje de varianza de una variable dada explicado por todos los factores en conjunto y puede interpretarse como la fiabilidad del indicador en el contexto de los factores considerados.
- Soluciones falsas
- Si la comunalidad supera 1,0, existe una solución espuria, lo que puede reflejar una muestra demasiado pequeña o la elección de extraer demasiados o muy pocos factores.
- Unicidad de una variable
- La variabilidad de una variable menos su comunalidad.
- Valores propios/raíces características
- Los autovalores miden la cantidad de variación en la muestra total que explica cada factor. La razón de los autovalores es la razón de la importancia explicativa de los factores con respecto a las variables. Si un factor tiene un autovalor bajo, entonces contribuye poco a la explicación de las varianzas en las variables y puede ignorarse por ser menos importante que los factores con autovalores más altos.
- Sumas de extracción de cargas al cuadrado
- Los autovalores iniciales y los autovalores posteriores a la extracción (que SPSS muestra como "Sumas de cargas al cuadrado de extracción") son iguales para la extracción mediante PCA, pero para otros métodos de extracción, los autovalores posteriores a la extracción serán menores que sus contrapartes iniciales. SPSS también muestra las "Sumas de cargas al cuadrado de rotación" e incluso para PCA, estos autovalores diferirán de los autovalores iniciales y de extracción, aunque su total será el mismo.
- Puntuaciones factoriales
- Puntuaciones de los componentes (en PCA)
- Las puntuaciones de cada caso (fila) en cada factor (columna). Para calcular la puntuación factorial de un caso dado para un factor determinado, se toma la puntuación estandarizada del caso en cada variable, se multiplica por las cargas factoriales correspondientes de la variable para el factor dado y se suman estos productos. El cálculo de las puntuaciones factoriales permite detectar valores atípicos en los factores. Además, las puntuaciones factoriales pueden utilizarse como variables en modelos posteriores.
Criterios para determinar el número de factores
Los investigadores desean evitar criterios subjetivos o arbitrarios para la retención de factores, como «me pareció lógico». Se han desarrollado varios métodos objetivos para resolver este problema, lo que permite a los usuarios determinar un rango apropiado de soluciones para investigar. [ 7 ] Sin embargo, estos diferentes métodos a menudo discrepan entre sí en cuanto al número de factores que deben retenerse. Por ejemplo, el análisis paralelo puede sugerir 5 factores, mientras que el MAP de Velicer sugiere 6, por lo que el investigador puede solicitar soluciones de 5 y 6 factores y analizar cada una en términos de su relación con datos externos y la teoría.
Criterios modernos
Análisis paralelo de Horn (PA): [ 8 ] Un método de simulación basado en Montecarlo que compara los autovalores observados con los obtenidos a partir de variables normales no correlacionadas. Se retiene un factor o componente si el autovalor asociado es mayor que el percentil 95 de la distribución de autovalores derivados de los datos aleatorios. El PA se encuentra entre las reglas más comúnmente recomendadas para determinar el número de componentes a retener, [ 7 ] [ 9 ] pero muchos programas no incluyen esta opción (una excepción notable es R ). [ 10 ] Sin embargo, Formann proporcionó evidencia tanto teórica como empírica de que su aplicación podría no ser apropiada en muchos casos, ya que su rendimiento está considerablemente influenciado por el tamaño de la muestra , la discriminación de los ítems y el tipo de coeficiente de correlación . [ 11 ]
La prueba MAP de Velicer (1976) [ 12 ] , tal como la describe Courtney (2013) [ 13 ] , “implica un análisis completo de componentes principales seguido del examen de una serie de matrices de correlaciones parciales” (p. 397 (aunque esta cita no aparece en Velicer (1976) y el número de página citado está fuera de las páginas de la cita). La correlación al cuadrado para el Paso “0” (véase la Figura 4) es la correlación fuera de la diagonal al cuadrado promedio para la matriz de correlación no parcializada. En el Paso 1, el primer componente principal y sus elementos asociados se parcializan. Posteriormente, se calcula la correlación fuera de la diagonal al cuadrado promedio para la matriz de correlación subsiguiente para el Paso 1. En el Paso 2, los dos primeros componentes principales se parcializan y se vuelve a calcular la correlación fuera de la diagonal al cuadrado promedio resultante. Los cálculos se llevan a cabo para k menos un paso (k representa el número total de variables en la matriz). Posteriormente, todas las correlaciones al cuadrado promedio para cada paso son alineados y el número de paso en los análisis que resultó en la correlación parcial cuadrática promedio más baja determina el número de componentes o factores a retener. [ 12 ] Mediante este método, los componentes se mantienen siempre que la varianza en la matriz de correlación represente varianza sistemática, en contraposición a la varianza residual o de error. Aunque metodológicamente similar al análisis de componentes principales, la técnica MAP ha demostrado tener un buen desempeño en la determinación del número de factores a retener en múltiples estudios de simulación. [ 7 ] [ 14 ] [ 15 ] [ 16 ] Este procedimiento está disponible a través de la interfaz de usuario de SPSS, [ 13 ] así como del paquete psych para el lenguaje de programación R. [ 17 ] [ 18 ]
Métodos más antiguos
Criterio de Kaiser: La regla de Kaiser consiste en descartar todos los componentes con autovalores inferiores a 1,0, siendo este el autovalor equivalente a la información explicada por un único elemento promedio. [ 19 ] El criterio de Kaiser es el predeterminado en SPSS y la mayoría de los programas estadísticos, pero no se recomienda usarlo como único criterio de corte para estimar el número de factores, ya que tiende a extraer factores en exceso. [ 20 ] Se ha creado una variación de este método en la que un investigador calcula intervalos de confianza para cada autovalor y retiene solo los factores cuyo intervalo de confianza completo sea mayor que 1,0. [ 14 ] [ 21 ]
Gráfico de sedimentación : [ 22 ] La prueba de sedimentación de Cattell representa los componentes en el eje X y los autovalores correspondientes en el eje Y. A medida que uno se mueve hacia la derecha, hacia componentes posteriores, los autovalores disminuyen. Cuando la disminución cesa y la curva forma un codo hacia una pendiente menos pronunciada, la prueba de sedimentación de Cattell indica que se deben eliminar todos los componentes posteriores al que comienza en el codo. Esta regla a veces es criticada por ser susceptible a la manipulación controlada por el investigador . Es decir, como elegir el "codo" puede ser subjetivo porque la curva tiene múltiples codos o es una curva suave, el investigador puede verse tentado a establecer el límite en la cantidad de factores deseados por su agenda de investigación.
Criterios de varianza explicada: Algunos investigadores simplemente utilizan la regla de conservar suficientes factores para explicar el 90 % (a veces el 80 %) de la variación. Cuando el objetivo del investigador es la parsimonia (explicar la varianza con el menor número de factores posible), el criterio podría ser tan bajo como el 50 %.
métodos bayesianos
Al asignar una distribución previa al número de factores latentes y luego aplicar el teorema de Bayes, los modelos bayesianos pueden devolver una distribución de probabilidad sobre el número de factores latentes. Esto se ha modelado utilizando el proceso del buffet indio [ 23 ] , pero se puede modelar de forma más sencilla asignando cualquier distribución previa discreta (por ejemplo, una distribución binomial negativa ) al número de componentes.
Métodos de rotación
El resultado del análisis de componentes principales (ACP) maximiza la varianza explicada primero por el primer factor, luego por el segundo, y así sucesivamente. Una desventaja de este procedimiento es que la mayoría de los ítems se agrupan en los primeros factores, mientras que muy pocos se agrupan en las variables posteriores. Esto dificulta la interpretación de los factores mediante la lectura de una lista de preguntas y cargas factoriales, ya que cada pregunta está fuertemente correlacionada con los primeros componentes, mientras que muy pocas lo están con los últimos.
La rotación facilita la interpretación de los resultados. Al elegir una base diferente para los mismos componentes principales —es decir, al seleccionar factores diferentes para expresar la misma estructura de correlación— es posible crear variables más fáciles de interpretar.
Las rotaciones pueden ser ortogonales u oblicuas; las rotaciones oblicuas permiten que los factores se correlacionen. [ 24 ] Esta mayor flexibilidad implica que son posibles más rotaciones, algunas de las cuales pueden ser más eficaces para lograr un objetivo específico. Sin embargo, esto también puede dificultar la interpretación de los factores, ya que cierta información se "contabiliza dos veces" y se incluye varias veces en diferentes componentes; algunos factores incluso pueden parecer casi idénticos.
Métodos ortogonales
Existen dos grandes clases de rotaciones ortogonales: aquellas que buscan filas dispersas (donde cada fila es un caso, es decir, un sujeto) y aquellas que buscan columnas dispersas (donde cada columna es una variable).
- Factores simples: estas rotaciones intentan explicar todos los factores utilizando solo unas pocas variables importantes. Este efecto se puede lograr utilizando Varimax (la rotación más común).
- Variables simples: estas rotaciones intentan explicar todas las variables utilizando solo unos pocos factores importantes. Este efecto se puede lograr utilizando Quartimax o los componentes sin rotar del PCA.
- Ambas: estas rotaciones intentan encontrar un equilibrio entre los dos objetivos mencionados, pero en el proceso pueden resultar en un ajuste deficiente para ambas tareas; por lo tanto, son menos populares que los métodos anteriores. Equamax es una de estas rotaciones.
Problemas con la rotación de factores
Puede resultar difícil interpretar una estructura factorial cuando cada variable se carga en múltiples factores. Pequeños cambios en los datos a veces pueden desequilibrar el criterio de rotación factorial, produciendo una rotación completamente diferente. Esto puede dificultar la comparación de los resultados de distintos experimentos. Este problema se ilustra con la comparación de diferentes estudios sobre diferencias culturales a nivel mundial. Cada estudio utilizó diferentes medidas de variables culturales y produjo un análisis factorial con rotaciones distintas. Los autores de cada estudio creían haber descubierto algo nuevo e inventaron nuevos nombres para los factores que encontraron. Una comparación posterior de los estudios reveló que los resultados eran bastante similares al comparar los resultados sin rotar. La práctica común de la rotación factorial ha ocultado la similitud entre los resultados de los diferentes estudios. [ 25 ]
Análisis factorial de orden superior
El análisis factorial de orden superior es un método estadístico que consiste en repetir los pasos de análisis factorial, rotación oblicua y análisis factorial de los factores rotados. Su ventaja radica en que permite al investigador visualizar la estructura jerárquica de los fenómenos estudiados. Para interpretar los resultados, se puede proceder multiplicando la matriz de patrones de factores primarios por las matrices de patrones de factores de orden superior (Gorsuch, 1983) y, posiblemente, aplicando una rotación Varimax al resultado (Thompson, 1990), o bien utilizando una solución de Schmid-Leiman (SLS, Schmid y Leiman, 1957, también conocida como transformación de Schmid-Leiman), que atribuye la variación de los factores primarios a los factores de segundo orden.
Análisis factorial exploratorio (AFE) frente a análisis de componentes principales (ACP)
El análisis factorial está relacionado con el análisis de componentes principales (ACP), pero no son idénticos. [ 26 ] Ha habido una controversia significativa en el campo sobre las diferencias entre ambas técnicas. El ACP puede considerarse una versión más básica del análisis factorial exploratorio (AFE), desarrollado en sus inicios antes de la llegada de las computadoras de alta velocidad. Tanto el ACP como el análisis factorial buscan reducir la dimensionalidad de un conjunto de datos, pero los enfoques para lograrlo difieren. El análisis factorial está claramente diseñado para identificar ciertos factores no observables a partir de las variables observadas, mientras que el ACP no aborda directamente este objetivo; en el mejor de los casos, el ACP proporciona una aproximación a los factores requeridos. [ 27 ] Desde el punto de vista del análisis exploratorio, los autovalores del ACP son cargas de componentes infladas, es decir, contaminadas con varianza de error. [ 28 ] [ 29 ] [ 30 ] [ 31 ] [ 32 ] [ 33 ]
Aunque el EFA y el PCA se tratan como técnicas sinónimas en algunos campos de la estadística, esto ha sido criticado. [ 34 ] [ 35 ] El análisis factorial "se ocupa del supuesto de una estructura causal subyacente : [asume] que la covariación en las variables observadas se debe a la presencia de una o más variables latentes (factores) que ejercen influencia causal sobre estas variables observadas". [ 36 ] En cambio, el PCA no asume ni depende de tal relación causal subyacente. Los investigadores han argumentado que las distinciones entre las dos técnicas pueden significar que existen beneficios objetivos al preferir una sobre la otra en función del objetivo analítico. Si el modelo factorial está formulado incorrectamente o no se cumplen los supuestos, el análisis factorial dará resultados erróneos. El análisis factorial se ha utilizado con éxito cuando una comprensión adecuada del sistema permite buenas formulaciones iniciales del modelo. El PCA emplea una transformación matemática de los datos originales sin supuestos sobre la forma de la matriz de covarianza. El objetivo del PCA es determinar combinaciones lineales de las variables originales y seleccionar algunas que puedan usarse para resumir el conjunto de datos sin perder mucha información. [ 37 ]
Argumentos que contrastan el PCA y el EFA.
Fabrigar et al. (1999) [ 34 ] abordan una serie de razones utilizadas para sugerir que el PCA no es equivalente al análisis factorial:
- En ocasiones se sugiere que el análisis de componentes principales (ACP) es computacionalmente más rápido y requiere menos recursos que el análisis factorial. Fabrigar et al. sugieren que la disponibilidad de recursos informáticos ha hecho que esta preocupación práctica sea irrelevante.
- El análisis de componentes principales (ACP) y el análisis factorial pueden producir resultados similares. Este punto también lo abordan Fabrigar et al.; en ciertos casos, cuando las comunalidades son bajas (por ejemplo, 0,4), ambas técnicas arrojan resultados divergentes. De hecho, Fabrigar et al. sostienen que, cuando los datos se ajustan a los supuestos del modelo factorial común, los resultados del ACP son inexactos.
- En ciertos casos, el análisis factorial da lugar a los llamados «casos Heywood». Estos abarcan situaciones en las que se estima que el modelo explica el 100 % o más de la varianza de una variable medida. Fabrigar et al. sugieren que estos casos resultan informativos para el investigador, ya que indican un modelo mal especificado o una violación del modelo factorial común. La ausencia de casos Heywood en el enfoque de PCA puede significar que tales problemas pasen desapercibidos.
- Los investigadores obtienen información adicional mediante el análisis de componentes principales (ACP), como la puntuación de un individuo en un componente específico; esta información no se obtiene con el análisis factorial. Sin embargo, como sostienen Fabrigar et al., el objetivo típico del análisis factorial —es decir, determinar los factores que explican la estructura de las correlaciones entre las variables medidas— no requiere conocer las puntuaciones factoriales, por lo que esta ventaja se anula. También es posible calcular las puntuaciones factoriales a partir de un análisis factorial.
Varianza versus covarianza
El análisis factorial tiene en cuenta el error aleatorio inherente a la medición, mientras que el PCA no lo hace. Este punto lo ejemplifica Brown (2009), [ 38 ] quien indicó que, con respecto a las matrices de correlación involucradas en los cálculos:
En el análisis de componentes principales (ACP), los valores 1,00 se colocan en la diagonal, lo que significa que se debe considerar toda la varianza de la matriz (incluida la varianza específica de cada variable, la varianza común a las variables y la varianza del error). Por lo tanto, por definición, esto incluiría toda la varianza de las variables. En cambio, en el análisis factorial exploratorio (AFE), las comunalidades se colocan en la diagonal, lo que significa que solo se debe considerar la varianza compartida con otras variables (excluyendo la varianza específica de cada variable y la varianza del error). Por lo tanto, por definición, esto incluiría solo la varianza común a las variables.
— Brown (2009), Análisis de componentes principales y análisis factorial exploratorio: definiciones, diferencias y opciones
Por esta razón, Brown (2009) recomienda utilizar el análisis factorial cuando existen ideas teóricas sobre las relaciones entre variables, mientras que el PCA debe utilizarse si el objetivo del investigador es explorar patrones en sus datos.
Diferencias en el procedimiento y los resultados
Las diferencias entre el PCA y el análisis factorial (FA) son ilustradas con más detalle por Suhr (2009): [ 35 ]
- El análisis de componentes principales (PCA) genera componentes principales que explican la máxima cantidad de varianza para las variables observadas; el análisis factorial (FA) explica la varianza común en los datos.
- El PCA inserta unos en las diagonales de la matriz de correlación; el FA ajusta las diagonales de la matriz de correlación con los factores únicos.
- El PCA minimiza la suma de las distancias perpendiculares al cuadrado al eje del componente; el FA estima los factores que influyen en las respuestas sobre las variables observadas.
- Las puntuaciones de los componentes en el PCA representan una combinación lineal de las variables observadas ponderadas por los vectores propios ; las variables observadas en el FA son combinaciones lineales de los factores subyacentes y únicos.
- En el análisis de componentes principales (PCA), los componentes resultantes no son interpretables, es decir, no representan "constructos" subyacentes; en el análisis factorial (FA), los constructos subyacentes pueden etiquetarse e interpretarse fácilmente, siempre que se especifique un modelo preciso.
En psicometría
Historia
Charles Spearman fue el primer psicólogo en abordar el análisis factorial común [ 39 ] y lo hizo en su artículo de 1904. [ 40 ] En él se ofrecían pocos detalles sobre sus métodos y se centraba en modelos de un solo factor. [ 41 ] Descubrió que las puntuaciones de los escolares en una amplia variedad de temas aparentemente no relacionados estaban correlacionadas positivamente, lo que le llevó a postular que una única capacidad mental general, o g , subyace y moldea el rendimiento cognitivo humano.
El desarrollo inicial del análisis factorial común con múltiples factores fue presentado por Louis Thurstone en dos artículos a principios de la década de 1930, [ 42 ] [ 43 ] resumidos en su libro de 1935, The Vector of Mind . [ 44 ] Thurstone introdujo varios conceptos importantes del análisis factorial, incluyendo comunalidad, unicidad y rotación. [ 45 ] Abogó por una "estructura simple" y desarrolló métodos de rotación que podían usarse para lograr dicha estructura. [ 39 ]
En la metodología Q , William Stephenson , alumno de Spearman, distingue entre el análisis factorial R , orientado al estudio de las diferencias interindividuales, y el análisis factorial Q , orientado a las diferencias intraindividuales subjetivas. [ 46 ] [ 47 ]
Raymond Cattell fue un firme defensor del análisis factorial y la psicometría , y utilizó la teoría multifactorial de Thurstone para explicar la inteligencia. Cattell también desarrolló la prueba de sedimentación y los coeficientes de similitud.
Aplicaciones en psicología
El análisis factorial se utiliza para identificar los factores que explican diversos resultados en diferentes pruebas. Por ejemplo, las investigaciones sobre inteligencia han demostrado que las personas que obtienen una puntuación alta en una prueba de habilidad verbal también obtienen buenos resultados en otras pruebas que requieren habilidades verbales. Los investigadores explicaron esto mediante el análisis factorial, que permitió aislar un factor, a menudo denominado inteligencia verbal, que representa el grado de capacidad de una persona para resolver problemas que implican habilidades verbales.
En psicología, el análisis factorial se asocia con mayor frecuencia a la investigación sobre la inteligencia. Sin embargo, también se ha utilizado para identificar factores en una amplia gama de ámbitos, como la personalidad, las actitudes, las creencias, etc. Está vinculado a la psicometría , ya que permite evaluar la validez de un instrumento al determinar si este mide efectivamente los factores postulados.
Ventajas
- Reducción del número de variables mediante la combinación de dos o más variables en un solo factor. Por ejemplo, el rendimiento en correr, lanzar la pelota, batear, saltar y levantar pesas podría combinarse en un solo factor, como la capacidad atlética general. Normalmente, en una matriz de ítems por personas, los factores se seleccionan agrupando ítems relacionados. En la técnica de análisis factorial Q, la matriz se transpone y los factores se crean agrupando personas relacionadas. Por ejemplo, liberales, libertarios, conservadores y socialistas podrían formar grupos separados.
- Identificación de grupos de variables interrelacionadas para observar cómo se relacionan entre sí. Por ejemplo, Carroll utilizó el análisis factorial para desarrollar su Teoría de los Tres Estratos . Descubrió que un factor denominado "percepción visual amplia" se relaciona con la habilidad de un individuo en tareas visuales. También halló un factor denominado "percepción auditiva amplia", relacionado con la capacidad para realizar tareas auditivas. Además, identificó un factor global, denominado "g" o inteligencia general, que se relaciona tanto con la "percepción visual amplia" como con la "percepción auditiva amplia". Esto significa que una persona con un alto valor de "g" probablemente también tenga una alta capacidad de "percepción visual" y una alta capacidad de "percepción auditiva", y que, por lo tanto, "g" explica en gran medida el desempeño de una persona en ambos ámbitos.
Desventajas
- «...cada orientación es igualmente aceptable matemáticamente. Pero las distintas teorías factoriales demostraron diferir tanto en cuanto a las orientaciones de los ejes factoriales para una solución dada como en cualquier otro aspecto, por lo que el ajuste del modelo no resultó útil para distinguir entre teorías» (Sternberg, 1977 [ 48 ] ). Esto significa que todas las rotaciones representan procesos subyacentes diferentes, pero todas son resultados igualmente válidos de la optimización del análisis factorial estándar. Por lo tanto, es imposible elegir la rotación adecuada utilizando únicamente el análisis factorial.
- El análisis factorial solo puede ser tan bueno como lo permitan los datos. En psicología, donde los investigadores a menudo tienen que recurrir a medidas menos válidas y fiables, como los autoinformes, esto puede resultar problemático.
- La interpretación del análisis factorial se basa en el uso de una "heurística", que es una solución "conveniente aunque no sea absolutamente cierta". [ 49 ] Se pueden hacer varias interpretaciones de los mismos datos factorizados de la misma manera, y el análisis factorial no puede identificar la causalidad.
En la investigación transcultural
El análisis factorial es una técnica frecuentemente utilizada en la investigación transcultural. Su propósito es extraer dimensiones culturales . Los modelos de dimensiones culturales más conocidos son los elaborados por Geert Hofstede , Ronald Inglehart , Christian Welzel , Shalom Schwartz y Michael Minkov. Una visualización popular es el mapa cultural del mundo de Inglehart y Welzel . [ 25 ]
En ciencias políticas
En un estudio de principios de 1965, se examinaron los sistemas políticos de todo el mundo mediante análisis factorial para construir modelos teóricos relacionados e investigaciones, comparar sistemas políticos y crear categorías tipológicas. [ 50 ] Para estos fines, en este estudio se identificaron siete dimensiones políticas básicas, que están relacionadas con una amplia variedad de comportamiento político: estas dimensiones son Acceso, Diferenciación, Consenso, Seccionalismo, Legitimación, Interés y Teoría e Investigación del Liderazgo.
Otros politólogos exploran la medición de la eficacia política interna utilizando cuatro nuevas preguntas añadidas al Estudio Nacional de Elecciones de 1988. En este caso, se utiliza el análisis factorial para determinar que estos ítems miden un concepto único, distinto de la eficacia externa y la confianza política, y que estas cuatro preguntas proporcionaron la mejor medida de la eficacia política interna hasta ese momento. [ 51 ]
En marketing
Los pasos básicos son:
- Identifique los atributos más relevantes que los consumidores utilizan para evaluar los productos de esta categoría.
- Utilice técnicas de investigación de mercado cuantitativas (como encuestas ) para recopilar datos de una muestra de clientes potenciales sobre sus valoraciones de todos los atributos del producto.
- Introduzca los datos en un programa estadístico y ejecute el análisis factorial. El ordenador generará un conjunto de atributos subyacentes (o factores).
- Utilice estos factores para construir mapas perceptuales y otras herramientas de posicionamiento de productos .
Recopilación de información
La fase de recopilación de datos suele estar a cargo de profesionales de la investigación de mercado. Las preguntas de la encuesta solicitan al encuestado que califique una muestra del producto o descripciones de conceptos de producto según diversos atributos. Se seleccionan entre cinco y veinte atributos, como facilidad de uso, peso, precisión, durabilidad, variedad de colores, precio o tamaño. Los atributos elegidos varían según el producto estudiado. Se formula la misma pregunta para todos los productos del estudio. Los datos de múltiples productos se codifican y se introducen en un programa estadístico como R , SPSS , SAS , Stata , STATISTICA , JMP y SYSTAT.
Análisis
El análisis aislará los factores subyacentes que explican los datos utilizando una matriz de asociaciones. [ 52 ] El análisis factorial es una técnica de interdependencia. Se examina el conjunto completo de relaciones interdependientes. No hay especificación de variables dependientes, variables independientes o causalidad. El análisis factorial supone que todos los datos de calificación sobre diferentes atributos pueden reducirse a unas pocas dimensiones importantes. Esta reducción es posible porque algunos atributos pueden estar relacionados entre sí. La calificación dada a cualquier atributo es parcialmente el resultado de la influencia de otros atributos. El algoritmo estadístico deconstruye la calificación (llamada puntuación bruta) en sus diversos componentes y reconstruye las puntuaciones parciales en puntuaciones factoriales subyacentes. El grado de correlación entre la puntuación bruta inicial y la puntuación factorial final se llama carga factorial .
Ventajas
- Se pueden utilizar tanto atributos objetivos como subjetivos, siempre que los atributos subjetivos puedan convertirse en puntuaciones.
- El análisis factorial puede identificar dimensiones o constructos latentes que el análisis directo quizás no detecte.
- Es fácil y económico.
Desventajas
- La utilidad depende de la capacidad de los investigadores para recopilar un conjunto suficiente de atributos del producto. Si se excluyen o se pasan por alto atributos importantes, el valor del procedimiento se reduce.
- Si los conjuntos de variables observadas son muy similares entre sí y distintos de otros elementos, el análisis factorial les asignará un único factor. Esto puede ocultar factores que representan relaciones más interesantes.
- La denominación de los factores puede requerir conocimientos teóricos, ya que atributos aparentemente disímiles pueden correlacionarse fuertemente por razones desconocidas.
En ciencias físicas y biológicas
El análisis factorial también se ha utilizado ampliamente en ciencias físicas como la geoquímica , la hidroquímica , [ 53 ] la astrofísica y la cosmología , así como en ciencias biológicas, como la ecología , la biología molecular , la neurociencia y la bioquímica .
En la gestión de la calidad del agua subterránea, es importante relacionar la distribución espacial de diferentes parámetros químicos con distintas fuentes posibles, que presentan diferentes características químicas. Por ejemplo, es probable que una mina de sulfuros esté asociada con altos niveles de acidez, sulfatos disueltos y metales de transición. Estas características pueden identificarse como factores mediante el análisis factorial en modo R, y la ubicación de las posibles fuentes puede sugerirse mediante la representación gráfica de las puntuaciones factoriales. [ 54 ]
En geoquímica , diferentes factores pueden corresponder a diferentes asociaciones minerales y, por lo tanto, a la mineralización. [ 55 ]
En el análisis de microarrays
El análisis factorial puede utilizarse para resumir datos de microarrays de ADN de oligonucleótidos de alta densidad a nivel de sonda para Affymetrix GeneChips. En este caso, la variable latente corresponde a la concentración de ARN en una muestra. [ 56 ]
Implementación
El análisis factorial se ha implementado en varios programas de análisis estadístico desde la década de 1980:
- BMDP
- JMP (software estadístico)
- Mplus (software estadístico)
- Python : módulo scikit-learn [ 57 ]
- R (con la función base factanal o fa del paquete psych ). Las rotaciones se implementan en el paquete GPArotation de R.
- SAS (usando PROC FACTOR o PROC CALIS)
- SPSS [ 58 ]
- Stata
Autónomo
- Factor- Software gratuito de análisis factorial desarrollado por la Universidad Rovira i Virgili.
Véase también
Notas
- ↑ En este ejemplo, la "inteligencia verbal" y la "inteligencia matemática" son variables latentes. El hecho de que no se observen directamente es lo que las convierte en latentes.
Referencias
- ↑ Jöreskog, Karl G. (1983). «Análisis factorial como modelo de errores en las variables». Principios de la medición psicológica moderna . Hillsdale: Erlbaum. pp. 185–196 . ISBN 0-89859-277-1.
- ↑ Bandalos, Deborah L. (2017). Teoría de la medición y aplicaciones para las ciencias sociales . The Guilford Press.
- 1 2 3 Harman, Harry H. (1976). Análisis factorial moderno . University of Chicago Press . págs. 175, 176. ISBN 978-0-226-31652-9.
- 1 2 3 4 5 6 7 8 9 Polit DF Beck CT (2012). Investigación en enfermería: Generación y evaluación de evidencia para la práctica de enfermería, 9.ª ed . Filadelfia, EE. UU.: Wolters Klower Health, Lippincott Williams & Wilkins.
- ↑ Meng, J. (2011). "Descubrir la regulación cooperativa de genes por microARN y factores de transcripción en glioblastoma mediante un modelo de factor híbrido no negativo" . Conferencia Internacional sobre Acústica, Habla y Procesamiento de Señales . Archivado del original el 23 de noviembre de 2011.
- ↑ Liou, C.-Y.; Musicus, BR (2008). "Aproximación de entropía cruzada de matrices de covarianza gaussianas estructuradas" (PDF) . IEEE Transactions on Signal Processing . 56 (7): 3362– 3367. Bibcode : 2008ITSP...56.3362L . doi : 10.1109/TSP.2008.917878 . S2CID 15255630 .
- 1 2 3 Zwick, William R.; Velicer, Wayne F. (1986). "Comparación de cinco reglas para determinar el número de componentes a retener". Psychological Bulletin . 99 (3): 432– 442. doi : 10.1037/0033-2909.99.3.432 .
- ↑ Horn, John L. (junio de 1965). " Una justificación y prueba para el número de factores en el análisis factorial". Psychometrika . 30 (2): 179– 185. doi : 10.1007/BF02289447 . PMID 14306381. S2CID 19663974 .
- ↑ Dobriban, Edgar (2017-10-02). "Métodos de permutación para análisis factorial y PCA". arXiv : 1710.00479v2 [ math.ST ].
- ↑
- Ledesma, RD; Valero-Mora, P. (2007). "Determinación del número de factores a retener en el AFE: un programa informático fácil de usar para realizar análisis paralelos" . Practical Assessment Research & Evaluation . 12 (2): 1– 11.
- ↑ Tran, US, & Formann, AK (2009). Rendimiento del análisis paralelo en la recuperación de la unidimensionalidad en presencia de datos binarios. Educational and Psychological Measurement, 69, 50-61.
- 1 2 Velicer, WF (1976). "Determinación del número de componentes a partir de la matriz de correlaciones parciales". Psychometrika . 41 (3): 321– 327. doi : 10.1007/bf02293557 . S2CID 122907389 .
- 1 2 Courtney, MGR (2013). Determinación del número de factores a retener en el AFE: Uso del menú R de SPSS v2.0 para realizar estimaciones más juiciosas. Practical Assessment, Research and Evaluation, 18(8). Disponible en línea: http://pareonline.net/getvn.asp?v=18&n=8 Archivado el 17 de marzo de 2015 en Wayback Machine
- 1 2 Warne, RT; Larsen, R. (2014). "Evaluación de una modificación propuesta de la regla de Guttman para determinar el número de factores en un análisis factorial exploratorio". Psychological Test and Assessment Modeling . 56 : 104–123 .
- ↑ Ruscio, John; Roche, B. (2012). "Determinación del número de factores a retener en un análisis factorial exploratorio utilizando datos comparativos de estructura factorial conocida". Psychological Assessment . 24 (2): 282– 292. doi : 10.1037/a0025697 . PMID 21966933 .
- ↑ Garrido, LE, Abad, FJ, y Ponsoda, V. (2012). Una nueva perspectiva del análisis paralelo de Horn con variables ordinales. Psychological Methods. Publicación anticipada en línea. doi : 10.1037/a0030005
- ↑ Revelle, William (2007). "Determinación del número de factores: el ejemplo del NEO-PI-R" (PDF) .
{{cite journal}}: Para citar una revista se requiere|journal=( ayuda ) - ↑ Revelle, William (8 de enero de 2020). "psych: Procedimientos para la investigación psicológica, psicométrica y de la personalidad" .
- ↑ Kaiser, Henry F. (abril de 1960). "La aplicación de las computadoras electrónicas al análisis factorial". Medición educativa y psicológica . 20 (1): 141– 151. doi : 10.1177/001316446002000116 . S2CID 146138712 .
- ↑ Bandalos, DL; Boehm-Kaufman, MR (2008). «Cuatro conceptos erróneos comunes en el análisis factorial exploratorio» . En Lance, Charles E.; Vandenberg, Robert J. (eds.). Mitos y leyendas urbanas estadísticas y metodológicas: doctrina, verdad y fábula en las ciencias organizacionales y sociales . Taylor & Francis. pp. 61–87 . ISBN 978-0-8058-6237-9.
- ↑ Larsen, R.; Warne, RT (2010). "Estimación de intervalos de confianza para valores propios en el análisis factorial exploratorio" . Behavior Research Methods . 42 (3): 871– 876. doi : 10.3758/BRM.42.3.871 . PMID 20805609 .
- ↑ Cattell, Raymond (1966). "La prueba de sedimentación para el número de factores". Multivariate Behavioral Research . 1 (2): 245– 76. doi : 10.1207/s15327906mbr0102_10 . PMID 26828106 .
- ↑ Alpaydin (2020). Introducción al aprendizaje automático (5.ª ed.). págs. 528–9 .
- ↑ "Métodos de rotación de factores" . Stack Exchange . Consultado el 7 de noviembre de 2022 .
- 1 2 Fog, A (2022). "Modelos bidimensionales de diferencias culturales: análisis estadístico y teórico" (PDF) . Investigación transcultural . 57 ( 2–3 ): 115–165 . doi : 10.1177/10693971221135703 . S2CID 253153619 .
- ↑ Bartholomew, DJ; Steele, F.; Galbraith, J.; Moustaki, I. (2008). Análisis de datos multivariados en ciencias sociales . Serie Estadística en las Ciencias Sociales y del Comportamiento (2.ª ed.). Taylor & Francis. ISBN 978-1584889601.
- ↑ Jolliffe IT Análisis de componentes principales , Serie: Springer Series in Statistics, 2.ª ed., Springer, NY, 2002, XXIX, 487 p. 28 il. ISBN 978-0-387-95442-4
- ↑ Cattell, RB (1952). Análisis factorial . Nueva York: Harper.
- ↑ Fruchter, B. (1954). Introducción al análisis factorial . Van Nostrand.
- ↑ Cattell, RB (1978). Uso del análisis factorial en las ciencias del comportamiento y de la vida . Nueva York: Plenum.
- ↑ Child, D. (2006). Los fundamentos del análisis factorial, 3.ª edición . Bloomsbury Academic Press.
- ↑ Gorsuch, RL (1983). Análisis factorial, 2.ª edición . Hillsdale, NJ: Erlbaum.
- ↑ McDonald, RP (1985). Análisis factorial y métodos relacionados . Hillsdale, NJ: Erlbaum.
- 1 2 Fabrigar; et al. (1999). "Evaluación del uso del análisis factorial exploratorio en la investigación psicológica" (PDF) . Métodos psicológicos.
- 1 2 Suhr, Diane (2009). "Análisis de componentes principales frente a análisis factorial exploratorio" (PDF) . Actas de SUGI 30. Recuperado el 5 de abril de 2012 .
- ↑ SAS Statistics. "Análisis de componentes principales" (PDF) . Libro de texto de soporte de SAS .
- ↑ Meglen, RR (1991). "Examen de grandes bases de datos: un enfoque quimiométrico mediante análisis de componentes principales". Journal of Chemometrics . 5 (3): 163– 179. doi : 10.1002/cem.1180050305 . S2CID 120886184 .
- ↑ Brown, JD (enero de 2009). "Análisis de componentes principales y análisis factorial exploratorio: definiciones, diferencias y opciones" (PDF) . Shiken: Boletín del Grupo de Interés Especial en Pruebas y Evaluación de JALT . Consultado el 16 de abril de 2012 .
- 1 2 Mulaik, Stanley A (2010). Fundamentos del análisis factorial. Segunda edición . Boca Raton, Florida: CRC Press. pág. 6. ISBN 978-1-4200-9961-4.
- ↑ Spearman, Charles (1904). "Inteligencia general determinada y medida objetivamente". American Journal of Psychology . 15 (2): 201– 293. doi : 10.2307/1412107 . JSTOR 1412107 .
- ↑ Bartholomew, DJ (1995). "Spearman y el origen y desarrollo del análisis factorial". British Journal of Mathematical and Statistical Psychology . 48 (2): 211– 220. doi : 10.1111/j.2044-8317.1995.tb01060.x .
- ↑ Thurstone, Louis (1931). "Análisis factorial múltiple". Psychological Review . 38 (5): 406– 427. doi : 10.1037/h0069792 .
- ↑ Thurstone, Louis (1934). "Los vectores de la mente". The Psychological Review . 41 : 1–32 . doi : 10.1037/h0075959 .
- ↑ Thurstone, LL (1935). Los vectores de la mente. Análisis multifactorial para el aislamiento de rasgos primarios . Chicago, Illinois: University of Chicago Press.
- ↑ Bock, Robert (2007). «Repensando a Thurstone». En Cudeck, Robert; MacCallum, Robert C. (eds.). Análisis factorial a los 100 años . Mahwah, Nueva Jersey: Lawrence Erlbaum Associates. pág. 37. ISBN 978-0-8058-6212-6.
- ↑ Mckeown, Bruce (21 de junio de 2013). Metodología Q. SAGE Publications. ISBN 9781452242194OCLC 841672556
- ↑ Stephenson, W. (agosto de 1935). "Técnica de análisis factorial" . Nature . 136 (3434): 297. Bibcode : 1935Natur.136..297S . doi : 10.1038/136297b0 . ISSN 0028-0836 . S2CID 26952603 .
- ↑ Sternberg, RJ (1977). Metáforas de la mente: concepciones de la naturaleza de la inteligencia . Nueva York: Cambridge University Press. págs. 85–111 .
- ↑ "Análisis factorial" . Archivado del original el 18 de agosto de 2004. Consultado el 22 de julio de 2004 .
- ↑ Gregg, Phillip M.; Banks, Arthur S. (1965). "Dimensiones de los sistemas políticos: análisis factorial de una encuesta transnacional". American Political Science Review . 59 (3): 602– 614. doi : 10.2307/1953171 . JSTOR 1953171. S2CID 145459216 .
- ↑ Niemi, Richard G.; Craig, Stephen C.; Mattei, Franco (diciembre de 1991). "Medición de la eficacia política interna en el estudio de las elecciones nacionales de 1988" . American Political Science Review . 85 (4): 1407– 1413. doi : 10.2307/1963953 . ISSN 0003-0554 . JSTOR 1963953. S2CID 146641381 .
- ↑ Ritter, N. (2012). Una comparación de métodos libres de distribución y no libres de distribución en el análisis factorial. Ponencia presentada en la Conferencia de la Asociación de Investigación Educativa del Suroeste (SERA) 2012, Nueva Orleans, LA (ED529153).
- ↑ Subbarao, C.; Subbarao, Nevada; Chandu, SN (diciembre de 1996). "Caracterización de la contaminación de aguas subterráneas mediante análisis factorial". Geología Ambiental . 28 (4): 175– 180. Bibcode : 1996EnGeo..28..175S . doi : 10.1007/s002540050091 . S2CID 129655232 .
- ↑ Love, D.; Hallbauer, DK; Amos, A.; Hranova, RK (2004). "Análisis factorial como herramienta en la gestión de la calidad del agua subterránea: dos estudios de caso del sur de África". Física y Química de la Tierra . 29 ( 15– 18): 1135– 43. Bibcode : 2004PCE....29.1135L . doi : 10.1016/j.pce.2004.09.027 .
- ↑ Barton, ES; Hallbauer, DK (1996). "Composiciones de elementos traza e isótopos de U—Pb de tipos de pirita en el Arrecife Negro Proterozoico, Secuencia de Transvaal, Sudáfrica: Implicaciones sobre la génesis y la edad". Chemical Geology . 133 ( 1– 4): 173– 199. Bibcode : 1996ChGeo.133..173B . doi : 10.1016/S0009-2541(96)00075-7 .
- ↑ Hochreiter, Sepp; Inteligente, Djork-Arné; Obermayer, Klaus (2006). "Un nuevo método de resumen para datos a nivel de sonda affymetrix" . Bioinformática . 22 (8): 943– 9. doi : 10.1093/bioinformatics/btl033 . PMID 16473874 .
- ↑ "sklearn.decomposition.FactorAnalysis — documentación de scikit-learn 0.23.2" . scikit-learn.org .
- ↑ MacCallum, Robert (junio de 1983). "Una comparación de programas de análisis factorial en SPSS, BMDP y SAS". Psychometrika . 48 (2): 223– 231. doi : 10.1007/BF02294017 . S2CID 120770421 .
Lecturas adicionales
- Child, Dennis (2006), Fundamentos del análisis factorial (3.ª ed.), Continuum International , ISBN 978-0-8264-8000-2.
- Fabrigar, LR; Wegener, DT; MacCallum, RC; Strahan, EJ (septiembre de 1999). "Evaluación del uso del análisis factorial exploratorio en la investigación psicológica". Métodos Psicológicos . 4 (3): 272– 299. doi : 10.1037/1082-989X.4.3.272 .
- BT Gray (1997) Análisis factorial de orden superior (Ponencia presentada en congreso)
- Jennrich, Robert I., "Rotación a cargas simples usando la función de pérdida de componentes: el caso oblicuo," Psychometrika , Vol. 71, No. 1, pp. 173–191, marzo de 2006.
- Katz, Jeffrey Owen y Rohlf, F. James. Plano de función de producto primario: una rotación oblicua a una estructura simple. Multivariate Behavioral Research , abril de 1975, vol. 10, págs. 219-232.
- Katz, Jeffrey Owen y Rohlf, F. James. Functionplane: Un nuevo enfoque para la rotación de estructuras simples. Psychometrika , marzo de 1974, vol. 39, n.º 1, págs. 37–51.
- Katz, Jeffrey Owen y Rohlf, F. James. Análisis de conglomerados de puntos de función. Systematic Zoology , septiembre de 1973, vol. 22, n.º 3, págs. 295–301.
- Mulaik, SA (2010), Fundamentos del análisis factorial , Chapman & Hall.
- Preacher, KJ; MacCallum, RC (2003). "Reparando la máquina de análisis factorial eléctrico de Tom Swift" (PDF) . Comprensión de la estadística . 2 (1): 13– 43. doi : 10.1207/S15328031US0201_02 . hdl : 1808/1492 .
- J. Schmid y JM Leiman (1957). El desarrollo de soluciones factoriales jerárquicas. Psychometrika , 22(1), 53–61.
- Thompson, B. (2004), Análisis factorial exploratorio y confirmatorio: comprensión de conceptos y aplicaciones , Washington DC: American Psychological Association , ISBN 978-1591470939.
- Hans-Georg Wolff, Katja Preising (2005) Exploración de la estructura de ítems y factores de orden superior con la solución de Schmid-Leiman : Códigos de sintaxis para SPSS y SAS Métodos, instrumentos y computadoras de investigación del comportamiento , 37 (1), 48-58
Enlaces externos
- Guía para principiantes sobre el análisis factorial
- Análisis factorial exploratorio. Manuscrito de libro de Tucker, L. y MacCallum R. (1993). Recuperado el 8 de junio de 2006 de:Archivado el 23 de mayo de 2013 en Wayback Machine.
- Garson, G. David, "Análisis factorial", de Statnotes: Temas en análisis multivariante . Recuperado el 13 de abril de 2009 de StatNotes: Temas en análisis multivariante, de G. David Garson en la Universidad Estatal de Carolina del Norte, Programa de Administración Pública.
- Análisis factorial a los 100 años : material de la conferencia
- FARMS — Análisis factorial para la síntesis robusta de microarrays, un paquete de R
- Análisis factorial
- modelos de variables latentes
- Investigación de mercado cuantitativa
- Gestión de productos
- Investigación de mercado
- Segmentación del mercado