En el procesamiento de señales , el análisis de componentes independientes ( ICA ) es un método computacional para separar una señal multivariada en subcomponentes aditivos. Esto se logra asumiendo que como máximo un subcomponente es gaussiano y que los subcomponentes son estadísticamente independientes entre sí. [ 1 ] ICA fue inventado por Jeanny Hérault y Christian Jutten en 1985. [ 2 ] ICA es un caso especial de separación ciega de fuentes . Un ejemplo común de aplicación de ICA es el " problema de la fiesta de cóctel ", que consiste en escuchar el habla de una persona en una habitación ruidosa. [ 3 ]
Introducción
El análisis de componentes independientes (ICA) intenta descomponer una señal multivariada en señales no gaussianas independientes. Por ejemplo, el sonido suele ser una señal compuesta por la suma numérica, en cada instante t, de señales provenientes de diversas fuentes. La cuestión, entonces, es si es posible separar estas fuentes contribuyentes de la señal total observada. Cuando se cumple el supuesto de independencia estadística, la separación ciega mediante ICA de una señal mixta ofrece muy buenos resultados. [ 5 ] También se utiliza para señales que, con fines de análisis, no se supone que se generen mediante mezcla.
Una aplicación sencilla del ICA es el problema de la "fiesta de cóctel ", donde las señales de voz subyacentes se separan de una muestra de datos compuesta por personas hablando simultáneamente en una habitación. Generalmente, el problema se simplifica asumiendo que no hay retardos ni ecos. Cabe destacar que una señal filtrada y retardada es una copia de un componente dependiente, por lo que no se incumple el supuesto de independencia estadística.
Mezclar pesos para construir elseñales observadas de laLos componentes se pueden colocar en unmatriz. Algo importante a considerar es que siHay fuentes presentes, al menosSe necesitan observaciones (por ejemplo, micrófonos si la señal observada es de audio) para recuperar las señales originales. Cuando hay un número igual de observaciones y señales fuente, la matriz de mezcla es cuadrada (). Otros casos de indeterminados () y sobredeterminado () han sido investigados.
El éxito de la separación ICA de señales mixtas se basa en dos supuestos y tres efectos de la mezcla de señales fuente. Dos supuestos:
- Las señales de origen son independientes entre sí.
- Los valores de cada señal fuente tienen distribuciones no gaussianas.
Tres efectos de la mezcla de señales de origen:
- Independencia: Según la suposición 1, las señales fuente son independientes; sin embargo, sus mezclas de señales no lo son. Esto se debe a que las mezclas de señales comparten las mismas señales fuente.
- Normalidad: Según el Teorema del Límite Central , la distribución de una suma de variables aleatorias independientes con varianza finita tiende a una distribución gaussiana. En términos generales, la suma de dos variables aleatorias independientes suele tener una distribución más cercana a la gaussiana que cualquiera de las dos variables originales. Aquí consideramos el valor de cada señal como la variable aleatoria.
- Complejidad: La complejidad temporal de cualquier mezcla de señales es mayor que la de su señal fuente constituyente más simple.
Estos principios contribuyen al establecimiento básico de ICA. Si las señales extraídas de un conjunto de mezclas son independientes y tienen distribuciones no gaussianas o tienen baja complejidad, entonces deben ser señales fuente. [ 6 ] [ 7 ]
Otro ejemplo común es la esteganografía de imágenes , donde se utiliza ICA para incrustar una imagen dentro de otra. Por ejemplo, dos imágenes en escala de grises se pueden combinar linealmente para crear imágenes mixtas en las que el contenido oculto es visualmente imperceptible. Posteriormente, se puede utilizar ICA para recuperar las imágenes originales a partir de las imágenes mixtas. Esta técnica es la base de la marca de agua digital, que permite incrustar información de propiedad en las imágenes, así como aplicaciones más encubiertas, como la transmisión de información sin ser detectada. El método incluso se ha relacionado con casos reales de ciberespionaje. En estas aplicaciones, ICA sirve para separar los datos basándose en la independencia estadística, lo que permite extraer componentes ocultos que no son evidentes en los datos observados.
Las técnicas esteganográficas, incluidas aquellas que potencialmente implican análisis basados en ICA, se han utilizado en casos reales de ciberespionaje. En 2010, el FBI desmanteló una red de espionaje rusa conocida como el "Programa Ilegal" (Operación Ghost Stories), donde los agentes utilizaron herramientas esteganográficas personalizadas para ocultar mensajes de texto cifrados dentro de archivos de imagen compartidos en línea. [ 8 ]
En otro caso, Xiaoqing Zheng, exingeniero de General Electric, fue condenado en 2022 por espionaje económico. Zheng utilizó esteganografía para extraer información confidencial sobre tecnología de turbinas, insertando datos de propiedad exclusiva en archivos de imagen para su transferencia a entidades en China. [ 9 ]
Definición de la independencia de los componentes
ICA encuentra los componentes independientes (también llamados factores, variables latentes o fuentes) maximizando la independencia estadística de los componentes estimados. Podemos elegir una de muchas maneras de definir una aproximación para la independencia, y esta elección rige la forma del algoritmo ICA. Las dos definiciones más amplias de independencia para ICA son:
- Minimización de la información mutua
- Maximización de la no gaussianidad
La familia de algoritmos ICA de minimización de la información mutua (MMI) utiliza medidas como la divergencia de Kullback-Leibler y la entropía máxima . La familia de algoritmos ICA de no gaussianidad, motivada por el teorema del límite central , utiliza la curtosis y la negentropía . [ 10 ]
Los algoritmos típicos para ICA utilizan centrado (restar la media para crear una señal de media cero), blanqueamiento (generalmente con la descomposición de valores propios ), [ 11 ] y reducción de dimensionalidad como pasos de preprocesamiento para simplificar y reducir la complejidad del problema para el algoritmo iterativo real.
Definiciones matemáticas
El análisis de componentes independientes lineales se puede dividir en casos sin ruido y con ruido, donde el ICA sin ruido es un caso especial del ICA con ruido. El ICA no lineal debe considerarse como un caso aparte.
Derivación general
En el modelo ICA clásico, se supone que los datos observadosen ese momentose genera a partir de señales fuentemediante una transformación lineal, dóndees una matriz de mezcla desconocida e invertible. Para recuperar las señales de origen, los datos se centran primero (media cero) y luego se blanquean de modo que los datos transformados tengan covarianza unitaria. Este blanqueamiento reduce el problema de estimar una matriz general.para estimar una matriz ortogonal, lo que simplifica significativamente la búsqueda de componentes independientes.
Si la matriz de covarianza de los datos centrados es, luego utilizando la descomposición en valores propios, la transformación blanqueadora puede tomarse comoEste paso garantiza que las fuentes recuperadas no estén correlacionadas y tengan varianza unitaria, dejando únicamente la tarea de rotar los datos blanqueados para maximizar la independencia estadística. Esta derivación general subyace a muchos algoritmos ICA y es fundamental para comprender el modelo ICA. [ 12 ]
Problema de mezcla reducida
El análisis de componentes independientes ( ICA ) aborda el problema de recuperar un conjunto de señales fuente no observadas.a partir de señales mixtas observadas, basado en el modelo de mezcla lineal:
donde eles unmatriz invertible llamada matriz de mezcla ,representa el vector m-dimensional que contiene los valores de las fuentes en el tiempo, yes el vector correspondiente de valores observados en el tiempoEl objetivo es estimar ambosy las señales de origenúnicamente a partir de los datos observados.
Tras centrarla, la matriz de Gram se calcula de la siguiente manera: donde D es una matriz diagonal con entradas positivas (suponiendotiene rango máximo), y Q es una matriz ortogonal. [ 11 ] Escribiendo la SVD de la matriz de mezclay comparando conLa mezcla A tiene la forma Por lo tanto, los valores fuente normalizados satisfacen , dónde Por lo tanto, ICA se reduce a encontrar la matriz ortogonal.Esta matriz se puede calcular utilizando técnicas de optimización mediante métodos de búsqueda de proyección (véase Búsqueda de proyección ). [ 11 ]
Entre los algoritmos más conocidos para el análisis de componentes independientes (ICA) se incluyen Infomax , FastICA , JADE y el análisis de componentes independientes del núcleo , entre otros. En general, el ICA no puede identificar el número real de señales fuente, un ordenamiento único y correcto de las mismas, ni la escala adecuada (incluido el signo) de las señales fuente.
El ICA es importante para la separación ciega de señales y tiene muchas aplicaciones prácticas. Está estrechamente relacionado con (o incluso es un caso especial de) la búsqueda de un código factorial de los datos, es decir, una nueva representación vectorial de cada vector de datos tal que se codifique de forma única mediante el vector de código resultante (codificación sin pérdidas), pero los componentes del código son estadísticamente independientes.
ICA lineal sin ruido
Los componentesdel vector aleatorio observadose generan como la suma de los componentes independientes,:
ponderado por los pesos de mezcla.
El mismo modelo generativo se puede escribir en forma vectorial como, donde el vector aleatorio observadoestá representado por los vectores baseLos vectores baseforman las columnas de la matriz de mezclay la fórmula generativa se puede escribir como, dónde.
Dado el modelo y las realizaciones (muestras)del vector aleatorioLa tarea consiste en estimar la matriz de mezcla.y las fuentesEsto se hace calculando de forma adaptativa elvectores y estableciendo una función de costo que maximice la no gaussianidad de los calculadoso minimiza la información mutua. En algunos casos, se puede utilizar el conocimiento previo de las distribuciones de probabilidad de las fuentes en la función de coste.
Las fuentes originalesse puede recuperar multiplicando las señales observadascon la inversa de la matriz de mezcla, también conocida como matriz de desmezcla. Aquí se supone que la matriz de mezcla es cuadrada (). Si el número de vectores base es mayor que la dimensionalidad de los vectores observados,, la tarea es sobrecompleta pero aún se puede resolver con la pseudoinversa .
ICA lineal con ruido
Con la suposición adicional de ruido gaussiano de media cero y no correlacionado, el modelo ICA toma la forma.
ICA no lineal
La mezcla de las fuentes no tiene por qué ser lineal. Utilizando una función de mezcla no linealcon parámetrosEl modelo ICA no lineal es.
Identificabilidad
Los componentes independientes son identificables salvo una permutación y escalado de las fuentes. [ 13 ] Esta identificabilidad requiere que:
- Como máximo una de las fuenteses gaussiana,
- El número de mezclas observadas,debe ser al menos tan grande como el número de componentes estimados:. Es equivalente a decir que la matriz de mezcladebe ser de rango completo para que exista su inverso.
ICA binario
Una variante especial del ICA es el ICA binario, en el que tanto las fuentes de señal como los monitores están en formato binario, y las observaciones de los monitores son mezclas disyuntivas de fuentes binarias independientes. Se ha demostrado que este problema tiene aplicaciones en diversos ámbitos, como el diagnóstico médico , la asignación de clústeres múltiples , la tomografía de redes y la gestión de recursos de internet .
Dejarsea el conjunto de variables binarias demonitores ysea el conjunto de variables binarias defuentes. Las conexiones fuente-monitor están representadas por la matriz de mezcla (desconocida)., dóndeindica que la señal de la i -ésima fuente puede ser observada por el j -ésimo monitor. El sistema funciona de la siguiente manera: en cualquier momento, si una fuenteestá activo () y está conectado al monitor() luego el monitorobservará alguna actividad (Formalmente tenemos:
dóndees la operación booleana AND yes una operación OR booleana. El ruido no se modela explícitamente, sino que puede tratarse como fuentes independientes.
El problema anterior se puede resolver heurísticamente [ 14 ] asumiendo que las variables son continuas y ejecutando FastICA en datos de observación binarios para obtener la matriz de mezcla.(valores reales), luego aplique técnicas de números redondos enpara obtener los valores binarios. Se ha demostrado que este método produce un resultado muy impreciso.
Otro método consiste en utilizar programación dinámica : dividir recursivamente la matriz de observación.en sus submatrices y ejecutar el algoritmo de inferencia en estas submatrices. La observación clave que lleva a este algoritmo es la submatrizdedóndecorresponde a la matriz de observación imparcial de componentes ocultos que no tienen conexión con la-ésimo monitor. Los resultados experimentales de [ 15 ] muestran que este enfoque es preciso bajo niveles de ruido moderados.
El marco ICA binario generalizado [ 16 ] introduce una formulación del problema más amplia que no requiere conocimiento previo del modelo generativo. En otras palabras, este método intenta descomponer una fuente en sus componentes independientes (en la medida de lo posible y sin perder información) sin ninguna suposición previa sobre su generación. Si bien este problema parece bastante complejo, puede resolverse con precisión mediante un algoritmo de árbol de búsqueda de ramificación y acotación , o bien acotarse superiormente con una sola multiplicación de una matriz por un vector.
Métodos para la separación ciega de fuentes
Búsqueda de proyección
Las mezclas de señales tienden a tener funciones de densidad de probabilidad gaussianas, y las señales fuente tienden a tener funciones de densidad de probabilidad no gaussianas. Cada señal fuente se puede extraer de un conjunto de mezclas de señales calculando el producto escalar de un vector de ponderación y aquellas mezclas de señales donde este producto escalar proporciona una proyección ortogonal de las mezclas de señales. El desafío restante es encontrar dicho vector de ponderación. Un tipo de método para lograrlo es la búsqueda de proyección . [ 17 ] [ 18 ]
La búsqueda de proyecciones busca una proyección a la vez de manera que la señal extraída sea lo menos gaussiana posible. Esto contrasta con el ICA, que normalmente extrae M señales simultáneamente de M mezclas de señales, lo que requiere estimar una matriz de desmezcla M × M. Una ventaja práctica de la búsqueda de proyecciones sobre el ICA es que se pueden extraer menos de M señales si es necesario, donde cada señal fuente se extrae de M mezclas de señales utilizando un vector de ponderación de M elementos.
Podemos utilizar la curtosis para recuperar la señal de múltiples fuentes encontrando los vectores de peso correctos mediante el uso de la búsqueda de proyección.
La curtosis de la función de densidad de probabilidad de una señal, para una muestra finita, se calcula como
dóndees la media muestral de, las señales extraídas. La constante 3 asegura que las señales gaussianas tengan curtosis cero, las señales supergaussianas tengan curtosis positiva y las señales subgaussianas tengan curtosis negativa. El denominador es la varianza dey garantiza que la curtosis medida tenga en cuenta la varianza de la señal. El objetivo de la búsqueda de proyección es maximizar la curtosis y lograr que la señal extraída sea lo menos normal posible.
Utilizando la curtosis como medida de no normalidad, ahora podemos examinar cómo la curtosis de una señalextraído de un conjunto de mezclas Mvaría según el vector de pesose rota alrededor del origen. Dado nuestro supuesto de que cada señal fuentees supergaussiano como cabría esperar:
- la curtosis de la señal extraídaser máximo precisamente cuando.
- la curtosis de la señal extraídaser máximo cuandoes ortogonal a los ejes proyectadosoporque sabemos que el vector de peso óptimo debe ser ortogonal a un eje transformado.o.
Para señales de mezcla de múltiples fuentes, podemos utilizar la curtosis y la ortogonalización de Gram-Schmidt (GSO) para recuperar las señales. Dada una mezcla de M señales en un espacio de M dimensiones, GSO proyecta estos puntos de datos en un espacio de ( M-1 ) dimensiones mediante el vector de pesos. Podemos garantizar la independencia de las señales extraídas con el uso de GSO.
Para encontrar el valor correcto dePodemos utilizar el método de descenso de gradiente . En primer lugar, blanqueamos los datos y los transformamos.en una nueva mezcla, que tiene varianza unitaria, yEste proceso se puede lograr aplicando la descomposición en valores singulares a,
Reescalar cada vectory dejar. La señal extraída por un vector ponderadoes. Si el vector de pesos w tiene longitud unitaria, entonces la varianza de y también es 1, es decirLa curtosis se puede escribir, por lo tanto, como:
El proceso de actualización paraes:
dóndees una pequeña constante para garantizar queconverge a la solución óptima. Después de cada actualización, normalizamosy establecery repetir el proceso de actualización hasta la convergencia. También podemos usar otro algoritmo para actualizar el vector de pesos..
Otro enfoque es usar negentropía [ 10 ] [ 19 ] en lugar de curtosis. Usar negentropía es un método más robusto que curtosis, ya que curtosis es muy sensible a los valores atípicos. Los métodos de negentropía se basan en una propiedad importante de la distribución gaussiana: una variable gaussiana tiene la mayor entropía entre todas las variables aleatorias continuas de igual varianza. Esta es también la razón por la que queremos encontrar las variables más no gaussianas. Una demostración simple se puede encontrar en Entropía diferencial .
y es una variable aleatoria gaussiana con la misma matriz de covarianza que x.
Una aproximación para la negentropía es
Una demostración se puede encontrar en los trabajos originales de Comon; [ 20 ] [ 10 ] ha sido reproducida en el libro Análisis de componentes independientes de Aapo Hyvärinen, Juha Karhunen y Erkki Oja [ 21 ] Esta aproximación también sufre del mismo problema que la curtosis (sensibilidad a los valores atípicos). Se han desarrollado otros enfoques. [ 22 ]
Una selección deyson
- y
Basado en Infomax
Infomax ICA [ 23 ] es esencialmente una versión paralela y multivariada de la búsqueda de proyección. Mientras que la búsqueda de proyección extrae una serie de señales una a una de un conjunto de M mezclas de señales, ICA extrae M señales en paralelo. Esto tiende a hacer que ICA sea más robusto que la búsqueda de proyección. [ 24 ]
El método de proyección utiliza la ortogonalización de Gram-Schmidt para garantizar la independencia de la señal extraída, mientras que el ICA utiliza la estimación infomax y de máxima verosimilitud para asegurar la independencia de la señal extraída. La no normalidad de la señal extraída se logra asignándole un modelo apropiado, o distribución a priori.
El proceso de ICA basado en Infomax , en resumen, es: dado un conjunto de mezclas de señalesy un conjunto de funciones de distribución acumulativa (FDA) de modelos independientes e idénticos., buscamos la matriz de desmezclalo que maximiza la entropía conjunta de las señales, dóndeson las señales extraídas porDado el óptimolas señalestienen entropía máxima y por lo tanto son independientes, lo que garantiza que las señales extraídastambién son independientes.es una función invertible, y es el modelo de señal. Nótese que si la función de densidad de probabilidad del modelo de señal de la fuentecoincide con la función de densidad de probabilidad de la señal extraída, luego maximizando la entropía conjunta detambién maximiza la cantidad de información mutua entreyPor esta razón, el uso de la entropía para extraer señales independientes se conoce como infomax .
Consideremos la entropía de la variable vectorial., dóndees el conjunto de señales extraídas por la matriz de desmezclaPara un conjunto finito de valores muestreados de una distribución con pdf, la entropía dese puede estimar como:
El PDF conjuntoSe puede demostrar que está relacionado con la función de densidad de probabilidad conjunta.de las señales extraídas mediante la forma multivariada:
dóndees la matriz jacobiana . Tenemos, y¿Es la función de densidad de probabilidad (pdf) asumida para las señales fuente?, por lo tanto,
por lo tanto,
Sabemos que cuando,es de distribución uniforme yse maximiza. Dado que
dóndees el valor absoluto del determinante de la matriz de desmezcla. Por lo tanto,
entonces,
desdey maximizarno afecta, por lo que podemos maximizar la función
para lograr la independencia de la señal extraída.
Si hay M funciones de densidad de probabilidad marginales de la función de densidad de probabilidad conjunta del modeloson independientes y utilizan la función de densidad de probabilidad del modelo supergaussiano común para las señales fuente., entonces tenemos
En la suma, dada una mezcla de señales observada , el conjunto correspondiente de señales extraídas y modelo de señal de fuente, podemos encontrar la matriz de desmezcla óptimay hacer que las señales extraídas sean independientes y no gaussianas. Al igual que en el caso de la búsqueda de proyección, podemos usar el método de descenso de gradiente para encontrar la solución óptima de la matriz de desmezcla.
Basado en la estimación de máxima verosimilitud
La estimación de máxima verosimilitud (MLE) es una herramienta estadística estándar para encontrar valores de parámetros (por ejemplo, la matriz de desmezcla).) que proporcionan el mejor ajuste de algunos datos (por ejemplo, las señales extraídas)) a un modelo dado (por ejemplo, la función de densidad de probabilidad conjunta supuesta (pdf)de señales de fuente). [ 24 ]
El "modelo" de ML incluye una especificación de un pdf, que en este caso es el pdfde las señales de la fuente desconocida. Utilizando ML ICA , el objetivo es encontrar una matriz de desmezcla que produzca señales extraídas.con un pdf conjunto lo más similar posible al pdf conjuntode las señales de la fuente desconocida.
Por lo tanto, MLE se basa en la suposición de que si la función de densidad de probabilidad del modeloy los parámetros del modeloSi son correctos, entonces se debería obtener una alta probabilidad para los datos.que fueron realmente observados. Por el contrario, siSi los valores de los parámetros están lejos de ser correctos, entonces se esperaría una baja probabilidad de los datos observados.
Utilizando MLE , llamamos probabilidad de los datos observados para un conjunto dado de valores de parámetros del modelo (por ejemplo, una pdf)y una matriz) la probabilidad de los valores de los parámetros del modelo dados los datos observados.
Definimos una función de verosimilitudde:
Esto equivale a la densidad de probabilidad en, desde.
Por lo tanto, si deseamos encontrar unque es muy probable que haya generado las mezclas observadasa partir de señales de fuente desconocidacon pdfentonces solo necesitamos encontrar esolo que maximiza la probabilidadLa matriz de desmezcla que maximiza la ecuación se conoce como el estimador de máxima verosimilitud (MLE) de la matriz de desmezcla óptima.
Es práctica común utilizar la verosimilitud logarítmica , porque es más fácil de evaluar. Como el logaritmo es una función monótona,que maximiza la funcióntambién maximiza su logaritmoEsto nos permite tomar el logaritmo de la ecuación anterior, lo que produce la función de verosimilitud logarítmica.
Si sustituimos una función de densidad de probabilidad (pdf) de un modelo de curtosis alta de uso común para las señales fuenteentonces tenemos
Esta matrizque maximiza esta función es la estimación de máxima verosimilitud .
Historia y antecedentes
El marco general inicial para el análisis de componentes independientes fue introducido por Jeanny Hérault y Bernard Ans en 1984, [ 25 ] desarrollado posteriormente por Christian Jutten en 1985 y 1986, [ 2 ] [ 26 ] [ 27 ] y refinado por Pierre Comon en 1991, [ 20 ] y popularizado en su artículo de 1994. [ 10 ] En 1995, Tony Bell y Terry Sejnowski introdujeron un algoritmo ICA rápido y eficiente basado en infomax , un principio introducido por Ralph Linsker en 1987. Existe un vínculo entre la estimación de máxima verosimilitud y los enfoques Infomax. [ 28 ] JF. Cardoso publicó un tutorial bastante completo sobre el enfoque de máxima verosimilitud para ICA en 1998. [ 29 ]
Hay muchos algoritmos disponibles en la literatura que realizan ICA. Uno muy utilizado, incluso en aplicaciones industriales, es el algoritmo FastICA, desarrollado por Hyvärinen y Oja, [ 30 ] que utiliza la negentropía como función de costo, ya propuesta 7 años antes por Pierre Comon en este contexto. [ 10 ] Otros ejemplos están más relacionados con la separación ciega de fuentes donde se utiliza un enfoque más general. Por ejemplo, se puede prescindir del supuesto de independencia y separar señales mutuamente correlacionadas, es decir, señales estadísticamente "dependientes". Sepp Hochreiter y Jürgen Schmidhuber mostraron cómo obtener ICA no lineal o separación de fuentes como un subproducto de la regularización (1999). [ 31 ] Su método no requiere conocimiento a priori sobre el número de fuentes independientes.
Aplicaciones
ICA puede extenderse para analizar señales no físicas. Por ejemplo, ICA se ha aplicado para descubrir temas de discusión en un conjunto de archivos de listas de noticias.
A continuación se enumeran algunas aplicaciones de la ICA: [ 6 ]

- esteganografía de imágenes [ 32 ]
- Imágenes ópticas de neuronas [ 33 ]
- clasificación de picos neuronales [ 34 ]
- reconocimiento facial [ 35 ]
- modelado de campos receptivos de neuronas visuales primarias [ 36 ]
- predicción de precios del mercado de valores [ 37 ]
- comunicaciones de telefonía móvil [ 38 ]
- detección de la madurez de los tomates basada en el color [ 39 ]
- eliminar artefactos, como parpadeos, de los datos de EEG . [ 40 ]
- predicción de la toma de decisiones mediante EEG [ 41 ]
- Análisis de los cambios en la expresión génica a lo largo del tiempo en experimentos de secuenciación de ARN de células individuales. [ 42 ]
- estudios de la red neuronal en estado de reposo del cerebro. [ 43 ]
- astronomía y cosmología [ 44 ]
- finanzas [ 45 ]
Disponibilidad
ICA se puede aplicar a través del siguiente software:
- SAS PROC ICA
- Paquete R ICA
- Implementación en Python de scikit-learn sklearn.decomposition.FastICA
- Implementación en C++ de mlpack de RADICAL (El algoritmo ICA robusto, preciso y directo (RADICAL)).
Véase también
Notas
- ↑ "Análisis de componentes independientes: una demostración" .
- ^ Ans , B., Hérault, J. y Jutten, C. (1985). Arquitecturas neuromimétiques adaptativas : Detección de primitivas. Cognitiva 85 (Vol. 2, págs. 593-597). París: CESTA.
- ↑ Hyvärinen, Aapo (2013). " Análisis de componentes independientes: avances recientes" . Philosophical Transactions: Mathematical, Physical and Engineering Sciences . 371 (1984) 20110534. Bibcode : 2012RSPTA.37110534H . doi : 10.1098 / rsta.2011.0534 . ISSN 1364-503X . JSTOR 41739975. PMC 3538438. PMID 23277597 .
- ↑ Isomura, Takuya; Toyoizumi, Taro (2016). "Una regla de aprendizaje local para el análisis de componentes independientes" . Scientific Reports . 6 28073. Bibcode : 2016NatSR...628073I . doi : 10.1038/srep28073 . PMC 4914970. PMID 27323661 .
- ↑ Comon, P.; Jutten C., (2010): Handbook of Blind Source Separation, Independent Component Analysis and Applications. Academic Press, Oxford, Reino Unido. ISBN 978-0-12-374726-6
- 1 2 Stone, James V. (2004). Análisis de componentes independientes: una introducción didáctica . Cambridge, Massachusetts: MIT Press. ISBN 978-0-262-69315-8.
- ↑ Hyvärinen, Aapo; Karhunen, Juha; Oja, Erkki (2001). Análisis de componentes independientes (1ª ed.). Nueva York: John Wiley & Sons. ISBN 978-0-471-22131-9.
- ↑ "Operación Historias Fantasma: Dentro del Caso del Espionaje Ruso" . FBI.gov . Oficina Federal de Investigación. 28 de junio de 2010.
- ↑ "Exingeniero de GE Power condenado por conspiración para cometer espionaje económico" . Justice.gov . Departamento de Justicia de EE. UU. 3 de enero de 2022.
- 1 2 3 4 5 Pierre Comon (1994) Análisis de componentes independientes, ¿un concepto nuevo? http://www.ece.ucsb.edu/wcsl/courses/ECE594/594C_F10Madhow/comon94.pdf
- 1 2 3 Holmes, M. (2023). Introducción a la computación científica y al análisis de datos, 2.ª ed . Springer. ISBN 978-3-031-22429-4.
- ↑ Holmes, Mark (2023). Introducción a la computación científica y al análisis de datos (2.ª ed.). Springer. ISBN 978-3-031-22429-4.
- ↑ Teorema 11, Comon, Pierre. "Análisis de componentes independientes, ¿un concepto nuevo?". Procesamiento de señales 36.3 (1994): 287-314.
- ↑ Johan Himberg y Aapo Hyvärinen, Análisis de componentes independientes para datos binarios: un estudio experimental , Actas del Taller Internacional sobre Análisis de Componentes Independientes y Separación Ciega de Señales (ICA2001), San Diego, California, 2001.
- ↑ Huy Nguyen y Rong Zheng, Análisis de componentes independientes binarios con mezclas or , IEEE Transactions on Signal Processing, Vol. 59, Número 7. (julio de 2011), págs. 3168 – 3181.
- ↑ Painsky, Amichai; Rosset, Saharon; Feder, Meir (2014). "Análisis generalizado de componentes independientes binarios". Simposio Internacional IEEE de Teoría de la Información de 2014. págs. 1326–1330 . doi : 10.1109/ISIT.2014.6875048 . ISBN 978-1-4799-5186-4. S2CID 18579555 .
- ↑ James V. Stone (2004); "Análisis de componentes independientes: una introducción didáctica", The MIT Press, Cambridge, Massachusetts, Londres, Inglaterra; ISBN 0-262-69315-1
- ↑ Kruskal, JB. 1969; "Hacia un método práctico que ayuda a descubrir la estructura de un conjunto de observaciones al encontrar la transformación de línea que optimiza un nuevo "índice de condensación", Páginas 427–440 de: Milton, RC, & Nelder, JA (eds), Computación estadística; Nueva York, Academic Press
- ↑ Hyvärinen, Aapo; Erkki Oja (2000). "Análisis de componentes independientes: algoritmos y aplicaciones". Redes Neuronales . 4-5. 13 ( 4– 5): 411– 430. Bibcode : 2000NN.....13..411H . CiteSeerX 10.1.1.79.7003 . doi : 10.1016/s0893-6080(00)00026-5 . PMID 10946390 . S2CID 11959218 .
- 1 2 P.Comon, Análisis de componentes independientes, Taller sobre estadística de orden superior, julio de 1991, republicado en JL. Lacoume, editor, Estadística de orden superior, págs. 29-38. Elsevier, Ámsterdam, Londres, 1992. Enlace HAL
- ↑ Hyvärinen, Aapo; Karhunen, Juha; Oja, Erkki (2001). Análisis de componentes independientes (Reimpresión ed.). Nueva York, Nueva York: Wiley. ISBN 978-0-471-40540-5.
- ↑ Hyvärinen, Aapo (1998). "Nuevas aproximaciones de la entropía diferencial para el análisis de componentes independientes y la búsqueda de proyecciones". Advances in Neural Information Processing Systems . 10 : 273–279 .
- ↑ Bell, AJ; Sejnowski, TJ (1995). "Un enfoque de maximización de la información para la separación ciega y la deconvolución ciega", Neural Computation, 7, 1129-1159
- 1 2 James V. Stone (2004). "Análisis de componentes independientes: una introducción didáctica", The MIT Press Cambridge, Massachusetts, Londres, Inglaterra; ISBN 0-262-69315-1
- ^ Hérault, J.; Respuesta, B. (1984). "Réseau de neurones à synapses modificables: Décodage de mensajes sensoriales compuestos por aprendizaje no supervisado y permanente". Cuentas Rendus de la Academia de Ciencias, Serie III . 299 : 525-528 .
- ^ Hérault, J., Jutten, C. y Ans, B. (1985). Detección de grandezas primitivas en un mensaje compuesto por una arquitectura de cálculo neuromimétique en aprendizaje no supervisado. Actas del décimo taller Traitement du signal et ses apps (Vol. 2, págs. 1017-1022). Niza (Francia): GRETSI.
- ↑ Hérault, J., & Jutten, C. (1986). Procesamiento de señales adaptativo espacio-temporal mediante modelos de redes neuronales. Conferencia Internacional sobre Redes Neuronales para la Computación (págs. 206-211). Snowbird (Utah, EE. UU.).
- ↑ JF.Cardoso, "Infomax y máxima verosimilitud para la separación de fuentes", IEEE Sig. Proc. Letters, 1997, 4(4):112-114.
- ↑ JF.Cardoso, "Separación ciega de señales: principios estadísticos", Proc. of the IEEE, 1998, 90(8):2009-2025.
- ↑ Hyvärinen, A.; Oja, E. (2000-06-01). "Análisis de componentes independientes: algoritmos y aplicaciones" (PDF) . Redes neuronales . 13 (4): 411– 430. Bibcode : 2000NN.....13..411H . doi : 10.1016 / S0893-6080(00)00026-5 . ISSN 0893-6080 . PMID 10946390. S2CID 11959218 .
- ↑ Hochreiter, Sepp; Schmidhuber, Jürgen (1999). "Feature Extraction Through LOCOCODE" ( PDF) . Neural Computation . 11 (3): 679–714 . doi : 10.1162/089976699300016629 . ISSN 0899-7667 . PMID 10085426. S2CID 1642107. Archivado del original (PDF) el 6 de julio de 2017. Consultado el 24 de febrero de 2018 .
- ↑ Ferreira, Artur J.; Figueiredo, Mário AT (2006). "Sobre el uso del análisis de componentes independientes para la compresión de imágenes" . Procesamiento de señales: Comunicación de imágenes . 21 (5): 378– 389. doi : 10.1016/j.image.2006.01.002 . ISSN 0923-5965 .
- ↑ Brown, GD; Yamada, S; Sejnowski, TJ (2001). "Análisis de componentes independientes en la fiesta del cóctel neuronal". Trends in Neurosciences . 24 (1): 54– 63. doi : 10.1016/s0166-2236(00)01683-0 . PMID 11163888 . S2CID 511254 .
- ↑ Lewicki, MS (1998). "Revisión de métodos para la clasificación de picos: detección y clasificación de potenciales de acción neuronales". Network: Computation in Neural Systems . 9 (4): 53– 78. Bibcode : 1998NCNS....9..R53L . doi : 10.1088/0954-898X_9_4_001 . S2CID 10290908 .
- ↑ Barlett, MS (2001). Análisis de imágenes faciales mediante aprendizaje no supervisado . Boston: Kluwer International Series on Engineering and Computer Science.
- ↑ Bell, AJ; Sejnowski, TJ (1997). "Los componentes independientes de las escenas naturales son filtros de borde" . Vision Research . 37 (23): 3327– 3338. doi : 10.1016/s0042-6989(97)00121-1 . PMC 2882863. PMID 9425547 .
- ↑ Back, AD; Weigend, AS (1997). "Una primera aplicación del análisis de componentes independientes para extraer la estructura de los rendimientos bursátiles" . International Journal of Neural Systems . 8 (4): 473– 484. Bibcode : 1997IJNS...08..473B . doi : 10.1142/s0129065797000458 . PMID 9730022. S2CID 872703 .
- ↑ Hyvarinen, A, Karhunen, J y Oja, E (2001a). Análisis de componentes independientes . Nueva York: John Wiley and Sons.
{{cite book}}: CS1 maint: varios nombres: lista de autores ( enlace ) - ↑ Polder, G; van der Heijen, FWAM (2003). "Estimación de la distribución de compuestos en imágenes espectrales de tomates mediante análisis de componentes independientes" . En R. Leitner (ed.). Imágenes espectrales. Actas del Taller Internacional de Carinthian Tech Research AG, Graz, Austria, 3 de abril de 2003. Viena, Austria: Sociedad Austriaca de Informática. págs. 57–64 .
- ↑ Delorme, A; Sejnowski, T; Makeig, S (2007). "Detección mejorada de artefactos en datos de EEG mediante estadísticas de orden superior y análisis de componentes independientes" . NeuroImage . 34 ( 4): 1443– 1449. doi : 10.1016/j.neuroimage.2006.11.004 . PMC 2895624. PMID 17188898 .
- ↑ Douglas, P (2013). "Decodificación de ensayos individuales de la toma de decisiones sobre creencias a partir de datos de EEG y fMRI utilizando características de componentes independientes" . Frontiers in Human Neuroscience . 7 : 392. doi : 10.3389/fnhum.2013.00392 . PMC 3728485. PMID 23914164 .
- ↑ Trapnell, C; Cacchiarelli, D; Grimsby, J (2014). "La dinámica y los reguladores de las decisiones sobre el destino celular se revelan mediante el ordenamiento pseudotemporal de células individuales" . Nature Biotechnology . 32 (4): 381– 386. doi : 10.1038/nbt.2859 . PMC 4122333. PMID 24658644 .
- ^ Kiviniemi, Vesa J.; Kantola, Juha-Heikki; Jauhiainen, Jukka; Hyvärinen, Aapo; Tervonen, Osmo (2003). "Análisis de componentes independientes de fuentes de señales de resonancia magnética funcional no deterministas". NeuroImagen . 19 (2): 253– 260. doi : 10.1016/S1053-8119(03)00097-1 . PMID 12814576 . S2CID 17110486 .
- ^ Wang, Jingying; Xu, Haiguang; Gu, Junhua; An, Tao; Cui, Haijuan; Li, Jianxun; Zhang, Zhongli; Zheng, Qian; Wu, Xiang-Ping (1 de noviembre de 2010). "¿Cómo identificar y separar cúmulos de galaxias brillantes del cielo de radio de baja frecuencia?" . La revista astrofísica . 723 (1): 620– 633. arXiv : 1008.3391 . Código Bib : 2010ApJ...723..620W . doi : 10.1088/0004-637X/723/1/620 . ISSN 0004-637X .
- ↑ Moraux, Franck; Villa, Christophe (2003). «La dinámica de la estructura temporal de los tipos de interés: un análisis de componentes independientes». Enfoques conexionistas en economía y ciencias de la gestión . Avances en ciencias de la gestión computacional. Vol. 6. págs. 215–232 . doi : 10.1007/978-1-4757-3722-6_11 . ISBN 978-1-4757-3722-6.
Referencias
- Comon, Pierre (1994): "Análisis de componentes independientes: ¿un nuevo concepto?" Archivado el 4 de marzo de 2016 en Wayback Machine , Procesamiento de señales , 36(3):287–314 (El artículo original que describe el concepto de ICA)
- Hyvarinen, A.; Karhunen, J.; Oja, E. (2001): Análisis de componentes independientes , Nueva York: Wiley, ISBN 978-0-471-40540-5( Capítulo introductorio )
- Hyvärinen, A.; Oja, E. (2000): "Análisis de componentes independientes: algoritmos y aplicaciones" , Redes neuronales , 13(4-5):411-430. (Introducción técnica pero pedagógica).
- Comon, P.; Jutten C., (2010): Manual de separación ciega de fuentes, análisis de componentes independientes y aplicaciones. Academic Press, Oxford, Reino Unido. ISBN 978-0-12-374726-6
- Lee, T.-W. (1998): Análisis de componentes independientes: Teoría y aplicaciones , Boston, Mass: Kluwer Academic Publishers, ISBN 0-7923-8261-7
- Acharyya, Ranjan (2008): Un nuevo enfoque para la separación ciega de fuentes convolutivas: separación basada en ondículas mediante función de contracción ISBN 3-639-07797-0ISBN 978-3639077971(Este libro se centra en el aprendizaje no supervisado con separación ciega de fuentes).
Enlaces externos
- ¿Qué es el análisis de componentes independientes? por Aapo Hyvärinen
- Análisis de componentes independientes: un tutorial de Aapo Hyvärinen
- Tutorial sobre análisis de componentes independientes
- FastICA como paquete para Matlab, en lenguaje R, C++
- Cajas de herramientas ICALAB para Matlab, desarrolladas en RIKEN.
- El kit de herramientas de análisis de señales de alto rendimiento proporciona implementaciones en C++ de FastICA e Infomax.
- Herramientas ICA de Matlab para ICA con Bell-Sejnowski, Molgedey-Schuster y ICA de campo medio. Desarrolladas en la DTU.
- Demostración del problema de la fiesta cóctel. Archivado el 13 de marzo de 2010 en Wayback Machine.
- EEGLAB Toolbox es una herramienta para el análisis integrado de componentes (ICA) de EEG para Matlab, desarrollada en la UCSD.
- FMRLAB Toolbox, herramienta ICA de fMRI para Matlab, desarrollada en la UCSD.
- MELODIC , parte de la biblioteca de software FMRIB .
- Análisis del uso de ICA en un contexto de representación de formas biomédicas.
- Algoritmos FastICA, CuBICA, JADE y TDSEP para Python y más...
- Caja de herramientas ICA de grupo y caja de herramientas ICA de fusión
- Tutorial: Uso de ICA para la limpieza de señales EEG. Archivado el 4 de marzo de 2016 en Wayback Machine.
- Estimación de la señal
- Reducción de dimensiones