AMiner (anteriormente ArnetMiner ) es un servicio en línea gratuito que se utiliza para indexar, buscar y extraer grandes cantidades de datos científicos .
Descripción general
AMiner (ArnetMiner) está diseñado para buscar y realizar operaciones de minería de datos en publicaciones académicas en Internet , utilizando análisis de redes sociales para identificar conexiones entre investigadores, conferencias y publicaciones. [ 1 ] Esto le permite brindar servicios como búsqueda de expertos, búsqueda geográfica, análisis de tendencias, recomendación de revisores, búsqueda de asociaciones, búsqueda de cursos, evaluación del rendimiento académico y modelado de temas.
AMiner se creó como un proyecto de investigación en análisis de influencia social, clasificación de redes sociales y extracción de redes sociales. Se han publicado varios artículos revisados por pares derivados del desarrollo del sistema. Ha estado en funcionamiento durante más de tres años y ha indexado a 130.000.000 de investigadores y más de 265 millones de publicaciones. [ 2 ] La investigación fue financiada por el Programa Nacional Chino de I+D de Alta Tecnología y la Fundación Nacional de Ciencias de China .
AMiner se utiliza habitualmente en el ámbito académico para identificar relaciones y establecer correlaciones estadísticas entre la investigación y los investigadores. Ha recibido más de 10 millones de accesos IP independientes de 220 países y regiones. El producto se ha utilizado en la plataforma SciVerse de Elsevier [ 3 ] y en congresos académicos como SIGKDD, ICDM, PKDD y WSDM.
Operación
AMiner extrae automáticamente el perfil del investigador de la web. Recopila e identifica las páginas relevantes y, a continuación, utiliza un método unificado para extraer datos de los documentos identificados. También extrae publicaciones de bibliotecas digitales en línea mediante reglas heurísticas.
Integra los perfiles de los investigadores y las publicaciones extraídas. Utiliza el nombre del investigador como identificador. Se ha propuesto un marco probabilístico para abordar el problema de la ambigüedad de nombres durante la integración. Los datos integrados se almacenan en una base de conocimiento de la red de investigadores (RNKB).
Los principales productos que existen en este ámbito son Google Scholar, Scirus de Elsevier y el proyecto de código abierto CiteSeer.
Historia
Fue iniciada y creada por el profesor Jie Tang de la Universidad de Tsinghua , China. Su lanzamiento tuvo lugar en marzo de 2006. A continuación se presenta una lista de las actualizaciones realizadas en los últimos años:
- Marzo de 2006, Versión 0.1. Las funciones incluyen la creación de perfiles de investigadores, la búsqueda de expertos, la búsqueda de conferencias y la búsqueda de publicaciones. El sistema fue desarrollado en Perl.
- Agosto de 2006, Versión 1.0, El sistema fue reimplementado en Java;
- Julio de 2007, Versión 2.0, Las nuevas funciones incluyen minería de intereses de investigadores, búsqueda de asociaciones, búsqueda de artículos de encuestas (actualmente no disponible);
- Abril de 2008, versión 3.0. Las nuevas funciones incluyen comprensión de consultas , nueva interfaz gráfica de usuario y análisis de registros de búsqueda;
- Noviembre de 2008, Versión 4.0, Las nuevas funciones incluyen búsqueda en grafos, modelado de temas, extracción de información sobre financiación de la NSF/NSFC ;
- Abril de 2009, Versión 5.0, Las nuevas funciones incluyen edición de perfil, servicio de API abierta, búsqueda de Bole, búsqueda de cursos (actualmente no disponible);
- Diciembre de 2009, Versión 6.0. Las nuevas funciones incluyen evaluación del rendimiento académico, comentarios de los usuarios y análisis de conferencias;
- Mayo de 2010, Versión 7.0, Las nuevas funciones incluyen la desambiguación de nombres, la recomendación de revisores de artículos y la creación de ArnetPage;
- En marzo de 2012, la versión II, renombrada como AMiner, reescribió todo el código y rediseñó la interfaz gráfica de usuario. Las nuevas funciones incluyen: búsqueda geográfica y la plataforma ArnetAPP.
- En junio de 2014, la versión II, renombrada como AMiner, reescribió todo el código y rediseñó la interfaz gráfica de usuario. Las nuevas funciones incluyen: búsqueda geográfica y la plataforma ArnetAPP.
- En diciembre de 2015, se lanzó en línea una versión completamente nueva.
- En mayo de 2017, se lanzó la versión profesional en línea.
- Abril de 2018, las nuevas funciones incluyen análisis de tendencias, [ 4 ] una desambiguación de nombres basada en aprendizaje profundo [ 5 ]
Recursos
AMiner publicó varios conjuntos de datos para fines de investigación académica, incluyendo Open Academic Graph, [ 6 ] DBLP+citation [ 7 ] (un conjunto de datos que agrega citas a los datos DBLP del Digital Bibliography & Library Project ), Name Disambiguation, [ 8 ] Social Tie Analysis. [ 9 ] Para más conjuntos de datos y códigos fuente disponibles para la investigación, consulte. [ 10 ]
Véase también
Referencias
- ↑ Jie Tang; Jing Zhang; Limin Yao; Juanzi Li; Li Zhang; Zhong Su (2008). "ArnetMiner" . Actas de la 14.ª conferencia internacional ACM SIGKDD sobre descubrimiento de conocimiento y minería de datos . Nueva York: ACM. págs. 990–998 . doi : 10.1145/1401890.1402008 . ISBN 9781605581934. S2CID 3348552 .
- ↑ "Arnetminer: introducción" . Consultado el 17 de diciembre de 2020 .
- ↑ "SciVerse - HUB - Inicio" . Consultado el 24 de abril de 2012 .
{{cite web}}: CS1 maint: servicio de archivado obsoleto ( enlace ) - ↑ "Análisis de tendencias" . Consultado el 24 de diciembre de 2018 .
- ↑ Yutao Zhang; Fanjin Zhang; Peiran Yao; Jie Tang (2018). "Desambiguación de nombres en AMiner" . Actas de la 24.ª Conferencia Internacional ACM SIGKDD sobre Descubrimiento de Conocimiento y Minería de Datos . Londres: ACM. págs. 1002–1011 . doi : 10.1145/3219819.3219859 . ISBN 9781450355520. S2CID 207579405 .
- ↑ "Open Academic Graph" . Consultado el 24 de diciembre de 2018 .
- ↑ "Relación entre artículos y citas en DBLP" . Consultado el 24 de diciembre de 2018 .
- ↑ "Desambiguación de nombres" . Consultado el 24 de abril de 2012 .
- ↑ "Inferir vínculos sociales en grandes redes" . Consultado el 24 de abril de 2012 .
- ↑ "Datos y códigos abiertos de ArnetMiner" . Consultado el 24 de abril de 2012 .
Enlaces externos
- AMiner.org ( Arnetminer.org ahora está archivado)
- AMiner.cn
Lecturas adicionales
- Jie Tang, Jing Zhang, Limin Yao, Juanzi Li, Li Zhang, Zhong Su. Arnetminer: extracción y minería de redes sociales académicas. En Actas de la 14.ª Conferencia Internacional ACM SIGKDD sobre Descubrimiento de Conocimiento y Minería de Datos (SIGKDD'2008).
- Chi Wang, Jiawei Han , Yuntao Jia, Jie Tang , Duo Zhang, Yintao Yu y Jingyi Guo. Minería de relaciones entre asesores y asesorados a partir de redes de publicaciones de investigación. En Actas de la Decimosexta Conferencia Internacional ACM SIGKDD sobre Descubrimiento de Conocimiento y Minería de Datos (SIGKDD'2010).
- Jie Tang , Jimeng Sun, Chi Wang y Zi Yang. Análisis de la influencia social en redes a gran escala. En Actas de la Decimoquinta Conferencia Internacional ACM SIGKDD sobre Descubrimiento de Conocimiento y Minería de Datos (SIGKDD'2009). págs. 807–816.
- Jie Tang , Ruoming Jin y Jing Zhang. Un enfoque de modelado de temas y su integración en el marco de trabajo de paseo aleatorio para la búsqueda académica. En Actas de la Conferencia Internacional IEEE de Minería de Datos de 2008 (ICDM'2008). págs. 1055–1060.
- Jie Tang , Limin Yao, Duo Zhang y Jing Zhang. Un enfoque combinado para la elaboración de perfiles de usuarios web. ACM Transactions on Knowledge Discovery from Data (TKDD), (vol. 5 n.º 1), artículo 2 (diciembre de 2010), 44 páginas.
- Yutao Zhang, Fanjin Zhang, Peiran Yao y Jie Tang . Desambiguación de nombres en AMiner: agrupamiento, mantenimiento e intervención humana. En Actas de la Vigésimo Cuarta Conferencia Internacional ACM SIGKDD sobre Descubrimiento de Conocimiento y Minería de Datos (KDD'18). págs. 1002-1011.
- minería de datos
- redes sociales
- Bases de datos e índices bibliográficos
- Bases de datos científicas