Articulo de referencia

Motor de búsqueda

Un resultado de búsqueda de Google para la frase "ópera de la flauta mágica" Un motor de búsqueda web o buscador de Internet es un sistema de software que proporciona enlaces a ...

Un resultado de búsqueda de Google para la frase "ópera de la flauta mágica"

Un motor de búsqueda web o buscador de Internet es un sistema de software que proporciona enlaces a páginas web y otra información relevante en la web en respuesta a la consulta del usuario . Los usuarios envían sus consultas a través de un navegador web o una aplicación móvil , y la página de resultados generalmente muestra una colección de enlaces junto con breves descripciones e imágenes relevantes. Los usuarios también tienen la opción de limitar la búsqueda a tipos específicos de resultados, como imágenes , vídeos o noticias .

Para un proveedor de búsqueda, su motor forma parte de un sistema de computación distribuida que puede abarcar numerosos centros de datos en todo el mundo. La velocidad y precisión de la respuesta del motor a una consulta se basan en un complejo sistema de indexación que se actualiza continuamente mediante rastreadores web automatizados . Esto puede incluir la extracción de datos de los archivos y bases de datos almacenados en los servidores web , aunque algunos contenidos no son accesibles para los rastreadores.

Desde los inicios de la web en la década de 1990, han existido numerosos motores de búsqueda; Google Search se convirtió en el dominante en la década de 2000 y lo ha mantenido. En mayo de 2025, según StatCounter, Google controlaba aproximadamente entre el 89 % y el 90 % de la cuota de mercado mundial de búsquedas, con sus competidores muy por detrás: Bing (~4 %), Yandex (~2,5 %), Yahoo! (~1,3 %), DuckDuckGo (~0,8 %) y Baidu (~0,7 %). [ 1 ] Mayo de 2025 marcó la primera vez en más de una década que la cuota de mercado de Google cayó por debajo del 90 %. Por lo tanto, el negocio de los sitios web que buscan mejorar su visibilidad en los resultados de búsqueda , conocido como marketing y optimización , se ha centrado principalmente en Google.

Historia

Antes de la década de 1990

En 1945, Vannevar Bush describió un sistema de recuperación de información que permitiría al usuario acceder a una gran cantidad de información desde un solo escritorio, al que denominó memex . [ 2 ] Describió este sistema en un artículo titulado " Como podríamos pensar " en The Atlantic Monthly . [ 3 ] El memex tenía como objetivo brindar al usuario la capacidad de superar la creciente dificultad de localizar información en índices centralizados de trabajos científicos cada vez más extensos. Vannevar Bush imaginó bibliotecas de investigación con anotaciones conectadas, similares a los hipervínculos modernos . [ 4 ]

El análisis de enlaces acabó convirtiéndose en un componente crucial de los motores de búsqueda a través de algoritmos como Hyper Search y PageRank . [ 5 ] [ 6 ]

Década de 1990: Nacimiento de los motores de búsqueda

Los primeros motores de búsqueda de Internet son anteriores al debut de la Web en diciembre de 1990: la búsqueda de usuarios WHOIS data de 1982, [ 7 ] y la búsqueda de usuarios en múltiples redes del Knowbot Information Service se implementó por primera vez en 1989. [ 8 ] El primer motor de búsqueda bien documentado que buscaba archivos de contenido, concretamente archivos FTP , fue Archie , que debutó el 10 de septiembre de 1990. [ 9 ]

Antes de septiembre de 1993, la World Wide Web se indexaba completamente a mano. Existía una lista de servidores web editada por Tim Berners-Lee y alojada en el servidor web del CERN . Se conserva una instantánea de la lista de 1992, [ 10 ] pero a medida que más y más servidores web se conectaban, la lista central dejó de ser viable. En el sitio de la NCSA , los nuevos servidores se anunciaban bajo el título "¡Novedades!". [ 11 ]

La primera herramienta utilizada para buscar contenido (a diferencia de los usuarios) en Internet fue Archie . [ 12 ] El nombre significa "archivo" sin la "v". [ 13 ] Fue creado por Alan Emtage , [ 13 ] [ 14 ] [ 15 ] [ 16 ] estudiante de ciencias de la computación en la Universidad McGill en Montreal, Quebec , Canadá. El programa descargaba los listados de directorios de todos los archivos ubicados en sitios FTP ( Protocolo de Transferencia de Archivos ) públicos y anónimos, creando una base de datos de búsqueda de nombres de archivos; sin embargo, el motor de búsqueda Archie no indexaba el contenido de estos sitios ya que la cantidad de datos era tan limitada que se podía buscar fácilmente de forma manual.

El auge de Gopher (creado en 1991 por Mark McCahill en la Universidad de Minnesota ) dio lugar a dos nuevos programas de búsqueda: Veronica y Jughead . Al igual que Archie, buscaban en los nombres y títulos de los archivos almacenados en los sistemas de indexación de Gopher. Veronica (Very Easy Rodent-Oriented Net-wide Index to Computerized Archives) proporcionaba una búsqueda por palabras clave de la mayoría de los títulos de los menús de Gopher en todos los listados de Gopher. Jughead (Jonzy's Universal Gopher Hierarchy Excavation And Display) era una herramienta para obtener información de menús de servidores Gopher específicos. Si bien el nombre del motor de búsqueda " Archie Search Engine " no hacía referencia a la serie de cómics Archie , " Veronica " y " Jughead " son personajes de la serie, haciendo referencia así a su predecesor.

En el verano de 1993, no existía ningún motor de búsqueda para la web, aunque se mantenían manualmente numerosos catálogos especializados. Oscar Nierstrasz, de la Universidad de Ginebra, escribió una serie de scripts en Perl que replicaban periódicamente estas páginas y las reescribían en un formato estándar. Esto sentó las bases de W3Catalog , el primer motor de búsqueda primitivo de la web, lanzado el 2 de septiembre de 1993. [ 17 ]

En junio de 1993, Matthew Gray, entonces en el MIT , creó lo que probablemente fue el primer robot web , el World Wide Web Wanderer , basado en Perl , y lo utilizó para generar un índice llamado "Wandex". El propósito del Wanderer era medir el tamaño de la World Wide Web, función que desempeñó hasta finales de 1995. El segundo motor de búsqueda de la web, Aliweb, apareció en noviembre de 1993. Aliweb no utilizaba un robot web, sino que dependía de que los administradores de los sitios web le notificaran la existencia en cada sitio de un archivo de índice en un formato específico.

JumpStation (creado en diciembre de 1993 [ 18 ] por Jonathon Fletcher ) utilizaba un robot web para encontrar páginas web y construir su índice, y un formulario web como interfaz para su programa de consulta. Fue, por lo tanto, la primera herramienta de descubrimiento de recursos de la WWW que combinaba las tres características esenciales de un motor de búsqueda web (rastreo, indexación y búsqueda), como se describe a continuación. Debido a los recursos limitados disponibles en la plataforma en la que se ejecutaba, su indexación y, por ende, su búsqueda, se limitaban a los títulos y encabezados encontrados en las páginas web que el rastreador encontraba.

Uno de los primeros motores de búsqueda basados ​​en rastreadores de texto fue WebCrawler , lanzado en 1994. A diferencia de sus predecesores, permitía a los usuarios buscar cualquier palabra en cualquier página web , lo que se ha convertido en el estándar para todos los principales motores de búsqueda desde entonces. También fue el motor de búsqueda más conocido por el público. Asimismo, en 1994, se lanzó Lycos (que comenzó en la Universidad Carnegie Mellon ) y se convirtió en una importante empresa comercial.

El primer motor de búsqueda popular en la web fue Yahoo! Search . [ 19 ] El primer producto de Yahoo!, fundado por Jerry Yang y David Filo en enero de 1994, fue un directorio web llamado Yahoo! Directory . En 1995, se agregó una función de búsqueda, que permitió a los usuarios buscar en Yahoo! Directory. [ 20 ] [ 21 ] Se convirtió en una de las formas más populares para que las personas encontraran páginas web de interés, pero su función de búsqueda operaba en su directorio web, en lugar de en sus copias de texto completo de las páginas web.

Poco después, surgieron varios motores de búsqueda que compitieron por la popularidad. Entre ellos se encontraban Magellan , Excite , Infoseek , Inktomi , Northern Light y AltaVista . Los usuarios también podían consultar el directorio en lugar de realizar una búsqueda por palabras clave.

En 1996, Robin Li desarrolló el algoritmo de puntuación de sitios RankDex para la clasificación de páginas de resultados de motores de búsqueda [ 22 ] [ 23 ] [ 24 ] y recibió una patente estadounidense para la tecnología. [ 25 ] Fue el primer motor de búsqueda que utilizó hipervínculos para medir la calidad de los sitios web que indexaba, [ 26 ] anterior a la patente de algoritmo muy similar presentada por Google dos años después en 1998. [ 27 ] Larry Page hizo referencia al trabajo de Li en algunas de sus patentes estadounidenses para PageRank. [ 28 ] Posteriormente, Li utilizó su tecnología RankDex para el motor de búsqueda Baidu , que fundó en China y lanzó en 2000.

En 1996, Netscape buscaba ofrecer un acuerdo exclusivo para que un único motor de búsqueda se convirtiera en el motor de búsqueda destacado de su navegador web. El interés fue tal que, en su lugar, Netscape llegó a acuerdos con cinco de los principales motores de búsqueda: por 5 millones de dólares al año, cada motor de búsqueda aparecería de forma rotativa en la página de búsqueda de Netscape. Los cinco motores fueron Yahoo!, Magellan, Lycos, Infoseek y Excite. [ 29 ] [ 30 ]

Google adoptó la idea de vender términos de búsqueda en 1998 de una pequeña empresa de motores de búsqueda llamada goto.com . Esta decisión tuvo un efecto significativo en el negocio de los motores de búsqueda, que pasó de tener dificultades a convertirse en uno de los negocios más rentables de Internet. [ 31 ] [ 32 ]

Los motores de búsqueda atrajeron importantes inversiones a finales de la década de 1990. [ 33 ] Varias empresas entraron en el mercado obteniendo ganancias récord durante sus ofertas públicas iniciales . Algunas han retirado su motor de búsqueda público y están comercializando ediciones exclusivas para empresas, como Northern Light. Muchas empresas de motores de búsqueda se vieron envueltas en la burbuja de las puntocom , un auge del mercado impulsado por la especulación que alcanzó su punto máximo en marzo de 2000.

Década de 2000-presente: Posterior a la burbuja de las puntocom

Alrededor del año 2000, el motor de búsqueda de Google alcanzó gran prominencia. [ 34 ] La compañía logró mejores resultados para muchas búsquedas con un algoritmo llamado PageRank , como se explicó en el documento Anatomía de un motor de búsqueda escrito por Sergey Brin y Larry Page , los fundadores posteriores de Google. [ 6 ] Este algoritmo iterativo clasifica las páginas web según la cantidad y el PageRank de otros sitios web y páginas que enlazan a ellas, bajo la premisa de que las páginas buenas o deseables están enlazadas a más que otras. La patente de Larry Page para PageRank cita la patente anterior de Robin Li , RankDex , como una influencia. [ 28 ] [ 24 ] Google también mantuvo una interfaz minimalista para su motor de búsqueda. En contraste, muchos de sus competidores integraron un motor de búsqueda en un portal web . De hecho, el motor de búsqueda de Google se volvió tan popular que surgieron motores de búsqueda falsos como Mystery Seeker .

En el año 2000, Yahoo! ofrecía servicios de búsqueda basados ​​en el motor de búsqueda de Inktomi. Yahoo! adquirió Inktomi en 2002 y Overture (propietaria de AlltheWeb y AltaVista) en 2003. Yahoo! utilizó el motor de búsqueda de Google hasta 2004, cuando lanzó su propio motor de búsqueda basado en la combinación de las tecnologías de sus adquisiciones.

Microsoft lanzó MSN Search por primera vez en otoño de 1998 utilizando resultados de búsqueda de Inktomi. A principios de 1999, el sitio comenzó a mostrar listados de Looksmart , combinados con resultados de Inktomi. Durante un breve período en 1999, MSN Search utilizó resultados de AltaVista. En 2004, Microsoft inició la transición a su propia tecnología de búsqueda, impulsada por su propio rastreador web (llamado msnbot ).

El motor de búsqueda de Microsoft, Bing , que había sido renombrado, se lanzó el 1 de junio de 2009. El 29 de julio de 2009, Yahoo! y Microsoft cerraron un acuerdo por el cual Yahoo! Search funcionaría con la tecnología de Microsoft Bing.

A partir de 2019,Entre los rastreadores de motores de búsqueda activos se incluyen los de Baidu , Bing, Brave , [ 35 ] Google, DuckDuckGo , Gigablast , Mojeek , Sogou y Yandex .

En la década de 2020, los motores de búsqueda impulsados ​​por inteligencia artificial y los asistentes de IA generativa se integraron cada vez más en la búsqueda web convencional. Estos sistemas combinan la indexación web tradicional con grandes modelos de lenguaje para proporcionar respuestas conversacionales, resúmenes y recomendaciones contextuales. [ 36 ]

Acercarse

Un motor de búsqueda mantiene los siguientes procesos en tiempo casi real: [ 37 ]

  1. Rastreo web
  2. Indexación
  3. Buscando [ 38 ]

Los motores de búsqueda web obtienen su información rastreando sitios web . El "araña" busca el archivo estándar robots.txt , que contiene directivas para las arañas de búsqueda, indicándoles qué páginas rastrear y cuáles no. Tras buscar robots.txt y encontrarlo o no, la araña envía cierta información para su indexación , dependiendo de diversos factores como los títulos, el contenido de la página, JavaScript , las hojas de estilo en cascada (CSS), los encabezados o sus metadatos en las etiquetas meta HTML . Después de rastrear un número determinado de páginas, indexar una cantidad específica de datos o pasar un tiempo determinado en el sitio web, la araña deja de rastrear y continúa. "[N]ingún rastreador web puede rastrear la totalidad de la web accesible. Debido a la infinidad de sitios web, las trampas de las arañas, el spam y otras exigencias de la web real, los rastreadores aplican una política de rastreo para determinar cuándo se considera suficiente el rastreo de un sitio. Algunos sitios web se rastrean exhaustivamente, mientras que otros se rastrean solo parcialmente". [ 39 ]

La indexación consiste en asociar palabras y otros tokens definibles que se encuentran en las páginas web con sus nombres de dominio y campos basados ​​en HTML . Estas asociaciones se almacenan en una base de datos pública y se puede acceder a ellas mediante búsquedas web. Una consulta de un usuario puede consistir en una sola palabra, varias palabras o una frase. El índice ayuda a encontrar información relacionada con la consulta lo más rápidamente posible. [ 38 ] Algunas de las técnicas de indexación y almacenamiento en caché son secretos comerciales, mientras que el rastreo web es un proceso sencillo que consiste en visitar todos los sitios de forma sistemática.

Entre visitas del rastreador , la versión en caché de la página (parte o la totalidad del contenido necesario para renderizarla) almacenada en la memoria de trabajo del motor de búsqueda se envía rápidamente a un solicitante. Si una visita está vencida, el motor de búsqueda puede actuar como un proxy web . En este caso, la página puede diferir de los términos de búsqueda indexados. [ 38 ] La página en caché conserva la apariencia de la versión cuyas palabras fueron indexadas previamente, por lo que una versión en caché de una página puede ser útil para el sitio web cuando la página real se ha perdido, pero este problema también se considera una forma leve de linkrot .

Arquitectura de alto nivel de un rastreador web estándar

Normalmente, cuando un usuario introduce una consulta en un motor de búsqueda, se trata de unas pocas palabras clave . [ 40 ] El índice ya contiene los nombres de los sitios que incluyen dichas palabras clave, y estos se obtienen instantáneamente del índice. La verdadera carga de procesamiento reside en la generación de las páginas web que conforman la lista de resultados de búsqueda: cada página de la lista debe ponderarse según la información de los índices. [ 38 ] A continuación, el primer resultado de búsqueda requiere la búsqueda, reconstrucción y marcado de los fragmentos que muestran el contexto de las palabras clave coincidentes. Esto es solo una parte del procesamiento que requiere cada página web de resultados de búsqueda, y las páginas siguientes (después de la primera) requieren un procesamiento posterior más exhaustivo.

Más allá de las simples búsquedas por palabras clave, los motores de búsqueda ofrecen su propia interfaz gráfica de usuario (GUI ) o operadores y parámetros de búsqueda basados ​​en comandos para refinar los resultados. Estos proporcionan los controles necesarios para el usuario involucrado en el ciclo de retroalimentación que los usuarios crean al filtrar y ponderar mientras refinan los resultados de búsqueda, dadas las páginas iniciales de los primeros resultados de búsqueda. Por ejemplo, desde 2007, el motor de búsqueda Google.com ha permitido filtrar por fecha haciendo clic en "Mostrar herramientas de búsqueda" en la columna más a la izquierda de la página de resultados de búsqueda inicial y luego seleccionando el rango de fechas deseado. [ 41 ] También es posible ponderar por fecha porque cada página tiene una hora de modificación. La mayoría de los motores de búsqueda admiten el uso de los operadores booleanos AND, OR y NOT para ayudar a los usuarios finales a refinar la consulta de búsqueda . Los operadores booleanos son para búsquedas literales que permiten al usuario refinar y extender los términos de la búsqueda. El motor busca las palabras o frases exactamente como se ingresan. Algunos motores de búsqueda proporcionan una función avanzada llamada búsqueda de proximidad , que permite a los usuarios definir la distancia entre palabras clave. [ 38 ] También existe la búsqueda basada en conceptos, donde la investigación implica el uso de análisis estadísticos en páginas que contienen las palabras o frases que busca el usuario.

La utilidad de un motor de búsqueda depende de la relevancia del conjunto de resultados que proporciona. Si bien puede haber millones de páginas web que incluyan una palabra o frase en particular, algunas páginas pueden ser más relevantes, populares o autorizadas que otras. La mayoría de los motores de búsqueda emplean métodos para clasificar los resultados y proporcionar primero los "mejores". La forma en que un motor de búsqueda decide qué páginas son las mejores coincidencias y en qué orden deben mostrarse los resultados varía ampliamente de un motor a otro. [ 38 ] Los métodos también cambian con el tiempo a medida que cambia el uso de Internet y evolucionan nuevas técnicas. Existen dos tipos principales de motores de búsqueda que han evolucionado: uno es un sistema de palabras clave predefinidas y ordenadas jerárquicamente que los humanos han programado extensamente. El otro es un sistema que genera un " índice invertido " analizando los textos que localiza. Esta primera forma depende mucho más de la propia computadora para realizar la mayor parte del trabajo.

La mayoría de los motores de búsqueda web son empresas comerciales que se financian con ingresos publicitarios , por lo que algunos permiten a los anunciantes obtener una mejor posición en los resultados de búsqueda a cambio de una tarifa. Los motores de búsqueda que no aceptan dinero por sus resultados obtienen ingresos mostrando anuncios relacionados con la búsqueda junto con los resultados habituales.

La búsqueda local es el proceso que optimiza los esfuerzos de las empresas locales. Se centra en garantizar resultados de búsqueda consistentes. Es importante porque muchas personas deciden adónde ir y qué comprar basándose en sus búsquedas. [ 42 ]

Cuota de mercado

A partir de enero de 2022 ,Google es, con diferencia, el motor de búsqueda más utilizado del mundo, con una cuota de mercado del 90%, y los otros motores de búsqueda más utilizados a nivel mundial fueron Bing con un 4%, Yandex con un 2% y Yahoo! con un 1%. Otros motores de búsqueda no mencionados tienen una cuota de mercado inferior al 3%. [ 43 ] En 2024, el dominio de Google fue declarado monopolio ilegal en un caso presentado por el Departamento de Justicia de los Estados Unidos. [ 44 ]

Rusia

A finales de 2023, la cuota de mercado de los motores de búsqueda en Rusia y Asia Oriental se había mantenido relativamente estable, aunque con algunos cambios notables debido a acontecimientos geopolíticos y tecnológicos.

En Rusia, Yandex continúa dominando el mercado de motores de búsqueda con una participación de aproximadamente el 73%, mientras que Google tiene alrededor del 25%. [ 45 ] Yandex también sigue siendo un actor clave en servicios localizados que incluyen navegación, transporte compartido y comercio electrónico, fortaleciendo su ecosistema.

Asia oriental

En China, Baidu sigue siendo el motor de búsqueda líder con una cuota de mercado de aproximadamente el 59,3 % a principios de 2024. Otros motores de búsqueda nacionales, como Sogou y 360 Search, tienen cuotas menores. Google sigue siendo inaccesible en China continental debido a problemas de censura de larga data, tras haberse retirado del mercado chino en 2010 a raíz de disputas sobre censura y ciberseguridad. [ 46 ] [ 47 ]

Bing, el motor de búsqueda de Microsoft, ha mantenido una presencia de nicho en China con una cuota de mercado de alrededor del 13,6%, lo que lo convierte en uno de los pocos motores de búsqueda extranjeros que operan bajo restricciones regulatorias locales. [ 48 ]

En Japón, Google Japan actualmente posee la mayor cuota de mercado (alrededor del 76,2%), mientras que Yahoo! Japan, operada por Z Holdings (una empresa conjunta de SoftBank y Naver), mantiene aproximadamente el 15,8% de la cuota de mercado. [ 49 ]

Tras la fusión de Kakao con Daum en 2014, los motores de búsqueda nacionales controlaban casi todo el mercado surcoreano. Naver lideraba con la mayor cuota de mercado, seguido de Daum. [ 50 ] Tras la escisión de Daum por parte de Kakao en 2025, la cuota de mercado de Daum en el país había caído por debajo de la de Google y Bing. Naver aún mantenía la mayor parte del mercado. [ 51 ] Naver alberga una «vasta cantidad de contenido adaptado localmente» de sus usuarios coreanos. [ 52 ]

En Taiwán, Google es el motor de búsqueda predominante, controlando más del 93% del mercado, con Yahoo! Taiwán y Bing muy por detrás. [ 53 ]

sesgo del motor de búsqueda

Aunque los motores de búsqueda están programados para clasificar los sitios web según una combinación de su popularidad y relevancia, los estudios empíricos indican diversos sesgos políticos, económicos y sociales en la información que proporcionan [ 54 ] [ 55 ] y en los supuestos subyacentes sobre la tecnología. [ 56 ] Estos sesgos pueden ser resultado directo de procesos económicos y comerciales (por ejemplo, las empresas que se anuncian con un motor de búsqueda también pueden volverse más populares en sus resultados de búsqueda orgánica ) y de procesos políticos (por ejemplo, la eliminación de resultados de búsqueda para cumplir con las leyes locales). [ 57 ] Por ejemplo, Google no mostrará ciertos sitios web neonazis en Francia y Alemania, donde la negación del Holocausto es ilegal.

Los sesgos también pueden ser resultado de procesos sociales, ya que los algoritmos de los motores de búsqueda suelen estar diseñados para excluir puntos de vista no normativos en favor de resultados más "populares". [ 58 ] Los algoritmos de indexación de los principales motores de búsqueda tienden a incluir sitios web con sede en EE. UU., en lugar de sitios web de países que no son EE. UU. [ 55 ]

El "Google Bombing" es un ejemplo de intento de manipular los resultados de búsqueda por motivos políticos, sociales o comerciales.

Varios académicos han estudiado los cambios culturales provocados por los motores de búsqueda, [ 59 ] y la representación de ciertos temas controvertidos en sus resultados, como el terrorismo en Irlanda , [ 60 ] la negación del cambio climático , [ 61 ] y las teorías de la conspiración . [ 62 ]

Resultados personalizados y burbujas de filtro

Se ha planteado la preocupación de que los motores de búsqueda como Google y Bing proporcionen resultados personalizados basados ​​en el historial de actividad del usuario, lo que ha dado lugar a lo que Eli Pariser denominó cámaras de eco o burbujas de filtro en 2011. [ 63 ] El argumento es que los motores de búsqueda y las plataformas de redes sociales utilizan algoritmos para adivinar selectivamente qué información le gustaría ver a un usuario, basándose en información sobre este (como la ubicación, el comportamiento de clics anterior y el historial de búsqueda). Como resultado, los sitios web tienden a mostrar solo información que coincide con el punto de vista anterior del usuario. Según Eli Pariser, los usuarios tienen menos exposición a puntos de vista contradictorios y se aíslan intelectualmente en su propia burbuja informativa. Desde que se identificó este problema, han surgido motores de búsqueda de la competencia que buscan evitarlo al no rastrear ni "burbujear" a los usuarios, como DuckDuckGo . Sin embargo, muchos académicos han cuestionado la visión de Pariser, encontrando que hay poca evidencia de la burbuja de filtro. [ 64 ] [ 65 ] [ 66 ] Por el contrario, varios estudios que intentan verificar la existencia de burbujas de filtro han encontrado solo niveles menores de personalización en la búsqueda, [ 66 ] que la mayoría de las personas encuentran una variedad de puntos de vista cuando navegan en línea, y que Google Noticias tiende a promover medios de comunicación establecidos y convencionales. [ 67 ] [ 65 ]

motores de búsqueda religiosos

El crecimiento global de Internet y los medios electrónicos en el mundo árabe y musulmán durante la última década ha impulsado a los seguidores del Islam en Oriente Medio y el subcontinente asiático a crear sus propios motores de búsqueda y portales de búsqueda filtrados que permitan a los usuarios realizar búsquedas seguras . Más allá de los filtros de búsqueda segura habituales , estos portales web islámicos clasifican los sitios web como " halal " o " haram ", según la interpretación de la ley islámica (Sharia) . ImHalal se lanzó en septiembre de 2011 y Halalgoogling en julio de 2013. Estos utilizan filtros haram en las colecciones de Google y Bing (entre otros). [ 68 ]

Si bien la falta de inversión y el lento desarrollo tecnológico en el mundo musulmán han obstaculizado el progreso y frustrado el éxito de un motor de búsqueda islámico, dirigido principalmente a los seguidores del Islam, proyectos como Muxlim (un sitio web sobre estilo de vida musulmán) recibieron millones de dólares de inversores como Rite Internet Ventures, y también fracasaron. Otros motores de búsqueda orientados a la religión son Jewogle, la versión judía de Google, [ 69 ] y el motor de búsqueda cristiano SeekFind.org. SeekFind filtra los sitios que atacan o degradan su fe. [ 70 ]

Envío a motores de búsqueda

El envío a motores de búsqueda web es un proceso mediante el cual un administrador web envía un sitio web directamente a un motor de búsqueda. Si bien a veces se presenta como una forma de promocionar un sitio web, generalmente no es necesario, ya que los principales motores de búsqueda utilizan rastreadores web que eventualmente encuentran la mayoría de los sitios web en Internet sin ayuda. Pueden enviar una página web a la vez o el sitio completo mediante un mapa del sitio , pero normalmente solo es necesario enviar la página de inicio , ya que los motores de búsqueda pueden rastrear un sitio web bien diseñado. Existen dos razones adicionales para enviar un sitio web o una página web a un motor de búsqueda: agregar un sitio web completamente nuevo sin esperar a que un motor de búsqueda lo descubra, y actualizar el registro de un sitio web después de un rediseño importante.

Algunos programas de envío a motores de búsqueda no solo envían sitios web a múltiples buscadores, sino que también añaden enlaces a otros sitios web desde sus propias páginas. Esto podría parecer útil para mejorar el posicionamiento de un sitio web , ya que los enlaces externos son uno de los factores más importantes que determinan dicho posicionamiento. Sin embargo, John Mueller de Google ha afirmado que esto «puede generar una enorme cantidad de enlaces no naturales para su sitio», con un impacto negativo en su posicionamiento. [ 71 ]

Comparación con los marcadores sociales

En comparación con los motores de búsqueda, un sistema de marcadores sociales tiene varias ventajas sobre el software tradicional de localización y clasificación automatizada de recursos, como los rastreadores de los motores de búsqueda . Toda la clasificación basada en etiquetas de los recursos de Internet (como los sitios web) la realizan seres humanos, que comprenden el contenido del recurso, a diferencia del software, que intenta determinar algorítmicamente el significado y la calidad de un recurso. Además, las personas pueden encontrar y marcar páginas web que aún no han sido detectadas o indexadas por los rastreadores web. [ 72 ] Adicionalmente, un sistema de marcadores sociales puede clasificar un recurso según la cantidad de veces que los usuarios lo han marcado, lo que puede ser una métrica más útil para los usuarios finales que los sistemas que clasifican los recursos según la cantidad de enlaces externos que apuntan a él. Sin embargo, ambos tipos de clasificación son vulnerables al fraude (ver Manipulación del sistema ) y ambos necesitan contramedidas técnicas para intentar abordarlo.

Tecnología

Archie

El primer motor de búsqueda web fue Archie , creado en 1990 [ 73 ] por Alan Emtage , un estudiante de la Universidad McGill en Montreal.

El método principal para almacenar y recuperar archivos era mediante el Protocolo de Transferencia de Archivos (FTP), un protocolo de comunicación que especifica una forma común para que las computadoras intercambien archivos a través de Internet. Funciona así: un administrador decide que quiere que los archivos de su computadora estén disponibles. Para ello, instala un programa en su computadora, llamado servidor FTP. Cuando alguien en Internet quiere recuperar un archivo de esta computadora, se conecta a ella mediante otro programa llamado cliente FTP. Cualquier programa cliente FTP puede conectarse con cualquier programa servidor FTP, siempre que ambos programas cumplan con las especificaciones establecidas en el protocolo FTP.

Inicialmente, cualquiera que quisiera compartir un archivo tenía que configurar un servidor FTP para que estuviera disponible para otros. Posteriormente, los sitios FTP "anónimos" se convirtieron en repositorios de archivos, permitiendo a todos los usuarios publicarlos y descargarlos.

Incluso con los sitios de archivo, muchos archivos importantes seguían dispersos en pequeños servidores FTP. Estos archivos solo podían localizarse mediante el equivalente en internet del boca a boca: alguien publicaba un correo electrónico en una lista de mensajes o un foro de discusión anunciando la disponibilidad del archivo.

Archie lo cambió todo. Combinaba un recolector de datos basado en scripts, que obtenía listados de sitios con archivos FTP anónimos, con un comparador de expresiones regulares para recuperar nombres de archivos que coincidieran con la consulta del usuario. (4) En otras palabras, el recolector de Archie rastreaba sitios FTP en Internet e indexaba todos los archivos que encontraba. Su comparador de expresiones regulares proporcionaba a los usuarios acceso a su base de datos. [ 74 ]

Verónica

En 1993, el grupo de Servicios Informáticos del Sistema de la Universidad de Nevada desarrolló Veronica . [ 73 ] Fue creada como un tipo de dispositivo de búsqueda similar a Archie, pero para archivos Gopher. Otro servicio de búsqueda de Gopher, llamado Jughead , apareció un poco más tarde, probablemente con el único propósito de completar el trío de tiras cómicas. Jughead es un acrónimo de Jonzy's Universal Gopher Hierarchy Excavation and Display (Excavación y Visualización Universal de la Jerarquía Gopher de Jonzy), aunque, al igual que con Veronica, es probable que el creador haya llegado al acrónimo de forma indirecta. La funcionalidad de Jughead era casi idéntica a la de Veronica, aunque parece ser un poco menos pulida. [ 74 ]

El vagabundo solitario

El World Wide Web Wanderer , desarrollado por Matthew Gray en 1993 [ 75 ] , fue el primer robot en la Web y fue diseñado para rastrear su crecimiento. Inicialmente, el Wanderer solo contabilizaba servidores web, pero poco después de su lanzamiento, comenzó a capturar URL a medida que avanzaba. La base de datos de URL capturadas se convirtió en el Wandex, la primera base de datos web.

El robot Wanderer de Matthew Gray generó bastante controversia en su momento, en parte porque las primeras versiones del software se propagaban sin control por la red y causaban una notable degradación del rendimiento general. Esta degradación se debía a que Wanderer accedía a la misma página cientos de veces al día. Wanderer pronto corrigió su comportamiento, pero la controversia sobre si los robots eran beneficiosos o perjudiciales para internet persistió.

En respuesta a Wanderer, Martijn Koster creó Archie-Like Indexing of the Web, o ALIWEB, en octubre de 1993. Como su nombre indica, ALIWEB era el equivalente HTTP de Archie, y por ello, sigue siendo único en muchos aspectos.

ALIWEB no cuenta con un robot de búsqueda web. En su lugar, los webmasters de los sitios participantes publican su propia información de indexación para cada página que desean incluir en el listado. La ventaja de este método es que los usuarios pueden describir su propio sitio, y un robot no consume ancho de banda. Las desventajas de ALIWEB son más problemáticas hoy en día. La principal desventaja es que se debe enviar un archivo de indexación especial. La mayoría de los usuarios no saben cómo crear dicho archivo y, por lo tanto, no envían sus páginas. Esto resulta en una base de datos relativamente pequeña, lo que significa que es menos probable que los usuarios busquen en ALIWEB que en uno de los grandes sitios basados ​​en bots. Esta paradoja se ha compensado en parte mediante la incorporación de otras bases de datos a la búsqueda de ALIWEB, pero aún no tiene el atractivo masivo de motores de búsqueda como Yahoo! o Lycos. [ 74 ]

Excitar

Excite , inicialmente llamado Architext, fue creado por seis estudiantes de pregrado de Stanford en febrero de 1993. Su idea era utilizar el análisis estadístico de las relaciones entre palabras para proporcionar búsquedas más eficientes en la gran cantidad de información disponible en Internet. Su proyecto obtuvo financiación completa a mediados de 1993. Una vez asegurada la financiación, lanzaron una versión de su software de búsqueda para que los webmasters la utilizaran en sus propios sitios web. En aquel entonces, el software se llamaba Architext, pero ahora se conoce como Excite para servidores web. [ 74 ]

Excite fue el primer motor de búsqueda comercial serio que se lanzó en 1995. [ 76 ] Fue desarrollado en Stanford y fue comprado por 6.500 millones de dólares por @Home. En 2001, Excite y @Home quebraron e InfoSpace compró Excite por 10 millones de dólares.

Algunos de los primeros análisis de búsquedas web se realizaron en registros de búsqueda de Excite [ 77 ] [ 40 ]

Yahoo!

En abril de 1994, dos candidatos a doctorado de la Universidad de Stanford, David Filo y Jerry Yang , crearon unas páginas que se hicieron bastante populares. Llamaron a esa colección de páginas Yahoo! Su explicación oficial para la elección del nombre fue que se consideraban un par de yahoos.

A medida que aumentaba el número de enlaces y sus páginas recibían miles de visitas diarias, el equipo ideó métodos para organizar mejor los datos. Para facilitar la recuperación de información, Yahoo! (www.yahoo.com) se convirtió en un directorio con función de búsqueda. Esta función era un sencillo motor de búsqueda de bases de datos. Dado que las entradas de Yahoo! se introducían y categorizaban manualmente, no se consideraba propiamente un motor de búsqueda, sino más bien un directorio. Desde entonces, Yahoo! ha automatizado algunos aspectos del proceso de recopilación y clasificación, difuminando la distinción entre motor de búsqueda y directorio.

El buscador Wanderer solo capturaba URL, lo que dificultaba encontrar contenido que no estuviera descrito explícitamente en su URL. Dado que las URL son de por sí bastante crípticas, esto no resultaba útil para el usuario promedio. Buscar en Yahoo! o Galaxy era mucho más efectivo, ya que contenían información descriptiva adicional sobre los sitios indexados.

Lycos

En julio de 1994, Michael Mauldin, que se encontraba de baja en la Universidad Carnegie Mellon, desarrolló el motor de búsqueda Lycos .

Tipos de motores de búsqueda web

Los motores de búsqueda en la web son sitios enriquecidos con una función para buscar el contenido almacenado en otros sitios. Existe una diferencia en la forma en que funcionan los distintos motores de búsqueda, pero todos realizan tres tareas básicas. [ 78 ]

  1. Búsqueda y selección de contenido total o parcial en función de las palabras clave proporcionadas.
  2. Mantener un índice del contenido y hacer referencia a la ubicación donde lo encuentran.
  3. Permite a los usuarios buscar palabras o combinaciones de palabras que se encuentren en ese índice.

El proceso comienza cuando un usuario introduce una consulta en el sistema a través de la interfaz proporcionada.

Básicamente, existen tres tipos de motores de búsqueda: aquellos que funcionan con robots (llamados rastreadores ; hormigas o arañas), aquellos que funcionan con aportaciones humanas y aquellos que son un híbrido de ambos.

Los motores de búsqueda basados ​​en rastreadores utilizan agentes de software automatizados (llamados rastreadores) que visitan un sitio web, leen la información del sitio, analizan sus metaetiquetas y siguen los enlaces que este contiene, indexando también todos los sitios web vinculados. El rastreador devuelve toda esta información a un repositorio central, donde se indexa. Periódicamente, el rastreador vuelve a los sitios para comprobar si la información ha cambiado. La frecuencia de estas visitas la determinan los administradores del motor de búsqueda.

Los motores de búsqueda gestionados por humanos dependen de que las personas envíen información que posteriormente se indexa y cataloga. Solo la información enviada se incluye en el índice.

En ambos casos, cuando un usuario consulta un motor de búsqueda para encontrar información, en realidad está buscando en el índice que el motor de búsqueda ha creado; no está buscando directamente en la web. Estos índices son enormes bases de datos de información que se recopilan, almacenan y posteriormente se consultan. Esto explica por qué a veces una búsqueda en un motor de búsqueda comercial, como Yahoo! o Google, devuelve resultados que, de hecho, son enlaces rotos. Dado que los resultados de la búsqueda se basan en el índice, si este no se ha actualizado desde que una página web dejó de ser válida, el motor de búsqueda la trata como un enlace activo, aunque ya no lo sea. Permanecerá así hasta que se actualice el índice.

Los distintos motores de búsqueda producen resultados diferentes, en parte debido a las diferencias en sus índices, que dependen de lo que encuentran los robots o de lo que envían los usuarios. Pero, aún más importante, no todos los motores de búsqueda utilizan el mismo algoritmo para buscar en los índices. El algoritmo es lo que utilizan los motores de búsqueda para determinar la relevancia de la información del índice con respecto a la búsqueda del usuario.

Uno de los elementos que analiza el algoritmo de un motor de búsqueda es la frecuencia y la ubicación de las palabras clave en una página web. Aquellas con mayor frecuencia suelen considerarse más relevantes. Sin embargo, la tecnología de los motores de búsqueda se está volviendo cada vez más sofisticada en su intento por desalentar lo que se conoce como relleno de palabras clave o spamdexing .

Otro elemento común que analizan los algoritmos es la forma en que las páginas se enlazan entre sí en la web. Al analizar cómo se enlazan las páginas, un motor de búsqueda puede determinar de qué trata una página (si las palabras clave de las páginas enlazadas son similares a las de la página original) y si esa página se considera "importante" y merecedora de una mejor posición en el ranking. Así como la tecnología se está volviendo cada vez más sofisticada para ignorar el relleno de palabras clave, también se está volviendo más astuta con los webmasters que crean enlaces artificiales en sus sitios para generar un ranking artificial.

Los motores de búsqueda web modernos son sistemas de software muy complejos que emplean tecnología que ha evolucionado a lo largo de los años. Existen diversas subcategorías de software de motores de búsqueda, cada una aplicable a necesidades específicas de navegación. Estas incluyen motores de búsqueda web (por ejemplo, Google ), motores de búsqueda de bases de datos o datos estructurados (por ejemplo, Dieselpoint) y motores de búsqueda mixtos o empresariales. Los motores de búsqueda más populares, como Google y Yahoo!, utilizan cientos de miles de ordenadores para procesar billones de páginas web y ofrecer resultados bastante precisos. Debido a este elevado volumen de consultas y procesamiento de texto, el software debe funcionar en un entorno altamente distribuido con un alto grado de redundancia.

Otra categoría de motores de búsqueda son los motores de búsqueda científicos. Estos motores de búsqueda buscan literatura científica. El ejemplo más destacado es Google Scholar. Los investigadores trabajan para mejorar la tecnología de los motores de búsqueda, logrando que comprendan los elementos de contenido de los artículos, como la extracción de constructos teóricos o hallazgos clave de la investigación. [ 79 ]

Véase también

Referencias

  1. Estadísticas globales de StatCounter: cuota de mercado de los motores de búsqueda (mayo de 2025)
  2. Bush, Vannevar (1 de julio de 1945). "Como podríamos pensar" . The Atlantic . Archivado del original el 22 de agosto de 2012. Consultado el 22 de febrero de 2024 .
  3. "Search Engine History.com" . www.searchenginehistory.com . Consultado el 2 de julio de 2020 .
  4. "Inicio de sesión seguro de Penn State WebAccess" . webaccess.psu.edu . Archivado del original el 22 de enero de 2022. Consultado el 2 de julio de 2020 .
  5. Marchiori, Massimo (1997). "La búsqueda de información correcta en la web: hiperbuscadores" . Actas de la Sexta Conferencia Internacional de la World Wide Web (WWW6) . Recuperado el 10 de enero de 2021 .
  6. 1 2 Brin, Sergey; Page, Larry (1998). "La anatomía de un motor de búsqueda web hipertextual a gran escala" (PDF) . Actas de la Séptima Conferencia Internacional de la World Wide Web (WWW7) . Archivado del original (PDF) el 13 de julio de 2017. Recuperado el 10 de enero de 2021 .
  7. ^ Ken Harrenstien; Vic White (marzo de 1982). Apodo/Whois . IETF . doi : 10.17487/RFC0812 . RFC 812 .Estado desconocido. Obsoleto según RFC 954 , 3912. 
  8. "Programación de Knowbot: Soporte del sistema para agentes móviles" . cnri.reston.va.us .
  9. Deutsch, Peter (11 de septiembre de 1990). " [ siguiente ] Un servidor de archivo de Internet (trataba sobre Lisp)" . groups.google.com . Consultado el 29 de diciembre de 2017 .
  10. "Servidores de la World Wide Web" . W3C . Consultado el 14 de mayo de 2012 .
  11. "¡Novedades! Febrero de 1994" . Mosaic Communications Corporation . Consultado el 14 de mayo de 2012 .
  12. Search Engine Watch (septiembre de 2001). "Motores de búsqueda" . Historia de Internet . Países Bajos: Universidad de Leiden. Archivado del original el 13 de abril de 2009.
  13. 1 2 "Archie" . PCMag . Consultado el 20 de septiembre de 2020 .
  14. Alexandra Samuel (21 de febrero de 2017). "Conozca a Alan Emtage, el tecnólogo negro que inventó ARCHIE, el primer motor de búsqueda de Internet" . ITHAKA . Consultado el 20 de septiembre de 2020 .
  15. Loop News Barbados. "Alan Emtage: un barbadense que deberías conocer" . loopnewsbarbados.com. Archivado del original el 23 de septiembre de 2020. Consultado el 21 de septiembre de 2020 .
  16. Grandoni, Dino (16 de abril de 2013). "Alan Emtage: El hombre que inventó el primer motor de búsqueda del mundo (pero no lo patentó)" . HuffPost .
  17. Oscar Nierstrasz (2 de septiembre de 1993). "Catálogo de búsqueda de recursos WWW (experimental)" .
  18. "Página de novedades de NCSA de diciembre de 1993" . 20 de junio de 2001. Archivado del original el 20 de junio de 2001. Consultado el 14 de mayo de 2012 .
  19. "¿Qué es el primer movimiento?" . SearchCIO . TechTarget . Septiembre de 2005 . Consultado el 5 de septiembre de 2019 .
  20. Oppitz, Marcus; Tomsu, Peter (2017). Inventando el siglo de la nube: cómo la nubosidad sigue cambiando nuestra vida, economía y tecnología . Springer. pág. 238. ISBN  9783319611617.
  21. "Yahoo! Search" . Yahoo !. 28 de noviembre de 1996. Archivado del original el 28 de noviembre de 1996. Consultado el 5 de septiembre de 2019 .
  22. Greenberg, Andy, "El hombre que está superando a Google" ,revista Forbes , 5 de octubre de 2009
  23. Yanhong Li, "Hacia un motor de búsqueda cualitativo", IEEE Internet Computing , vol. 2, n.º 4, págs. 24-29, julio/agosto de 1998, doi : 10.1109/4236.707687
  24. 1 2 "Acerca de: RankDex" , rankdex.com
  25. USPTO, "Sistema y método de recuperación de documentos hipertextuales" , Patente estadounidense número: 5920859, Inventor: Yanhong Li, Fecha de presentación: 5 de febrero de 1997, Fecha de emisión: 6 de julio de 1999
  26. "Baidu vs. Google: Comparación de los gemelos de la búsqueda" . FourWeekMBA . 18 de septiembre de 2018. Consultado el 16 de junio de 2019 .
  27. Altucher, James (18 de marzo de 2011). "10 cosas inusuales sobre Google" . Forbes . Consultado el 16 de junio de 2019 .
  28. 1 2 "Método para la clasificación de nodos en una base de datos enlazada" . Patentes de Google. Archivado del original el 15 de octubre de 2015. Recuperado el 19 de octubre de 2015 .
  29. "Yahoo! y Netscape firman un acuerdo de distribución internacional" (PDF) . Archivado del original (PDF) el 16 de noviembre de 2013. Consultado el 12 de agosto de 2009 .
  30. "Los acuerdos de navegadores impulsan las acciones de Netscape un 7,8%" . Los Angeles Times . 1 de abril de 1996.
  31. Oremus, Will (14 de octubre de 2013). "El gran éxito de Google" . Slate . ISSN 1091-2339 . Consultado el 12 de marzo de 2025 . 
  32. Jay (19 de febrero de 1998). "GoTo: El motor de búsqueda olvidado" . La historia de la web . Consultado el 12 de marzo de 2025 .
  33. Gandal, Neil (2001). "La dinámica de la competencia en el mercado de motores de búsqueda de Internet" . Revista Internacional de Organización Industrial . 19 (7): 1103– 1117. doi : 10.1016/S0167-7187(01)00065-0 . ISSN 0167-7187 . 
  34. "Nuestra historia en profundidad" . Archivado del original el 1 de noviembre de 2012. Consultado el 31 de octubre de 2012 .
  35. "Búsqueda valiente" .
  36. Roose, Kevin (16 de febrero de 2023). "La carrera por construir un motor de búsqueda impulsado por IA" . The New York Times . Recuperado el 31 de mayo de 2026 .
  37. "Definición – motor de búsqueda" . Techtarget . Consultado el 1 de junio de 2023 .
  38. 1 2 3 4 5 6 Jawadekar, Waman S (2011), "8. Gestión del conocimiento: herramientas y tecnología" , Gestión del conocimiento: texto y casos , Nueva Delhi: Tata McGraw-Hill Education Private Ltd, pág. 278, ISBN  978-0-07-07-0086-4Consultado el 23 de noviembre de 2012.
  39. Dasgupta, Anirban; Ghosh, Arpita; Kumar, Ravi; Olston, Christopher; Pandey, Sandeep; y Tomkins, Andrew. La capacidad de descubrimiento de la web . http://www.arpitaghosh.com/papers/discoverability.pdf
  40. 1 2 Jansen, BJ, Spink, A., y Saracevic, T. 2000. Vida real, usuarios reales y necesidades reales: Un estudio y análisis de las consultas de los usuarios en la web . Information Processing & Management. 36(2), 207–227.
  41. Chitu, Alex (30 de agosto de 2007). "Manera fácil de encontrar páginas web recientes" . Sistema operativo de Google . Recuperado el 22 de febrero de 2015 .
  42. "¿Qué es el SEO local y por qué es importante la búsqueda local?" . Search Engine Journal . Consultado el 26 de abril de 2020 .
  43. "Cuota de mercado mundial de los motores de búsqueda" . Similarweb Principales motores de búsqueda . Consultado el 19 de febrero de 2024 .
  44. Kerr, Dara (2 de mayo de 2024). "EE. UU. contra Google: Al concluir el histórico juicio sobre el 'poder monopólico', esto es lo que hay que tener en cuenta" . NPR .
  45. "Cuota de mercado de los motores de búsqueda en Rusia - junio de 2024" . StatCounter . Consultado el 30 de julio de 2025 .
  46. "Google pone fin a la redirección de búsqueda en China" . BBC News . 29 de junio de 2010. Consultado el 30 de julio de 2025 .
  47. "El dilema de Google en China: quedarse o irse" . Reuters . Marzo de 2023. Consultado el 30 de julio de 2025 .
  48. "Cuota de mercado de los motores de búsqueda en China - junio de 2024" . StatCounter . Consultado el 30 de julio de 2025 .
  49. "Cuota de mercado de los motores de búsqueda en Japón - junio de 2024" . StatCounter . Consultado el 30 de julio de 2025 .
  50. KH디지털2 (1 de octubre de 2014). "Kakao y Daum 'conectados' para generar sinergia" . The Korea Herald . Consultado el 13 de mayo de 2026 .{{cite web}}: CS1 maint: nombres numéricos: lista de autores ( enlace )
  51. Jie, Ye-eun (1 de diciembre de 2025). "Daum se independiza: Kakao separa su portal después de 10 años" . The Korea Herald . Consultado el 13 de mayo de 2026 .
  52. Nam, Hyun-woo (16 de abril de 2026). "Naver sigue siendo el actor dominante en el mercado de búsquedas de Corea" . The Korea Times . Consultado el 13 de mayo de 2026 .
  53. "Cuota de mercado de los motores de búsqueda en Taiwán - junio de 2024" . StatCounter . Consultado el 30 de julio de 2025 .
  54. Segev, El (2010). Google y la brecha digital: los sesgos del conocimiento en línea , Oxford: Chandos Publishing.
  55. 1 2 Vaughan, Liwen; Mike Thelwall (2004). "Sesgo de cobertura de los motores de búsqueda: evidencia y posibles causas". Information Processing & Management . 40 (4): 693– 707. CiteSeerX 10.1.1.65.5130 . doi : 10.1016/S0306-4573(03)00063-3 . S2CID 18977861 .  
  56. Jansen, BJ y Rieh, S. (2010) Los diecisiete constructos teóricos de la búsqueda y recuperación de información . Revista de la Sociedad Americana de Ciencias y Tecnología de la Información. 61(8), 1517–1534.
  57. Centro Berkman para Internet y la Sociedad (2002), "Sustitución de Google por sistemas de búsqueda alternativos en China: documentación y capturas de pantalla" , Facultad de Derecho de Harvard.
  58. Introna, Lucas; Helen Nissenbaum (2000). "Dando forma a la web: por qué importa la política de los motores de búsqueda". The Information Society . 16 (3): 169– 185. CiteSeerX 10.1.1.24.8051 . doi : 10.1080/01972240050133634 . S2CID 2111039 .  
  59. Hillis, Ken; Petit, Michael; Jarrett, Kylie (12 de octubre de 2012). Google y la cultura de la búsqueda . Routledge. ISBN 9781136933066.
  60. Reilly, P. (1 de enero de 2008). "«Buscando terroristas en Google: ¿Son visibles los terroristas norirlandeses en los motores de búsqueda de Internet?». En Spink, Prof. Dra. Amanda; Zimmer, Michael (eds.). Búsqueda web . Ciencia de la información y gestión del conocimiento. Vol.  14. Springer Berlin Heidelberg. pp. 151–175 . Bibcode : 2008wsis.book..151R . doi : 10.1007/978-3-540-75829-7_10 . ISBN  978-3-540-75828-0. S2CID 84831583 . 
  61. Hiroko Tabuchi , " Cómo los negacionistas del cambio climático llegan a la cima de las búsquedas en Google ", The New York Times, 29 de diciembre de 2017. Consultado el 14 de noviembre de 2018.
  62. Ballatore, A (2015). "Google chemtrails: Una metodología para analizar la representación de temas en los motores de búsqueda" . First Monday . 20 (7). doi : 10.5210/fm.v20i7.5597 .
  63. Pariser, Eli (2011). La burbuja de filtros : lo que Internet te oculta . Nueva York: Penguin Press. ISBN  978-1-59420-300-8OCLC 682892628 
  64. O'Hara, K. (1 de julio de 2014). "En adoración de un eco" . IEEE Internet Computing . 18 (4): 79– 83. Bibcode : 2014IIC....18d..79O . doi : 10.1109/MIC.2014.71 . ISSN 1089-7801 . S2CID 37860225 .  
  65. 1 2 Bruns, Axel (29 de noviembre de 2019). "Burbuja de filtro" . Internet Policy Review . 8 (4). doi : 10.14763/2019.4.1426 . hdl : 10419/214088 . ISSN 2197-6775 . S2CID 211483210 .  
  66. 1 2 Haim, Mario; Graefe, Andreas; Brosius, Hans-Bernd (2018). "¿Estallido de la burbuja del filtro?" . Periodismo Digital . 6 (3): 330– 343. doi : 10.1080/21670811.2017.1338145 . ISSN 2167-0811 . S2CID 168906316 .  
  67. Nechushtai, Efrat; Lewis, Seth C. (2019). "¿Qué tipo de guardianes de noticias queremos que sean las máquinas? Burbujas de filtro, fragmentación y las dimensiones normativas de las recomendaciones algorítmicas" . Computers in Human Behavior . 90 : 298–307 . doi : 10.1016/j.chb.2018.07.043 . S2CID 53774351 . 
  68. "Nuevo motor de búsqueda aprobado por el Islam para musulmanes" . News.msn.com. Archivado del original el 12 de julio de 2013. Consultado el 11 de julio de 2013 .
  69. "Jewogle - Preguntas frecuentes" . Archivado del original el 7 de febrero de 2019. Consultado el 6 de febrero de 2019 .
  70. "Halalgoogling: Los musulmanes obtienen su propio Google 'libre de pecado'; ¿Deberían los cristianos tener un Google cristiano? - Blog cristiano" . Blog cristiano . 25 de julio de 2013. Archivado del original el 13 de septiembre de 2014. Consultado el 13 de septiembre de 2014 .
  71. Schwartz, Barry (29 de octubre de 2012). "Google: Los servicios de envío a motores de búsqueda pueden ser perjudiciales" . Search Engine Roundtable . Recuperado el 4 de abril de 2016 .
  72. Heymann, Paul; Koutrika, Georgia; Garcia-Molina, Hector (12 de febrero de 2008). "¿Puede el marcaje social mejorar la búsqueda web?" . Primera Conferencia Internacional ACM sobre Búsqueda Web y Minería de Datos . Recuperado el 12 de marzo de 2008 .
  73. 1 2 Priti Srinivas Sajja; Rajendra Akerkar (2012). Tecnologías inteligentes para aplicaciones web . Boca Raton: CRC Press. pág. 87. ISBN  978-1-4398-7162-1Consultado el 3 de junio de 2014 .
  74. 1 2 3 4 "Una historia de los motores de búsqueda" . Wiley . Consultado el 1 de junio de 2014 .
  75. Priti Srinivas Sajja; Rajendra Akerkar (2012). Tecnologías inteligentes para aplicaciones web . Boca Raton: CRC Press. pág. 86. ISBN  978-1-4398-7162-1Consultado el 3 de junio de 2014 .
  76. "Los principales motores de búsqueda" . 21 de enero de 2014. Archivado del original el 5 de junio de 2014. Consultado el 1 de junio de 2014 .
  77. Jansen, BJ, Spink, A., Bateman, J., y Saracevic, T. 1998. Recuperación de información en la vida real: Un estudio de consultas de usuarios en la web . SIGIR Forum, 32(1), 5 -17.
  78. Priti Srinivas Sajja; Rajendra Akerkar (2012). Tecnologías inteligentes para aplicaciones web . Boca Raton: CRC Press. pág. 85. ISBN  978-1-4398-7162-1Consultado el 3 de junio de 2014 .
  79. Li, Jingjing; Larsen, Kai; Abbasi, Ahmed (1 de diciembre de 2020). "TheoryOn: un marco de diseño y un sistema para desbloquear el conocimiento del comportamiento a través del aprendizaje de ontologías" . MIS Quarterly . 44 (4): 1733– 1772. doi : 10.25300/MISQ/2020/15323 . S2CID 219401379 . 

Lecturas adicionales

  • Steve Lawrence; C. Lee Giles (1999). "Accesibilidad de la información en la web" . Nature . 400 (6740): 107– 9. Bibcode : 1999Natur.400..107L . doi : 10.1038/21987 . PMID 10428673. S2CID 4347646 .  
  • Bing Liu (2007), Minería de datos web: Exploración de hipervínculos, contenido y datos de uso . Springer, ISBN 3-540-37881-2
  • Bar-Ilan, J. (2004). El uso de motores de búsqueda web en la investigación en ciencias de la información. ARIST, 38, 231–288.
  • Levene, Mark (2005). Introducción a los motores de búsqueda y la navegación web . Pearson.
  • Hock, Randolph (2007). El manual del buscador extremo .ISBN 978-0-910965-76-7
  • Javed Mostafa (febrero de 2005). "Buscando mejores búsquedas web". Scientific American . 292 (2): 66– 73. Bibcode : 2005SciAm.292b..66M . doi : 10.1038/scientificamerican0205-66 .
  • Ross, Nancy; Wolfram, Dietmar (2000). "Búsqueda del usuario final en Internet: un análisis de los temas de pares de términos enviados al motor de búsqueda Excite". Journal of the American Society for Information Science . 51 (10): 949– 958. doi : 10.1002/1097-4571(2000)51:10 < 949::AID-ASI70 > 3.0.CO ; 2-5 .
  • Xie, M.; et  al. (1998). "Dimensiones de calidad de los motores de búsqueda de Internet". Journal of Information Science . 24 (5): 365– 372. doi : 10.1177/016555159802400509 . S2CID 34686531 . 
  • Recuperación de información: Implementación y evaluación de motores de búsqueda . MIT Press. 2010. Archivado del original el 5 de octubre de 2020. Consultado el 7 de agosto de 2010 .
  • Yeo, ShinJoung. (2023) Detrás del cuadro de búsqueda: Google y la industria global de Internet (U of Illinois Press, 2023) ISBN 0-252-08712-7JSTOR 4116455