El valor noindex de una metaetiqueta robots de HTML solicita que los bots automatizados de Internet eviten indexar una página web. [ 1 ] [ 2 ] También es un valor del encabezado de respuesta HTTP X-Robots-Tag. [ 3 ] Las razones por las que se podría querer usar esta metaetiqueta incluyen indicar a los robots que no indexen una base de datos muy grande, páginas web muy transitorias, páginas web en desarrollo, páginas web que se desea mantener un poco más privadas o las versiones de páginas compatibles con impresoras y dispositivos móviles. Dado que la responsabilidad de respetar la etiqueta noindex de un sitio web recae en el autor del robot de búsqueda, a veces estas etiquetas se ignoran. Además, la interpretación de la etiqueta noindex a veces es ligeramente diferente de una empresa de motores de búsqueda a otra.
No indexar páginas completas
<html> <head> < meta name = " robots " content = " noindex " > <title> No indexar esta página </title> </head>Los valores posibles para el contenido de la metaetiqueta son: "none", "all", "index", "noindex", "nofollow" y "follow". También es posible una combinación de los valores, [ 1 ] por ejemplo:
< meta name = "robots" content = "noindex, follow" >Directivas específicas para bots
La directiva noindex se puede restringir solo a ciertos bots especificando un valor "name" diferente en la etiqueta meta. Por ejemplo, para bloquear específicamente el bot de Google, [ 4 ] especifique:
< meta name = "googlebot" content = "noindex" >O bien, para bloquear el bot de Bing, especifique:
< meta name = "bingbot" content = "noindex" >O bien, para bloquear el bot de Baidu, especifique:
< meta name = "baiduspider" content = "noindex" >archivo robots.txt
Se puede utilizar un archivo robots.txt para bloquear el rastreo web.
No indexar parte de una página
También es posible excluir de la indexación parte de una página web, por ejemplo, el texto de navegación, en lugar de la página completa. Existen diversas técnicas para lograrlo; es posible combinar varias. Se desconoce si Googlebot , el principal rastreador de indexación de Google , reconoce alguna de estas técnicas.
etiqueta <noindex>
El motor de búsqueda ruso Yandex introdujo una nueva etiqueta que impide la indexación del contenido entre las etiquetas. Para permitir la validación del código fuente , se puede utilizar alternativamente: [ 5 ]<noindex>...</noindex><!--noindex-->
<p> Indexa este texto. < noindex > No indexar este texto. </ noindex > <!--noindex--> No indexar este texto. <!--/noindex--> </ p >Otros rastreadores de indexación también reconocen la etiqueta, incluido Atomz . [ 6 ]<noindex>...</noindex>
microformato
Existe un borrador de especificación de microformatos de 2005 con la misma funcionalidad. El perfil de exclusión de robots busca el atributo y el valor class="robots-noindex" en las etiquetas HTML: [ 7 ]
<p> Indexar este texto. </p> < div class = " robots-noindex" > No indexar este texto. </div> < span class = " robots - noindex " > No indexar este texto. </span> < p class = " robots-noindex" > No indexar este texto . </p>También es posible una combinación de valores, [ 7 ] por ejemplo:
< div class = "robots-noindex robots-follow" > Texto. </ div >Yahoo!
En 2007, Yahoo! introdujo una funcionalidad similar al microformato en su araña. Sin embargo, la araña de Yahoo! es incompatible, ya que busca el valor class="robots-nocontent" y solo este valor: [ 8 ]
<p> Indexar este texto. </p> < div class = " robots-nocontent" > No indexar este texto. </div> < span class = "robots-nocontent" > No indexar este texto. </span> < p class = " robots - nocontent" > No indexar este texto . </p>SharePoint
El iFilter de SharePoint 2010 excluye el contenido dentro de una etiqueta. Inicialmente, las etiquetas internas no se excluían, pero esto podría haber cambiado. También se desconoce si el atributo se puede aplicar a etiquetas distintas de . [ 9 ]<divclass="noindex">...</div><div>...</div><div>...</div>
<p> Indexar este texto. </p> < div class = " noindex " > No indexar este texto . </div>Comentarios estructurados
Dispositivo de búsqueda de Google
El Google Search Appliance utiliza comentarios estructurados: [ 10 ]
<p> Indexa este texto. <!--googleoff: all--> No indexar este texto. <!--googleon: all -- > </p>Otros robots indexadores también utilizan sus propios comentarios estructurados.
Véase también
- atributo de enlace nofollow
- Estándar de exclusión de robots
Referencias
- 1 2 Robots y el elemento META , especificación oficial del W3
- ↑ Acerca de la etiqueta <META> de Robots
- ↑ "Robots.txt vs. Etiquetas Noindex" .
- ↑ Uso de metaetiquetas para bloquear el acceso a tu sitio , Ayuda de Google Webmasters Tools
- ↑ "Uso de etiquetas HTML" . Webmaster → Ayuda . Yandex . Sección: etiqueta <noindex> . Consultado el 25 de marzo de 2013 .
- ↑ "Preguntas frecuentes sobre búsqueda general" . Ayuda . Atomz . 2013. Sección: ¿Cómo excluyo partes de mi sitio de la búsqueda? Archivado del original el 8 de diciembre de 2021. Recuperado el 23 de marzo de 2013. ¿
Necesitas
evitar que partes de páginas individuales se indexen? Si quieres excluir partes de una página de la indexación, encierra el texto con
las
etiquetas
<noindex>
y
</noindex>
. Esto es útil, por ejemplo, si quieres excluir el texto de navegación de las búsquedas
.
( Se requiere registro )
- 1 2 Janes, Peter (18 de junio de 2005). "Perfil de exclusión de robots" . Microformatos . Recuperado el 24 de marzo de 2013 .
- ↑ Garg, Priyank (2 de mayo de 2007). "Presentación de Robots-Nocontent para secciones de página" . Blog de búsqueda de Yahoo! Yahoo !. Archivado del original el 20 de agosto de 2014. Recuperado el 23 de marzo de 2013 .
- ↑ "Controlar la indexación de búsqueda (rastreo) dentro de una página con Noindex" . Microsoft Developer . Microsoft . 7 de junio de 2010. Archivado del original el 4 de noviembre de 2017. Consultado el 4 de noviembre de 2017 .
- ↑ "Administración del rastreo: Preparación para un rastreo" . Google Search Appliance . Google Inc. 23 de agosto de 2012. Sección: Exclusión de texto no deseado del índice. Archivado del original el 23 de noviembre de 2012. Consultado el 23 de marzo de 2013 .