La guía de rastreo e indexación de esta sección presenta noindex y nofollow, las dos directivas de meta robots más conocidas. Son solo dos de una lista más larga que permite un control mucho más fino de cómo aparece (o no aparece) cada página en los resultados de búsqueda, incluyendo directivas pensadas específicamente para limitar cuánto contenido se muestra en el snippet, algo que ha ganado relevancia práctica con la aparición de resúmenes generados por IA que citan fragmentos más largos que un snippet clásico.
La sintaxis base: uno o varios valores separados por comas
Todas las directivas de esta guía se declaran igual que noindex: en la etiqueta <meta name="robots" content="..."> del <head>, o en la cabecera HTTP X-Robots-Tag para recursos que no son HTML. Se pueden combinar varias directivas separadas por comas en el mismo valor, y también se puede dirigir una directiva a un rastreador concreto en vez de a todos, sustituyendo robots por el nombre de ese user-agent (por ejemplo googlebot) para que solo ese rastreador la aplique.
none: el atajo que casi nadie usa pero que existe
La directiva none es exactamente equivalente a declarar noindex, nofollow a la vez; es un atajo de sintaxis, no una directiva con comportamiento distinto. Su utilidad práctica es marginal (escribir las dos directivas explícitas es igual de válido y más legible para cualquiera que revise el código más adelante), pero conviene reconocerla al auditar sitios ajenos porque tiene exactamente el mismo efecto restrictivo que la combinación completa, y confundirla con un simple noindex lleva a subestimar que también está cortando el flujo de rastreo hacia los enlaces de esa página.
<!-- Equivalentes exactos -->
<meta name="robots" content="none">
<meta name="robots" content="noindex, nofollow">
noarchive: control sobre la copia en caché, hoy más simbólico que práctico
noarchive le pide a Google que no guarde ni muestre una copia en caché de la página. Durante años tuvo un efecto visible directo: el enlace "En caché" que aparecía junto a cada resultado de búsqueda, útil cuando una web caía temporalmente y el usuario quería acceder de todos modos a la última versión indexada. Google retiró ese enlace de caché de los resultados de búsqueda de forma generalizada, así que el efecto visible original de noarchive prácticamente ha desaparecido para el usuario medio. Sigue siendo relevante documentarla por dos motivos: sigue siendo parte de la especificación oficial y algunos motores o herramientas de terceros pueden respetarla igualmente, y comunica una intención clara (no archivar el contenido) que puede volver a tener relevancia práctica si Google u otro buscador reintroducen algún mecanismo de copia o cita histórica del contenido.
nosnippet: sin fragmento de texto, sin vista previa, sin nada que mostrar más allá del título y la URL
nosnippet le dice a Google que no muestre ningún fragmento de texto descriptivo, ni ninguna vista previa de vídeo o imagen, bajo el resultado de esa página en el buscador: solo aparecerá el título y la URL, sin ningún adelanto del contenido. Es una directiva radical que rara vez conviene aplicar a contenido normal (reduce directamente el CTR, porque el snippet es lo que ayuda al usuario a decidir si esa página responde a su búsqueda), pero tiene casos de uso legítimos: páginas cuyo contenido cambia de forma tan rápida que cualquier fragmento cacheado quedaría desactualizado casi de inmediato, o contenido bajo licencia donde mostrar cualquier fragmento, por corto que sea, ya supone un problema contractual con el proveedor del contenido.
<meta name="robots" content="nosnippet">
max-snippet, max-image-preview y max-video-preview: el control fino que sustituyó al todo o nada
Antes de que existieran estas tres directivas, la única forma de limitar el snippet era nosnippet, un interruptor de todo o nada. Google introdujo un grupo de directivas que permiten fijar un límite numérico en vez de eliminar el snippet por completo, lo que da mucho más control fino, especialmente relevante hoy porque los resúmenes generados por sistemas de IA en el buscador pueden citar fragmentos considerablemente más largos que un snippet tradicional de una o dos líneas si no se limita explícitamente:
<meta name="robots" content="max-snippet:150, max-image-preview:large, max-video-preview:30">
max-snippet fija el número máximo de caracteres de texto que se pueden mostrar como fragmento (el valor 0 equivale a no mostrar ningún fragmento de texto, similar a nosnippet pero solo para el texto; -1 significa sin límite explícito, dejando que Google decida). max-image-preview controla el tamaño máximo de la miniatura de imagen que puede mostrarse, con tres valores posibles: none (ninguna imagen), standard (tamaño por defecto) o large (miniatura grande, necesaria por ejemplo para que un artículo sea elegible para determinados formatos visuales destacados). max-video-preview fija en segundos la duración máxima de una vista previa animada de vídeo, con 0 para una sola imagen estática como miniatura y -1 para sin límite.
Por qué max-snippet importa más ahora que hace unos años
Cuando el snippet estaba limitado de facto por el espacio visual de un resultado de búsqueda tradicional (una o dos líneas de texto), el incentivo para configurar max-snippet de forma explícita era bajo: el límite práctico ya lo imponía el propio diseño de la interfaz. Con la aparición de resúmenes generados por sistemas de IA que pueden citar y sintetizar fragmentos bastante más largos de una página dentro de una respuesta conversacional, un sitio que depende del tráfico directo a su página (por ejemplo, contenido de pago parcial, o contenido cuyo modelo de negocio es la visita en sí) tiene un motivo real para fijar un max-snippet bajo, limitando cuánto contenido puede reutilizarse fuera de la propia página sin necesidad de recurrir al todo o nada de nosnippet.
Cuando meta robots y X-Robots-Tag se contradicen: qué gana
En sitios con configuraciones heredadas de distintas épocas es habitual encontrar una página con una directiva en la etiqueta <meta name="robots"> del HTML y una directiva distinta en la cabecera HTTP X-Robots-Tag del mismo recurso. La regla de resolución no es que una fuente tenga prioridad fija sobre la otra: Google combina todas las directivas encontradas, de cualquier fuente válida, y aplica la más restrictiva quando entran en conflicto directo. Un index en el HTML combinado con un noindex en la cabecera HTTP se resuelve como noindex, no como un empate ni como preferencia por una fuente sobre otra: en caso de duda, gana siempre la directiva que más limita la visibilidad de la página.
# Cabecera HTTP dice noindex...
Header set X-Robots-Tag "noindex"
<!-- ...aunque el HTML diga index, el resultado final es noindex -->
<meta name="robots" content="index">
Preguntas frecuentes
¿Sirve de algo usar noarchive hoy si Google ya no muestra el enlace "En caché"?
El beneficio directo y visible para el usuario ha desaparecido con la retirada de ese enlace, pero la directiva sigue formando parte de la especificación y puede seguir siendo respetada por otros motores o herramientas, así que mantenerla no perjudica y comunica una intención que puede recuperar relevancia si cambia el comportamiento de algún buscador.
¿max-snippet:0 es lo mismo que nosnippet?
Muy parecido pero no idéntico: max-snippet:0 elimina el fragmento de texto pero no necesariamente afecta a las vistas previas de imagen o vídeo, que se controlan con sus propias directivas independientes; nosnippet elimina todo tipo de vista previa a la vez.
¿Puedo aplicar max-snippet solo a Googlebot y dejar el resto de buscadores sin límite?
Sí, sustituyendo robots por googlebot en el nombre de la etiqueta o de la cabecera; cada buscador que respeta estas directivas las lee bajo su propio nombre de user-agent además de bajo el genérico robots, lo que permite reglas distintas por buscador si hace falta.
¿Reduce el CTR usar nosnippet o un max-snippet muy bajo?
Casi siempre sí, porque el fragmento de texto es una de las señales que más ayuda al usuario a decidir si el resultado responde a su búsqueda antes de hacer clic; conviene reservar estas directivas para casos con una razón de negocio concreta, no aplicarlas por defecto a todo el sitio.