HERRAMIENTA GRATIS · GENERADOR DE ETIQUETAS META ROBOTS
Generador de etiquetas meta robots
Construye la etiqueta meta robots, las cabeceras X-Robots-Tag equivalentes y el bloque de robots.txt para los rastreadores de IA — y mira la regla que de verdad le llega a cada rastreador. No suele ser la que te prometen la mayoría de los generadores.
También enEnglish繁體中文日本語한국어EspañolFrançaisDeutschPortuguês (Brasil)
index no es una regla de Google — una página sin etiqueta robots ya es indexable. Solo noindex cambia algo.
0 significa sin fragmento; -1 deja que Google elija. También se aplica a las vistas generales de IA y al modo IA.
0 permite solo una imagen fija; -1 significa sin límite.
Pasada esa fecha la página sale de los resultados y Googlebot la rastrea mucho menos.
agente: regla, regla. Se suman a las reglas de arriba; no pueden cancelarlas.
Son tokens de robots.txt, no directivas meta — por eso este control escribe un bloque de robots.txt, no una etiqueta.
Todo ocurre dentro de esta página. Nada de lo que escribas se envía a ningún sitio.
Cómo construir una etiqueta meta robots que haga lo que querías
Elige las restricciones, añade excepciones por rastreador si las tienes y lee la regla efectiva. Tres de las comprobaciones existen porque las herramientas que posicionan para esta búsqueda se equivocan en la semántica, no en la sintaxis.
- Decide qué vas a restringir. Solo cuentan las restricciones. En la lista de Google no existe una regla «index», y «all» no tiene efecto cuando se indica explícitamente: una página que quieres indexada no necesita ninguna etiqueta.
- Di si el robots.txt bloquea la URL. Si la bloquea y además pides noindex, el generador se detiene. Una página bloqueada no se descarga, así que el noindex no se lee nunca — el motivo más común de que una página se niegue a salir del índice.
- Escribe las líneas por rastreador solo como restricciones. Las reglas se combinan como la suma de las reglas negativas. Una etiqueta específica puede endurecer lo que se aplica a ese rastreador; no puede aflojar nada.
- Usa la versión de cabecera para lo que no sea HTML. PDF, imágenes, CSV y descargas generadas no tienen head donde poner una etiqueta. X-Robots-Tag lleva las mismas reglas como cabecera de respuesta, con fragmentos para Apache y nginx.
- Los rastreadores de IA se tratan en el robots.txt, no aquí. Todas las exclusiones publicadas por Google, OpenAI, Anthropic, Perplexity, Apple, Meta y Common Crawl son tokens de user-agent de robots.txt. La tercera salida es ese bloque.
noindex y Disallow se anulan entre sí
Un generador de etiquetas meta robots construye la etiqueta <meta name="robots"> que le dice a los buscadores si una página debe indexarse, si hay que seguir sus enlaces y cuánto de ella pueden mostrar. El error más caro con el que puede ayudarte no es una errata. Es combinar esa etiqueta con una línea Disallow.
Las palabras de Google: para que la regla noindex surta efecto, la página no debe estar bloqueada por un archivo robots.txt y tiene que ser accesible para el rastreador. Si está bloqueada, el rastreador no llega a ver la regla, y la URL puede seguir apareciendo en los resultados a partir de enlaces que apunten a ella — sin fragmento y sin el título que elegiste.
Este es el bucle en el que se queda la gente. Una página no sale del índice, así que la bloquean también en el robots.txt, lo que garantiza que no salga nunca. Y el atajo evidente también está cerrado: especificar noindex en el robots.txt no está admitido por Google. El orden es siempre el mismo:
- Quitar la línea
Disallowpara que la página se pueda rastrear. - Servir
noindex— como etiqueta meta en el HTML, comoX-Robots-Tagen todo lo demás. - Esperar a que se vuelva a rastrear. Solo una vez fuera del índice tiene sentido bloquear el rastreo, y para entonces normalmente ya no hace falta.
La casilla del formulario está ahí para que el generador pueda negarse. Ninguna de las dos herramientas que ocupan hoy la primera y la sexta posición para esta búsqueda menciona Disallow en ningún punto de su página.
Las reglas por rastreador se suman — no sustituyen
Puedes dirigirte a un rastreador por su nombre: <meta name="googlebot">, <meta name="googlebot-news">, <meta name="bingbot">. Lo que casi todas las explicaciones cuentan al revés es cómo se combina con la etiqueta genérica.
La documentación de Google: cuando se especifican varios rastreadores con reglas distintas, el buscador usa la suma de las reglas negativas. El ejemplo que da es un nofollow genérico más un noindex para Googlebot, y el resultado para Googlebot es noindex, nofollow: las dos, no la más específica. Para las cabeceras enuncia el mismo principio: cuando las reglas entran en conflicto, se aplica la más restrictiva.
Lo que significa que esta pareja no hace lo que parece que hace:
<meta name="robots" content="noindex">
<meta name="googlebot" content="index"> <!-- no devuelve la página al índice -->
No existe una regla positiva que deshaga una negativa. Para que te indexe Google y nadie más, restringes a los demás; no le das permiso a Google. El generador calcula la regla efectiva para cada rastreador que nombres y avisa en cuanto una línea intenta aflojar en vez de apretar.
Una consecuencia más, barata de decir y fácil de pasar por alto: nosnippet y max-snippet:50 en la misma página dan como resultado ningún fragmento, porque gana la regla más restrictiva.
La decisión que solo tiene una página en español: notranslate
En un sitio en inglés, notranslate es una casilla que casi nadie toca. En una página en español es una decisión real, y conviene separarla de la que se le parece.
notranslate le pide a Google que no ofrezca una traducción de esta página. Quien busca en otro idioma y se encuentra tu resultado deja de ver el «Traducir esta página». Eso no mejora la versión en español de nada: solo recorta a quién le sirve la página. Tiene sentido en un caso concreto — texto legal, precios o condiciones cuya traducción automática te generaría un problema — y casi ninguno más.
Lo que la gente suele querer cuando llega a esa casilla es otra cosa: controlar qué versión en español ve cada país. Eso no es una directiva de robots, es hreflang. Y ahí hay dos errores que comprobamos contra la documentación de Google sobre versiones localizadas:
hreflang="mx"no existe. La primera parte del valor es un código de idioma ISO 639-1;mxno es un idioma. México se escribees-MX.hreflang="uk"no es el Reino Unido.ukes ucraniano. El Reino Unido esen-GB.hreflang="ES"sí es válido, en cambio: los códigos de idioma no distinguen mayúsculas, así que se lee como español. Este es un caso en el que el aviso habitual está equivocado.
Resumiendo la relación entre las dos cosas: hreflang reparte entre es-ES, es-419, es-MX y el es a secas; notranslate decide si un lector de otro idioma puede leerte traducido. No son alternativas, y marcar la segunda no arregla nunca un problema de la primera.
Directivas que ya no hacen nada
Google publica una lista de reglas que no usa, y los generadores las siguen ofreciendo sin ninguna nota al respecto. Comprobado el 2026-09-15 contra la especificación de las etiquetas meta robots:
| Regla | Estado |
|---|---|
noarchive | La Búsqueda de Google ya no la usa — controlaba el enlace a la copia en caché, y esa función ha desaparecido. |
nocache | La Búsqueda de Google no la usa. |
nositelinkssearchbox | Ya no se usa — el cuadro de búsqueda de enlaces de sitio que suprimía ya no existe. |
index, follow | No están en la lista de reglas válidas de Google. El valor documentado para «sin restricciones» es all, y all no tiene efecto si se indica explícitamente. |
La herramienta que ocupa el primer puesto para esta búsqueda ofrece noarchive y nositelinkssearchbox como directivas que funcionan, sin matices. Este generador seguirá emitiendo noarchive si se lo pides — puede que algún otro buscador lo lea — pero te dice que Google no. Y marca una etiqueta index, follow por lo que es: una etiqueta que no cambia nada, en una página que ya era indexable.
De ahí sale una regla práctica. Publica una etiqueta robots solo cuando estés restringiendo algo. Si no hay nada que restringir, la mejor etiqueta es ninguna etiqueta.
Rastreadores de IA: el interruptor está en el robots.txt, no en una etiqueta meta
Circulan bastantes consejos que sugieren <meta name="noai">, o meter Google-Extended en una etiqueta meta. Fuimos a leer la documentación de cada proveedor. Ninguna de las dos cosas funciona, y esta es la forma real del asunto.
- Google-Extended no tiene ninguna cadena de user-agent. La documentación de rastreadores de Google dice que el rastreo se hace con los user-agents de Google ya existentes y que el token se usa solo con función de control en el robots.txt. No hay nada a lo que una etiqueta meta pueda dirigirse. Gobierna el entrenamiento y el grounding de Gemini, y no afecta a la Búsqueda de Google ni al posicionamiento.
- OpenAI, Anthropic y Perplexity documentan todos tokens de robots.txt —
GPTBot,OAI-SearchBot,ChatGPT-User;ClaudeBot,Claude-SearchBot,Claude-User;PerplexityBot,Perplexity-User. Ninguno de los tres documenta una etiqueta meta. noaiynoimageaino aparecen en ninguno de esos documentos. Son una propuesta del lado editorial, no algo que un buscador grande declare respetar.- Las descargas que dispara una persona son otra categoría. Perplexity documenta que
Perplexity-Userpor lo general ignora el robots.txt porque la petición la hizo alguien; Meta dice lo mismo deMeta-ExternalFetcher. Para esos, una línea de robots.txt no es un muro.
Dos cosas del lado meta sí llegan de verdad a las respuestas de IA, y ambas son directivas corrientes de Google: nosnippet y max-snippet se aplican explícitamente a las vistas generales de IA y al modo IA, y limitan cuánto de la página puede usarse como entrada directa. Esa es la lista honesta.
La tercera salida escribe el bloque de robots.txt según la política que elijas, agrupado por proveedor. Bloquear a los rastreadores del lado de las respuestas es una decisión real con un coste real — te saca de los resultados que esos motores citan. Si el objetivo es justo el contrario, el material está en las herramientas GEO, agrupadas por lo que hacen de verdad.
Preguntas frecuentes
¿Qué es un generador de etiquetas meta robots?
Un generador de etiquetas meta robots construye la etiqueta meta name="robots" que le dice a los buscadores si una página debe indexarse, si hay que seguir sus enlaces y cuánto de ella pueden mostrar. Este además emite las cabeceras X-Robots-Tag equivalentes y el bloque de robots.txt para rastreadores de IA, y calcula la regla efectiva para cada rastreador que nombres.
¿Puedo usar noindex y Disallow en el robots.txt a la vez?
No — se anulan. Google indica que para que una regla noindex surta efecto la página no debe estar bloqueada por robots.txt; una página bloqueada no se descarga, así que la regla no se lee nunca, y la URL puede seguir apareciendo en resultados desde enlaces. Permite el rastreo, sirve noindex y espera a que se vuelva a rastrear.
¿Debo marcar notranslate en una página en español?
Casi nunca. notranslate solo impide que Google ofrezca traducir la página, lo que reduce a quién le sirve sin mejorar nada de la versión en español. Tiene sentido con textos legales, precios o condiciones que no quieres ver traducidos automáticamente. Para decidir qué versión ve cada país se usa hreflang, que no es una directiva de robots.
¿Una etiqueta para googlebot sustituye a la etiqueta robots genérica?
No en la dirección que se espera. Google usa la suma de las reglas negativas entre la etiqueta genérica y la específica del rastreador, y cuando hay conflicto se aplica la más restrictiva. Una etiqueta específica puede endurecer las reglas para ese rastreador; no puede volver a permitir lo que la genérica prohibió.
¿Necesito una etiqueta index, follow?
No. Ni index ni follow están en la lista de reglas válidas de Google, y el valor documentado para «sin restricciones», all, no tiene efecto cuando se indica. Una página sin ninguna etiqueta meta robots es plenamente indexable, así que una etiqueta solo merece la pena si restringe algo.
¿Sigue funcionando noarchive?
Para la Búsqueda de Google no. Está en la lista de reglas históricas y en desuso, junto a nocache y nositelinkssearchbox, porque el enlace a la copia en caché que controlaba ha dejado de existir. Otros buscadores puede que aún lo lean, así que este generador lo emite si lo pides mientras te dice que Google no actuará sobre él.
¿Cuándo uso X-Robots-Tag en lugar de la etiqueta meta?
Siempre que el recurso no tenga head HTML — PDF, imágenes, vídeos, CSV, descargas generadas. Cualquier regla válida en una etiqueta meta robots lo es como cabecera X-Robots-Tag, la cabecera puede nombrar un user-agent antes de las reglas, y varias cabeceras se combinan.
¿Llegó el noindex, o la página sigue ahí dentro?
Comprobar tu propio dominio no cuesta nada, y lee el veredicto del propio Google: cada página con su estado HTTP en vivo y su estado de indexación, impresiones y posición media frente al periodo anterior, y el tráfico por origen con los motores de IA contados aparte.
$ npm i -g @clize/clize && clize install $ clize seo check --domain tudominio.es[ Herramientas GEO de Clize → ]