Bloquear en robots.txt no borra tu página de Google
Por Jesús Porres · Publicado el 28 de julio de 2026
El fallo que veo cada mes
Este fin de semana pasó algo que ilustra a la perfección un error que veo en webs de dentistas, abogados y talleres casi cada semana: cientos de conversaciones compartidas de una IA acabaron apareciendo en Google. Lo llamativo es que esas páginas llevaban la orden correcta para no salir, un «noindex», y aun así ahí estaban.
La causa es un malentendido que cuesta caro. Mucha gente cree que bloquear una página en el robots.txt la borra de Google. No la borra. Y en algunos casos consigue justo lo contrario.
Disallow y noindex no son lo mismo
Son dos órdenes distintas y conviene no mezclarlas. Disallow, en el fichero robots.txt, le dice a Google «no entres a rastrear esta zona». Noindex le dice «esta página no la muestres en los resultados». Una habla de rastreo, la otra de aparecer o no.
Aquí está la trampa. Si le prohíbes a Google entrar en una página, Google nunca llega a leer lo que hay dentro, incluido el noindex. Y si esa página tenía enlaces desde fuera o ya estaba indexada, la sigue mostrando, porque la única orden que veía para retirarla estaba precisamente en la puerta que le cerraste. El resultado es el opuesto al que buscabas: la página se queda en Google, y encima sin manera de sacarla.
Por qué esto le pasa a una web local
Piensa en las páginas que no quieres que salgan en Google: la de «gracias por tu solicitud de presupuesto», un panel privado de cliente, la web en pruebas que dejaste montada, páginas de filtros que se duplican solas, un PDF de tarifas internas. Muchas plantillas de WordPress y bastantes plugins bloquean todo eso con Disallow dando por hecho que así desaparece.
No desaparece. Si alguien enlazó esa página o ya estaba indexada, sigue ahí. Para una pyme local esto tiene dos lecturas. La mala: contenido que no cuidas apareciendo bajo el nombre de tu negocio. La buena, si lo entiendes bien: pasas a tener control real sobre qué páginas de servicio y qué zonas quieres que Google enseñe.
La regla que no falla
Para quitar una página de los resultados: ponle un noindex y deja que Google la rastree. No la bloquees en robots.txt. Google entra, lee la orden y la retira. Es lento a veces, pero funciona.
El Disallow del robots.txt guárdalo para otra cosa: ahorrar rastreo en zonas que no aportan nada al posicionamiento, como carritos o buscadores internos, teniendo claro que eso no saca de Google lo que ya estaba dentro. Si algo te suena a que Google hace lo que le da la gana con ese fichero, lo cuento aparte en cuando Google ignora tu robots.txt, y el caso de páginas que Google rastrea pero decide no mostrar lo tienes en rastreada, actualmente no indexada.
Media hora para dejar de mostrar lo que no quieres
- Busca site:tudominio.es en Google.
Apunta las páginas que no deberían estar: las de gracias, la web de pruebas, los filtros repetidos.
- Cambia el bloqueo por un noindex.
Para esas páginas, quita el Disallow del robots.txt y ponles un noindex real, desde tu plugin de SEO o en el código. Deja que Google las rastree para que lea la orden.
- Revisa qué bloquea tu robots.txt.
Confirma que no estás cerrando sin querer las páginas de servicio o de ciudad que sí quieres posicionar. Ese error es más frecuente de lo que parece.
Si abres tu robots.txt y no tienes ni idea de qué está bloqueando, es justo lo que revisamos en la auditoría SEO gratuita: qué páginas ve Google, cuáles muestra y cuáles se le han quedado sueltas.
Preguntas frecuentes sobre robots.txt y noindex
¿Bloquear una página en robots.txt la borra de Google?
No, si esa página ya estaba indexada. Bloquear en robots.txt solo le dice a Google que no la rastree, no que la retire de los resultados. Si alguien la enlaza o ya estaba dentro, seguirá apareciendo. Para sacarla de verdad necesitas un noindex, y para que Google lo lea tiene que poder entrar en la página.
¿Qué diferencia hay entre Disallow y noindex?
Disallow, en el robots.txt, significa «no entres a rastrear esta zona». Noindex significa «no muestres esta página en los resultados». Son órdenes distintas: si pones las dos a la vez, Google no rastrea la página y por tanto nunca ve el noindex, así que la puede mostrar igualmente. Para ocultar una página usa noindex y deja que la rastree.
¿Cómo saco de Google la página de «gracias por tu presupuesto»?
Quítale el bloqueo del robots.txt si lo tiene, ponle una etiqueta noindex (desde tu plugin de SEO o en el código) y deja que Google pueda rastrearla. Google entrará, leerá el noindex y la retirará de los resultados. Comprueba antes con «site:tudominio.es» qué páginas de este tipo tienes sueltas por ahí.
¿Sabes qué páginas tuyas está mostrando Google?
Pide la auditoría gratuita y te decimos qué páginas de tu web salen en Google, cuáles deberían estar ocultas y si el robots.txt te está bloqueando algo que sí quieres posicionar.
Si quieres ganar visibilidad en tu zona de forma ordenada, esto es parte de nuestro SEO local.