Robots.txt en WordPress: guía actualizada para 2026

El archivo robots.txt no es un escudo de seguridad ni una orden para borrar páginas de Google. Sirve para indicar a los rastreadores qué rutas pueden solicitar y cuáles prefieres que no recorran. En WordPress, además, existe una diferencia importante entre controlar el rastreo con robots.txt y controlar la indexación de una página con la meta robots, por ejemplo mediante noindex. Confundir ambas cosas puede dejar páginas visibles en buscadores o bloquear recursos que Google necesita para renderizar la web.

La versión original de este artículo se publicó en 2015 y proponía una lista muy agresiva de bloqueos para bots y carpetas internas. Esa receta ya no es una buena base. En 2026 conviene partir del archivo que realmente sirve tu instalación, comprobar el sitemap y tomar las decisiones de indexación a nivel de página.

Las claves del robots.txt en WordPress en 20 segundos

  • Comprueba primero tu archivo real en https://tudominio.com/robots.txt; WordPress puede generarlo de forma virtual.
  • Disallow controla solicitudes de rastreo, pero no garantiza que una URL desaparezca del índice.
  • Para evitar la indexación de una página utiliza noindex o protección con contraseña, sin bloquear antes el acceso del rastreador.
  • No bloquees CSS, JavaScript, imágenes o carpetas necesarias para mostrar correctamente el contenido.
  • El sitemap ayuda a descubrir URLs, pero no convierte en buenas ni indexables las páginas que incluyas en él.

Qué hace y qué no hace robots.txt

Cuando un rastreador visita un sitio, busca el archivo robots.txt en la raíz del dominio. Una directiva Disallow le pide que no solicite una ruta concreta para el agente de usuario al que se aplica. Es una indicación de rastreo, no un mecanismo de autenticación: un usuario puede intentar abrir la URL directamente y un bot malicioso puede ignorarla.

Google explica además que una URL bloqueada puede seguir apareciendo en sus resultados sin un fragmento de contenido. Si lo que quieres es que una página no se indexe, el rastreador debe poder acceder a ella para encontrar la instrucción noindex, o debes protegerla con contraseña. Por eso robots.txt y meta robots resuelven problemas distintos.

El punto de partida: mira el archivo que sirve tu web

Abre https://tudominio.com/robots.txt en el navegador. No copies un archivo de otro proyecto sin comprobar antes qué genera tu instalación, tu tema y tus plugins. También revisa si el sitio está en producción: en una instalación no pública, WordPress puede devolver reglas distintas.

Un ejemplo sencillo para una web pública podría ser este:

User-agent: *
Disallow: /wp-admin/
Allow: /wp-admin/admin-ajax.php
Sitemap: https://tudominio.com/wp-sitemap.xmlLenguaje del código: HTTP (http)

Es un ejemplo, no una plantilla que debas pegar sin revisar. WordPress suele proteger el área de administración y permitir la llamada a admin-ajax.php, pero el sitemap puede estar en otra dirección si lo gestiona un plugin SEO. Añádelo solo cuando hayas comprobado la URL exacta y evita duplicar líneas que ya aparecen.

Qué conviene bloquear y qué es mejor dejar accesible

La regla más prudente es bloquear únicamente rutas que no necesiten ser rastreadas y que no aporten contenido público. El área /wp-admin/ es el caso habitual. Las páginas de búsqueda interna, algunos feeds, archivos de autor o parámetros pueden necesitar una estrategia adicional, pero no se resuelven siempre con robots.txt: hay que valorar cómo se generan, si tienen enlaces y qué directiva de indexación necesita cada una.

No bloquees por sistema /wp-includes/, /wp-content/, CSS, JavaScript, imágenes o fuentes. Aunque ciertas carpetas no sean páginas que quieras posicionar, sus recursos pueden ser necesarios para que los buscadores entiendan el diseño y el contenido. Tampoco uses robots.txt para ocultar copias privadas, paneles, documentos sensibles o archivos de configuración: utiliza permisos, autenticación o elimina el archivo del espacio público.

Las listas largas que bloquean agentes de usuario uno por uno suelen dar una falsa sensación de control y pueden quedarse obsoletas. Si recibes tráfico automatizado abusivo, analiza primero los registros y aplica límites, reglas del servidor, WAF o medidas específicas de seguridad. Robots.txt no sustituye ninguna de ellas.

Robots.txt, meta robots y wp_robots: no son lo mismo

Para una URL concreta, la meta robots permite indicar noindex, nofollow o directivas relacionadas. WordPress dispone de la función wp_robots() y del filtro wp_robots para que el tema o los plugins ajusten esas etiquetas. Esta vía es más precisa para archivos de poco valor, resultados de búsqueda o páginas que deben poder rastrearse pero no entrar en el índice.

En cambio, el filtro robots_txt permite modificar el contenido del archivo robots.txt que WordPress genera. Si lo usas desde un plugin propio o un fragmento de código, comprueba el parámetro $public y conserva las reglas existentes. Un ejemplo mínimo sería:

add_filter( 'robots_txt', function ( $output, $public ) {
    if ( ! $public ) {
        return $output;
    }

    $sitemap = home_url( '/wp-sitemap.xml' );

    if ( strpos( $output, 'Sitemap:' ) === false ) {
        $output .= "Sitemap: {$sitemap}" . PHP_EOL;
    }

    return $output;
}, 10, 2 );Lenguaje del código: PHP (php)

Este código solo tiene sentido si la URL del sitemap es realmente esa y si ningún plugin ya la añade. Si no estás acostumbrado a modificar filtros de WordPress, es más seguro revisar la documentación del plugin SEO o utilizar un plugin de fragmentos con copias y posibilidad de deshacer el cambio. Después de guardar, vuelve a abrir robots.txt y comprueba el resultado.

El sitemap de WordPress y los plugins SEO

Las versiones actuales de WordPress incluyen un sitemap XML nativo, normalmente accesible en /wp-sitemap.xml. Un plugin SEO puede sustituirlo por su propia dirección, añadir índices de sitemaps o modificar qué tipos de contenido aparecen. Solo debes declarar la URL que existe y responde correctamente con código 200.

Un sitemap no fuerza la indexación: sirve como ayuda para que los buscadores descubran URLs que ya consideras públicas y útiles. Si el archivo incluye páginas que deberían ser noindex, revisa la configuración del plugin o del tipo de contenido en lugar de intentar taparlas únicamente con robots.txt.

Cómo revisar un robots.txt sin causar problemas

  • Comprueba que el archivo se carga en la raíz del dominio y que no devuelve un error, una redirección extraña o contenido de otro entorno.
  • Busca bloqueos accidentales del dominio completo, como Disallow: /, especialmente después de migrar de staging a producción.
  • Confirma que no se bloquean CSS, JavaScript, imágenes ni recursos que la plantilla necesita para renderizar.
  • Abre el sitemap declarado y verifica que contiene las URLs canónicas que quieres ofrecer a los buscadores.
  • Revisa en Search Console las páginas excluidas y los avisos de rastreo; no interpretes cada exclusión como un error.
  • Después de cambiar reglas, vuelve a comprobar el archivo y observa los registros y los informes durante varios días.

Preguntas frecuentes

¿Cuál es el mejor robots.txt para WordPress?

No hay un archivo universal. Para una web pública suele bastar con conservar las reglas que genera WordPress, bloquear el área de administración y declarar el sitemap real. Las demás reglas dependen del contenido, la arquitectura y la estrategia de indexación.

¿Robots.txt elimina una página de Google?

No de forma fiable. Disallow limita el rastreo, pero una URL bloqueada puede aparecer sin descripción. Para evitar la indexación, usa noindex con la página accesible para el rastreador o protégela con contraseña.

¿Debo bloquear wp-content y wp-includes?

No por defecto. Esas rutas pueden contener estilos, scripts, imágenes y otros recursos necesarios para renderizar la web. Bloquearlas sin comprobar el efecto puede dificultar que los buscadores interpreten la página.

¿Dónde pongo el sitemap?

En una línea Sitemap con la dirección completa del sitemap que realmente sirve tu web, normalmente https://tudominio.com/wp-sitemap.xml en WordPress nativo. Si un plugin SEO utiliza otra URL, declara esa y evita duplicados.

Fuentes: documentación oficial de SEO de WordPress, filtro robots_txt de WordPress y documentación de Google sobre robots.txt.

MyR

Te puede interesar...

  1. Hola, gracias por la información, me preguntaba si para una tienda en woocommerce, el robots.txt debería tener algunas indicaciones especiales para la tienda??

    Gracias por tu tiempo, saludos

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

WordPress Directo
WPDirecto.com es una revista especializada en WordPress y WooCommerce que ofrece una amplia gama de recursos, incluyendo tutoriales, análisis de plugins y plantillas, consejos de optimización y estrategias de SEO, para ayudar a los usuarios a mejorar y personalizar sus sitios web, manteniéndolos informados sobre las últimas novedades y tendencias en el mundo de WordPress.

© 1995-2025 Color Vivo Internet, SLU (Medios y Redes Online).. Otros contenidos se cita fuente. Infraestructura cloud servidores dedicados de Stackscale.