TL;DR
noindexes la única directiva que saca una página de Google y, por tanto, de AI Overviews y AI Mode. El error nº1 en WordPress: la casilla "Disuadir a los motores de búsqueda" (Ajustes > Lectura) activada, que inyectanoindex,nofollowen todo el sitio desde WP 5.3. Segundo foco de riesgo: plantillas mal configuradas en Yoast, Rank Math y AIOSEO (archivos, taxonomías, sitio completo).robots.txtNO desindexa: solo controla el rastreo; si bloqueas el rastreo, Google no ve elnoindex. Bloquear GPTBot, ClaudeBot o PerplexityBot elimina la visibilidad en respuestas de IA, pero no afecta a la indexación en Google. La visibilidad en IA se construye sobre una base indexable: primero arregla la base técnica, después mide y mejora con Semly.
Si tu web en WordPress no aparece en Google y tampoco te citan ChatGPT, Gemini o Perplexity, hay una causa que se repite más de lo que parece: un noindex puesto sin querer. Suele venir de una casilla olvidada o de una plantilla mal configurada, no de un problema grave. La buena noticia es que se detecta y se arregla en minutos.
Noindex en WordPress: qué es y por qué te deja fuera de Google y de la IA
noindex es una directiva que le dice a los buscadores: "no incluyas esta página en tus resultados". Se aplica con una etiqueta meta robots en el HTML o con una cabecera X-Robots-Tag para archivos que no son HTML, como PDF o imágenes.
La regla de oro: para que Google te cite en AI Overviews y AI Mode, la página debe estar indexada y ser elegible para snippet. Si no está indexada, no hay nada que citar. Da igual lo bueno que sea tu contenido.
Aquí está la confusión que más problemas causa. Piensa en una tienda física:
robots.txtes la puerta. Decide si el robot puede entrar a mirar.noindexes el cartel de "no añadir al catálogo". Decide si la página aparece en resultados.
Si cierras la puerta, el robot no entra y nunca ve el cartel. Por eso bloquear el rastreo no desindexa: puede incluso dejar la URL visible en Google, porque no puede leer el noindex.
Y ojo con los rastreadores de IA, porque no todos se comportan igual. Los de búsqueda, como Googlebot u OAI-SearchBot, respetan el noindex. Los de entrenamiento y recolección, como GPTBot, ClaudeBot y PerplexityBot, se controlan sobre todo vía robots.txt (según fuentes secundarias).
| Directiva | Qué bloquea | Qué NO bloquea |
|---|---|---|
noindex |
Aparición en resultados de búsqueda | El rastreo de la página |
nofollow |
Seguir los enlaces de la página | La indexación de la página |
nosnippet |
Mostrar fragmento; también limita el uso como input en AI Overviews y AI Mode | La indexación |
max-snippet:[n] |
Fragmentos más largos de n caracteres | La indexación |
noarchive |
Nada: está obsoleta, la caché ya no existe | La indexación |
noimageindex |
Indexar las imágenes de la página | La indexación del texto |
Diagnóstico rápido: cómo saber si tu WordPress está bloqueando a Google
Antes de tocar nada, haz este chequeo de cinco minutos. No necesitas código.
- Ajustes > Lectura: comprueba que "Disuadir a los motores de búsqueda" está DESACTIVADA. Si está marcada, tienes el problema principal.
- Código fuente de la home: abre la página, pulsa clic derecho y busca
<meta name="robots". Lee el contenido. Si dicenoindex, ahí está el bloqueo. - Search Console > Inspección de URL: mira el HTML que recibió Googlebot y el estado de indexación. Es la prueba definitiva.
- Informe de indexación: busca la etiqueta "Excluida por etiqueta noindex". Ahí verás cuántas URLs están fuera.
robots.txt: abretudominio.com/robots.txty revisa que no haya unDisallow: /general.
Un aviso importante para no confundir diagnósticos. "Excluida por etiqueta noindex" significa que hay una directiva bloqueando. "Rastreada: actualmente no indexada" es otra cosa: Google la vio, pero decidió no indexarla todavía. Y "indexado pero no mostrado" significa que está en el índice, pero no aparece por consulta. Son tres problemas distintos con tres soluciones distintas.
Paso a paso: cómo quitar el noindex en WordPress
Paso 1 — Desactivar la casilla de WordPress (Ajustes > Lectura)
Ve a Ajustes > Lectura y desmarca "Disuadir a los motores de búsqueda". Guarda.
Desde WordPress 5.3, esa casilla genera noindex,nofollow en todo el sitio y, además, eliminó el Disallow: / del robots.txt. El motivo es justo el que explicábamos: bloquear el rastreo impedía que Google leyera el noindex.
Punto de control: guarda y vuelve a mirar el código fuente. La etiqueta noindex debe haber desaparecido.
Señal de error típica: sigue apareciendo tras guardar. Suele ser caché del plugin o del servidor.
Paso 2 — Revisar las plantillas de tu plugin SEO (Yoast, Rank Math, AIOSEO)
Aquí está el segundo foco de riesgo, y es más silencioso.
- Yoast: las búsquedas internas y las páginas 404 ya vienen con
noindex,followpor defecto, y eso está bien. Revisa tipos de contenido y taxonomías para asegurarte de que no has marcado algo que sí quieres indexar. - Rank Math: el No Index global por tipo de contenido puede sobrescribirse por post individual, y al revés. Es fácil dejarlo mal sin darse cuenta.
- AIOSEO: revisa su lógica de plantillas en "Titles & Meta".
Punto de control: un solo toggle mal puesto desindexa archivos enteros, como todas las categorías o todas las etiquetas. Señal de error típica: el informe de indexación muestra decenas de URLs excluidas de golpe.
Paso 3 — Comprobar el noindex por página o entrada individual
Cada plugin tiene su ajuste en el editor del post, normalmente en un panel lateral o en una caja bajo el contenido. Lo importante es entender la herencia: si la plantilla dice noindex, el post lo hereda salvo que lo cambies a mano.
Punto de control: abre dos o tres URLs clave (home, una categoría, un producto) y verifica el meta robots en cada una.
Señal de error típica: la home está bien, pero los productos no. Eso apunta a plantilla, no a post.
Paso 4 — Revisar robots.txt y las reglas de rastreo
Confirma que no hay un Disallow: / ni bloqueos que impidan a Google ver el noindex. Recuerda la regla: robots.txt no desindexa, solo controla el acceso.
Punto de control: el archivo debe permitir el rastreo de las secciones que quieres posicionar. Señal de error típica: bloqueas todo "por seguridad" y luego te preguntas por qué nada aparece.
Paso 5 — Verificar que Google y los bots de IA pueden acceder
Comprueba los user-agents de IA y decide conscientemente si los permites. No lo hagas por inercia.
| User-agent | Qué controla | Cómo se controla |
|---|---|---|
| GPTBot | Entrenamiento de OpenAI | robots.txt |
| OAI-SearchBot | Resultados de búsqueda en ChatGPT | robots.txt |
| ChatGPT-User | Acciones iniciadas por el usuario | robots.txt (puede no aplicar) |
| ClaudeBot | Anthropic | robots.txt |
| PerplexityBot | Perplexity | robots.txt |
| Google-Extended | Uso para entrenamiento y grounding de Google | robots.txt |
Punto de control: los cambios en robots.txt pueden tardar unas 24 horas en aplicarse.
Señal de error típica: bloqueas todos los bots de IA "por precaución" y pierdes citaciones sin darte cuenta.
Paso 6 — Solicitar la reindexación y medir
En Search Console, usa Inspección de URL y pulsa "Solicitar indexación". Los plazos son realistas: días, no minutos.
Punto de control: "URL is on Google" no garantiza que aparezca en resultados. Solo confirma que está en el índice. Señal de error típica: esperar que la visibilidad en IA cambie de un día para otro. No funciona así.
Checklist de los 6 pasos
- Casilla "Disuadir" desactivada en Ajustes > Lectura
- Plantillas de Yoast, Rank Math o AIOSEO revisadas
-
noindexpor página comprobado en 2-3 URLs clave -
robots.txtsin bloqueos generales - Bots de IA revisados y decididos conscientemente
- Reindexación solicitada y seguimiento en Search Console
Errores frecuentes y cómo arreglarlos
| Error | Síntoma | Solución |
|---|---|---|
| Casilla "Disuadir" activada tras migración o staging | Todo el sitio con noindex,nofollow |
Desmarcarla en Ajustes > Lectura |
noindex heredado de una plantilla de plugin |
Archivos o taxonomías enteras fuera | Revisar plantillas en el plugin SEO |
Confundir robots.txt con noindex |
Crees que está resuelto, pero sigues fuera | Comprobar el meta robots real |
| Bloquear todos los bots de IA "por precaución" | Pierdes citaciones en ChatGPT y otros | Permitir los bots que quieras que te citen |
Creer que noai o noimageai funcionan |
Falsa sensación de control | No son directivas soportadas por Google; usa robots.txt |
Pensar que noarchive sirve para algo |
Configuración inútil | Está obsoleta: la caché ya no existe |
Dos preguntas que aparecen siempre. "¿Por qué mi web no aparece aunque no tengo noindex?" Puede ser contenido fino, falta de enlaces o simplemente que Google aún no la ha procesado. "¿noindex afecta a ChatGPT?" Depende del rastreador: los de búsqueda lo respetan, los de entrenamiento se controlan sobre todo por robots.txt.
Cómo comprobar que ya eres visible en Google y en la IA
Primero, confirma la base: que las páginas clave estén indexadas y sean elegibles para snippet en Search Console.
Después, mide la visibilidad en IA. Y aquí hay un matiz que cambia todo: una sola medición no sirve. Lo que importa es la tendencia. Además, conviene distinguir dos cosas:
- Mención: la IA nombra tu marca en su respuesta.
- Citación: la IA enlaza tu página como fuente.
Puedes aparecer en muchas menciones y en pocas citaciones. Y la citación es la que trae tráfico real.
Según el Informe Semly 2026, basado en 100 tiendas, 10.000 prompts y 4,5 millones de respuestas durante 90 días, la visibilidad media pasó del 11,8% al 22,6% y la tasa de citación del 2,7% al 6,8%. El propio plan de 90 días incluye, en el Día 1-30, "verificar que los bots y los sistemas de recopilación de información tengan acceso al sitio". Es decir, el acceso de los bots es el punto de partida, no un detalle.
Ahí es donde entra Semly. Una vez que la base técnica está sana, Semly es la capa que monitoriza si ChatGPT, Gemini, Claude, Google AI y Grok recomiendan tu marca, analiza los prompts reales de tus clientes, vigila a la competencia y las fuentes citadas, y genera contenido para que la IA pueda recomendarte. Los planes arrancan en 49 €/mes y hay prueba de 7 días. No es una herramienta de diagnóstico técnico de indexación: es el paso siguiente, el de medir y mejorar.
Qué hacer después
Mantén una rutina de revisión. Cada vez que migres el sitio, cambies de plugin SEO o toques plantillas, vuelve a pasar la checklist. Son cinco minutos que te ahorran semanas de invisibilidad.
Refuerza la base SEO antes de optimizar para IA: rastreo, indexación, contenido y enlaces. Sin esa base, cualquier táctica de visibilidad en IA se queda en nada.
Y si tu CMS se convierte en un cuello de botella, existe una alternativa práctica: publicar una base de conocimiento en un subdominio propio, con sitemap y llms.txt automáticos. Así separas el contenido que quieres que la IA lea del ruido técnico de la tienda.
¿Cuándo pasar a monitorización continua? Cuando ya tengas la base arreglada y quieras saber, con datos y no con intuición, si la IA te recomienda. Ese es el momento de empezar a medir con Semly.
Preguntas frecuentes
¿Cómo quito el noindex de WordPress?
Empieza por Ajustes > Lectura y desmarca "Disuadir a los motores de búsqueda". Después revisa las plantillas de tu plugin SEO y el ajuste por página. Termina comprobando el meta robots en el código fuente.
¿noindex afecta a ChatGPT?
Depende del rastreador. Los de búsqueda, como OAI-SearchBot, respetan el noindex. Los de entrenamiento y recolección, como GPTBot, se controlan sobre todo vía robots.txt.
¿Qué pasa si bloqueo GPTBot? Dejas de aparecer en las respuestas de ChatGPT que dependen de ese rastreo, pero no afecta a tu indexación en Google. Es una decisión de visibilidad, no de posicionamiento clásico.
¿Cuánto tarda Google en desindexar o reindexar?
No hay un plazo fijo. Desindexar puede tardar semanas, y reindexar depende del rastreo y de la calidad de la página. Los cambios en robots.txt suelen tardar unas 24 horas en aplicarse.