Reglas de Google para la búsqueda con IA: cómo excluirte y qué dejar de hacer
Google documentó un control para excluirte de los AI Overviews, un informe de impresiones y una lista de cosas que no hacen falta. Qué significa cada una para tu sitio.
TL;DR
Si administras un sitio y no tienes claro qué te aplica de todo lo que Google ha ido publicando, son tres cosas y encajan entre sí. Primero, un control de IA generativa en Search Console que mantiene tus páginas fuera de los AI Overviews y del AI Mode, y que Google declara que no se usa como señal de posicionamiento ni de inclusión en el resto de la búsqueda. Segundo, un informe de rendimiento de IA generativa que muestra impresiones en esas funciones, sin clics, sin posición y con despliegue parcial. Tercero, una guía cuya sección de mitos dice por escrito que no necesitas llms.txt ni otros archivos para IA, que no hace falta trocear el contenido, que los datos estructurados no son obligatorios y que no tienes que escribir distinto para la IA. La distinción que sostiene todo lo demás: Google habla de Google. Verificado contra su documentación el 12 de agosto de 2026.
Qué publicó Google exactamente
Son tres documentos, y casi toda la cobertura ha recogido solo uno.
- Funciones de IA y tu sitio web, que enumera todos los controles que tienes y lo que te cuesta cada uno.
- El informe de rendimiento de IA generativa en Search Console, más uno aparte para Discover.
- La guía de optimización para IA, que contiene una sección titulada "lo que no necesitas hacer".
El tercero es el interesante, y casi nadie del sector de la optimización lo está citando. Aquí lo citamos entero, incluidas las partes que a nosotros nos resultan incómodas.
El control de exclusión, y por qué el aviso de siempre ya no vale
Search Console tiene ahora un control de IA generativa dentro de Configuración. Apagarlo mantiene tu contenido fuera de los AI Overviews y del AI Mode.
La frase que importa es de Google: ese control "no se usa como señal de posicionamiento o de inclusión que afecte a otras partes de la búsqueda".
Es un cambio real, y deja obsoleto un consejo que era correcto hasta hace poco, incluido un consejo que nosotros mismos hemos dado. Antes de que existiera, las únicas formas de quedarte fuera de las funciones de IA eran noindex, nosnippet o bloquear a Googlebot, y las tres dañaban de rebote tu presencia normal en el buscador. "No te excluyas, pierdes posiciones" era cierto porque excluirte significaba excluirte de todo.
Ya no lo es. Así que si tienes una postura de licencias, un muro de pago o un motivo legal para no aparecer en respuestas de IA, ahora tienes un instrumento acotado para eso. Los cambios tardan uno o dos días en aplicarse, y las propiedades hijas heredan la configuración de la propiedad padre por defecto.
Aun así no lo usaríamos, y el motivo no tiene nada que ver con las posiciones. La respuesta de IA se genera igual, te nombre o no te nombre entre sus fuentes. Excluirte no elimina la respuesta, te elimina a ti de los créditos. Te quedas con los mismos clics perdidos y encima renuncias a la mención.
Ojo con lo que ese control no hace: no impide el entrenamiento. Eso es Google-Extended, una directiva distinta.
El informe que sí puedes mirar, y lo que no te va a decir
El informe de rendimiento de IA generativa cubre AI Overviews y AI Mode. Lee los límites antes de montar un panel encima.
- Solo impresiones. Sin clics. Sin posición. Ves que te mostraron y no si sirvió de algo.
- Excluye Search Labs, porque esos experimentos siguen moviéndose.
- Despliegue parcial. Google lo está sacando "a una parte de los propietarios de sitios web", y además necesitas un mínimo de impresiones en funciones de IA para que aparezca. Muchos sitios sencillamente no lo tienen.
- Búsqueda y Discover son informes distintos. El de Discover añade páginas con más y menos impresiones, y de qué países vienen.
- Se aplican los topes habituales, incluido el límite de 1.000 filas, y los datos recientes todavía pueden cambiar.
En todo lo demás, el tráfico de las funciones de IA sigue sumado dentro de tus datos normales: los sitios que aparecen en funciones de IA están incluidos en el tráfico general de búsqueda de Search Console, dentro del tipo de búsqueda web. Por eso no puedes separar los clics de IA de los normales en el informe principal, y por eso nadie te puede decir con honestidad qué porcentaje de tu tráfico vino de un AI Overview.
Qué hacer con él este mes. Si tienes el informe, anota tus impresiones actuales. Ese dato no se reconstruye después, y una línea base apuntada hoy vale más que un informe mejor dentro de un año.
Lo que Google dice que NO necesitas hacer
Citado tal cual, porque parafrasear es justo como se retuerce este tipo de documentación.
"No necesitas crear archivos legibles por máquina, archivos de texto para IA, marcado ni Markdown para aparecer en la Búsqueda de Google."
"La propia Búsqueda de Google no los usa."
"Hacerlo no perjudicará ni ayudará a la visibilidad o al posicionamiento de tu sitio en la Búsqueda de Google."
"No hay ningún requisito de dividir tu contenido en trozos diminutos para que la IA lo entienda mejor."
"No existe una longitud de página ideal; al final, haz páginas para tu audiencia, no solo para la búsqueda con IA generativa."
"No necesitas escribir de una manera concreta solo para la búsqueda con IA generativa."
"Los datos estructurados no son obligatorios para la búsqueda con IA generativa, y no hay ningún marcado especial de schema.org que debas añadir."
"Buscar 'menciones' poco auténticas no ayuda tanto como parece."
Leído junto, eso es Google diciendo que buena parte de la capa táctica que se vende como generative engine optimization no hace nada dentro de Google. El motivo también está escrito: las funciones de IA "se apoyan en nuestros sistemas centrales de posicionamiento y calidad de la Búsqueda". No son un índice aparte con reglas aparte.
Nosotros vendemos parte de lo que está en esa lista, así que seamos exactos en vez de defensivos. Los datos estructurados siguen ganando resultados enriquecidos y siguen ayudando a que un buscador sepa qué empresa eres, algo que importa bastante cuando tu nombre lo comparten otros negocios. Lo que no son es una palanca específica de IA. Y llms.txt, ese archivo de texto opcional en la raíz del dominio que resume tu sitio para los modelos, no hace nada en Google. Google lo dice, y sobre su propio producto tiene razón.
La distinción que casi todo el mundo se salta
Google está describiendo a Google.
Su documentación cubre AI Overviews, AI Mode y Discover, que se apoyan en el índice del propio Google. ChatGPT, Perplexity y Claude son otra cadena de recuperación. Usan sus propios rastreadores, sus propios índices y, en algunos casos, un buscador de terceros por detrás. Nada de lo que dice Google los describe ni los limita.
Así que la versión honesta de cada afirmación es esta:
| Afirmación | Dentro de Google | Fuera de Google |
|---|---|---|
| llms.txt ayuda | No, Google dice que no lo usa | Sin demostrar, pero el archivo apunta a estos asistentes y cuesta casi nada |
| Hacen falta datos estructurados | No, explícitamente no | Tampoco, y siguen sirviendo para dejar clara tu entidad |
| Pasajes troceados o de longitud fija | Sin requisito y sin longitud ideal | Los pasajes autocontenidos se citan mejor, que es un argumento de redacción |
| Importa el acceso del rastreador | Sí, reglas normales de rastreo | Sí, y sus rastreadores son user-agents distintos que hay que permitir aparte |
La única fila idéntica en las dos columnas es la aburrida: un rastreador tiene que poder acceder a la página. Puedes comprobar la tuya con nuestro verificador de acceso para rastreadores de IA gratuito, que aplica las reglas reales de precedencia de robots.txt.
Entonces, qué sí funciona
Quita todo lo que Google acaba de descartar y lo que queda no es poco. Solo es menos mecánico que las tácticas a las que sustituye.
Merecer la cita. La propia recomendación de Google es contenido único, de primera mano y realmente útil, y avisa explícitamente contra el material que "podría producir fácilmente un modelo de IA generativa". Un asistente que resume contenido genérico no tiene ningún motivo para nombrar una fuente.
Escribir párrafos que se sostengan solos. No porque haya una cifra de palabras premiada, que Google dice claramente que no existe. Porque un párrafo que solo se entiende después de los dos anteriores no se puede levantar hacia una respuesta, así que el modelo va a buscar una fuente donde alguien escribió una idea completa en un bloque. Es un estándar de redacción, no un marcado.
Dejar entrar a los rastreadores. La única puerta dura, y la que más sitios fallan sin enterarse.
Ser una entidad legible. Nombre, dirección y perfiles consistentes, para que un modelo sepa qué empresa eres. Aquí es donde los datos estructurados sí se ganan el sitio.
Medir menciones, no solo posiciones. Que te nombren ya es una pregunta distinta de dónde posicionas, y solo una de las dos está en tu panel por defecto. Nuestro verificador de visibilidad en IA puntúa las señales que lo deciden.
Los demás controles y lo que cuesta cada uno
Por completitud, porque las contrapartidas no son obvias y la documentación las lista sin rodeos.
| Control | Efecto en funciones de IA | Efecto en la búsqueda normal |
|---|---|---|
| Control de IA generativa | Te saca | Ninguno. No es señal de posicionamiento ni de inclusión |
robots.txt (Googlebot) | Te saca | Te saca también del buscador |
noindex | Te saca | Elimina la página entera |
nosnippet | Limita el uso por la IA | Elimina tu fragmento normal |
data-nosnippet | Limita la sección marcada | Quita esa sección de los fragmentos |
max-snippet | Limita el largo disponible | Limita el largo de tu fragmento |
| Google-Extended | Ninguno en las funciones de IA de la Búsqueda | Ninguno. Cubre entrenamiento fuera de ahí |
El patrón conviene interiorizarlo: todo lo que no es la primera ni la última fila es un instrumento romo que paga la exclusión de la IA con visibilidad normal. Solo el control de IA generativa separa las dos cosas, y por eso su llegada cambió el consejo.
Qué cambiamos en nuestro propio sitio por esto
Publicar esto nos obligó a revisar nuestras páginas contra la documentación de Google, y una FAQ había que arreglarla. En nuestro artículo sobre si ChatGPT puede leer tu web, la respuesta sobre bloquear rastreadores de IA metía a Google-Extended junto a GPTBot y PerplexityBot como uno de los rastreadores que te consiguen citaciones. Está mal: Google-Extended cubre entrenamiento fuera de la Búsqueda y no decide si apareces en los AI Overviews. El que sí lo decide es el control descrito arriba, que no existía cuando escribimos esa respuesta.
Las dos cosas quedan corregidas en la propia página, con la fecha. La recomendación no cambió: deja pasar a los rastreadores de búsqueda y respuesta, y trata a los de puro entrenamiento como una decisión de licencias aparte. Lo que cambió es que uno de los bots estaba clasificado en el grupo equivocado, y que ahora existe un instrumento acotado para quien de verdad necesita excluirse.
Todas las citas y afirmaciones de este artículo se comprobaron contra la documentación de Google el 12 de agosto de 2026. Google actualiza estas páginas, así que si lees esto mucho después, comprueba la fuente antes de actuar.
Preguntas frecuentes
-
¿Puedo excluirme de los AI Overviews sin perder posiciones en Google?
Sí, dentro de Google, y esta es la parte que cambió. Search Console tiene ahora un control de IA generativa en Configuración que mantiene tu contenido fuera de los AI Overviews y del AI Mode, y Google declara que ese control no se usa como señal de posicionamiento ni de inclusión que afecte a otras partes de la búsqueda. Hasta que salió, las únicas maneras de quedarte fuera de las funciones de IA eran noindex, nosnippet o bloquear a Googlebot, y las tres dañaban también tu presencia normal en el buscador. Así que el aviso de siempre, que excluirte te cuesta las posiciones, ya está desactualizado. El motivo para no tocarlo es otro: la respuesta de IA sale igual, así que apagarlo renuncia a la citación y no recupera nada.
-
¿Sirve llms.txt para Google?
No, y Google lo dice por escrito. Su guía para las funciones de IA generativa afirma que no necesitas crear archivos legibles por máquina, archivos de texto para IA, marcado ni Markdown para aparecer en la búsqueda de Google, que la propia búsqueda de Google no los usa, y que publicarlos no perjudica ni ayuda a tu visibilidad ni a tu posicionamiento allí. Eso zanja la pregunta sobre Google. No zanja las demás: llms.txt se propuso para asistentes como ChatGPT, Perplexity y Claude, que son otra cadena de recuperación con otro comportamiento. Mantén el archivo si vas a por esos. No esperes que haga nada en Google, y desconfía de quien te diga lo contrario.
-
¿Necesito datos estructurados para aparecer en las funciones de IA?
Según Google, no. Su guía dice literalmente que los datos estructurados no son obligatorios para la búsqueda con IA generativa y que no hay ningún marcado especial de schema.org que debas añadir, aunque añade que sigue siendo buena idea dentro de tu estrategia general. Las dos mitades importan. El schema, que es el marcado que le dice a una máquina de qué va una página, sigue ganando resultados enriquecidos y sigue ayudando a distinguir qué empresa eres cuando tu nombre lo comparten otras. Lo que no es, es una palanca específica de los AI Overviews, y venderlo como tal es inexacto.
-
¿Cómo veo cuántas impresiones tengo en los AI Overviews?
Search Console añadió un informe de rendimiento de IA generativa que cubre AI Overviews y AI Mode, con uno aparte para Discover. Conoce sus límites antes de montar un panel encima. Muestra solo impresiones, sin clics y sin posición. Excluye los experimentos de Search Labs. Se está desplegando a una parte de las propiedades, así que puede que no lo tengas, y hace falta un mínimo de impresiones para que aparezca. En todo lo demás, el tráfico de las funciones de IA sigue sumado dentro de tus datos normales de búsqueda web, que es justo por lo que no puedes separar los clics de IA de los clics normales en el informe principal.
-
¿Bloquear a los rastreadores de IA protege mi contenido?
Lo protege quitándolo, que rara vez es lo que la gente quiere decir. Dentro de Google los controles son romos: robots.txt, noindex, nosnippet, data-nosnippet y max-snippet limitan a la vez las funciones de IA y tu presencia normal, porque actúan sobre el rastreo y sobre los fragmentos, no sobre la IA. Las dos excepciones acotadas son el control de IA generativa, que afecta solo a las funciones de IA, y Google-Extended, que limita el entrenamiento fuera de la búsqueda. Fuera de Google, bloquear a los rastreadores de búsqueda y respuesta le regala la citación al competidor que sí los dejó pasar.
¿Quieres el playbook antes que tu competencia?
Documentamos cada técnica que aplicamos con clientes. Posts nuevos sobre GEO, AEO y velocidad web cada mes, sin paja, solo método.
Más artículos
- GEODominio en Búsqueda
Auditamos 63 agencias de visibilidad en IA: la mitad publica llms.txt
Medimos robots.txt, llms.txt y datos estructurados en las 63 webs que rankean para agencia GEO y AEO. Un tercio de esos llms.txt no cumple el formato.
Ver artículo - GEODominio en Búsqueda
GEO para empresas B2B: qué cambia cuando compra un comité
En B2B el volumen de búsqueda es mínimo y el contrato es grande, así que la página que se lleva la citación casi nunca es tu blog. Qué construir en su lugar.
Ver artículo - GEODominio en Búsqueda
Cuánto cuesta una agencia GEO: rangos reales y qué mueve tu presupuesto
Los rangos publicados en España y Estados Unidos, con fuente y fecha, las tres variables que deciden en qué extremo caes, y lo que deberías estar ahorrando.
Ver artículo - GEODominio en Búsqueda
¿ChatGPT puede leer tu web? Cuatro comprobaciones que lo deciden
Cuatro cosas deciden si ChatGPT puede usar tu web: acceso del rastreador, renderizado, estructura y datos para apoyarse. Cómo comprobar cada una, en el orden que importa.
Ver artículo - GEODominio en Búsqueda
Cómo elegir una agencia de generative engine optimization (GEO)
Guía del comprador para contratar una agencia GEO: qué hace, cinco cosas que verificar, qué preguntar y las señales de alerta de una agencia SEO disfrazada.
Ver artículo - GEODominio en Búsqueda
Cómo hacer generative engine optimization: guía paso a paso
Ya sabes qué es el GEO y ahora quieres el cómo. Es un ciclo de cuatro pasos: páginas citables, schema y llms.txt, acceso para los crawlers de IA y medir la tasa de citación.
Ver artículo - GEODominio en Búsqueda
Ejemplos de llms.txt y una plantilla lista para copiar
Un archivo llms.txt real y anotado, luego una plantilla para rellenar y cómo validarla. Los ejemplos salen del mismo archivo que servimos en este sitio.
Ver artículo - GEODominio en Búsqueda
Novedades de búsqueda con IA: qué cambió en el Q2 2026 y qué significa para ti
Los AI Overviews ya cubren casi la mitad de las búsquedas y ChatGPT estrenó anuncios. Qué cambió este trimestre y las tres jugadas para que tu marca siga visible y citada.
Ver artículo - GEODominio en Búsqueda
Mejores herramientas de generative engine optimization (2026): guía por criterios
¿Buscas herramientas de generative engine optimization? Júzgalas por una cosa: ¿miden si la IA te cita? Un marco neutral para elegir, y cuándo todavía no necesitas ninguna.
Ver artículo