Dominio en Búsqueda

Reglas de Google para la búsqueda con IA: cómo excluirte y qué dejar de hacer

Google documentó un control para excluirte de los AI Overviews, un informe de impresiones y una lista de cosas que no hacen falta. Qué significa cada una para tu sitio.

Por Einner Ariña 8 min de lectura

TL;DR

Si administras un sitio y no tienes claro qué te aplica de todo lo que Google ha ido publicando, son tres cosas y encajan entre sí. Primero, un control de IA generativa en Search Console que mantiene tus páginas fuera de los AI Overviews y del AI Mode, y que Google declara que no se usa como señal de posicionamiento ni de inclusión en el resto de la búsqueda. Segundo, un informe de rendimiento de IA generativa que muestra impresiones en esas funciones, sin clics, sin posición y con despliegue parcial. Tercero, una guía cuya sección de mitos dice por escrito que no necesitas llms.txt ni otros archivos para IA, que no hace falta trocear el contenido, que los datos estructurados no son obligatorios y que no tienes que escribir distinto para la IA. La distinción que sostiene todo lo demás: Google habla de Google. Verificado contra su documentación el 12 de agosto de 2026.

Qué publicó Google exactamente

Son tres documentos, y casi toda la cobertura ha recogido solo uno.

  1. Funciones de IA y tu sitio web, que enumera todos los controles que tienes y lo que te cuesta cada uno.
  2. El informe de rendimiento de IA generativa en Search Console, más uno aparte para Discover.
  3. La guía de optimización para IA, que contiene una sección titulada "lo que no necesitas hacer".

El tercero es el interesante, y casi nadie del sector de la optimización lo está citando. Aquí lo citamos entero, incluidas las partes que a nosotros nos resultan incómodas.

El control de exclusión, y por qué el aviso de siempre ya no vale

Search Console tiene ahora un control de IA generativa dentro de Configuración. Apagarlo mantiene tu contenido fuera de los AI Overviews y del AI Mode.

La frase que importa es de Google: ese control "no se usa como señal de posicionamiento o de inclusión que afecte a otras partes de la búsqueda".

Es un cambio real, y deja obsoleto un consejo que era correcto hasta hace poco, incluido un consejo que nosotros mismos hemos dado. Antes de que existiera, las únicas formas de quedarte fuera de las funciones de IA eran noindex, nosnippet o bloquear a Googlebot, y las tres dañaban de rebote tu presencia normal en el buscador. "No te excluyas, pierdes posiciones" era cierto porque excluirte significaba excluirte de todo.

Ya no lo es. Así que si tienes una postura de licencias, un muro de pago o un motivo legal para no aparecer en respuestas de IA, ahora tienes un instrumento acotado para eso. Los cambios tardan uno o dos días en aplicarse, y las propiedades hijas heredan la configuración de la propiedad padre por defecto.

Aun así no lo usaríamos, y el motivo no tiene nada que ver con las posiciones. La respuesta de IA se genera igual, te nombre o no te nombre entre sus fuentes. Excluirte no elimina la respuesta, te elimina a ti de los créditos. Te quedas con los mismos clics perdidos y encima renuncias a la mención.

Ojo con lo que ese control no hace: no impide el entrenamiento. Eso es Google-Extended, una directiva distinta.

El informe que sí puedes mirar, y lo que no te va a decir

El informe de rendimiento de IA generativa cubre AI Overviews y AI Mode. Lee los límites antes de montar un panel encima.

  • Solo impresiones. Sin clics. Sin posición. Ves que te mostraron y no si sirvió de algo.
  • Excluye Search Labs, porque esos experimentos siguen moviéndose.
  • Despliegue parcial. Google lo está sacando "a una parte de los propietarios de sitios web", y además necesitas un mínimo de impresiones en funciones de IA para que aparezca. Muchos sitios sencillamente no lo tienen.
  • Búsqueda y Discover son informes distintos. El de Discover añade páginas con más y menos impresiones, y de qué países vienen.
  • Se aplican los topes habituales, incluido el límite de 1.000 filas, y los datos recientes todavía pueden cambiar.

En todo lo demás, el tráfico de las funciones de IA sigue sumado dentro de tus datos normales: los sitios que aparecen en funciones de IA están incluidos en el tráfico general de búsqueda de Search Console, dentro del tipo de búsqueda web. Por eso no puedes separar los clics de IA de los normales en el informe principal, y por eso nadie te puede decir con honestidad qué porcentaje de tu tráfico vino de un AI Overview.

Qué hacer con él este mes. Si tienes el informe, anota tus impresiones actuales. Ese dato no se reconstruye después, y una línea base apuntada hoy vale más que un informe mejor dentro de un año.

Lo que Google dice que NO necesitas hacer

Citado tal cual, porque parafrasear es justo como se retuerce este tipo de documentación.

"No necesitas crear archivos legibles por máquina, archivos de texto para IA, marcado ni Markdown para aparecer en la Búsqueda de Google."

"La propia Búsqueda de Google no los usa."

"Hacerlo no perjudicará ni ayudará a la visibilidad o al posicionamiento de tu sitio en la Búsqueda de Google."

"No hay ningún requisito de dividir tu contenido en trozos diminutos para que la IA lo entienda mejor."

"No existe una longitud de página ideal; al final, haz páginas para tu audiencia, no solo para la búsqueda con IA generativa."

"No necesitas escribir de una manera concreta solo para la búsqueda con IA generativa."

"Los datos estructurados no son obligatorios para la búsqueda con IA generativa, y no hay ningún marcado especial de schema.org que debas añadir."

"Buscar 'menciones' poco auténticas no ayuda tanto como parece."

Leído junto, eso es Google diciendo que buena parte de la capa táctica que se vende como generative engine optimization no hace nada dentro de Google. El motivo también está escrito: las funciones de IA "se apoyan en nuestros sistemas centrales de posicionamiento y calidad de la Búsqueda". No son un índice aparte con reglas aparte.

Nosotros vendemos parte de lo que está en esa lista, así que seamos exactos en vez de defensivos. Los datos estructurados siguen ganando resultados enriquecidos y siguen ayudando a que un buscador sepa qué empresa eres, algo que importa bastante cuando tu nombre lo comparten otros negocios. Lo que no son es una palanca específica de IA. Y llms.txt, ese archivo de texto opcional en la raíz del dominio que resume tu sitio para los modelos, no hace nada en Google. Google lo dice, y sobre su propio producto tiene razón.

La distinción que casi todo el mundo se salta

Google está describiendo a Google.

Su documentación cubre AI Overviews, AI Mode y Discover, que se apoyan en el índice del propio Google. ChatGPT, Perplexity y Claude son otra cadena de recuperación. Usan sus propios rastreadores, sus propios índices y, en algunos casos, un buscador de terceros por detrás. Nada de lo que dice Google los describe ni los limita.

Así que la versión honesta de cada afirmación es esta:

AfirmaciónDentro de GoogleFuera de Google
llms.txt ayudaNo, Google dice que no lo usaSin demostrar, pero el archivo apunta a estos asistentes y cuesta casi nada
Hacen falta datos estructuradosNo, explícitamente noTampoco, y siguen sirviendo para dejar clara tu entidad
Pasajes troceados o de longitud fijaSin requisito y sin longitud idealLos pasajes autocontenidos se citan mejor, que es un argumento de redacción
Importa el acceso del rastreadorSí, reglas normales de rastreoSí, y sus rastreadores son user-agents distintos que hay que permitir aparte

La única fila idéntica en las dos columnas es la aburrida: un rastreador tiene que poder acceder a la página. Puedes comprobar la tuya con nuestro verificador de acceso para rastreadores de IA gratuito, que aplica las reglas reales de precedencia de robots.txt.

Entonces, qué sí funciona

Quita todo lo que Google acaba de descartar y lo que queda no es poco. Solo es menos mecánico que las tácticas a las que sustituye.

Merecer la cita. La propia recomendación de Google es contenido único, de primera mano y realmente útil, y avisa explícitamente contra el material que "podría producir fácilmente un modelo de IA generativa". Un asistente que resume contenido genérico no tiene ningún motivo para nombrar una fuente.

Escribir párrafos que se sostengan solos. No porque haya una cifra de palabras premiada, que Google dice claramente que no existe. Porque un párrafo que solo se entiende después de los dos anteriores no se puede levantar hacia una respuesta, así que el modelo va a buscar una fuente donde alguien escribió una idea completa en un bloque. Es un estándar de redacción, no un marcado.

Dejar entrar a los rastreadores. La única puerta dura, y la que más sitios fallan sin enterarse.

Ser una entidad legible. Nombre, dirección y perfiles consistentes, para que un modelo sepa qué empresa eres. Aquí es donde los datos estructurados sí se ganan el sitio.

Medir menciones, no solo posiciones. Que te nombren ya es una pregunta distinta de dónde posicionas, y solo una de las dos está en tu panel por defecto. Nuestro verificador de visibilidad en IA puntúa las señales que lo deciden.

Los demás controles y lo que cuesta cada uno

Por completitud, porque las contrapartidas no son obvias y la documentación las lista sin rodeos.

ControlEfecto en funciones de IAEfecto en la búsqueda normal
Control de IA generativaTe sacaNinguno. No es señal de posicionamiento ni de inclusión
robots.txt (Googlebot)Te sacaTe saca también del buscador
noindexTe sacaElimina la página entera
nosnippetLimita el uso por la IAElimina tu fragmento normal
data-nosnippetLimita la sección marcadaQuita esa sección de los fragmentos
max-snippetLimita el largo disponibleLimita el largo de tu fragmento
Google-ExtendedNinguno en las funciones de IA de la BúsquedaNinguno. Cubre entrenamiento fuera de ahí

El patrón conviene interiorizarlo: todo lo que no es la primera ni la última fila es un instrumento romo que paga la exclusión de la IA con visibilidad normal. Solo el control de IA generativa separa las dos cosas, y por eso su llegada cambió el consejo.

Qué cambiamos en nuestro propio sitio por esto

Publicar esto nos obligó a revisar nuestras páginas contra la documentación de Google, y una FAQ había que arreglarla. En nuestro artículo sobre si ChatGPT puede leer tu web, la respuesta sobre bloquear rastreadores de IA metía a Google-Extended junto a GPTBot y PerplexityBot como uno de los rastreadores que te consiguen citaciones. Está mal: Google-Extended cubre entrenamiento fuera de la Búsqueda y no decide si apareces en los AI Overviews. El que sí lo decide es el control descrito arriba, que no existía cuando escribimos esa respuesta.

Las dos cosas quedan corregidas en la propia página, con la fecha. La recomendación no cambió: deja pasar a los rastreadores de búsqueda y respuesta, y trata a los de puro entrenamiento como una decisión de licencias aparte. Lo que cambió es que uno de los bots estaba clasificado en el grupo equivocado, y que ahora existe un instrumento acotado para quien de verdad necesita excluirse.

Todas las citas y afirmaciones de este artículo se comprobaron contra la documentación de Google el 12 de agosto de 2026. Google actualiza estas páginas, así que si lees esto mucho después, comprueba la fuente antes de actuar.

Preguntas frecuentes

  • ¿Puedo excluirme de los AI Overviews sin perder posiciones en Google?

    Sí, dentro de Google, y esta es la parte que cambió. Search Console tiene ahora un control de IA generativa en Configuración que mantiene tu contenido fuera de los AI Overviews y del AI Mode, y Google declara que ese control no se usa como señal de posicionamiento ni de inclusión que afecte a otras partes de la búsqueda. Hasta que salió, las únicas maneras de quedarte fuera de las funciones de IA eran noindex, nosnippet o bloquear a Googlebot, y las tres dañaban también tu presencia normal en el buscador. Así que el aviso de siempre, que excluirte te cuesta las posiciones, ya está desactualizado. El motivo para no tocarlo es otro: la respuesta de IA sale igual, así que apagarlo renuncia a la citación y no recupera nada.

  • ¿Sirve llms.txt para Google?

    No, y Google lo dice por escrito. Su guía para las funciones de IA generativa afirma que no necesitas crear archivos legibles por máquina, archivos de texto para IA, marcado ni Markdown para aparecer en la búsqueda de Google, que la propia búsqueda de Google no los usa, y que publicarlos no perjudica ni ayuda a tu visibilidad ni a tu posicionamiento allí. Eso zanja la pregunta sobre Google. No zanja las demás: llms.txt se propuso para asistentes como ChatGPT, Perplexity y Claude, que son otra cadena de recuperación con otro comportamiento. Mantén el archivo si vas a por esos. No esperes que haga nada en Google, y desconfía de quien te diga lo contrario.

  • ¿Necesito datos estructurados para aparecer en las funciones de IA?

    Según Google, no. Su guía dice literalmente que los datos estructurados no son obligatorios para la búsqueda con IA generativa y que no hay ningún marcado especial de schema.org que debas añadir, aunque añade que sigue siendo buena idea dentro de tu estrategia general. Las dos mitades importan. El schema, que es el marcado que le dice a una máquina de qué va una página, sigue ganando resultados enriquecidos y sigue ayudando a distinguir qué empresa eres cuando tu nombre lo comparten otras. Lo que no es, es una palanca específica de los AI Overviews, y venderlo como tal es inexacto.

  • ¿Cómo veo cuántas impresiones tengo en los AI Overviews?

    Search Console añadió un informe de rendimiento de IA generativa que cubre AI Overviews y AI Mode, con uno aparte para Discover. Conoce sus límites antes de montar un panel encima. Muestra solo impresiones, sin clics y sin posición. Excluye los experimentos de Search Labs. Se está desplegando a una parte de las propiedades, así que puede que no lo tengas, y hace falta un mínimo de impresiones para que aparezca. En todo lo demás, el tráfico de las funciones de IA sigue sumado dentro de tus datos normales de búsqueda web, que es justo por lo que no puedes separar los clics de IA de los clics normales en el informe principal.

  • ¿Bloquear a los rastreadores de IA protege mi contenido?

    Lo protege quitándolo, que rara vez es lo que la gente quiere decir. Dentro de Google los controles son romos: robots.txt, noindex, nosnippet, data-nosnippet y max-snippet limitan a la vez las funciones de IA y tu presencia normal, porque actúan sobre el rastreo y sobre los fragmentos, no sobre la IA. Las dos excepciones acotadas son el control de IA generativa, que afecta solo a las funciones de IA, y Google-Extended, que limita el entrenamiento fuera de la búsqueda. Fuera de Google, bloquear a los rastreadores de búsqueda y respuesta le regala la citación al competidor que sí los dejó pasar.

¿Quieres el playbook antes que tu competencia?

Documentamos cada técnica que aplicamos con clientes. Posts nuevos sobre GEO, AEO y velocidad web cada mes, sin paja, solo método.