Googlebot: token de robots, verificacion, permitir o bloquear
Esta pagina esta traducida automaticamente. Las cifras y la evidencia proceden sin cambios de las observaciones almacenadas.
Googlebot es un rastreador de IA operado por Google. Su token de robots.txt es Googlebot, y la documentacion del proveedor que descargamos el 2026-09-06 es la fuente de cada afirmacion de esta pagina.
| Token de robots | Googlebot |
|---|---|
| Proveedor | |
| Finalidad | search index |
| Verificacion documentada | rangos IP publicados y DNS inverso |
| Documentacion del proveedor verificada por ultima vez | 2026-09-06 |
| Proporcion de dominios leidos que lo bloquean para / | 0.8% of 128 |
| Last verified |
Identidad
| Token de robots | Googlebot |
|---|---|
| Comparado como | googlebot |
| Proveedor | |
| Finalidad | search index |
| Documentacion | https://developers.google.com/search/docs/crawling-indexing/googlebot |
| Verificacion documentada | rangos IP publicados y DNS inverso: https://developers.google.com/static/search/apis/ipranges/googlebot.json (.googlebot.com, .google.com) |
Included because AI answers frequently ground on the Google index. The reverse DNS suffixes are the ones app/botverify.py already forward confirms.
Permitir o bloquear
User-agent: Googlebot Allow: /
User-agent: Googlebot Disallow: /
Una regla del archivo robots.txt es una peticion que un rastreador bien educado atiende. No es un control de acceso, y esta pagina no le dice a nadie que elegir.
Preguntas
Respeta Googlebot el archivo robots.txt?
La documentacion del proveedor en https://developers.google.com/search/docs/crawling-indexing/googlebot indica que Googlebot respeta el archivo robots.txt. Descargamos esa pagina y respondio a nuestro verificador el 2026-09-06. Esto registra lo que documenta el proveedor, no lo que hizo una peticion concreta.
Como permito Googlebot en el archivo robots.txt?
Anada este grupo al archivo robots.txt en la raiz del host: User-agent: Googlebot Allow: /. Segun la RFC 9309 el token se compara sin distinguir mayusculas como subcadena del user agent, y gana la regla coincidente mas larga.
Como bloqueo Googlebot en el archivo robots.txt?
Anada este grupo al archivo robots.txt en la raiz del host: User-agent: Googlebot Disallow: /. Una regla del archivo robots.txt es una peticion que un rastreador bien educado atiende; no es un control de acceso.
Como compruebo que una peticion vino realmente de Googlebot?
El proveedor publica tanto un archivo de rangos IP (https://developers.google.com/static/search/apis/ipranges/googlebot.json) como una convencion de DNS inverso. Ambas comprobaciones estan documentadas; lo que prueba la peticion es la direccion, nunca la cadena de user agent.
Lo que medimos
De los 128 dominios registrados cuyo archivo robots.txt hemos leido, 1 bloquean Googlebot para / y 127 lo permiten, es decir un 0.8% bloqueado, semana 2026-W37. Solo recuentos: no se nombra ningun dominio.
El indice semanal de acceso de los rastreadores de IA
Fuentes
| Fuente | Tipo | HTTP | Verificado | Nota |
|---|---|---|---|---|
| https://developers.google.com/search/docs/crawling-indexing/googlebot | vendor | 200 | 2026-09-06 | 35 occurrences of Googlebot in the common crawlers page fetched the same day |
| https://developers.google.com/search/docs/crawling-indexing/overview-google-crawlers | vendor | 200 | 2026-09-06 | crawler overview index page |
Datos libres
Comprobar un dominio con todos los tokens
AEO Watch es un monitor independiente y factual. No esta afiliado a ningun proveedor de rastreadores, ninguno lo respalda y no habla en nombre de ninguno. Cada afirmacion es una observacion con la fecha en que se hizo y la prueba en bruto que la sostiene: una linea del archivo robots.txt, un codigo de estado HTTP, una cabecera. Aqui no hay puntuaciones, ni calificaciones, ni veredictos, y nada de esta pagina es un consejo. Un sitio puede excluirse en cualquier momento y la exclusion se respeta de forma automatica y permanente.