Googlebot: jeton robots, verification, autoriser ou bloquer
Cette page est traduite automatiquement. Les mesures et les preuves proviennent telles quelles des observations enregistrees.
Googlebot est un robot d'IA exploite par Google. Son jeton robots.txt est Googlebot, et la documentation de l'editeur que nous avons telechargee le 2026-09-06 est la source de chaque affirmation de cette page.
| Jeton robots | Googlebot |
|---|---|
| Editeur | |
| Finalite | search index |
| Verification documentee | plages IP publiees et DNS inverse |
| Documentation de l'editeur verifiee le | 2026-09-06 |
| Part des domaines lus qui le bloquent pour / | 0.8% of 128 |
| Last verified |
Identite
| Jeton robots | Googlebot |
|---|---|
| Compare comme | googlebot |
| Editeur | |
| Finalite | search index |
| Documentation | https://developers.google.com/search/docs/crawling-indexing/googlebot |
| Verification documentee | plages IP publiees et DNS inverse: https://developers.google.com/static/search/apis/ipranges/googlebot.json (.googlebot.com, .google.com) |
Included because AI answers frequently ground on the Google index. The reverse DNS suffixes are the ones app/botverify.py already forward confirms.
Autoriser ou bloquer
User-agent: Googlebot Allow: /
User-agent: Googlebot Disallow: /
Une regle du fichier robots.txt est une demande qu'un robot bien eleve respecte. Ce n'est pas un controle d'acces, et cette page ne dit a personne quoi choisir.
Questions
Est-ce que Googlebot respecte le fichier robots.txt?
La documentation de l'editeur a l'adresse https://developers.google.com/search/docs/crawling-indexing/googlebot indique que Googlebot respecte le fichier robots.txt. Nous avons telecharge cette page et elle a repondu a notre verificateur le 2026-09-06. Cela enregistre ce que l'editeur documente, pas ce qu'une requete particuliere a fait.
Comment autoriser Googlebot dans le fichier robots.txt?
Ajoutez ce groupe au fichier robots.txt place a la racine de l'hote: User-agent: Googlebot Allow: /. Selon la RFC 9309, le jeton est compare sans tenir compte de la casse comme sous chaine du user agent, et la regle correspondante la plus longue l'emporte.
Comment bloquer Googlebot dans le fichier robots.txt?
Ajoutez ce groupe au fichier robots.txt place a la racine de l'hote: User-agent: Googlebot Disallow: /. Une regle du fichier robots.txt est une demande qu'un robot bien eleve respecte; ce n'est pas un controle d'acces.
Comment verifier qu'une requete vient reellement de Googlebot?
L'editeur publie a la fois un fichier de plages IP (https://developers.google.com/static/search/apis/ipranges/googlebot.json) et une convention de DNS inverse. Les deux verifications sont documentees; c'est l'adresse qui prouve la requete, jamais la chaine de user agent.
Ce que nous mesurons
Sur les 128 domaines recenses dont nous avons lu le fichier robots.txt, 1 bloquent Googlebot pour / et 127 l'autorisent, soit 0.8% de blocage, semaine 2026-W37. Uniquement des comptes: aucun domaine n'est nomme.
L'index hebdomadaire de l'acces des robots d'IA
Sources
| Source | Type | HTTP | Verifie | Remarque |
|---|---|---|---|---|
| https://developers.google.com/search/docs/crawling-indexing/googlebot | vendor | 200 | 2026-09-06 | 35 occurrences of Googlebot in the common crawlers page fetched the same day |
| https://developers.google.com/search/docs/crawling-indexing/overview-google-crawlers | vendor | 200 | 2026-09-06 | crawler overview index page |
Donnees libres
Verifier un domaine pour tous les jetons
AEO Watch est un observateur independant et factuel. Il n'est affilie a aucun editeur de robot, n'est soutenu par aucun et ne parle au nom d'aucun. Chaque affirmation est une observation portant la date a laquelle elle a ete faite et la preuve brute qui la fonde: une ligne du fichier robots.txt, un code d'etat HTTP, un en tete. Il n'y a ici ni note, ni classement, ni verdict, et rien sur cette page n'est un conseil. Un site peut se retirer a tout moment et ce retrait est respecte automatiquement et definitivement.