# Google-Extended

## In short

Google-Extended est un robot d'IA exploite par Google. Son jeton robots.txt est Google-Extended, et la documentation de l'editeur que nous avons telechargee le 2026-09-06 est la source de chaque affirmation de cette page.

| Fact | Value |
| --- | --- |
| Jeton robots | Google-Extended |
| Editeur | Google |
| Finalite | training corpus, grounding |
| Verification documentee | plages IP publiees |
| Documentation de l'editeur verifiee le | 2026-09-06 |
| Part des domaines lus qui le bloquent pour / | 17.2% of 128 |
| Last verified | 2026-09-06 |

## Est-ce que Google-Extended respecte le fichier robots.txt?

La documentation de l'editeur a l'adresse https://developers.google.com/search/docs/crawling-indexing/google-common-crawlers indique que Google-Extended respecte le fichier robots.txt. Nous avons telecharge cette page et elle a repondu a notre verificateur le 2026-09-06. Cela enregistre ce que l'editeur documente, pas ce qu'une requete particuliere a fait.

## Comment autoriser Google-Extended dans le fichier robots.txt?

Ajoutez ce groupe au fichier robots.txt place a la racine de l'hote: User-agent: Google-Extended
Allow: /. Selon la RFC 9309, le jeton est compare sans tenir compte de la casse comme sous chaine du user agent, et la regle correspondante la plus longue l'emporte.

## Comment bloquer Google-Extended dans le fichier robots.txt?

Ajoutez ce groupe au fichier robots.txt place a la racine de l'hote: User-agent: Google-Extended
Disallow: /. Une regle du fichier robots.txt est une demande qu'un robot bien eleve respecte; ce n'est pas un controle d'acces.

## Comment verifier qu'une requete vient reellement de Google-Extended?

L'editeur publie a l'adresse https://developers.google.com/static/search/apis/ipranges/special-crawlers.json les plages d'adresses IP depuis lesquelles ce robot telecharge. Comparez l'adresse de la requete a ce fichier. Une chaine de user agent seule ne prouve rien, car n'importe qui peut l'envoyer.

## Source

- https://developers.google.com/search/docs/crawling-indexing/google-common-crawlers (HTTP 200, Verifie 2026-09-06)
- https://developers.google.com/static/search/apis/ipranges/special-crawlers.json (HTTP 200, Verifie 2026-09-06)

AEO Watch est un observateur independant et factuel. Il n'est affilie a aucun editeur de robot, n'est soutenu par aucun et ne parle au nom d'aucun. Chaque affirmation est une observation portant la date a laquelle elle a ete faite et la preuve brute qui la fonde: une ligne du fichier robots.txt, un code d'etat HTTP, un en tete. Il n'y a ici ni note, ni classement, ni verdict, et rien sur cette page n'est un conseil. Un site peut se retirer a tout moment et ce retrait est respecte automatiquement et definitivement.
