Amzn-SearchBot: jeton robots, verification, autoriser ou bloquer
Cette page est traduite automatiquement. Les mesures et les preuves proviennent telles quelles des observations enregistrees.
Amzn-SearchBot est un robot d'IA exploite par Amazon. Son jeton robots.txt est Amzn-SearchBot, et la documentation de l'editeur que nous avons telechargee le 2026-09-17 est la source de chaque affirmation de cette page.
| Jeton robots | Amzn-SearchBot |
|---|---|
| Editeur | Amazon |
| Finalite | search index |
| Verification documentee | plages IP publiees |
| Documentation de l'editeur verifiee le | 2026-09-17 |
| Part des domaines lus qui le bloquent pour / | 4.3% of 12373 |
| Last verified |
Identite
| Jeton robots | Amzn-SearchBot |
|---|---|
| Compare comme | amzn-searchbot |
| Editeur | Amazon |
| Finalite | search index |
| Documentation | https://developer.amazon.com/amazonbot |
| Verification documentee | plages IP publiees: https://developer.amazon.com/amazonbot/searchbot-ip-addresses/ |
Vendor text fetched on 2026-09-17: 'Amzn-SearchBot is used to improve search experiences in Amazon products and services.' The same page states 'Amzn-SearchBot does not crawl content for generative AI model training', so no training purpose is recorded here. It is covered by the page's robots.txt section: 'Automated crawling from these listed user agents respects the Robots Exclusion Protocol, honoring the user-agent and the allow/disallow directives.' Documented UA sample contains 'compatible; Amzn-SearchBot/0.1'.
Autoriser ou bloquer
User-agent: Amzn-SearchBot Allow: /
User-agent: Amzn-SearchBot Disallow: /
Une regle du fichier robots.txt est une demande qu'un robot bien eleve respecte. Ce n'est pas un controle d'acces, et cette page ne dit a personne quoi choisir.
Build a robots.txt with Amzn-SearchBot and every other documented token
Questions
Est-ce que Amzn-SearchBot respecte le fichier robots.txt?
La documentation de l'editeur a l'adresse https://developer.amazon.com/amazonbot indique que Amzn-SearchBot respecte le fichier robots.txt. Nous avons telecharge cette page et elle a repondu a notre verificateur le 2026-09-17. Cela enregistre ce que l'editeur documente, pas ce qu'une requete particuliere a fait.
Comment autoriser Amzn-SearchBot dans le fichier robots.txt?
Ajoutez ce groupe au fichier robots.txt place a la racine de l'hote: User-agent: Amzn-SearchBot Allow: /. Selon la RFC 9309, le jeton est compare sans tenir compte de la casse comme sous chaine du user agent, et la regle correspondante la plus longue l'emporte.
Comment bloquer Amzn-SearchBot dans le fichier robots.txt?
Ajoutez ce groupe au fichier robots.txt place a la racine de l'hote: User-agent: Amzn-SearchBot Disallow: /. Une regle du fichier robots.txt est une demande qu'un robot bien eleve respecte; ce n'est pas un controle d'acces.
Comment verifier qu'une requete vient reellement de Amzn-SearchBot?
L'editeur publie a l'adresse https://developer.amazon.com/amazonbot/searchbot-ip-addresses/ les plages d'adresses IP depuis lesquelles ce robot telecharge. Comparez l'adresse de la requete a ce fichier. Une chaine de user agent seule ne prouve rien, car n'importe qui peut l'envoyer.
Ce que nous mesurons
Sur les 12373 domaines recenses dont nous avons lu le fichier robots.txt, 534 bloquent Amzn-SearchBot pour / et 11839 l'autorisent, soit 4.3% de blocage, semaine 2026-W41. Uniquement des comptes: aucun domaine n'est nomme.
L'index hebdomadaire de l'acces des robots d'IA
Sources
| Source | Type | HTTP | Verifie | Remarque |
|---|---|---|---|---|
| https://developer.amazon.com/amazonbot | vendor | 200 | 2026-09-17 | 9 occurrences of Amazonbot, 8 of Amzn-SearchBot and 7 of Amzn-User; robots.txt discussed 10 times; the page names one published IP address URL per user agent |
| https://developer.amazon.com/amazonbot/searchbot-ip-addresses/ | vendor | 200 | 2026-09-17 | the published IP list for this user agent, printed as JSON inside a code block on the page rather than served as a JSON document: 816 prefixes under a prefixes array with an ip_prefix field, creationTime 2026-09-08. Identical bytes and hash on two fetches on 2026-09-17, so it is not a volatile source; also refreshed weekly into data/bot_ranges.json |
Donnees libres
- The AEO Watch dataset
- Tranco top 1,000 AI crawler policy (CSV, CC BY 4.0)
- The AEO Watch API
- The checker as a command line tool (one file, no install)
Verifier un domaine pour tous les jetons
Check your own site
The same checks, run on your domain now: what robots.txt tells each AI crawler, whether the edge answers them, and whether the text is readable without JavaScript. Free, no signup.
Limits: 8 checks and 5 different domains per address per hour; a repeat of the same domain inside 7 days is answered from what we already hold.
AEO Watch est un observateur independant et factuel. Il n'est affilie a aucun editeur de robot, n'est soutenu par aucun et ne parle au nom d'aucun. Chaque affirmation est une observation portant la date a laquelle elle a ete faite et la preuve brute qui la fonde: une ligne du fichier robots.txt, un code d'etat HTTP, un en tete. Il n'y a ici ni note, ni classement, ni verdict, et rien sur cette page n'est un conseil. Un site peut se retirer a tout moment et ce retrait est respecte automatiquement et definitivement.