Amzn-SearchBot: token robots, verifica, consentire o bloccare
Questa pagina e tradotta automaticamente. I numeri e le prove provengono invariati dalle osservazioni memorizzate.
Amzn-SearchBot e un crawler di IA gestito da Amazon. Il suo token robots.txt e Amzn-SearchBot, e la documentazione del fornitore che abbiamo scaricato il 2026-09-17 e la fonte di ogni affermazione in questa pagina.
| Token robots | Amzn-SearchBot |
|---|---|
| Fornitore | Amazon |
| Finalita | search index |
| Verifica documentata | intervalli IP pubblicati |
| Documentazione del fornitore verificata l'ultima volta | 2026-09-17 |
| Quota dei domini letti che lo bloccano per / | 4.3% of 12373 |
| Last verified |
Identita
| Token robots | Amzn-SearchBot |
|---|---|
| Confrontato come | amzn-searchbot |
| Fornitore | Amazon |
| Finalita | search index |
| Documentazione | https://developer.amazon.com/amazonbot |
| Verifica documentata | intervalli IP pubblicati: https://developer.amazon.com/amazonbot/searchbot-ip-addresses/ |
Vendor text fetched on 2026-09-17: 'Amzn-SearchBot is used to improve search experiences in Amazon products and services.' The same page states 'Amzn-SearchBot does not crawl content for generative AI model training', so no training purpose is recorded here. It is covered by the page's robots.txt section: 'Automated crawling from these listed user agents respects the Robots Exclusion Protocol, honoring the user-agent and the allow/disallow directives.' Documented UA sample contains 'compatible; Amzn-SearchBot/0.1'.
Consentire o bloccare
User-agent: Amzn-SearchBot Allow: /
User-agent: Amzn-SearchBot Disallow: /
Una regola del file robots.txt e una richiesta che un crawler educato rispetta. Non e un controllo di accesso, e questa pagina non dice a nessuno cosa scegliere.
Build a robots.txt with Amzn-SearchBot and every other documented token
Domande
Amzn-SearchBot rispetta il file robots.txt?
La documentazione del fornitore all'indirizzo https://developer.amazon.com/amazonbot afferma che Amzn-SearchBot rispetta il file robots.txt. Abbiamo scaricato quella pagina e ha risposto al nostro verificatore il 2026-09-17. Questo registra cio che il fornitore documenta, non cio che ha fatto una singola richiesta.
Come consento Amzn-SearchBot nel file robots.txt?
Aggiungi questo gruppo al file robots.txt nella radice dell'host: User-agent: Amzn-SearchBot Allow: /. Secondo la RFC 9309 il token viene confrontato senza distinzione tra maiuscole e minuscole come sottostringa dello user agent, e vince la regola corrispondente piu lunga.
Come blocco Amzn-SearchBot nel file robots.txt?
Aggiungi questo gruppo al file robots.txt nella radice dell'host: User-agent: Amzn-SearchBot Disallow: /. Una regola del file robots.txt e una richiesta che un crawler educato rispetta; non e un controllo di accesso.
Come verifico che una richiesta provenga davvero da Amzn-SearchBot?
Il fornitore pubblica all'indirizzo https://developer.amazon.com/amazonbot/searchbot-ip-addresses/ gli intervalli di indirizzi IP da cui questo crawler scarica. Confronta l'indirizzo della richiesta con quel file. Una stringa di user agent da sola non prova nulla, perche chiunque puo inviarla.
Che cosa misuriamo
Dei 12373 domini censiti di cui abbiamo letto il file robots.txt, 534 bloccano Amzn-SearchBot per / e 11839 lo consentono, cioe il 4.3% bloccato, settimana 2026-W41. Solo conteggi: nessun dominio viene nominato.
L'indice settimanale di accesso dei crawler di IA
Fonti
| Fonte | Tipo | HTTP | Verificato | Nota |
|---|---|---|---|---|
| https://developer.amazon.com/amazonbot | vendor | 200 | 2026-09-17 | 9 occurrences of Amazonbot, 8 of Amzn-SearchBot and 7 of Amzn-User; robots.txt discussed 10 times; the page names one published IP address URL per user agent |
| https://developer.amazon.com/amazonbot/searchbot-ip-addresses/ | vendor | 200 | 2026-09-17 | the published IP list for this user agent, printed as JSON inside a code block on the page rather than served as a JSON document: 816 prefixes under a prefixes array with an ip_prefix field, creationTime 2026-09-08. Identical bytes and hash on two fetches on 2026-09-17, so it is not a volatile source; also refreshed weekly into data/bot_ranges.json |
Dati liberi
- The AEO Watch dataset
- Tranco top 1,000 AI crawler policy (CSV, CC BY 4.0)
- The AEO Watch API
- The checker as a command line tool (one file, no install)
Verifica un dominio con tutti i token
Check your own site
The same checks, run on your domain now: what robots.txt tells each AI crawler, whether the edge answers them, and whether the text is readable without JavaScript. Free, no signup.
Limits: 8 checks and 5 different domains per address per hour; a repeat of the same domain inside 7 days is answered from what we already hold.
AEO Watch e un osservatorio indipendente e fattuale. Non e affiliato ad alcun fornitore di crawler, non e approvato da nessuno e non parla per nessuno. Ogni affermazione e un'osservazione con la data in cui e stata fatta e la prova grezza che la sostiene: una riga del file robots.txt, un codice di stato HTTP, un'intestazione. Qui non ci sono punteggi, voti o verdetti, e nulla in questa pagina e un consiglio. Un sito puo chiedere l'esclusione in qualsiasi momento e l'esclusione e rispettata in modo automatico e permanente.