meta-externalagent: token robots, verifica, consentire o bloccare
Questa pagina e tradotta automaticamente. I numeri e le prove provengono invariati dalle osservazioni memorizzate.
meta-externalagent e un crawler di IA gestito da Meta. Il suo token robots.txt e meta-externalagent, e la documentazione del fornitore che abbiamo scaricato il 2026-09-06 e la fonte di ogni affermazione in questa pagina.
| Token robots | meta-externalagent |
|---|---|
| Fornitore | Meta |
| Finalita | training corpus, search index |
| Verifica documentata | nessuno pubblicato |
| Documentazione del fornitore verificata l'ultima volta | 2026-09-06 |
| Quota dei domini letti che lo bloccano per / | 16.4% of 128 |
| Last verified |
Identita
| Token robots | meta-externalagent |
|---|---|
| Confrontato come | meta-externalagent |
| Fornitore | Meta |
| Finalita | training corpus, search index |
| Documentazione | https://developers.facebook.com/docs/sharing/webmasters/web-crawlers/ |
| Verifica documentata | nessuno pubblicato |
The vendor page fetched on 2026-09-06 carries the exact snippet 'User-agent: meta-externalagent Allow: / # Allow everything Disallow: /private/ # Disallow a specific directory', asks for up to 24 hours for a robots.txt change to take effect, and notes that its integrity and security checks may not follow robots.txt.
Consentire o bloccare
User-agent: meta-externalagent Allow: /
User-agent: meta-externalagent Disallow: /
Una regola del file robots.txt e una richiesta che un crawler educato rispetta. Non e un controllo di accesso, e questa pagina non dice a nessuno cosa scegliere.
Domande
meta-externalagent rispetta il file robots.txt?
La documentazione del fornitore all'indirizzo https://developers.facebook.com/docs/sharing/webmasters/web-crawlers/ afferma che meta-externalagent rispetta il file robots.txt. Abbiamo scaricato quella pagina e ha risposto al nostro verificatore il 2026-09-06. Questo registra cio che il fornitore documenta, non cio che ha fatto una singola richiesta.
Come consento meta-externalagent nel file robots.txt?
Aggiungi questo gruppo al file robots.txt nella radice dell'host: User-agent: meta-externalagent Allow: /. Secondo la RFC 9309 il token viene confrontato senza distinzione tra maiuscole e minuscole come sottostringa dello user agent, e vince la regola corrispondente piu lunga.
Come blocco meta-externalagent nel file robots.txt?
Aggiungi questo gruppo al file robots.txt nella radice dell'host: User-agent: meta-externalagent Disallow: /. Una regola del file robots.txt e una richiesta che un crawler educato rispetta; non e un controllo di accesso.
Come verifico che una richiesta provenga davvero da meta-externalagent?
Non abbiamo trovato un metodo di verifica documentato per meta-externalagent: il fornitore non pubblica ne un file di intervalli IP ne una convenzione di DNS inverso che potessimo scaricare. Senza di essi, una stringa di user agent non e prova dell'origine.
Che cosa misuriamo
Dei 128 domini censiti di cui abbiamo letto il file robots.txt, 21 bloccano meta-externalagent per / e 107 lo consentono, cioe il 16.4% bloccato, settimana 2026-W37. Solo conteggi: nessun dominio viene nominato.
L'indice settimanale di accesso dei crawler di IA
Fonti
| Fonte | Tipo | HTTP | Verificato | Nota |
|---|---|---|---|---|
| https://developers.facebook.com/docs/sharing/webmasters/web-crawlers/ | vendor | 200 | 2026-09-06 | served as text/markdown; 5 occurrences of meta-externalagent |
| https://darkvisitors.com/agents/meta-externalagent | aggregator | 200 | 2026-09-06 | corroboration only; volatile source: identical byte count but a different content hash on every fetch (verified twice on 2026-09-06), so the refresher compares byte counts for it, not hashes |
Dati liberi
Verifica un dominio con tutti i token
AEO Watch e un osservatorio indipendente e fattuale. Non e affiliato ad alcun fornitore di crawler, non e approvato da nessuno e non parla per nessuno. Ogni affermazione e un'osservazione con la data in cui e stata fatta e la prova grezza che la sostiene: una riga del file robots.txt, un codice di stato HTTP, un'intestazione. Qui non ci sono punteggi, voti o verdetti, e nulla in questa pagina e un consiglio. Un sito puo chiedere l'esclusione in qualsiasi momento e l'esclusione e rispettata in modo automatico e permanente.