meta-externalagent: jeton robots, verification, autoriser ou bloquer
Cette page est traduite automatiquement. Les mesures et les preuves proviennent telles quelles des observations enregistrees.
meta-externalagent est un robot d'IA exploite par Meta. Son jeton robots.txt est meta-externalagent, et la documentation de l'editeur que nous avons telechargee le 2026-09-06 est la source de chaque affirmation de cette page.
| Jeton robots | meta-externalagent |
|---|---|
| Editeur | Meta |
| Finalite | training corpus, search index |
| Verification documentee | aucune publiee |
| Documentation de l'editeur verifiee le | 2026-09-06 |
| Part des domaines lus qui le bloquent pour / | 16.4% of 128 |
| Last verified |
Identite
| Jeton robots | meta-externalagent |
|---|---|
| Compare comme | meta-externalagent |
| Editeur | Meta |
| Finalite | training corpus, search index |
| Documentation | https://developers.facebook.com/docs/sharing/webmasters/web-crawlers/ |
| Verification documentee | aucune publiee |
The vendor page fetched on 2026-09-06 carries the exact snippet 'User-agent: meta-externalagent Allow: / # Allow everything Disallow: /private/ # Disallow a specific directory', asks for up to 24 hours for a robots.txt change to take effect, and notes that its integrity and security checks may not follow robots.txt.
Autoriser ou bloquer
User-agent: meta-externalagent Allow: /
User-agent: meta-externalagent Disallow: /
Une regle du fichier robots.txt est une demande qu'un robot bien eleve respecte. Ce n'est pas un controle d'acces, et cette page ne dit a personne quoi choisir.
Questions
Est-ce que meta-externalagent respecte le fichier robots.txt?
La documentation de l'editeur a l'adresse https://developers.facebook.com/docs/sharing/webmasters/web-crawlers/ indique que meta-externalagent respecte le fichier robots.txt. Nous avons telecharge cette page et elle a repondu a notre verificateur le 2026-09-06. Cela enregistre ce que l'editeur documente, pas ce qu'une requete particuliere a fait.
Comment autoriser meta-externalagent dans le fichier robots.txt?
Ajoutez ce groupe au fichier robots.txt place a la racine de l'hote: User-agent: meta-externalagent Allow: /. Selon la RFC 9309, le jeton est compare sans tenir compte de la casse comme sous chaine du user agent, et la regle correspondante la plus longue l'emporte.
Comment bloquer meta-externalagent dans le fichier robots.txt?
Ajoutez ce groupe au fichier robots.txt place a la racine de l'hote: User-agent: meta-externalagent Disallow: /. Une regle du fichier robots.txt est une demande qu'un robot bien eleve respecte; ce n'est pas un controle d'acces.
Comment verifier qu'une requete vient reellement de meta-externalagent?
Nous n'avons trouve aucune methode de verification documentee pour meta-externalagent: l'editeur ne publie ni fichier de plages IP ni convention de DNS inverse que nous puissions telecharger. Sans cela, une chaine de user agent ne prouve pas l'origine.
Ce que nous mesurons
Sur les 128 domaines recenses dont nous avons lu le fichier robots.txt, 21 bloquent meta-externalagent pour / et 107 l'autorisent, soit 16.4% de blocage, semaine 2026-W37. Uniquement des comptes: aucun domaine n'est nomme.
L'index hebdomadaire de l'acces des robots d'IA
Sources
| Source | Type | HTTP | Verifie | Remarque |
|---|---|---|---|---|
| https://developers.facebook.com/docs/sharing/webmasters/web-crawlers/ | vendor | 200 | 2026-09-06 | served as text/markdown; 5 occurrences of meta-externalagent |
| https://darkvisitors.com/agents/meta-externalagent | aggregator | 200 | 2026-09-06 | corroboration only; volatile source: identical byte count but a different content hash on every fetch (verified twice on 2026-09-06), so the refresher compares byte counts for it, not hashes |
Donnees libres
Verifier un domaine pour tous les jetons
AEO Watch est un observateur independant et factuel. Il n'est affilie a aucun editeur de robot, n'est soutenu par aucun et ne parle au nom d'aucun. Chaque affirmation est une observation portant la date a laquelle elle a ete faite et la preuve brute qui la fonde: une ligne du fichier robots.txt, un code d'etat HTTP, un en tete. Il n'y a ici ni note, ni classement, ni verdict, et rien sur cette page n'est un conseil. Un site peut se retirer a tout moment et ce retrait est respecte automatiquement et definitivement.