GPTBot: robots-Token, Verifizierung, erlauben oder sperren
Diese Seite ist maschinell uebersetzt. Die Messwerte und die Belege stammen unveraendert aus den gespeicherten Beobachtungen.
GPTBot ist ein KI Crawler, betrieben von OpenAI. Sein robots.txt Token lautet GPTBot, und die Herstellerdokumentation, die wir am 2026-09-06 abgerufen haben, ist die Quelle jeder Aussage auf dieser Seite.
| Robots Token | GPTBot |
|---|---|
| Hersteller | OpenAI |
| Zweck | training corpus |
| Dokumentierte Pruefung | veroeffentlichte IP Bereiche |
| Herstellerdokumentation zuletzt geprueft | 2026-09-06 |
| Anteil der gelesenen Domains, die ihn fuer / sperren | 20.3% of 128 |
| Last verified |
Identitaet
| Robots Token | GPTBot |
|---|---|
| Abgeglichen als | gptbot |
| Hersteller | OpenAI |
| Zweck | training corpus |
| Dokumentation | https://platform.openai.com/docs/bots |
| Dokumentierte Pruefung | veroeffentlichte IP Bereiche: https://openai.com/gptbot.json |
Vendor page states the content may be used to train generative AI foundation models and publishes the IP range file. Documented UA sample contains 'GPTBot/1.4; +https://openai.com/gptbot'.
Erlauben oder sperren
User-agent: GPTBot Allow: /
User-agent: GPTBot Disallow: /
Eine Regel in der robots.txt ist eine Bitte, die ein gut erzogener Crawler befolgt. Sie ist keine Zugriffskontrolle, und diese Seite sagt niemandem, wie er sich entscheiden soll.
Fragen
Befolgt GPTBot die robots.txt?
Die Herstellerdokumentation unter https://platform.openai.com/docs/bots gibt an, dass GPTBot die robots.txt beachtet. Wir haben diese Seite abgerufen, und sie hat unserem Pruefer am 2026-09-06 geantwortet. Das haelt fest, was der Hersteller dokumentiert, nicht was eine einzelne Anfrage getan hat.
Wie erlaube ich GPTBot in der robots.txt?
Fuegen Sie diese Gruppe in die robots.txt im Wurzelverzeichnis des Hosts ein: User-agent: GPTBot Allow: /. Nach RFC 9309 wird der Token ohne Beachtung der Gross und Kleinschreibung als Teilzeichenkette des User Agent verglichen, und die laengste passende Regel gewinnt.
Wie sperre ich GPTBot in der robots.txt?
Fuegen Sie diese Gruppe in die robots.txt im Wurzelverzeichnis des Hosts ein: User-agent: GPTBot Disallow: /. Eine Regel in der robots.txt ist eine Bitte, die ein gut erzogener Crawler befolgt; sie ist keine Zugriffskontrolle.
Wie pruefe ich, ob eine Anfrage wirklich von GPTBot kam?
Der Hersteller veroeffentlicht unter https://openai.com/gptbot.json die IP Bereiche, aus denen dieser Crawler abruft. Vergleichen Sie die Adresse der Anfrage mit dieser Datei. Eine User Agent Zeichenkette allein beweist nichts, denn jeder kann sie senden.
Was wir messen
Von den 128 erfassten Domains, deren robots.txt wir gelesen haben, sperren 26 den Token GPTBot fuer / und 102 erlauben ihn, das sind 20.3% gesperrt, Woche 2026-W37. Nur Zahlen: keine Domain wird genannt.
Der woechentliche Index des KI Crawler Zugangs
Quellen
| Quelle | Typ | HTTP | Geprueft | Hinweis |
|---|---|---|---|---|
| https://platform.openai.com/docs/bots | vendor | 200 | 2026-09-06 | vendor redirects to developers.openai.com; 8 occurrences of GPTBot in the fetched body |
| https://openai.com/gptbot.json | vendor | 200 | 2026-09-06 | published IP ranges, also refreshed weekly into data/bot_ranges.json |
Freie Daten
Eine Domain gegen alle Token pruefen
AEO Watch ist ein unabhaengiger, faktischer Monitor. Er ist mit keinem Crawler Hersteller verbunden, wird von keinem unterstuetzt und spricht fuer keinen. Jede Aussage ist eine Beobachtung mit dem Datum, an dem sie gemacht wurde, und dem Rohbeleg dahinter: eine Zeile aus der robots.txt, ein HTTP Statuscode, ein Header. Es gibt hier keine Noten, keine Bewertungen und keine Urteile, und nichts auf dieser Seite ist eine Beratung. Eine Website kann jederzeit widersprechen, und der Widerspruch wird automatisch und dauerhaft beachtet.