GPTBot: OpenAIs Trainingscrawler für ChatGPT
Steckbrief
Betreiber: OpenAI · Herkunft: USA
Klasse: Training
robots.txt-Token:
GPTBotProdukt: Sammelt Inhalte fürs Training zukünftiger ChatGPT-Modelle
Prüfweg: JSON-IP-Liste unter openai.com/gptbot.json
Verifizierbar: Ja, offiziell dokumentiert (OpenAI)
User-Agent
Mozilla/5.0 AppleWebKit/537.36 (KHTML, like Gecko); compatible; GPTBot/1.4; +https://openai.com/gptbotQuelle: OpenAI Bots-Doku.
Was GPTBot tut
GPTBot sammelt Text-, Bild- und weitere Inhalte, die in das Training zukünftiger OpenAI-Modelle einfließen. Er baut keinen durchsuchbaren Index auf und beantwortet auch keine Nutzerfragen, er ist reine Datengrundlage für die Modelle, die später in ChatGPT und über die OpenAI-API laufen (OpenAI).
Für dich bedeutet das: Ein Abruf durch GPTBot führt weder zu einem Zitat noch zu einem Referral. Der einzige mögliche Nutzen ist langfristig und indirekt, dass ein trainiertes Modell deine Marke „kennt", wenn Nutzer sie später ohne Websuche erwähnen. Ob dieser Effekt in eurem Feld messbar ist, hängt von Größe und Prominenz eurer Domain ab.
GPTBot ist der derzeit größte einzelne KI-Trainingscrawler im Cloudflare-Netz: Sein Anteil am KI-only-Crawl-Traffic stieg von 11,9 % (Juli 2024) auf 28,1 % (Juli 2025) (Cloudflare).
So verifizierst du ihn
OpenAI publiziert die IP-Ranges maschinenlesbar unter openai.com/gptbot.json. Ein Abruf mit dem UA GPTBot, dessen Absender-IP nicht in dieser Datei liegt, ist ein Spoofing-Versuch, behandel ihn wie unbekannten Bot-Traffic.
Was GPTBot dir bringt
Direkter Nutzen: keiner (kein Zitat, kein Referral)
Indirekter Nutzen: Langzeit-Markenkenntnis der Modelle, praktisch nicht attributierbar
Volumen: höchster KI-Trainings-Anteil im Cloudflare-Netz. 28,1 % (Juli 2025) (Cloudflare)
Referral-Verhältnis (Anbieterebene OpenAI): 1.091,4:1 (Juli 2025), pro Referral etwa 1.100 Crawl-Requests (Cloudflare); wobei OpenAIs Referrals fast ausschließlich aus dem Such-Bot
OAI-SearchBotundChatGPT-Userkommen, nicht aus GPTBot selbst
Empfehlung
Strategisch entscheiden, hier trennt sich der Weg klar in zwei Lager:
Erlauben, wenn ihr wollt, dass ChatGPT eure Marke, Produkte oder Fachbegriffe später ohne Websuche kennt. Das ist eine langfristige Wette, kein direkter Kanal.
Blockieren, wenn ihr eure Inhalte nicht ohne Gegenleistung ins Modelltraining geben wollt. Wichtig: Der GPTBot-Block hat keinerlei Auswirkung auf eure Sichtbarkeit in der ChatGPT-Suche, dafür ist
OAI-SearchBotzuständig, ein völlig anderer Bot.
robots.txt zum Kopieren:
# GPTBot vom Training ausschließen
User-agent: GPTBot
Disallow: /
# Zitatfähigkeit in ChatGPT trotzdem erhalten
User-agent: OAI-SearchBot
Allow: /
User-agent: ChatGPT-User
Allow: /Verwandte Bots
OAI-SearchBot, OpenAIs Index-Crawler für die ChatGPT-Suche
ChatGPT-User, Live-Abruf, wenn ein ChatGPT-Nutzer eine URL prüft
ClaudeBot, die Anthropic-Entsprechung
Stand & Changelog
Stand: 12. August 2026
Aug 2026: UA auf Version 1.4 aktualisiert; IP-Liste bestätigt
Juli 2025: Anteil am KI-Crawl-Traffic erstmals über 28 %
Aug 2023: Erste Veröffentlichung des Bots durch OpenAI