Wissen

Wie die AI Daten auf deiner Seite sammelt, und welchen Traffic du wirklich siehst

Fünf Arten von AI-Traffic, das Crawl-zu-Klick-Verhältnis, und warum Last-Click-Attribution den Beitrag der AI unsichtbar macht. Von der ersten Zeile Markup bis zum attribuierten Kauf.

10 Min. Lesezeit·
Crawler lesen eine Seite; der meiste AI-Traffic bleibt unsichtbar, nur ein Klick wird sichtbar

Während du das liest, besuchen AI-Bots deine Seite. Nicht einmal, sondern laufend, und die meisten geben dir nie einen Klick zurück. Sie lesen, lernen, zitieren und reichern an. Das Problem: In Google Analytics siehst du davon fast nichts, weil AI-Crawler kein JavaScript ausführen. Was am Server ankommt, ist die ganze Wahrheit, und die ist überraschend.

Fünf Arten, wie die AI deine Seite besucht

AI-Traffic ist nicht ein Ding. Es sind mindestens fünf verschiedene Absichten, und jede bedeutet etwas anderes für dich:

Klasse

Beispiel-Bots

Was passiert

Was es bedeutet

Standard-Crawl (Training)

GPTBot, ClaudeBot, CCBot, Google-Extended

Schluckt Inhalte fürs Modell, breit und periodisch

Du landest im Modell-Wissen, aber ohne Live-Bezug

On-Demand-Recherche

ChatGPT-User, OAI-SearchBot, Perplexity-User

Holt live, weil jemand gerade eine Frage stellt

Deine Seite wird für eine konkrete Antwort geprüft

Deep Research

Burst derselben On-Demand-Bots

Viele Seiten am Stück für einen Report

Jemand recherchiert dich tief und mehrstufig

Zitation

Die Untermenge mit Link in der Antwort

Landet sichtbar in der Antwort, seltener Klick

Der eigentliche Referral, der Rest ist stiller Konsum

Anreicherung / Agenten

Amazonbot (Rufus), Applebot-Extended (Apple Intelligence, Siri)

Reichert Produkt- und Firmendaten für Assistenten und Voice an

Deine Daten fließen in Kauf-Agenten und Sprach-Antworten

Ein Trainings-Crawl ist etwas völlig anderes als jemand, der dich gerade aktiv in einer Deep Research untersucht. Wer beides in einen Topf wirft, versteht seinen AI-Traffic nicht.

Nicht alles ist AI, trenne das Rauschen

Neben den AI-Bots kommt viel Traffic, der nichts mit AI zu tun hat, und der deine Zahlen verfälscht, wenn du ihn mitzählst:

  • SEO-Tools: AhrefsBot, SemrushBot und Co. crawlen für Backlink- und Keyword-Indizes, nicht für AI-Antworten.

  • Wettbewerber-Monitoring: Werkzeuge, mit denen andere dich beobachten.

  • Scraper und Spam: oft aus Datacenter-Ranges, die Inhalte abgreifen, ohne dir je etwas zu bringen.

Und ehrlich gesagt: unsere eigenen Klariton-Scans, die bei der Arbeit mit dir entstehen (Checks, Verifikation), zählen wir nicht in deine Reach-Zahlen. Sonst würdest du deine eigene Messung verfälschen. Sauberer AI-Reach heißt: AI-Bots ja, SEO-Tools, Spam und unser eigenes Werkzeug raus.

So erkennst du die Muster in deinen Logs

Diese Signale stehen in deinen Server-Logs, nicht in Google Analytics (das lädt per JavaScript, das der Bot nie startet). Der Schlüssel ist der User-Agent jedes Requests. In einem Log sieht ein AI-Besuch etwa so aus:

203.0.113.7 [21/Jul/2026] "GET /produkt/xy" 200
"Mozilla/5.0 (compatible; ChatGPT-User/1.0; +https://openai.com/bot)"

Die Kennung im User-Agent, hier ChatGPT-User, verrät Absender und Absicht. Die wichtigsten Kennungen, Stand Juli 2026 (sie ändern sich, prüfe sie regelmäßig):

User-Agent enthält

Wer und Klasse

Was es bedeutet

GPTBot

OpenAI · Training

Fürs Modell, breit und periodisch

OAI-SearchBot, ChatGPT-User

OpenAI · On-Demand

Holt live für eine konkrete Antwort

PerplexityBot

Perplexity · Training

Fürs Modell

Perplexity-User

Perplexity · On-Demand

Live für eine Antwort

ClaudeBot

Anthropic · Training

Fürs Modell

Claude-User

Anthropic · On-Demand

Live für eine Antwort

Google-Extended

Google · Training

Für Gemini-Training

Amazonbot

Amazon (Rufus, Alexa) · Anreicherung

Reichert Produktdaten an

Applebot-Extended

Apple (Apple Intelligence, Siri) · Anreicherung

Für Assistenten und Voice

AhrefsBot, SemrushBot

SEO-Tool · KEIN AI

Rausfiltern, verfälscht sonst deine AI-Zahlen

Aus einzelnen Zeilen wird ein Muster, wenn du die Zeit dazunimmst: mehrere On-Demand-Kennungen (ChatGPT-User, Perplexity-User) in wenigen Minuten auf verschiedenen Seiten heißt Deep Research, jemand recherchiert dich gerade tief. Leere oder generische User-Agents (python-requests, curl) aus reinen Datacenter-Ranges sind dagegen Scraper-Rauschen und zählen nicht als AI. Genau diese Trennung nimmt dir das Agentic-Reach-Modul ab, damit du nicht selbst Logs lesen musst.

Viel gelesen, selten geklickt

Cloudflare hat es mit Zahlen belegt (Crawl-to-Click-Gap, Juli 2025): das Verhältnis von Crawls zu zurückgeschickten Klicks ist dramatisch. Anthropic kam auf rund 38.000 Crawls pro einem Besucher, OpenAI auf etwa 1.100, Perplexity auf knapp 200. Deine Inhalte werden also massiv konsumiert, aber die AI hält den Nutzer in ihrer eigenen Antwort, statt ihn zu dir zu schicken.

Deine Marke kann in der AI hundertfach gelesen werden, lange bevor sie einen Klick sieht. Wer nur Klicks misst, hält das für Stille.

Das ist keine schlechte Nachricht, sondern eine unsichtbare. Sichtbarkeit in der AI passiert, ob du es misst oder nicht. Die Frage ist nur, ob du es siehst.

Sichtbarkeit ist nicht das Ziel, der Kauf ist es

Gelesen zu werden ist der Anfang der Kette, nicht das Ende. Die volle Kette geht: Crawl → Zitation → Klick → Kauf. Jede Stufe verliert Volumen, und jede Stufe ist eine eigene Messung. Nur die letzte zahlt deine Rechnung.

  • Crawl: Wie oft und von welchem Bot wird deine Seite gelesen?

  • Zitation: Landest du in der Antwort, oder nur im stillen Konsum?

  • Klick: Führt die Zitation zu einem echten Besuch?

  • Kauf: Wird aus dem Besuch ein Abschluss, im Shop?

Die meisten Tools messen die erste Stufe und nennen es Erfolg. Aber ein Crawl ist kein Umsatz. Erst wenn du die Kette bis zum Kauf durchziehst, weißt du, was AI-Sichtbarkeit dir wirklich bringt.

Warum Last-Click die AI unsichtbar macht

Hier liegt der teuerste Messfehler. AI ist fast immer der erste Kontakt, die Entdeckung im Upper Funnel. Der Kunde fragt die AI, findet dich, kommt aber erst beim zweiten oder dritten Besuch über Google oder direkt zurück und kauft dann. Miss du per Last-Click, bekommt AI null Kredit, der Kauf sieht aus, als käme er von Google.

So unterschätzt heute praktisch jeder den Beitrag der AI. Richtig ist eine anteilige, Multi-Touch-Attribution: erster Besuch via AI-Referral, zweiter via Google, dritter direkt, und AI bekommt seinen fairen Anteil an der Kette, statt aus der Statistik zu verschwinden.

AI ist der erste Touch. Last-Click löscht ihn. Anteilige Attribution bringt ihn zurück.

Was du davon messen kannst

Weil AI-Crawler kein JavaScript ausführen, muss die Messung server-seitig passieren, am Edge, bevor irgendein Skript läuft. Genau da setzt Klaritons Agentic-Reach-Modul an:

  • Welcher Bot welche Seite gelesen hat, in Echtzeit, sauber nach Absicht getrennt (Training, On-Demand, Deep Research).

  • Aktive Recherche: ein Burst von On-Demand-Reads heißt, jemand untersucht dich gerade, und das Thema der Seiten verrät die Absicht.

  • Bis zum Umsatz: First-Touch-Erfassung und Session-Gruppierung über die Zeit, damit ein AI-Erstkontakt nicht verloren geht, wenn der Kauf später über einen anderen Kanal kommt.

Der kostenlose Klariton-Check zeigt dir den Einstieg: sehen und zitieren dich ChatGPT, Perplexity, Gemini und Claude überhaupt? Der Rest der Kette, von der Recherche bis zum attribuierten Kauf, ist genau das, was Agentic Reach sichtbar macht, während andere beim Crawl-Zählen stehen bleiben.

Frag Klariton

Stell deine Frage zu Klariton.

Gegroundet in Klaritons eigenem Wissen, belegt statt erfunden.

Oder stell deine eigene Frage:
Nächster Schritt

Wie sichtbar ist deine Marke für AI?

Der kostenlose AI-Visibility-Check zeigt dir in unter einer Minute, wie AI-Assistenten deinen Shop heute sehen.