Reddit verliert 86 Prozent seiner ChatGPT-Zitationen, während ein Modell ohne Hersteller den Markt erobert
Zwei Vorgänge aus derselben Augustwoche, die auf dasselbe hinauslaufen: Bei der einen Quelle ist unklar, warum sie verschwindet. Beim einen Modell ist unklar, wer es überhaupt betreibt. Wer seine KI-Sichtbarkeit auf eine Taktik oder einen Anbieternamen stützt, baut auf Sand.
In der Woche vom 14. bis zum 20. August ist in unserem Feld zweimal etwas passiert, das man normalerweise für unwahrscheinlich hält. Eine der meistzitierten Quellen in ChatGPT ist fast vollständig aus den Antworten verschwunden, ohne Ankündigung und ohne Erklärung. Und ein Modell, das niemandem gehört, hat in wenigen Tagen einen erheblichen Teil der Entwickleraufmerksamkeit auf sich gezogen.
Beide Vorgänge sind für sich genommen Branchennachrichten. Zusammen ergeben sie eine Lehre, die über die Woche hinausreicht.
Reddit verschwindet aus ChatGPTs Quellenmix
Die Messdaten stammen von Promptwatch, das Zitationen in KI-Antworten laufend erhebt. Zwischen dem 18. Juli und dem 7. August lag Reddits Anteil an den Zitationen in ChatGPT Search im Schnitt bei 3,83 Prozent. Ab dem 14. August fiel er unter ein Prozent und lag im Schnitt bei 0,52 Prozent. Das ist ein Rückgang um 86,4 Prozent, und er hat sich nicht über Wochen aufgebaut, sondern innerhalb weniger Tage.
Ein Hinweis auf die Mechanik steckt in einer zweiten Zahl: ChatGPTs Nutzung des site:-Operators in seinen Fanout-Abfragen sprang am 8. August von etwa 0,4 Prozent auf annähernd 17 Prozent und stieg danach weiter. Es sieht also weniger nach einer Bestrafung einer einzelnen Domain aus als nach einer geänderten Art, Quellen überhaupt auszuwählen.
Zwei Dinge gehören zur Ehrlichkeit dazu.
Erstens sagt Promptwatch selbst, dass ein Datenerfassungsproblem nicht auszuschließen ist und die Größe des Rückgangs vorläufig behandelt werden sollte. Wir geben die Zahl weiter, weil sie gut belegt und breit aufgegriffen ist, aber sie ist eine Messung von außen, keine Bestätigung von OpenAI. Eine offizielle Erklärung gibt es bis heute nicht.
Zweitens ist der Effekt engine-spezifisch. In Googles AI Overviews ging Reddits Anteil im selben Zeitfenster um etwa 11 Prozent zurück, im AI Mode um rund 30 Prozent, in beiden Fällen allmählich. Die Kante gibt es nur bei ChatGPT. Wer also von "die KI zitiert Reddit nicht mehr" spricht, verallgemeinert eine Beobachtung an einem einzigen System.
Was Marken daraus lernen sollten
In den vergangenen zwei Jahren ist aus der Beobachtung, dass Sprachmodelle gern Foren zitieren, eine Taktik geworden: Präsenz auf Reddit aufbauen, Threads bespielen, dort sichtbar sein, wo die Modelle hinschauen. Diese Taktik hat in einer einzigen Woche einen erheblichen Teil ihrer Grundlage verloren.
Das Problem ist nicht, dass die Taktik falsch war. Das Problem ist, dass sie eine Taktik war und als Strategie behandelt wurde.
Quellenanteile schwanken nach Engine, nach Thema und nach dem Retrieval-System, das gerade eingesetzt wird. Sie sind eine Eigenschaft des Anbieters, nicht eine Eigenschaft Ihrer Marke. Alles, was Sie auf einer fremden Plattform aufbauen, hängt an einer Auswahlentscheidung, die jemand anders trifft, jederzeit ändern kann und Ihnen nicht erklären muss.
Was bleibt, wenn die Quellenauswahl kippt: die eigene Seite, die eigenen Produktdaten, belegte Aussagen, die auch dann noch stimmen, wenn sie über einen anderen Weg gefunden werden. Das ist unspektakulärer als ein Forenprofil, aber es gehört Ihnen.
Gleichzeitig erscheint ein Modell ohne Hersteller
Am 20. August erschien auf OpenRouter ein Modell namens Ox Alpha. Ein Kontextfenster von 1.048.576 Token, Eingaben als Text, Bild und Video, in der Vorschauwoche kostenlos. Was fehlte, war der Hersteller. Als Anbieter steht dort "stealth", und das Modell selbst antwortet auf die Frage nach seiner Herkunft, es sei von einer nicht offengelegten Organisation entwickelt worden.
Ein leistungsfähiges Modell, das man kostenlos in Produktionsnähe testen kann, findet schnell Nutzer. Die Frage, wessen Server dabei die Eingaben sehen, blieb offen.
Meta oder China?
Die Entwicklergemeinde hat das getan, was Entwickler tun: gemessen. Vier voneinander unabhängige Indizienklassen zeigen in dieselbe Richtung, nämlich auf die GLM-Familie von Z.ai, vormals Zhipu AI, konkret auf eine Variante von GLM-5.3.
Ein Tokenizer-Test traf in 95 von 95 Proben. Die API gibt exakt die Fehlertexte zurück, die Z.ai verwendet. Die Budgets für Video-Token entsprechen denen von GLM-5V-Turbo. Dazu kommen übereinstimmende Code-Stil-Merkmale. Ein Tokenizer ist deshalb so aussagekräftig, weil er beschreibt, wie ein Modell Text in Einheiten zerlegt, und das lässt sich kaum verstecken, ohne das Modell neu zu bauen.
Meta gilt nach denselben Spuren als unwahrscheinlich.
Und trotzdem: Das ist eine unabhängige Zuordnung, keine Bestätigung. Der Anbieter hat sich nicht geäußert, und solange das so ist, bleibt es eine sehr gut begründete Vermutung. Wir schreiben das ausdrücklich hin, weil der Unterschied zwischen "die Spuren zeigen dorthin" und "es ist bewiesen" genau der Unterschied ist, den wir in unseren eigenen Auswertungen auch machen.
Bemerkenswert am Rande: Es ist nicht das erste Mal. Ox Alpha ist das fünfte anonyme Modell mit Verbindungen zu chinesischen Laboren, das auf dieser Plattform aufgetaucht ist.
Nachtrag vom 31. August 2026: aufgelöst
Der Anbieter hat sich inzwischen geäußert. **Hinter Ox Alpha steht Zhipu, auch als Z.AI bekannt, aus Peking.** Bestätigt wurde es am 26. August gegenüber Bloomberg, es handelt sich um eine neue Iteration der GLM-Reihe, von Z.ai als GLM-5.3-Flash benannt. Anonym lief das Modell damit vom 20. bis zum 26. August, also sechs Tage.
Der oben stehende Absatz bleibt deshalb stehen, wie er ist. Wir haben die Zuordnung als sehr gut begründete Vermutung gekennzeichnet und nicht als Beweis. Sie hat sich als richtig erwiesen, aber der Unterschied war zum Zeitpunkt des Schreibens der richtige, und er bleibt es beim nächsten Mal.
Wie es herauskam, ist der eigentliche Punkt. Nicht durch eine Offenlegung, sondern durch Messen. Das Forschungsunternehmen CTGT nennt einen exakten Tokenizer-Treffer, elf von elf gegen den GLM-5.x-Wortschatz, und eine Temperatur-Obergrenze von exakt 1.0, was Google, OpenAI und xAI ausschließt und zu Zhipus dokumentiertem Bereich passt.
Dazu ein Befund, der die Sache rund macht: Ox Alpha trug laut CTGT einen System-Prompt, der dem Modell untersagte, etwas über seine Herkunft preiszugeben. Die Anonymität war kein Nebeneffekt einer frühen Vorschau, sondern eingebaut.
CTGT berichtet außerdem, das Modell sei bei bestimmten politischen Themen in seinem Antwortverhalten statistisch nicht von dem am stärksten zensierten Modell zu unterscheiden, das sie geprüft haben. Das ist deren Messung, nicht unsere, und wir geben sie als solche weiter. Für die Frage, ob man ein Modell in ein Produkt einbaut, gehört sie trotzdem auf den Tisch.
Und dann ging es schnell. Seit dem 30. August ist dasselbe Modell als GLM-5.3 Flash regulär über Cloudflare AI Search buchbar. Vom namenlosen Modell zum Baustein in fremder Infrastruktur in zehn Tagen.
Damit ist die Lehre dieses Artikels nicht widerlegt, sondern belegt. Sechs Tage lang haben Entwickler ein Modell nahe an der Produktion getestet, ohne zu wissen, wessen Server ihre Eingaben sehen. Dass es sich am Ende auflöste, war eine Entscheidung des Anbieters und kein Recht der Nutzer.
Die gemeinsame Geschichte
Auf den ersten Blick haben die beiden Vorgänge nichts miteinander zu tun. Auf den zweiten schon.
Bei Reddit ist nicht stabil, woher eine Antwort ihre Belege nimmt. Bei Ox Alpha ist nicht einmal bekannt, wer die Antwort erzeugt. In beiden Fällen ist die Ebene, auf der viele Unternehmen ihre KI-Strategie aufbauen, genau die Ebene, die sich ohne Vorwarnung ändern kann: die Plattform, die Quelle, der Modellname.
Daraus folgt kein Grund zur Panik, sondern eine ziemlich nüchterne Konsequenz. Was trägt, ist das, was Sie selbst belegen und selbst messen können:
Eigene, belegte Wissensbasis. Antworten, die aus Ihrem geprüften Material stammen und deren Herkunft nachvollziehbar ist, sind unabhängig davon, welches Modell gerade fragt. Genau dafür sind Buying Answers gebaut.
Messung statt Vermutung. Ob Ihre Marke in Antworten vorkommt, und wie sich das je Engine entwickelt, ist eine Messfrage. LLM Discovery Intelligence und Prompt Monitoring beobachten das laufend, statt einmal eine Stichprobe zu ziehen. Wer im Juli einen Nullpunkt erhoben hat, kann heute sagen, was der August mit ihm gemacht hat. Wer nicht, kann es nicht nachholen.
Prüfung, die nicht am Modell hängt. Ob eine Antwort stimmt, darf nicht davon abhängen, welches Modell sie erzeugt hat. Safe Guard hält veröffentlichte Antworten gegen Ihre Produktdaten und Ihre Regeln, das Test Center prüft das Verhalten, bevor Kunden es sehen. Bei einem Anbieter, dessen Herkunft ungeklärt ist, ist das keine Formalie.
Die Woche hat zwei Annahmen kassiert: dass eine gute Quelle eine gute Quelle bleibt, und dass man weiß, mit wem man spricht. Beides war nie garantiert. Neu ist nur, wie schnell es sich zeigen kann.
Quellen
Stell deine Frage zu Klariton.
Gegroundet in Klaritons eigenem Wissen, belegt statt erfunden.
Klariton ist eine Answer-Engine-Optimization-Plattform. Sie ergänzt deine bestehende Shop- oder Website, ohne etwas zu ersetzen oder Daten zu migrieren. Aus deinem eigenen Wissen entstehen geprüfte, quellenbasierte Antworten (BIQs), die AI-Assistenten und deine Besucher direkt nutzen.
Produkttexte, FAQs, Datenblätter, dein CMS oder Shop-Katalog. Klariton verarbeitet dein Material read-only und baut daraus belegte Antworten. Deine Daten werden nicht zum Modell-Training verwendet.
Alle AI-Aufrufe laufen EU-gehostet. Personenbezogene Daten werden vor jedem Aufruf pseudonymisiert. Klariton greift read-only auf deine Quellen zu und speichert keine Klartext-Kundendaten.
Jede Antwort ist quellenbelegt und durchläuft ein Review-Gate. Nichts wird ungeprüft veröffentlicht. Safe Guard überwacht veröffentlichte Antworten laufend gegen dein Material und meldet veraltete oder schwache Aussagen.
Nein. Klariton integriert sich in deine bestehende Seite, ohne Systemwechsel oder Migration. Ein Embed genügt, dein CMS bleibt die Quelle der Wahrheit.
Die Pläne skalieren mit Touchpoints und Antwortvolumen. Der AI-Visibility-Check ist kostenlos und ohne Anmeldung. Für den Rest sprich uns einfach an.
Wie sichtbar ist deine Marke für AI?
Der kostenlose AI-Visibility-Check zeigt dir in unter einer Minute, wie AI-Assistenten deinen Shop heute sehen.