Wir sprechen von „der KI“ als einem Block. Aber stellen Sie ChatGPT, Gemini, Claude und Perplexity dieselbe Frage: Sagen sie dasselbe über Ihre Marke? Wir haben es gemessen. Die Antwort ist nein — und der Abstand ist groß.
Der Geltungsbereich
Wir haben 617 Fragen genommen, jede an mehrere Modelle parallel gestellt (im Schnitt 4,3 Modelle: ChatGPT, Claude, Gemini, Perplexity u. a.), in echten Audits. Für jede Antwort messen wir, ob die auditierte Marke tatsächlich erscheint (Entitätserkennung im erzeugten Text). Dann prüfen wir Frage für Frage, ob die Modelle übereinstimmen.
Der Befund
Bei fast jeder vierten Frage nennt mindestens ein Modell die Marke und mindestens ein anderes nicht — bei exakt derselben Frage. Anders gesagt: Ihre Sichtbarkeit ist keine stabile Eigenschaft, sondern eine Variable, die vom befragten Modell abhängt.
Warum KIs auseinandergehen
Drei Gründe wirken zusammen. Erstens hat jedes Modell ein anderes Trainingsgedächtnis, zu einem anderen Datum eingefroren: Was das eine über Sie „weiß“, ignoriert das andere. Zweitens surfen manche Modelle im Web und andere antworten aus dem Gedächtnis — zwei verschiedene Markenbilder (wir haben 7 Punkte Unterschied in unserem Barometer gemessen). Drittens schöpfen sie nicht aus denselben Quellen: LinkedIn, Wikipedia, Bewertungen, Register wiegen je nach Modell unterschiedlich (siehe unsere Studie zu den Quellen).
Was das bedeutet
Ein Sichtbarkeits-Audit auf einem einzigen Modell misst eine von vier Realitäten. Sich „sichtbar auf ChatGPT“ zu nennen sagt nichts über Gemini, Claude oder Perplexity — und Ihre Kunden nutzen zufällig das eine oder andere. Genau deshalb fragen wir 50+ Modelle ab und denken in Verteilungen, mit Konfidenzintervallen, statt in einer einzigen Zahl. Die Methode ist öffentlich auf unserer Methodik-Seite, und das Observatorium verfolgt diese Zahlen über die Zeit.
Die Grenzen dieser Zahlen
Diese Daten stammen von Marken, die sich auditieren ließen — keine repräsentative Stichprobe. „Uneinigkeit“ bezieht sich auf die Präsenz (Marke erscheint oder nicht), nicht auf den Wortlaut. Die Raten ändern sich mit jedem Modell-Update.
Sie möchten wissen, auf welchen Modellen Sie erscheinen — und auf welchen Sie unsichtbar sind? Genau das misst ein Audit, Modell für Modell.
Jede Frage an ChatGPT ohne Ihren Namen in der Antwort ist ein Wettbewerber, der an Ihrer Stelle empfohlen wird — gemessen an 6 820 echten KI-Antworten.