Du hast es bestimmt schon einmal getan: ChatGPT geöffnet und gefragt "welche Unternehmen sind gut in [dein Fach]?", um zu sehen, ob du dabei bist. Ein logischer Reflex und als Messinstrument nahezu wertlos. Nicht, weil die Antwort falsch ist, sondern weil eine Antwort nichts aussagt.

Dasselbe Modell, drei Antworten

KI-Assistenten würfeln. Wörtlich: In der Wahl ihres nächsten Wortes steckt bewusst Zufall, denn sonst wären alle Antworten hölzern und identisch. Stell dieselbe Frage dreimal und du bekommst drei verschiedene Listen. In unseren Messungen kommt es ständig vor, dass eine Marke in Ziehung eins und drei genannt wird und in Ziehung zwei nicht.

Eine einzelne Frage an ChatGPT hat dieselbe Beweiskraft wie ein einziger Münzwurf für die Frage, ob eine Münze fair ist.

Wer aus einer Antwort schließt "wir sind drin!" oder schlimmer "wir sind rausgeflogen!", steuert nach Rauschen. In unserer eigenen Messhistorie sahen wir eine Marke an einem Tag von 56% auf 22% fallen, gleiche Fragen, gleiche Einstellungen, und bei der nächsten Messung war sie einfach wieder da. Das war kein Rückgang; das war Zufall.

Und du vergisst zwei Drittel des Feldes

ChatGPT ist nicht der einzige Assistent, dem deine Kunden ihre Fragen stellen. Gemini steckt in jeder Google-Umgebung, Claude wächst stark in geschäftlichen Umgebungen. Und diese drei sind sich untereinander auffällig uneinig: In unserer vergleichenden Messung erschien dieselbe Marke in 36% der Claude-Antworten, 5% bei ChatGPT und 1% bei Gemini.

Wer nur in ChatGPT schaut und dort nichts findet, kann bei Claude Marktführer sein, und umgekehrt. Ohne alle drei zu messen, weißt du schlicht nicht, wo du stehst.

Wie du es richtig misst

Zuverlässig zu messen ist keine Magie, es ist Disziplin:

1. Stell die Fragen, die Kunden wirklich stellen. Nicht "was hältst du von [Marke]", sondern "welche Agentur wähle ich für ein Unternehmensvideo?", die Frage, wenn noch nichts gewählt ist. Das ist der Moment, in dem Sichtbarkeit Geld wert ist.

2. Stell jede Frage mehrmals. Dreimal ist das Minimum, auf dem du überhaupt etwas sagen kannst; mehr ist besser. Und speichere jede Ziehung einzeln, damit du siehst, wie stabil das Bild ist.

3. Rechne mit einem Konfidenzintervall. "Genannt in 2 von 3 Antworten" liegt mit 95% Sicherheit irgendwo zwischen 21% und 94%. Diese Bandbreite fühlt sich unbefriedigend an und ist genau das, was drei Messungen wert sind. Erst nach Wochen des Messens wird das Band schmal genug, um Trends zu sehen.

4. Wiederhole es wöchentlich. Sichtbarkeit ist kein Foto, sondern ein Film. Die Frage ist nicht nur "bin ich drin", sondern "bewegt es sich, und nachweisbar?"

Der kürzeste Weg

Das geht von Hand: drei Assistenten, zehn Fragen, dreimal pro Woche, in einer Tabelle Strichliste führen. Das bedeutet, neunzig Chats pro Woche zu verfolgen. Oder du lässt es messen. Geony macht genau das oben Genannte, jede Woche, mit einem Intervall auf jeder Zahl und jeder Quelle rückverfolgbar bis zur echten Antwort.