geony.
Die Methode

Etwas messen, das jedes Mal anders antwortet

Stelle ChatGPT dreimal dieselbe Frage und du bekommst drei verschiedene Antworten. Das macht KI-Sichtbarkeit zu einem Stichprobenproblem, und genau so behandeln wir es.

1. Jede Frage, mehrere Ziehungen

Eine Messung ist eine Momentaufnahme eines Systems, das rät. Geony stellt jede Frage standardmäßig dreimal pro Messrunde, an jeden Assistenten einzeln, und speichert jede Ziehung separat. Im Bildschirm siehst du deshalb Punkte pro Ziehung und keine weggemittelte Zahl: "2 von 3" und "67%" sind dieselbe Zahl, aber die erste zeigt, wie schmal die Basis ist.

2. Jeder Prozentsatz trägt ein Wilson-Intervall

Bei jedem Präsenzprozentsatz zeigen wir das 95%-Konfidenzintervall (Wilson score), dieselbe Statistik, die medizinische Studien für kleine Stichproben nutzen. Drei Messungen mit einem Treffer sind "33% (6 – 79%)", und diese Bandbreite ist keine Schwäche, sondern die Wahrheit. Je mehr Messungen, desto schmaler das Band.

Probier es selbst: 36% genannt, aber wie sicher weißt du das?

9 Messungen
0%100%

Bei 9 Messungen liegt die tatsächliche Sichtbarkeit mit 95% Sicherheit zwischen 14% und 67%: so breit, dass die Zahl fast nichts sagt. Ein einzelner Check ist das.

3. Der Alarm schweigt bei Überlappung

Ein Rückgang von 56% auf 22% klingt alarmierend. Aber wenn sich die Intervalle überlappen, lässt sich der Unterschied nicht vom Zufall trennen, und dann senden wir keinen Alert. Das kommt direkt aus unserer eigenen Messgeschichte: derselbe Rückgang trat an einem einzigen Tag auf, gleiche Konfiguration, und war Rauschen. Ein Tool, das darauf Alarm schlägt, trainiert dich, Alarme zu ignorieren.

4. Assistenten getrennt, nie nur der Durchschnitt

In unseren Messungen erschien dieselbe Marke in 36% der Claude-Antworten, 5% bei ChatGPT und 1% bei Gemini. Der Durchschnitt daraus (14%) beschreibt keinen einzigen Assistenten. Deshalb bekommt jeder Assistent eine eigene Spalte mit einem eigenen Intervall, und auch das Alerting wird pro Assistent bewertet: eine Marke kann bei einem Assistenten völlig verschwinden, während der Durchschnitt nichts zeigt.

5. Quellen aus den Metadaten, nicht aus dem Fließtext

Welche Quellen eine Antwort zitiert, lesen wir aus den strukturierten Zitierdaten des Assistenten selbst. Ein Sprachmodell, das im Fließtext URLs nennt, erfindet sie regelmäßig; Metadaten nicht. Jede Quelle in Geony ist damit auf eine echte Antwort in einem echten Moment zurückführbar.

6. Was wir nicht tun

Wir zeigen keine Sentiment-Scores, solange wir sie nicht gegen einen validierten Satz beweisen können. Wir berichten keine Trends auf zu wenig Daten; unter der Schwelle schweigt das System lieber, als dass es rät. Und wir schreiben keine "KI-optimierten Inhalte" für dich: wir zeigen, welche Quellen die Antwort bestimmen, die Arbeit bleibt die Arbeit.

Innerhalb eines Tages weißt du, ob KI deine Marke nennt oder ignoriert

Die erste Messung läuft mit deinen eigenen Prompts, über drei Assistenten, mit echten Zahlen. Keine Demo-Daten, kein Vertriebsgespräch vorab.

Lieber erst kurz besprechen? Ein Gespräch vereinbaren