Je hebt het vast al eens gedaan: ChatGPT geopend en gevraagd "welke bedrijven zijn goed in [jouw vak]?" om te kijken of je erbij staat. Logische reflex, en als meetinstrument vrijwel waardeloos. Niet omdat het antwoord fout is, maar omdat één antwoord niets zegt.

Hetzelfde model, drie antwoorden

AI-assistenten gokken. Letterlijk: er zit bewust toeval in hoe ze hun volgende woord kiezen, want anders zouden alle antwoorden houterig en identiek zijn. Stel dezelfde vraag drie keer en je krijgt drie verschillende lijstjes. In onze metingen komt het voortdurend voor dat een merk in trekking één en drie genoemd wordt en in trekking twee niet.

Eén losse vraag aan ChatGPT heeft dezelfde bewijskracht als één muntworp over de vraag of een munt eerlijk is.

Wie op basis van één antwoord concludeert "we staan erin!" of erger, "we zijn eruit gevallen!", stuurt op ruis. We zagen in onze eigen meetgeschiedenis een merk op één dag van 56% naar 22% gaan, zelfde vragen, zelfde instellingen, en de volgende meting stond het er gewoon weer. Dat was geen daling; dat was toeval.

En je vergeet twee derde van het speelveld

ChatGPT is niet de enige assistent waar je klanten hun vragen stellen. Gemini zit in elke Google-omgeving, Claude groeit hard in zakelijke omgevingen. En die drie zijn het onderling opvallend oneens: in onze vergelijkende meting verscheen hetzelfde merk in 36% van de Claude-antwoorden, 5% bij ChatGPT en 1% bij Gemini.

Wie alleen in ChatGPT kijkt en daar niets vindt, kan bij Claude marktleider zijn, en andersom. Zonder alle drie te meten weet je simpelweg niet waar je staat.

Hoe je het wél meet

Betrouwbaar meten is geen magie, het is discipline:

1. Stel de vragen die klanten echt stellen. Niet "wat vind je van [merk]" maar "welk bureau kies ik voor een bedrijfsvideo?", de vraag wanneer er nog niets gekozen is. Dat is het moment waarop zichtbaarheid geld waard is.

2. Stel elke vraag meerdere keren. Drie keer is het minimum waarop je überhaupt iets kunt zeggen; meer is beter. En bewaar elke trekking apart, zodat je ziet hoe stabiel het beeld is.

3. Reken met een betrouwbaarheidsinterval. "Genoemd in 2 van de 3 antwoorden" is met 95% zekerheid ergens tussen de 21% en 94%. Die bandbreedte voelt onbevredigend en is precies wat drie metingen waard zijn. Pas na weken meten wordt de band smal genoeg om trends te zien.

4. Herhaal het wekelijks. Zichtbaarheid is geen foto maar een film. De vraag is niet alleen "sta ik erin" maar "beweegt het, en aantoonbaar?"

De kortste route

Dit kan handmatig: drie assistenten, tien vragen, drie keer per week, turven in een spreadsheet. Dat is negentig chats per week bijhouden. Of je laat het meten. Geony doet exact het bovenstaande, elke week, met een interval op elk cijfer en elke bron herleidbaar tot het echte antwoord.