Open data: de hele meting, openbaar
Dit is het eerste gratis, controleerbare AI-zichtbaarheidsdatabestand van Nederland. Alle 360 klantvragen uit de AI-Index, per vraag zeven meetmomenten, met per meting het letterlijke antwoord van het model en de genormaliseerde bedrijvenlijst. Geen selectie, geen bewerking achteraf: ook de 19 antwoorden waarin het model weigerde staan erin, gemarkeerd als ongeldig. Download het bestand en reken alles na.
De dataset in cijfers
Alles hieronder is nagerekend op de brontabel en komt exact zo terug in de bestanden. Er is niets afgerond en niets weggelaten.
Zo komt elk antwoord tot stand
Elk antwoord in de dataset is het resultaat van precies dezelfde bevraging: één model, één prompt, één instelling. Wie de vraag met dezelfde opzet herhaalt, krijgt vergelijkbare lijsten terug. De volledige verantwoording, stap voor stap, staat op de methodologiepagina.
Twee dingen moet je weten voordat je de historie leest
Ten eerste: de kolommen Maand -1 tot en met Maand -6 hebben geen eigen datum, alleen het actuele antwoord is gedateerd. Ten tweede: bij 184 van de 360 vragen staat in Maand -5 en Maand -6 exact hetzelfde antwoord, omdat die vragen nog geen zes echte metingen achter de rug hebben. Er zitten dus minder echte meetmomenten in de historie dan er kolommen zijn. We hadden dat kunnen wegpoetsen; het staat er bewust nog in.
Wat het model te zien krijgt
Boven elke vraag staat deze vaste instructie. De vraag zelf komt eronder, verder krijgt het model niets mee: geen context over ons, geen voorbeelden, geen webtoegang.
"Je bent een objectieve adviseur. Welke 10 Nederlandse bedrijven (of bedrijven actief in Nederland) raad je aan voor de onderstaande vraag? Geef als antwoord ALLEEN een komma-gescheiden lijst"
Van ruwe tekst naar telbare namen
Het model schrijft bedrijfsnamen niet consequent: Bol.com, bol.com en Bol.Com komen alle drie voor. Wie eerlijk wil tellen moet die varianten samenvoegen, en precies laten zien hoe. De regels staan gedocumenteerd in het exportscript en zijn samengevat simpel: we vergelijken namen zonder hoofdletters, accenten, spaties, koppeltekens en punten, en kiezen per groep de meest voorkomende spelling als weergavenaam. In de bestanden staat naast elke genormaliseerde lijst ook de onbewerkte antwoordtekst, zodat je onze keuzes kunt narekenen.
Eén grens trekken we bewust niet over: we voegen alleen spellingsvarianten samen, geen entiteiten
Capgemini en Capgemini Nederland tellen apart, want het model noemde ze apart. Zou je ze samenvoegen, dan leg je een interpretatie over de data heen die er niet in zit. De volledige normalisatieregel, met de gevolgen voor de ranglijst, staat in de methodologie.
Per branche: wie wordt het vaakst genoemd
Dit zijn tellingen, geen kwaliteitsoordelen. Per branche zie je de tien namen die het vaakst voorkomen in alle geldige antwoorden: 40 vragen maal 7 meetmomenten, maximaal 280 vermeldingen. Het kleine getal eronder is het actuele beeld: in hoeveel van de 40 vragen de naam in het laatste antwoord staat. Alles hieronder reken je zelf na met de CSV.
- 01Coolblue248nu 35/40
- 02MediaMarkt228nu 32/40
- 03Bol.com191nu 27/40
- 04BCC138nu 24/40
- 05Amazon.nl90nu 14/40
- 06Wehkamp78nu 12/40
- 07Expert73nu 13/40
- 08Blokker69nu 8/40
- 09HEMA62nu 7/40
- 10Action58nu 7/40
- 01IKEA232nu 30/40
- 02Leen Bakker198nu 29/40
- 03JYSK137nu 20/40
- 04Wehkamp131nu 18/40
- 05Kwantum118nu 14/40
- 06Bol.com112nu 17/40
- 07FonQ88nu 15/40
- 08Loods 567nu 13/40
- 09Beter Bed57nu 9/40
- 10Flinders57nu 7/40
- 01ANWB115nu 19/40
- 02BOVAG70nu 8/40
- 03AutoScout2466nu 7/40
- 04Autotrack66nu 8/40
- 05Vakgarage58nu 8/40
- 06CarNext55nu 5/40
- 07KwikFit50nu 8/40
- 08Bosch Car Service47nu 8/40
- 09Marktplaats47nu 7/40
- 10Euromaster42nu 7/40
- 01Zilveren Kruis54nu 6/40
- 02Erasmus MC52nu 9/40
- 03Menzis49nu 6/40
- 04VGZ49nu 5/40
- 05Amsterdam UMC46nu 9/40
- 06CZ44nu 6/40
- 07Radboudumc43nu 6/40
- 08LUMC39nu 7/40
- 09DSW37nu 4/40
- 10ONVZ36nu 3/40
- 01Microsoft110nu 14/40
- 02Exact64nu 8/40
- 03Salesforce52nu 6/40
- 04HubSpot49nu 7/40
- 05Teamleader47nu 6/40
- 06Google44nu 6/40
- 07monday.com44nu 5/40
- 08Zoho39nu 6/40
- 09Atlassian38nu 5/40
- 10AFAS37nu 7/40
- 01TheFork32nu 5/40
- 02Booking.com28nu 4/40
- 03Sligro28nu 5/40
- 04La Place27nu 4/40
- 05Bagels & Beans25nu 3/40
- 06Tripadvisor25nu 5/40
- 07Bidfood24nu 4/40
- 08OpenTable24nu 4/40
- 09Albert Heijn23nu 3/40
- 10Lightspeed22nu 3/40
- 01Dept186nu 25/40
- 02MediaMonks93nu 10/40
- 03OrangeValley92nu 13/40
- 04Traffic Builders63nu 9/40
- 05iProspect57nu 7/40
- 06Storm Digital51nu 6/40
- 07TBWA\NEBOKO45nu 7/40
- 08Valtech38nu 4/40
- 09Merkle36nu 5/40
- 10Mirabeau34nu 5/40
- 01Ordina144nu 20/40
- 02KPN109nu 16/40
- 03Accenture103nu 14/40
- 04Capgemini92nu 16/40
- 05Conclusion86nu 12/40
- 06Xebia86nu 13/40
- 07Capgemini Nederland71nu 8/40
- 08Deloitte65nu 11/40
- 09Deloitte Nederland63nu 8/40
- 10Accenture Nederland62nu 9/40
- 01PostNL115nu 19/40
- 02DB Schenker91nu 11/40
- 03Kuehne + Nagel89nu 12/40
- 04Active Ants65nu 10/40
- 05Montapacking63nu 9/40
- 06DHL Supply Chain57nu 9/40
- 07UPS56nu 5/40
- 08DSV55nu 7/40
- 09DPD53nu 5/40
- 10FedEx49nu 5/40
Wat deze data wel en niet zegt
Bij open data hoort een bijsluiter: dit is wat je wel en niet uit deze bestanden mag concluderen. Lees dit voordat je de ranglijsten ergens overneemt. Twijfel je ergens aan, reken het dan zelf na in de CSV: elke cel op deze pagina is daaruit te herleiden. De uitgebreide versie hiervan, inclusief hoeveel toeval er in een maandverschil zit, staat onder methodologie.
Drie bestanden, één licentie
Kies het formaat dat bij je gereedschap past. De CSV opent in Excel en Numbers, de JSON is voor code, en de summary is een kleine samenvatting met de tellingen per branche.
Je mag deze data kopiëren, bewerken en publiceren, ook commercieel, zolang je de bron vermeldt. Nette vorm: Bron: Nationale AI-Index 2026.1, theseo.nl (CC BY 4.0) met een link naar deze pagina. Dat nummer is de datasetversie; hij staat in het meta-blok van de JSON en in de laatste kolom van de CSV. Wat de licentie precies wel en niet dekt, en hoe je naar een uitgave verwijst, staat op de methodologiepagina. Journalisten en onderzoekers die vragen hebben over de methode mogen altijd mailen naar sales@theseo.nl.
Waarom we dit gratis publiceren
Er gaan veel cijfers rond over AI-zichtbaarheid. Percentages verloren verkeer, scores van 0 tot 100, ranglijsten zonder methode. Wij hebben daar zelf aan meegedaan: op de AI-Index-pagina stonden beweringen die we niet konden onderbouwen, en die hebben we er zichtbaar afgehaald. Deze open data is de volgende stap in dezelfde richting. Niet zeggen dat je meet, maar laten zien wat je meet.
Het bestand is bewust compleet
De weigeringen staan erin, de dubbele kolommen staan erin, de ruwe tekst staat naast elke genormaliseerde lijst. Wie een fout vindt in onze telling kan hem aanwijzen, en dat is precies de bedoeling. Een bewering die je niet kunt controleren is marketing; een bewering die je kunt narekenen is data.
Verdienen we hier iets aan
Indirect. Wie in deze lijsten zoekt naar zijn eigen naam en hem niet vindt, wil meestal weten waarom. Dat uitzoekwerk is het merkrapport van 75 euro, en de weg ernaartoe begint bij een site die op orde is, te beginnen met een gratis SEO-scan. Het bestand zelf blijft gratis, ook als je nooit klant wordt. Data die je pas krijgt na een formulier is geen open data.
Zo werk je praktisch met de bestanden
De CSV opent direct in Excel, Numbers of Google Sheets. Elke regel is een meting: een vraag op een meetmoment. Voor alleen het actuele beeld filter je de kolom meetmoment op 0. Benieuwd hoe stabiel een naam is? Filter dan op de kolom bedrijven_genormaliseerd en tel in hoeveel van de zeven meetmomenten van dezelfde vraag de naam terugkomt. De kolom geldig staat op nee bij de 19 weigeringen; laat die regels buiten elke telling, precies zoals wij doen.
Elke regel in de CSV draagt achteraan de kolom datasetversie
Die staat er zodat een losgeknipte regel of een tabel die je zelf samenstelt nog steeds zegt uit welke uitgave hij komt. Wat de versie betekent en hoe hij doortelt staat op de methodologiepagina.
Voor code is de JSON handiger
Het meta-blok bovenin bevat het dataset-ID, de versie, de publicatiedatum, de meetperiode, het model, de letterlijke prompt, de meetcyclus en de aantallen, zodat je publicatie de methode kan citeren zonder deze pagina over te tikken. Daaronder staan dezelfde 2.520 metingen als records, met de bedrijvenlijst als echte array. Een voorbeeld: alle geldige actuele antwoorden van een branche pak je met een filter op meetmoment == 0 en geldig == true.
Twee valkuilen die we je willen meegeven
Vergelijk nooit een enkele maandkolom met een andere en trek daar een conclusie uit, want met temperature 1 zit er toeval in elk antwoord; tel over alle meetmomenten heen. En behandel de kolommen Maand -5 en Maand -6 voorzichtig, want bij 184 vragen zijn ze identiek en tellen ze dezelfde meting dubbel. Wie streng wil rekenen laat Maand -6 weg en houdt zes zekere meetmomenten over.
Veelgestelde vragen
Wat zit er precies in de dataset?
Alle 360 vragen uit de negen branchelijsten, elk met zeven meetmomenten: het actuele antwoord met datum en zes bewaarde eerdere antwoorden. Per meting staat de ruwe antwoordtekst erin, de genormaliseerde bedrijvenlijst, het model en of de meting geldig is. Dat zijn 2.520 regels.
Mag ik deze data gebruiken in eigen publicaties?
Ja. De data valt onder CC BY 4.0. Je mag hem kopiëren, bewerken en publiceren, ook commercieel, zolang je theseo.nl als bron vermeldt. Een link naar deze pagina is de nette vorm.
Waarom verschillen de antwoorden per maand soms zo sterk?
We bevragen het model met temperature 1, de standaardinstelling waarmee het ook in gewone chatgesprekken antwoordt. Daardoor zit er toeval in elk antwoord: dezelfde vraag kan een maand later drie andere namen opleveren zonder dat er iets veranderd is. Kijk daarom naar hoe vaak een naam over alle metingen terugkomt, niet naar een enkele verschuiving.
Waarom zijn Maand -5 en Maand -6 vaak identiek?
Bij 184 van de 360 vragen staat in Maand -5 en Maand -6 exact hetzelfde antwoord. Die vragen hebben nog geen zes echte metingen achter de rug; bij het vullen van de tabel is het oudste antwoord toen gekopieerd. Er zitten dus minder echte meetmomenten in de historie dan er kolommen zijn. We laten het staan zoals het is, zodat je het zelf kunt zien.
Wat betekent geen geldige meting?
In 19 van de 2.520 antwoorden weigerde het model een lijst te geven of stelde het een tegenvraag, vooral bij zorgvragen waar het geen namen zonder verificatie wilde noemen. Die cellen staan er wel in, met de volledige tekst, maar zijn gemarkeerd als ongeldig en tellen niet mee in de ranglijsten.
Is dit wat ChatGPT ook tegen consumenten zegt?
Niet precies. We bevragen gpt-5-mini via de API, zonder webzoeken en zonder geheugen. ChatGPT met webzoeken, Gemini of Perplexity kunnen andere namen geven. Dit meet wat er in het model zelf zit, en juist dat is de laag waar je met je zichtbaarheid iets aan kunt doen.
Hoe zijn de bedrijfsnamen genormaliseerd?
Spellingvarianten zijn samengevoegd: Bol.com, bol.com en Bol.Com tellen als een naam. We vergelijken zonder hoofdletters, accenten, spaties, koppeltekens en punten, en kiezen de meest voorkomende spelling als weergavenaam. We voegen geen entiteiten samen: Capgemini en Capgemini Nederland blijven apart, want het model noemde ze apart. De regels staan gedocumenteerd in het exportscript en zijn volledig uitgeschreven op de methodologiepagina, samen met wat die keuze voor de ranglijst betekent.
Waarom geven jullie dit gratis weg?
Omdat beweringen over AI-zichtbaarheid controleerbaar horen te zijn. Er gaan veel cijfers rond zonder bron, wij hebben daar zelf aan meegedaan en dat rechtgezet. Wil je weten hoe jouw bedrijf er in deze data uitkomt, dan zoeken we dat voor 75 euro voor je uit in een merkrapport. De data zelf blijft gewoon gratis.
Sta jij erin?
Zoek je eigen naam op in de CSV. Sta je erin, dan is de vraag hoe stabiel, en sta je er niet in, dan is de vraag waarom niet. Beide vragen zoeken we voor je uit in het merkrapport: de hele vragenlijst van jouw branche, jouw naam geteld, en een volgorde van wat je eraan doet. Wil je eerst zelf kijken, dan is alles op deze pagina gratis en zonder account te downloaden.