AI-vindbaarheid: gevonden en geciteerd worden door AI
AI-vindbaarheid is de mate waarin AI-assistenten zoals ChatGPT, Gemini, Claude en Perplexity de informatie op je website kunnen bereiken, begrijpen en als bron gebruiken in hun antwoorden. Het omvat technische toegang, inhoud die echte klantvragen beantwoordt en controleerbaar bewijs. Een vermelding of citatie is nooit gegarandeerd, maar je kunt haar wel meten.
Door Enrico Clein, oprichter van WebMCP.nl.
Hoe AI-assistenten bronnen kiezen
Er bestaat geen openbare formule die voor alle AI-assistenten bepaalt welke bron in een antwoord belandt. Wel weet je een paar dingen zeker. Ten eerste kan een assistent alleen gebruiken wat hij kan bereiken en lezen. Ten tweede moet je pagina de vraag van de gebruiker echt beantwoorden. En ten derde verschilt het gedrag per dienst, taal, product en per keer dat de vraag wordt gesteld.
Voor Googles AI Overviews en AI Mode is de basis gedocumenteerd. Volgens Google Search Central moet een pagina geïndexeerd zijn en in aanmerking komen voor een zoekresultaat met snippet. Google verlangt daarvoor geen speciaal AI-tekstbestand en geen nieuwe schema-markup. Dat betekent niet dat opname gegarandeerd is, en Googles toelichting zegt niets over het gedrag van andere AI-producten. Onderzoek een andere assistent volgens diens eigen documentatie.
Ontbreekt je merk in een AI-antwoord, dan is dat een signaal, geen diagnose. Een merk kan ontbreken omdat de vraag niet bij je aanbod past, omdat het antwoord helemaal geen merken noemt, of omdat andere bronnen beter aansluiten. De conclusie ‘AI kan onze site niet lezen’ volgt niet uit één antwoord. Leg daarom eerst tien concrete klantvragen vast: vragen die iemand vóór een aankoop of aanvraag echt stelt, over een toepassing, beperking, alternatief of prijsopbouw. Noteer per vraag welke pagina van je site een nuttig, controleerbaar antwoord geeft. Ontbreekt die pagina, dan heb je een inhoudelijk probleem gevonden voordat je iets over ranking hoeft te beweren. Zo onderzoek je waarom je niet genoemd wordt.
Wat inhoud citeerbaar maakt
Wie in één gegenereerd antwoord als bron wil verschijnen, heeft baat bij inhoud die zich laat citeren: korte, feitelijke antwoorden op concrete vragen, voorwaarden en beperkingen die er eerlijk bij staan, een rekenvoorbeeld waar dat helpt en verwijzingen naar controleerbare bronnen. Een auteursnaam en een eerlijke wijzigingsdatum helpen de lezer de herkomst en actualiteit te beoordelen. Gebruik ze niet als belofte van meer citaties, en laat een datum niet automatisch verspringen als de inhoud niet veranderd is.
Technische signalen die je zelf beheert
De technische kant van AI-vindbaarheid is het deel dat je volledig in eigen hand hebt. Het garandeert geen vermelding, maar een fout hier kan wel elke inhoudelijke inspanning tenietdoen.
1. robots.txt: laat de juiste AI-crawlers toe
AI-diensten gebruiken eigen user-agents, vaak meerdere per dienst: een voor training, een voor de zoekindex en een voor het ophalen van een pagina op verzoek van een gebruiker. Wie er per ongeluk een blokkeert, maakt zijn pagina's voor dat kanaal onbereikbaar. Deze user-agents laten wij in onze eigen robots.txt expliciet toe:
| Assistent | User-agents |
|---|---|
| ChatGPT / OpenAI | GPTBot, OAI-SearchBot, ChatGPT-User |
| Claude / Anthropic | ClaudeBot (training), Claude-SearchBot (zoekindex), Claude-User (ophalen op verzoek) |
| Gemini / Google | Google-Extended (Googles AI-control; géén aparte GeminiBot) |
| Perplexity | PerplexityBot, Perplexity-User |
| Mistral (Le Chat) | MistralAI-User |
| Apple Intelligence | Applebot-Extended |
| Common Crawl / Cohere | CCBot, cohere-ai |
Of je training wilt toestaan, is een eigen afweging; zoek- en ophaalcrawlers blokkeren betekent in elk geval dat die assistent je pagina niet live kan lezen. Controleer ook noindex-instructies: in onze scan weegt noindex zwaar mee, omdat een uitgesloten pagina nergens als bron kan dienen.
2. Inhoud die zonder JavaScript leesbaar is
AI-crawlers renderen meestal geen JavaScript. Wat pas ná het uitvoeren van scripts op de pagina verschijnt, bestaat voor hen niet. Render je kerntekst daarom server-side (SSR of statisch), met één <h1> per pagina, lang="nl" op het <html>-element, gelabelde formuliervelden en alt-teksten op afbeeldingen. Test het simpel: bekijk de broncode of schakel JavaScript uit en kijk of je antwoorden er nog staan.
3. Structured data
Schema.org in JSON-LD helpt machines begrijpen wat een pagina is: een organisatie, een product, een artikel of een veelgestelde vraag. Plaats minimaal Organization en WebSite, plus het type dat bij de pagina past, zoals Product, Article of FAQPage, en controleer het met validator.schema.org. Zet structured data in de server-HTML, niet alleen via JavaScript. Onthoud wel: voor Googles AI-functies is geen nieuwe schema-markup vereist. Structured data is een duidelijke beschrijving, geen toegangskaartje.
4. llms.txt: optioneel, geen rankingfactor
llms.txt is een voorstel voor een tekstbestand dat bruikbare informatie en documentatie aanwijst. Het is een voorstel, geen standaard. Google Search heeft het niet nodig: voor AI Overviews en AI Mode noemt Google Search Central geen speciaal AI-tekstbestand. Je kunt het publiceren als goedkope, extra ingang naar je kernpagina's, zoals wij zelf doen, maar behandel het niet als bewezen rankingfactor. Ook Lighthouse controleert alleen of het bestand aanwezig is, niet of het je zichtbaarheid verbetert.
Meten: drie uitkomsten, niet één score
AI-vindbaarheid meet je niet met één getal. Houd drie uitkomsten uit elkaar, want elk bewijst iets anders:
| Uitkomst | Wat leg je vast? | Wat bewijst het niet? |
|---|---|---|
| Merkvermelding | Wordt het juiste merk genoemd, en in welke context? | Dat de assistent jouw site heeft gebruikt |
| Bronverwijzing | Welke concrete pagina wordt gelinkt? | Dat iemand doorklikt of klant wordt |
| Bezoek en resultaat | Herkenbare verwijzingen en relevante acties op je site | Dat alle AI-invloed meetbaar is |
Herhaal dezelfde vragen op meerdere momenten en noteer datum, product, taal en of zoeken aan stond. Bewaar antwoorden of schermafbeeldingen. Rapporteer het resultaat als uitkomst van deze steekproef, niet als ‘ons aandeel in alle AI-antwoorden’. En een verandering na een site-update bewijst nog niet dat die update de oorzaak was.
Voor de technische kant is er de gratis AI-Ready Scan. De gratis AI-Ready Check meet je website in 8 categorieën. Je krijgt je technische score en een korte samenvatting. Eén categorie gaat specifiek over AI-vindbaarheid (AEO/GEO): crawlerbeleid, titels, korte antwoorden, auteursvermelding, datums, bronverwijzingen en beslispagina's voor koopvragen. Hoe elke check werkt en weegt, staat in de openbare methodiek. Belangrijk: de scan meet technische signalen, niet of een AI-assistent je bedrijf daadwerkelijk noemt. Als een meting per AI-systeem is afgesproken, leggen we de gekozen systemen, vragen, markt, taal en meetmomenten vast. Het resultaat bevat de daadwerkelijk verkregen antwoorden en eventuele bronverwijzingen. Een technische scanscore vervangt die meting niet; vermeldingen of citaties zijn niet gegarandeerd.
Verbeteren: klein, onderbouwd, herhaalbaar
Kies één pagina waar een relevante klantvraag onvoldoende wordt beantwoord. Voeg bijvoorbeeld voorwaarden, een concreet rekenvoorbeeld, een heldere beperking of een controleerbare bron toe. Schrijf op wat je aanpast en welke vraag daardoor beter beantwoord moet worden, en meet daarna opnieuw met dezelfde opzet. Zo bouw je kennis op over wat voor jouw markt werkt, in plaats van een lijst algemene tips af te vinken.
Wil je dat wij dit uitvoeren? Bij GEO- en AEO-optimalisatie maken we je bedrijfsprofiel helder en voeren we de afgesproken prioriteitsverbeteringen uit, met vooraf vastgelegde scope en meting.
Van vindbaar naar bruikbaar
AI-vindbaarheid gaat over de vraag of een assistent je informatie vindt en gebruikt. De volgende laag is de vraag of een agent bij jou ook iets kan doen: een afspraak plannen, een offerte aanvragen, een bestelling voorbereiden. Daarvoor is WebMCP bedoeld, een voorgestelde webstandaard waarmee je site functies als tools aanbiedt aan browser-agents.
Die lagen vervangen elkaar niet. Een betere boekingstool lost een ontbrekend antwoord over annuleringsvoorwaarden niet op, en een goed antwoord maakt je nog niet bedienbaar. Maak eerst de informatie goed; onderzoek daarna of je bezoeker ook een taak met een agent wil uitvoeren. Het verschil tussen llms.txt, MCP en WebMCP staat op onze vergelijkingspagina.