Heb je llms.txt nodig? Wat de cijfers zeggen.

AI & Vindbaarheid

Kort antwoord: Nee, en dat is niet langer een mening. Ahrefs keek naar de serverlogs van 137.210 domeinen en stelde vast dat 97% van de bestaande llms.txt-bestanden in mei 2026 geen enkele aanvraag kreeg, van bots noch van mensen. Het bestand kost je twee uur en wordt in de praktijk niet opgevraagd, dus de vraag is vooral wat je met diezelfde twee uur beter doet.

Wat is een llms.txt precies?

Het is een eenvoudig tekstbestand dat je in de hoofdmap van je site zet, dus op dezelfde plek als je robots.txt. Waar robots.txt zegt welke bots waar mogen komen, doet llms.txt iets anders: het is bedoeld als een leeswijzer voor taalmodellen. Je zet er in gewone opmaaktaal in wat je site aanbiedt, welke pagina's ertoe doen en waar ze staan, zodat een model niet door je menu, je scripts en je opmaak hoeft te ploeteren om te vinden waar het om gaat.

Het idee komt van Jeremy Howard, die het in 2024 voorstelde en er in augustus 2026 een tweede versie van publiceerde. Het probleem dat hij wil oplossen is echt: een webpagina is gebouwd voor een mens die kijkt, niet voor een machine die leest, en het nuttige deel zit verstopt tussen navigatie en techniek. Een gecureerd lijstje zou dat werk overbodig maken.

En het is bepaald geen randverschijnsel. OpenAI, Anthropic en Google publiceren zelf een llms.txt bij hun ontwikkelaarsdocumentatie, en Chrome controleert in zijn eigen kwaliteitstest of je site er een heeft. Daar zit alleen een addertje dat het hele artikel draagt: een bestand publiceren is iets anders dan er een opvragen. De vraag is niet of grote partijen het bestand kennen, maar of hun crawlers dat van jou ophalen.

Cocoon Productions · Uit de serverlogs
Wat er echt met llms.txt gebeurt
1
137.210 domeinen doorgelicht
Niet gevraagd aan de eigenaars en niet afgeleid uit een tool, maar rechtstreeks uit het verkeer en de botlogs van die domeinen.
2
Ongeveer 38.000 hadden een geldig bestand
Dat is een kleine kwart van het geheel, en het zijn precies de sites die de moeite namen. Zij vormen de meting.
3
97% daarvan kreeg geen enkele aanvraag
In de hele maand mei 2026, van geen enkele bot en van geen enkele bezoeker. Niet zelden opgevraagd, maar nul keer.
Ahrefs, 15 juni 2026, op basis van hun eigen verkeers- en botanalyse. Let op wat de 97% precies is: het aandeel van de bestanden die er staan, niet van alle onderzochte domeinen. Dat maakt het cijfer eerder strenger dan milder, want het gaat over de sites die het wél deden.

Waarom wordt het dan niet opgehaald?

Omdat het een voorstel is en geen afspraak. Niemand heeft zich verbonden om het bestand op te vragen, en een leeswijzer die niemand openslaat, doet niets. Dat klinkt hard, maar het is precies de reden waarom het advies zo lang overeind bleef: zolang niemand in de logs keek, kon je het niet weten, en dus bleef iedereen elkaar napraten dat het wel zou helpen.

Nu heeft iemand het wel gedaan, en de uitkomst is niet voor tweeërlei uitleg vatbaar. Het bestand wordt aangemaakt, maar niet opgehaald. Eerlijkheidshalve: het Nederlandse taalgebied doet het op dit punt beter dan je zou verwachten. De artikels die hier bovenaan staan, komen ook tot een voorzichtige conclusie in plaats van tot een aanbeveling.

Hoeveel Nederlandse sites hebben er een?

Bij de vijfhonderd grootste Nederlandse domeinen heeft 8,2% een llms.txt, gemeten op 1 augustus 2026. In juni was dat nog 6,6%, dus het aantal groeit gestaag. Van de 392 sites die te bereiken waren, gaat het om ongeveer tweeëndertig bestanden.

Leg je die twee metingen naast elkaar, dan kom je op een schatting die niemand tot nu toe maakte. Van die tweeëndertig Nederlandse bestanden zou er, aan een aanvraagpercentage van drie procent, ongeveer één ooit opgehaald zijn. Neem dat voor wat het is: twee metingen uit verschillende bronnen op elkaar gelegd, dus een orde van grootte en geen telling. Maar het is wel de eerste keer dat iemand dat cijfer voor Nederland uitrekent.

Cocoon Productions · Dezelfde twee uur
Wat je in de plaats doet
Dit wordt wel gelezen
  • Je prijs en je levertermijn als tekst op de productpagina.
  • Structured data, waar bijna de helft van de Nederlandse top-500 er geen heeft.
  • Het antwoord op de koopvraag in de eerste schermvulling, niet in de laatste alinea.
  • Dit werk helpt ook je bezoeker, en dat doet een llms.txt niet.
Dit blijft liggen
  • Het bestand aanmaken en er een structuur voor bedenken.
  • Het bijhouden telkens je site verandert, want anders wijst het naar pagina's die er niet meer zijn.
  • Uitleggen aan wie ernaar vraagt waarom het er staat.
  • Twee uur die je maar één keer kan uitgeven.
Dit is geen pleidooi tegen het bestand, wel tegen de volgorde. Wie llms.txt bovenaan zijn lijstje zet terwijl zijn prijzen in een afbeelding staan, lost het verkeerde probleem op.

Wanneer is het dan wel zinvol?

Op drie momenten, en het is nuttig om die te kennen zodat dit artikel geen dogma wordt. Zet het bestand er gerust neer als het je letterlijk tien minuten kost omdat je platform het aanbiedt, want dan valt er niets af te wegen. Doe het ook als je documentatie of een kennisbank hebt waar de structuur echt hulp gebruikt, want daar is de wegwijzer het meest waard.

En zet het erop als je het als een weddenschap ziet in plaats van als een maatregel. Het kan volgend jaar wel opgehaald worden, en dan heb je het al staan. Alleen: houd het dan ook bij, want een wegwijzer die naar verdwenen pagina's wijst, is slechter dan geen wegwijzer.

Wat je vandaag zeker eerst doet, is nakijken of je productpagina overweg kan met een machine die niets uitvoert. Dat staat in is je productpagina leesbaar voor AI, met twaalf punten en drie controles. En wil je de volgorde van dit soort werk op je eigen cijfers laten uitrekenen, dan doet de E-Commerce Agent Workflow dat.

Veelgestelde vragen over llms.txt

Schaadt het als je er toch een zet?

Nee, zolang je hem bijhoudt. Een bestand dat naar pagina's wijst die verdwenen zijn of dat een oude structuur beschrijft, geeft een verkeerd beeld van je site. Dat is het enige echte risico, en het is er pas na verloop van tijd.

Waarom groeit het aantal dan nog altijd?

Omdat het advies sneller rondgaat dan de meting. Bij de grootste Nederlandse sites ging het van 6,6% in juni naar 8,2% in augustus. De cijfers uit de serverlogs zijn pas sinds juni 2026 openbaar, dus het duurt nog even voor dat doorsijpelt.

Kan je zelf zien of iemand het ophaalt?

Ja, als je bij je serverlogs kan. Zoek daar op het pad naar het bestand en kijk welke bezoekers het opvroegen. Werk je op een gehost platform waar je die logs niet krijgt, dan kan je het niet zien, en dan is dat op zich al een reden om er geen tijd in te steken.

  • Waar het op neerkomt
  • 97% van de bestaande llms.txt-bestanden kreeg in mei 2026 geen enkele aanvraag.
  • Dat komt uit serverlogs van 137.210 domeinen, niet uit een enquête of een tool.
  • Bij de grootste Nederlandse sites heeft 8,2% er een, en dat aandeel groeit nog.
  • Naar schatting is van die tweeëndertig Nederlandse bestanden er ongeveer één ooit opgehaald.
  • Zet dezelfde twee uur op je productpagina, want dat werk wordt wel gelezen.

Cijfers uit Ahrefs (15 juni 2026, verkeers- en botanalyse van 137.210 domeinen, meetmaand mei 2026) en Writgo (scan van de vijfhonderd grootste Nederlandse domeinen, 1 augustus 2026, 392 bereikbare sites). De beschrijving van het bestand zelf komt van llmstxt.org, waar het voorstel en de tweede versie van augustus 2026 staan. De schatting van ongeveer één opgehaald bestand in Nederland is van ons, door die twee metingen op elkaar te leggen; ze komt uit verschillende bronnen en is dus een orde van grootte.

Sophie Callebaut

Negen jaar digitale groei voor kmo’s, in België en internationaal. Ik schrijf over het stuk dat de meeste mensen overslaan: eerst bepalen wat een tekst moet opleveren, en achteraf nakijken of dat gelukt is. Ik bouw de systemen die ik zelf gebruik, en verpak ze zodat online ondernemers ermee aan de slag kunnen zonder iemand in dienst te nemen.

Vorige
Vorige

Blokkeer je AI-crawlers, of laat je ze binnen?

Volgende
Volgende

Is je productpagina leesbaar voor AI?