Naar hoofdinhoud
Notura

· zeven minuten lezen

llms.txt: wat het is, en waarom wij het niet als wondermiddel verkopen

Een leeswijzer voor AI-assistenten, in een plat tekstbestand. Wat erin staat, waarom wij het zelf hebben, en waarom het in onze eigen weging het lichtste gewicht van allemaal krijgt.

Wat er in dat bestand staat

Een llms.txt is een plat tekstbestand dat je op de voorkant van je domein zet, achter een schuine streep en die naam. Er staat geen code in. Er staat in gewone taal wie je bent, wat je doet, voor wie, welke pagina's op je site de belangrijkste zijn en hoe iemand je bereikt. Je kunt het in een half uur met de hand tikken en je kunt het openen in kladblok.

Waarvoor het bedoeld is, is net zo eenvoudig. Een assistent die iets over jouw bedrijf wil zeggen moet je site doorwerken: opmaak, menu's, een cookiemelding, scripts, en ergens daartussen de zinnen die er echt over gaan. Het idee achter het bestand is dat je die zinnen apart aanbiedt, opgeruimd, zonder de rest erbij. Een bordje bij de ingang in plaats van elke deur openduwen.

En dan het woord dat je moet vasthouden: het is een voorstel, geen standaard. Iemand heeft een handige vorm bedacht en opgeschreven, en de partijen die het zouden moeten lezen hebben nooit gezegd dat ze het lezen. Dat verschil is de rest van dit artikel.

Wij hebben het zelf, en we laten het genereren

Op deze site staat het. Typ ons domein met daarachter llms punt txt en je krijgt de leeswijzer te zien; er staat een uitgebreide versie naast met de volle tekst per pagina. Dat kun je nu doen, het is sneller dan verder lezen.

Interessanter is hoe het er komt. Onze leeswijzer wordt opgebouwd uit het register waarin elke pagina van deze site staat, dus zodra er een pagina bijkomt of verdwijnt beweegt het bestand mee. Dat is geen liefhebberij. Hij was hier eerst met de hand geschreven, en toen we naast elkaar legden welke adressen erin stonden bleken het acht van de tien indexeerbare adressen te zijn: de privacyverklaring en de homepage ontbraken. Niemand had het gemerkt, want een leeswijzer klaagt niet.

Dat is trouwens het beste argument voor zo'n bestand dat we kennen, en het heeft weinig met AI te maken. Wie het maakt, moet in tien regels opschrijven wat hij doet, voor wie, en welke pagina's het waard zijn om te lezen. Wie dat niet kort krijgt, heeft geen bestandsprobleem.

De eerlijke kant: niemand heeft gezegd dat hij het leest

Hier hoort de rem. Geen van de grote aanbieders van AI-assistenten heeft het formaat officieel omarmd. Er is geen documentatie van hun kant waarin staat dat hun crawler dat bestand opzoekt, en er is geen bevestiging dat wat erin staat zwaarder telt dan de gewone pagina waarop het ook al stond.

Wij kunnen daarnaast geen meting laten zien waarin het bestand het verschil maakte. Niet omdat we niet meten, maar omdat je zoiets nauwelijks kunt isoleren: een assistent noemt je of hij noemt je niet, en waarom hij dat deed vertelt hij er niet bij. Wie beweert dat hij dat wel kan aanwijzen, moet die meting kunnen laten zien. Vraag ernaar en vraag door.

Let ook op de vorm van het argument dat je vaak terugkrijgt: het kan geen kwaad, dus doe het. Dat is waar. Het is geen bewijs dat het werkt. Die twee dingen worden in verkoopgesprekken structureel door elkaar gehaald, en dat gaat zelden per ongeluk.

Wat onze eigen weging erover zegt

Wij wegen dertien factoren als we bepalen hoe vindbaar een bedrijf is in AI-assistenten. De gratis scan meet er vijf direct op je homepage; dat staat ook op de scanpagina, met de acht die we niet meten er eerlijk bij. In die weging krijgt llms.txt het laagste gewicht van allemaal, gedeeld met een andere factor.

De twee zwaarste gaan over iets anders. De eerste is of jouw tekst het antwoord op de vraag van je klant echt raakt, in dezelfde woorden waarin een mens die vraag stelt. De tweede is of je elders genoemd en geciteerd wordt, op plekken die niet van jou zijn. Die twee samen zijn bijna de helft van de hele weging. Een bestand uploaden is er niet een van.

Nu het ongemakkelijke deel, want het staat in onze eigen code. Naast die weging draait er een diepe technische controle over vijf gebieden, en daarin krijgt een ontbrekende llms.txt juist een van de zwaarste gewichten binnen het onderdeel AI-vindbaarheid. Dat spreekt de weging hierboven tegen. We hebben dus twee eigen metingen die het niet met elkaar eens zijn over hoeveel dit uitmaakt.

Dat staat op onze lijst en het is nog niet opgelost. Zolang dat zo is houden we ons aan de weging: die kijkt naar de hele uitkomst, de controle kijkt naar een vinkje. We schrijven het hier op omdat je het anders niet zou weten, en omdat een meetinstrument dat zijn eigen tegenspraak verzwijgt niet lang een meetinstrument blijft.

Waarom we het dan toch hebben

Drie redenen, en geen ervan is dat het werkt. Het kost bijna niets: eenmalig schrijven en neerzetten, en bij ons niet eens dat, omdat het meebeweegt met de site. Het kan niets kapotmaken: het bestand staat naast je site en niet ervoor, een bezoeker merkt er niets van en een zoekmachine gebruikt het niet tegen je. En als het formaat over een jaar wel wordt opgepakt, sta je er al.

Dat is de hele afweging: een kleine eenmalige inzet tegen een kleine kans op iets. Zulke gokken hoor je te nemen, want de rekening is laag en de andere kant is niet nul. Wat je niet hoort te doen is hem verkopen als de sleutel tot ChatGPT.

Wij nemen die gok dus wel en we brengen hem niet in rekening. Dat is het verschil tussen iets doen omdat het verstandig is en iets doen omdat het goed verkoopt.

Waar het wel vandaan komt

Als je een middag hebt en je wilt dat een assistent je noemt, dan gaat je tijd naar vier dingen. Ze zijn alle vier minder leuk dan een bestand uploaden, en ze wegen alle vier zwaarder.

Genoemd worden op plekken die niet van jou zijn. Een assistent citeert het liefst iets dat niet uit je eigen mond komt: een vakblad, een lokale krant, een leverancier die je noemt, een klant die iets over je opschrijft. Dit is het zwaarste dat je zelf kunt beïnvloeden en ook het traagste, dus begin er als eerste aan.

Gewoon goed vindbaar zijn. Assistenten leunen voor hun feiten grotendeels op zoekindexen, dus wie klassiek onvindbaar is, is het daar ook. De basis is hier niet nieuw en niet spannend: leesbare tekst zonder dat er eerst scripts moeten draaien, echte antwoorden op echte vragen, en feiten die ook machineleesbaar op de pagina staan. Alleen feiten die er zichtbaar staan, want iets anders aan de machine vertellen dan aan de bezoeker kan je je site kosten.

Lokaal kloppen. Dezelfde bedrijfsnaam, hetzelfde adres, hetzelfde telefoonnummer, op je site en op elke plek waar je vermeld staat, tot en met de afkortingen. Onze weging heeft hier een eigen factor voor, en het is het saaiste werk op deze lijst. Het is ook het goedkoopste.

Meepraten waar je klanten praten. Forums, vakgroepen, de plekken waar mensen elkaar iets aanraden en waar een naam blijft hangen. Ook daarvoor staat er een eigen factor in de weging. Dit valt niet uit te besteden zonder dat het opvalt, en dat is precies waarom het werkt.

Hoe je een aanbieder hierop test

Verkoopt iemand je een llms.txt als de ingang naar AI-assistenten, stel dan drie vragen. Ze zijn niet vals en ze zijn in een gesprek te beantwoorden.

Welke meting laat zien dat het werkte? Niet een tevreden klant, maar een meting: dezelfde vraag aan dezelfde assistent, twee momenten, het antwoord erbij en de datum erbij.

Welk gewicht geef je het, en naast wat? Wie er geen andere factoren naast kan leggen, weegt niet maar verkoopt. Een gewicht zonder buren is een mening.

En: wat gebeurt er als het formaat nooit wordt overgenomen? Het eerlijke antwoord is dat je dan een half uur kwijt bent en niets meer. Krijg je dat antwoord niet, dan weet je genoeg over de rest van het gesprek.

Wat je hiermee deze week doet

Kijk eerst of je het al hebt. Typ je eigen domein, daarachter een schuine streep, dan llms punt txt. Zie je tekst, dan heb je het. Zie je je eigen homepage terug of een foutmelding, dan niet.

Heb je het niet en wil je het: schrijf tien regels. Wie je bent, wat je doet, voor wie, je belangrijkste pagina's met per pagina een regel uitleg, en hoe iemand je bereikt. Zet het als tekstbestand op de voorkant van je domein en haal het daarna van je lijst af. Dit is geen project.

Besteed je tijd daarna aan het werk dat wel weegt. Neem de vraag die je deze week aan de telefoon kreeg, schrijf hem op met het antwoord zoals je het gaf, inclusief het stuk dat je liever niet zou opschrijven omdat het je zwakke punt is, en zet dat op je site. Dat is een uur werk en het valt in het zwaarste deel van de weging.

En meet het. Stel de vraag van je klant aan een paar assistenten, zonder je bedrijfsnaam erin, en bewaar het antwoord met de datum erbij. Doe dat over een maand opnieuw met exact dezelfde formulering. Dan weet je of er iets beweegt, en dat is meer dan de meeste mensen die je hierover iets verkopen kunnen zeggen.

Veelgestelde vragen

Moet ik een llms.txt hebben?

Als je er een half uur voor hebt: ja. Het kost bijna niets en het kan niets breken. Gaat dat half uur ten koste van het opschrijven van je echte antwoorden op de vragen die je aan de telefoon krijgt, dan nee, want dat weegt aantoonbaar zwaarder. De volgorde is hier het hele advies.

Leest ChatGPT dit bestand echt?

Dat is niet bevestigd. Geen van de grote aanbieders heeft ergens vastgelegd dat hun crawler het bestand opzoekt, of dat wat erin staat zwaarder weegt dan een gewone pagina. Wij kunnen ook geen meting laten zien waarin het aantoonbaar verschil maakte. Wie het je als zekerheid verkoopt, verkoopt je iets wat hij niet weet.

Waarom hebben jullie het dan zelf?

Omdat de rekening klein is en de mogelijke opbrengst niet nul. Eenmalig schrijven, het kan niets kapotmaken, en als het formaat later wel wordt opgepakt staan we er al. Dat is een verstandige gok. Wat we niet doen is er een dienst van maken of hem verkopen als de ingang naar AI-assistenten.

Wat is het verschil met een sitemap?

Een sitemap is een lijst adressen voor zoekmachines: machineleesbaar, zonder uitleg. Een llms.txt is bedoeld voor een lezer die taal begrijpt, dus er staat in wat je doet en waarom een pagina het waard is. Het grote verschil zit in de zekerheid: van de sitemap weten we dat hij gebruikt wordt, van de llms.txt is dat precies wat niet vaststaat.

Jullie zeggen dat het weinig uitmaakt, en toch meet je het. Hoe zit dat?

Onze weging kent dertien factoren en llms.txt is er een van, met het laagste gewicht. Hem weglaten zou de uitkomst niet eerlijker maken, alleen onvolledig. Wat we niet doen is de score erop laten leunen: in het rapport staat het gewicht erbij, zodat je zelf ziet hoe klein het aandeel is.

Wil je weten waar je nu staat?

De gratis scan meet je site live en zet het rapport direct op de pagina. Geen account, geen creditcard. Bij elke controle staat het ruwe gemeten bewijs, dus je kunt zelf nakijken waar een score op rust.

Toegankelijkheid
AI-assistent