llms.txt uitgelegd: wat het is en of jij er een nodig hebt
llms.txt is een voorgesteld markdown-bestand aan de basis van je site dat AI-systemen een kort, samengevat overzicht van je belangrijkste content geeft, qua opzet vergelijkbaar met robots.txt of sitemap.xml, maar dan voor taalmodellen.
Voorgesteld door Jeremy Howard (Answer.AI) in september 2024, heeft llms.txt vandaag echte maar beperkte adoptie: duizenden sites publiceren er een, en OpenAI, Anthropic en Google publiceren bestanden voor hun eigen developer docs, maar het is nog geen vereiste die een grote AI-crawler bevestigd volgt.
Scoor je paginaWat is llms.txt?
llms.txt is een voorgestelde standaard voor een gewoon markdown-bestand, geplaatst op /llms.txt aan de basis van een site (of op elk subpad), dat een AI-agent een kort, gestructureerd overzicht geeft van een site of een deel ervan: wat de site is, en een samengestelde lijst met links naar de pagina's die het lezen waard zijn. Het idee lost een echt probleem op: een normale HTML-pagina is gebouwd voor mensen, verpakt in navigatie, advertenties en JavaScript, en die terugvertalen naar schone tekst die een AI-model efficiënt kan gebruiken, is omslachtig en onnauwkeurig.
Het volgt de naamgevingsconventie van robots.txt en sitemap.xml, een vaste bestandsnaam op een voorspelbare plek, maar het doet een andere klus dan beide. robots.txt vertelt geautomatiseerde tools wat ze mogen benaderen. sitemap.xml vermeldt elke indexeerbare pagina voor zoekmachines. llms.txt biedt in plaats daarvan een kort, samengevat overzicht, leesbaar voor mens en machine, bedoeld om op verzoek gelezen te worden, wanneer een AI-agent een site moet begrijpen of iets specifieks erin moet vinden, niet om als geheel gecrawld te worden.
De adoptie is echt maar niet universeel, en het is belangrijk om precies te zijn over wat voor soort adoptie er bestaat. Duizenden sites publiceren nu een llms.txt-bestand, sommige documentatieplatforms genereren er automatisch een, en Chrome's Lighthouse-tool controleert erop als onderdeel van zijn checks voor agentic browsing. OpenAI, Anthropic en Google Gemini publiceren allemaal llms.txt-bestanden voor hun eigen developer-documentatie. Wat nog niet bevestigd is, is dat de algemene AI-crawlers die worden gebruikt voor dagelijks browsen en trainen, GPTBot, ClaudeBot, PerplexityBot en vergelijkbare, daadwerkelijk llms.txt-content ophalen en prioriteren zoals zoekmachines betrouwbaar robots.txt respecteren. Het duidelijkste bevestigde gebruik vandaag is coding agents en documentatietools, die llms.txt-bestanden wél volgen om API-referenties en tutorials te vinden.
Wat llms.txt wel en niet doet
Een samengevat overzicht, geen volledige crawl
In tegenstelling tot sitemap.xml, dat alles vermeldt, is llms.txt bedoeld om alleen te bevatten wat een AI-agent echt nodig heeft: een korte omschrijving plus links naar de pagina's die het meest tellen.
Geen bevestigd ranking- of citatiesignaal
Geen enkel groot AI-bedrijf heeft bevestigd dat het publiceren van een llms.txt-bestand verbetert of je content geciteerd wordt. Behandel het als een gemaksbestand voor agents die ervoor kiezen het te lezen, niet als een groeihefboom op zichzelf.
Een aanvulling op robots.txt en sitemap.xml, geen vervanging
llms.txt vervangt geen van beide bestanden. robots.txt bepaalt nog steeds crawlertoegang, en sitemap.xml vermeldt nog steeds elke pagina voor zoekmachines. llms.txt voegt daar een samengevatte, AI-leesbare laag aan toe.
Moet je er een maken?
Weinig moeite om te maken
Een minimale llms.txt is een kort markdown-bestand: een titel, een samenvatting van één regel, en een lijst met links naar je belangrijkste pagina's. Het kost veel minder tijd dan de meeste ander GEO-werk.
Een redelijke gok op waar het naartoe gaat
De adoptie is in minder dan twee jaar gegroeid van een voorstel in 2024 naar duizenden publicerende sites en ondersteuning door Chrome's Lighthouse. Er nu een publiceren kost weinig en positioneert je vooruit op eventuele toekomstige crawlerondersteuning.
Sterkste zaak voor documentatie- en API-sites
Het duidelijkste, bevestigde gebruik vandaag is coding agents die developer-documentatie lezen. Beheer je docs, een API-referentie, of een developer portal, dan levert llms.txt vandaag het meest bewezen voordeel.
Maak je llms.txt in 3 stappen
Zet je belangrijkste pagina's op een rijtje
Kies de pagina's die je een AI-agent als eerste zou willen laten lezen: je homepage, belangrijke product- of docspagina's, en alles wat uitlegt wat je doet.
Schrijf het bestand
Begin met een H1-titel en een blockquote-samenvatting van één regel, voeg dan een markdown-lijst met links toe onder één of meer H2-secties. Houd het kort. Het hele punt is dat het makkelijk past in de context van een model.
Publiceer op /llms.txt en check je GEO-score opnieuw
Plaats het bestand aan de basis van je site. Zorg er daarna voor dat de pagina's waarnaar het linkt zelf crawlbaar, goed gestructureerd en citeerbaar zijn. llms.txt wijst een agent alleen naar je content, het lost niet op wat de content mist.
llms.txt — veelgestelde vragen
Wat is llms.txt?
llms.txt is een voorgesteld markdown-bestand aan de basis van een site (/llms.txt) dat AI-agents een kort, samengevat overzicht van de site geeft, plus links naar de belangrijkste pagina's. Het werd in september 2024 voorgesteld door Jeremy Howard van Answer.AI.
Gebruiken ChatGPT, Claude en Perplexity llms.txt daadwerkelijk?
Niet bevestigd als algemene regel. OpenAI, Anthropic en Google publiceren llms.txt-bestanden voor hun eigen developer-documentatie, en coding agents volgen betrouwbaar llms.txt-bestanden om API-referenties te vinden. Maar geen enkel groot AI-bedrijf heeft bevestigd dat zijn algemene crawler (GPTBot, ClaudeBot, PerplexityBot) het llms.txt-bestand van een willekeurige site ophaalt en prioriteert tijdens normaal browsen of trainen. Behandel het als opkomend en optioneel, niet als een bevestigde vereiste.
Hoe verschilt llms.txt van robots.txt?
robots.txt vertelt crawlers wat ze mogen benaderen en is een gevestigde, breed gerespecteerde standaard. llms.txt biedt in plaats daarvan een samengevat overzicht van de belangrijkste content van een site, leesbaar voor mens en AI, bedoeld om op verzoek gelezen te worden in plaats van gecrawld. Ze dienen verschillende doelen en zijn bedoeld om naast elkaar te bestaan.
Is dit niet hetzelfde als sitemap.xml?
Nee. Een sitemap vermeldt elke indexeerbare pagina, vooral voor zoekmachines, en bevat zelden AI-vriendelijke markdown-versies van pagina's. llms.txt is bewust kort en samengevat, een handvol van de pagina's die het meest tellen, geen uitputtende lijst.
Moet ik een llms.txt-bestand voor mijn site maken?
Het is een toevoeging met weinig moeite en weinig risico, vooral als je documentatie of een API-referentie beheert, waar het bevestigde gebruik (coding agents) al bestaat. Voor een algemene marketingsite behandel je het beter als een kleine, toekomstgerichte toevoeging dan als prioriteit boven crawlbaarheid, structured data en helderheid van content, die vandaag een bewezen effect hebben op AI-zichtbaarheid.
Wat moet een geldig llms.txt-bestand bevatten?
Een H1 met de naam van de site of het project is de enige verplichte sectie. Meestal wordt die gevolgd door een blockquote-samenvatting van één regel, optionele contextalinea's, en één of meer secties met H2-koppen die een markdown-lijst met links bevatten, elk met een korte omschrijving.
Check of je site klaar is om geciteerd te worden
Een llms.txt-bestand helpt alleen als de pagina's erachter daadwerkelijk crawlbaar en citeerbaar zijn. Scoor je pagina eerst op 22 metrics. Vijf checks per domein zijn elke 30 dagen gratis.
Scoor je pagina