llms.txt explicado: o que é e se você precisa de um
llms.txt é um arquivo markdown proposto na raiz do seu site que dá aos sistemas de IA um resumo curto e selecionado do seu conteúdo principal, parecido em espírito com o robots.txt ou sitemap.xml, mas para modelos de linguagem.
Proposto por Jeremy Howard (Answer.AI) em setembro de 2024, o llms.txt tem hoje uma adoção real mas limitada: milhares de sites publicam um, e OpenAI, Anthropic e Google publicam arquivos para sua própria documentação de desenvolvedores, mas ainda não é uma exigência que algum grande rastreador de IA siga de forma confirmada.
Pontuar sua páginaO que é llms.txt?
llms.txt é um padrão proposto para um arquivo markdown simples, colocado em /llms.txt na raiz de um site (ou em qualquer subcaminho), que dá a um agente de IA uma visão geral curta e estruturada de um site ou de uma seção dele: o que o site é, e uma lista selecionada de links para as páginas que vale a pena ler. A ideia resolve um problema real: uma página HTML normal é construída para pessoas, envolta em navegação, anúncios e JavaScript, e convertê-la de volta em texto limpo que um modelo de IA consiga usar de forma eficiente é custoso e impreciso.
Ele segue a convenção de nomenclatura do robots.txt e do sitemap.xml, um nome de arquivo fixo em um local previsível, mas cumpre uma função diferente das duas. O robots.txt diz a ferramentas automatizadas o que elas podem acessar. O sitemap.xml lista cada página indexável para os mecanismos de busca. O llms.txt, em vez disso, oferece um resumo curto, selecionado, legível por humanos e máquinas, pensado para ser lido sob demanda, quando um agente de IA precisa entender um site ou encontrar algo específico nele, não rastreado por completo.
A adoção é real mas não universal, e é importante ser preciso sobre que tipo de adoção existe de fato. Milhares de sites agora publicam um arquivo llms.txt, algumas plataformas de documentação geram um automaticamente, e a ferramenta Lighthouse do Chrome audita sua presença como parte de suas verificações de navegação agêntica. OpenAI, Anthropic e Google Gemini publicam arquivos llms.txt para sua própria documentação de desenvolvedores. O que ainda não está confirmado é que os rastreadores de IA de uso geral usados para navegação e treinamento do dia a dia, GPTBot, ClaudeBot, PerplexityBot e similares, realmente buscam e priorizam o conteúdo do llms.txt da forma como os mecanismos de busca respeitam de forma confiável o robots.txt. O caso de uso mais claramente confirmado hoje é o de agentes de codificação e ferramentas de documentação, que realmente seguem arquivos llms.txt para encontrar referências de API e tutoriais.
O que o llms.txt faz e não faz
Um resumo selecionado, não um rastreamento completo
Diferente do sitemap.xml, que lista tudo, o llms.txt deve conter apenas o que um agente de IA realmente precisa: uma breve descrição mais links para as páginas mais importantes.
Não é um sinal confirmado de ranqueamento ou citação
Nenhuma grande empresa de IA confirmou que publicar um arquivo llms.txt melhora as chances de seu conteúdo ser citado. Trate-o como um arquivo de conveniência para agentes que optam por lê-lo, não como uma alavanca de crescimento por si só.
Um complemento ao robots.txt e ao sitemap.xml, não um substituto
O llms.txt não substitui nenhum dos dois arquivos. O robots.txt continua controlando o acesso de rastreadores, e o sitemap.xml continua listando cada página para mecanismos de busca. O llms.txt adiciona por cima uma camada selecionada e legível por IA.
Você deveria criar um?
Pouco esforço para criar
Um llms.txt mínimo é um arquivo markdown curto: um título, um resumo de uma linha, e uma lista de links para suas páginas mais importantes. Leva muito menos tempo do que a maior parte do outro trabalho de GEO.
Uma aposta razoável sobre para onde as coisas estão indo
A adoção cresceu de uma proposta em 2024 para milhares de sites publicando um e o suporte do Lighthouse do Chrome em menos de dois anos. Publicar um agora custa pouco e te posiciona à frente de qualquer suporte futuro de rastreadores.
Caso mais forte para sites de documentação e API
O caso de uso mais claro e confirmado hoje é o de agentes de codificação lendo documentação de desenvolvedores. Se você mantém uma documentação, uma referência de API, ou um portal para desenvolvedores, o llms.txt tem agora o benefício mais comprovado.
Crie seu llms.txt em 3 passos
Liste suas páginas mais importantes
Escolha as páginas que você gostaria que um agente de IA lesse primeiro: sua página inicial, páginas importantes de produto ou documentação, e qualquer coisa que explique o que você faz.
Escreva o arquivo
Comece com um título H1 e um resumo em citação de uma linha, depois adicione uma lista markdown de links sob uma ou mais seções H2. Mantenha curto. O objetivo é que caiba facilmente no contexto de um modelo.
Publique em /llms.txt e verifique seu GEO Score novamente
Coloque o arquivo na raiz do seu site. Depois, garanta que as páginas para as quais ele aponta sejam elas mesmas rastreáveis, bem estruturadas e citáveis. O llms.txt só indica um agente para seu conteúdo, ele não corrige o que falta ao conteúdo.
llms.txt — perguntas frequentes
O que é llms.txt?
llms.txt é um arquivo markdown proposto, colocado na raiz de um site (/llms.txt), que dá aos agentes de IA um resumo curto e selecionado do site mais links para suas páginas mais importantes. Foi proposto por Jeremy Howard, da Answer.AI, em setembro de 2024.
ChatGPT, Claude e Perplexity realmente usam llms.txt?
Não está confirmado como regra geral. OpenAI, Anthropic e Google publicam arquivos llms.txt para sua própria documentação de desenvolvedores, e agentes de codificação seguem de forma confiável arquivos llms.txt para encontrar referências de API. Mas nenhuma grande empresa de IA confirmou que seu rastreador de uso geral (GPTBot, ClaudeBot, PerplexityBot) busca e prioriza o llms.txt de um site qualquer durante navegação ou treinamento normais. Trate-o como algo emergente e opcional, não como uma exigência confirmada.
Qual a diferença entre llms.txt e robots.txt?
O robots.txt diz aos rastreadores o que eles podem acessar e é um padrão bem estabelecido e amplamente respeitado. O llms.txt, em vez disso, oferece um resumo selecionado, legível por humanos e IA, do conteúdo principal de um site, pensado para ser lido sob demanda em vez de rastreado. Eles cumprem propósitos diferentes e devem coexistir.
Isso não é o mesmo que sitemap.xml?
Não. Um sitemap lista cada página indexável, principalmente para mecanismos de busca, e raramente inclui versões em markdown adaptadas para IA das páginas. O llms.txt é deliberadamente curto e selecionado, um punhado das páginas mais importantes, não uma lista exaustiva.
Devo criar um arquivo llms.txt para meu site?
É uma adição de baixo esforço e baixo risco, especialmente se você mantém documentação ou uma referência de API, onde o caso de uso confirmado (agentes de codificação) já existe. Para um site de marketing geral, trate-o como uma pequena adição voltada para o futuro em vez de uma prioridade acima da rastreabilidade, dos dados estruturados e da clareza do conteúdo, que hoje têm efeito comprovado na visibilidade em IA.
O que um arquivo llms.txt válido precisa conter?
Um H1 com o nome do site ou projeto é a única seção obrigatória. Geralmente é seguido por um resumo em citação de uma linha, parágrafos de contexto opcionais, e uma ou mais seções com título H2 contendo uma lista markdown de links, cada um com uma breve descrição.
Verifique se seu site está pronto para ser citado
Um arquivo llms.txt só ajuda se as páginas por trás dele forem de fato rastreáveis e citáveis. Primeiro pontue sua página em 22 métricas. Cinco verificações por domínio são gratuitas a cada 30 dias.
Pontuar sua página