O que é llms.txt?
O llms.txt, também chamado de arquivo llms.txt ou LLMs.txt, é um arquivo Markdown hospedado na raiz do site que funciona como um índice curado para modelos de linguagem. O arquivo lista as páginas mais relevantes do domínio com títulos, links e descrições curtas, em formato fácil de processar por um LLM.
A proposta surgiu em 2024 como padrão aberto sugerido pela comunidade, inspirado no robots.txt e no sitemap.xml. O llms.txt tem função própria: entregar um resumo legível do que importa no site, pensado para caber na janela de contexto de um modelo.
O arquivo faz parte das práticas de GEO. A adoção pelos grandes provedores de IA ainda é limitada, e não há garantia de que todos os crawlers de IA leiam o arquivo. O custo de implementação, porém, é baixo.
Como funciona na prática?
A implementação segue passos simples e não exige mudanças no restante do site.
- Crie um arquivo de texto chamado llms.txt em formato Markdown.
- Comece com um título de nível 1 com o nome do site e um parágrafo curto explicando o que o site oferece.
- Liste as seções principais com títulos de nível 2 e, abaixo de cada uma, links em lista, cada link com uma descrição de uma linha.
- Publique o arquivo na raiz do domínio, acessível publicamente.
- Opcionalmente, crie um llms-full.txt com o conteúdo completo das páginas principais em Markdown.
Quando um sistema de IA com RAG acessa o site, o arquivo oferece um mapa limpo do conteúdo, sem menus e scripts que atrapalham a extração de texto.
Exemplos de uso
- Uma empresa de software brasileira publica um llms.txt listando documentação, planos e integrações. Assistentes de IA que consultam o site encontram o caminho direto para as respostas.
- Um e-commerce de móveis inclui no arquivo as páginas de política de frete, trocas e garantia, temas que geram muitas perguntas em chats com IA.
- Uma consultoria contábil lista no arquivo seus guias sobre MEI, Simples Nacional e obrigações mensais, concentrando em um só lugar o conteúdo que gera citação em IA.
Erros comuns
- Tratar o llms.txt como substituto do robots.txt. Os dois arquivos têm funções diferentes, e o llms.txt não bloqueia nem autoriza crawlers.
- Listar todas as URLs do site sem critério, o que anula a função de curadoria do arquivo.
- Esquecer de atualizar o arquivo quando páginas importantes mudam de endereço ou saem do ar.
- Esperar resultado garantido. A leitura do arquivo depende de cada provedor de IA, e a adoção do padrão ainda está em evolução.
Perguntas frequentes sobre llms.txt
Qual a diferença entre llms.txt e robots.txt?
O robots.txt controla quais robôs podem acessar quais áreas do site, funcionando como porteiro. O llms.txt funciona como guia de leitura: apresenta as páginas mais importantes em formato Markdown para que modelos de linguagem entendam o site com menos esforço. Um controla acesso, o outro facilita compreensão.
O llms.txt é obrigatório para aparecer em respostas de IA?
Não. Sistemas de IA citam sites que não têm o arquivo, porque a recuperação de conteúdo depende principalmente da qualidade e da estrutura das páginas. O llms.txt é um complemento de baixo custo que pode facilitar o trabalho dos sistemas que optam por lê-lo.
Como saber se os robôs de IA estão lendo meu llms.txt?
Verifique os logs de acesso do servidor e filtre requisições à URL /llms.txt. Os user-agents registrados mostram quais bots acessaram o arquivo e com que frequência. Sem acessos, o arquivo segue servindo como documentação organizada do site, sem prejuízo para o restante da estratégia.