GEO & AEO — Busca por IA

llms.txt

Por Gustavo Bonato Abrão e Francis Trauer · Atualizado em 16 de julho de 2026

Definição

llms.txt é um arquivo de texto em Markdown colocado na raiz do site que resume as páginas mais importantes para modelos de linguagem, usado para ajudar sistemas de IA a entender e citar o conteúdo do site com mais precisão.

ClassificaçãoDocumento / Entregável
CategoriaGEO & AEO — Busca por IA
Também conhecido comoArquivo llms.txt · LLMs.txt
NívelAvançado

O que é llms.txt?

O llms.txt, também chamado de arquivo llms.txt ou LLMs.txt, é um arquivo Markdown hospedado na raiz do site que funciona como um índice curado para modelos de linguagem. O arquivo lista as páginas mais relevantes do domínio com títulos, links e descrições curtas, em formato fácil de processar por um LLM.

A proposta surgiu em 2024 como padrão aberto sugerido pela comunidade, inspirado no robots.txt e no sitemap.xml. O llms.txt tem função própria: entregar um resumo legível do que importa no site, pensado para caber na janela de contexto de um modelo.

O arquivo faz parte das práticas de GEO. A adoção pelos grandes provedores de IA ainda é limitada, e não há garantia de que todos os crawlers de IA leiam o arquivo. O custo de implementação, porém, é baixo.

Como funciona na prática?

A implementação segue passos simples e não exige mudanças no restante do site.

  1. Crie um arquivo de texto chamado llms.txt em formato Markdown.
  2. Comece com um título de nível 1 com o nome do site e um parágrafo curto explicando o que o site oferece.
  3. Liste as seções principais com títulos de nível 2 e, abaixo de cada uma, links em lista, cada link com uma descrição de uma linha.
  4. Publique o arquivo na raiz do domínio, acessível publicamente.
  5. Opcionalmente, crie um llms-full.txt com o conteúdo completo das páginas principais em Markdown.

Quando um sistema de IA com RAG acessa o site, o arquivo oferece um mapa limpo do conteúdo, sem menus e scripts que atrapalham a extração de texto.

Exemplos de uso

  • Uma empresa de software brasileira publica um llms.txt listando documentação, planos e integrações. Assistentes de IA que consultam o site encontram o caminho direto para as respostas.
  • Um e-commerce de móveis inclui no arquivo as páginas de política de frete, trocas e garantia, temas que geram muitas perguntas em chats com IA.
  • Uma consultoria contábil lista no arquivo seus guias sobre MEI, Simples Nacional e obrigações mensais, concentrando em um só lugar o conteúdo que gera citação em IA.

Erros comuns

  • Tratar o llms.txt como substituto do robots.txt. Os dois arquivos têm funções diferentes, e o llms.txt não bloqueia nem autoriza crawlers.
  • Listar todas as URLs do site sem critério, o que anula a função de curadoria do arquivo.
  • Esquecer de atualizar o arquivo quando páginas importantes mudam de endereço ou saem do ar.
  • Esperar resultado garantido. A leitura do arquivo depende de cada provedor de IA, e a adoção do padrão ainda está em evolução.

Perguntas frequentes sobre llms.txt

Qual a diferença entre llms.txt e robots.txt?

O robots.txt controla quais robôs podem acessar quais áreas do site, funcionando como porteiro. O llms.txt funciona como guia de leitura: apresenta as páginas mais importantes em formato Markdown para que modelos de linguagem entendam o site com menos esforço. Um controla acesso, o outro facilita compreensão.

O llms.txt é obrigatório para aparecer em respostas de IA?

Não. Sistemas de IA citam sites que não têm o arquivo, porque a recuperação de conteúdo depende principalmente da qualidade e da estrutura das páginas. O llms.txt é um complemento de baixo custo que pode facilitar o trabalho dos sistemas que optam por lê-lo.

Como saber se os robôs de IA estão lendo meu llms.txt?

Verifique os logs de acesso do servidor e filtre requisições à URL /llms.txt. Os user-agents registrados mostram quais bots acessaram o arquivo e com que frequência. Sem acessos, o arquivo segue servindo como documentação organizada do site, sem prejuízo para o restante da estratégia.

Termos relacionados

Crawlers de IA

Crawlers de IA são robôs que percorrem sites para coletar conteúdo destinado a sistemas de inteligência artificial, usados para treinar modelos de linguagem ou para alimentar respostas de busca com IA em tempo real.

Bloqueio e Permissão de Crawlers de IA

Bloqueio e permissão de crawlers de IA é a técnica de controlar, via robots.txt e regras de servidor, quais robôs de inteligência artificial acessam o site, usada para equilibrar proteção de conteúdo e visibilidade em respostas geradas por IA.

GEO (Generative Engine Optimization)

GEO é a estratégia de otimizar conteúdo e marca para serem citados nas respostas de motores generativos, como ChatGPT, Gemini e AI Overviews, usada para manter visibilidade quando a busca acontece dentro de uma IA. Também chamado de Generative Engine Optimization ou Otimização para Motores Generativos.

LLM (Large Language Model)

LLM é um modelo de inteligência artificial treinado com volumes enormes de texto para entender e gerar linguagem natural, usado como base de assistentes como ChatGPT e Gemini. Também chamado de Large Language Model ou Grande Modelo de Linguagem, ele sustenta as buscas generativas e as respostas de IA que citam marcas e sites.

Citação em IA (AI Citations)

Citação em IA é a menção ou link que uma resposta gerada por inteligência artificial atribui a um site ou marca como fonte da informação, usada como indicador de visibilidade em buscadores com IA e como nova porta de entrada de tráfego qualificado.

RAG (Retrieval-Augmented Generation)

RAG é a técnica que combina recuperação de informação com geração de texto por IA, buscando documentos relevantes antes de redigir a resposta, usada para dar dados atuais e verificáveis aos modelos de linguagem e reduzir respostas inventadas.

← Voltar ao glossário