Guia
llms.txt: o que é e você precisa? (guia honesto)
Por Marnix Geerkens. Publicado em 2026-08-11. Atualizado em 2026-08-11.
Em resumo
llms.txt é um arquivo de texto na raiz de um site que resume em Markdown puro o que o site é e quais páginas são mais importantes, escrito como um roteiro de leitura para modelos de IA. A Semrush investigou se esse arquivo se relaciona com um desempenho melhor nos mecanismos de busca de IA e não encontrou correlação mensurável. Ainda assim, vale a pena publicar, simplesmente porque o custo é quase zero.
- Nenhum grande provedor de IA confirmou que o rastreador dele usa o llms.txt de forma estruturada.
- O que de fato tem efeito comprovado: fatos no HTML puro, dados estruturados FAQPage, números com fonte nomeada, e menções fora do próprio site.
- A maior parte do conteúdo sobre llms.txt exagera o efeito dele. Esta página não faz isso.
O que é o llms.txt, e de onde veio essa ideia?
llms.txt é um arquivo de texto na raiz de um site que resume em Markdown puro o que o site é e quais páginas são mais importantes, pensado como um roteiro de leitura para modelos de IA. A ideia nasceu de uma comparação com o robots.txt: um arquivo pequeno e padronizado, num endereço fixo, que um sistema automatizado consegue ler rápido antes de explorar o resto do site.
A diferença em relação ao robots.txt está no peso que o arquivo carrega. O robots.txt é um padrão consolidado que os buscadores respeitam há anos, com um significado claro e obrigatório: pode ou não pode rastrear aqui. O llms.txt não tem esse status. É uma sugestão que um sistema de IA pode ler ou simplesmente ignorar, e nenhum grande provedor de IA confirmou publicamente que o rastreador dele usa o arquivo de forma estruturada para montar respostas.
O que o llms.txt promete, e o que a evidência realmente mostra?
A promessa em torno do llms.txt soa convincente: dê a um modelo de IA um resumo organizado do seu site, e ele passa a te citar mais ou a te encontrar com mais facilidade. Faz sentido na teoria, mas fazer sentido na teoria e ser medido na prática são duas coisas diferentes.
A Semrush investigou a questão e relatou não ter encontrado correlação mensurável entre ter um arquivo llms.txt e um desempenho melhor ou mais citações nos mecanismos de busca de IA. Não é a opinião de um blog qualquer, é uma descoberta relatada por uma empresa que mede visibilidade em IA como produto principal. Se uma agência vender um pacote de "otimização de llms.txt" como o centro de uma estratégia de GEO, isso é um sinal de alerta, não uma confirmação do que funciona.
Então por que ainda vale a pena colocar um?
Porque o custo é quase zero. Escrever um arquivo llms.txt leva poucos minutos: uma descrição curta do seu site e uma lista das páginas mais importantes, em Markdown. Não há evidência de que ele atrapalhe, e se algum dia um sistema de IA passar a usá-lo de forma estruturada, você já está pronto.
A RocketLauncher também publica o próprio llms.txt, exatamente por esse motivo: é um extra barato, não uma estratégia. O erro que a maior parte do conteúdo sobre llms.txt comete é tratá-lo como o principal caminho para ser citado mais vezes. Não é. É um item pequeno e gratuito na lista, enquanto o trabalho de verdade está em outro lugar.
O que realmente move as citações de IA?
A evidência sempre aponta para os mesmos lugares, e nenhum deles é um arquivo de texto solto na raiz do site.
Fatos no HTML puro, não depois do JavaScript
Rastreadores de IA como GPTBot, ClaudeBot, PerplexityBot e CCBot não executam JavaScript, eles leem só o HTML puro que o servidor devolve. Se um fato, um preço ou uma resposta de FAQ só aparece na página depois que um script roda, nenhum desses rastreadores vê. O Gemini é a exceção, porque roda sobre o renderizador do próprio Google, que executa JavaScript.
Dados estruturados FAQPage
Uma seção de FAQ já ajuda como texto simples, mas o schema FAQPage marca de forma explícita qual frase é a pergunta e qual é a resposta, em vez de deixar um modelo tentar deduzir isso pelo layout da página.
Números reais com fonte nomeada
Um número sem fonte costuma ser ignorado. Um número com um nome atrás, como um relatório, uma pesquisa ou um dado público, é tratado como confiável e muitas vezes é citado ao pé da letra, junto com a fonte.
Menções fora do seu próprio site
A empresa de software WRITER afirma que cerca de 85% do que os modelos de IA citam vem de terceiros, não do próprio site da empresa. É uma alegação da fornecedora WRITER, não verificada de forma independente, mas a direção bate com o que você mesmo consegue conferir: uma avaliação com nome e data, uma menção num guia especializado, ou uma resposta num fórum contam como fonte ao lado da sua própria página.
E o índice em que você precisa estar?
Uma etapa costuma ser esquecida porque não tem nada a ver com a sua própria página: o ChatGPT em modo busca roda sobre o índice de busca do Bing. Se a sua página não está nesse índice, o ChatGPT em modo busca não consegue te citar, não importa quão bom seja o seu HTML, o seu schema ou o seu llms.txt. Cadastrar o site no Bing Webmaster Tools e enviar o sitemap são etapas pelo menos tão importantes quanto qualquer coisa escrita na própria página.
O próximo passo prático
Antes de gastar tempo escrevendo um llms.txt, confira onde você está agora. Passe o seu site pelo scanner de site grátis para ver se os seus fatos, o seu FAQ e os seus dados estruturados já estão legíveis no HTML puro, exatamente o que um rastreador de IA enxerga. Sem login, resultado em segundos.
Depois, leve o resultado para a RocketLauncher University, a comunidade gratuita onde você tira dúvidas sobre GEO e AEO e já garante o período de teste gratuito do GoHighLevel.
Se você entrar por este link, eu recebo uma comissão. Isso não muda o seu preço.
Perguntas frequentes
O que é llms.txt exatamente?
llms.txt é um arquivo de texto na raiz de um site (por exemplo, rocketlauncher.ai/llms.txt) que resume em Markdown puro o que o site é e quais páginas são mais importantes, pensado como um roteiro de leitura para modelos de IA. Não é um padrão técnico que os rastreadores são obrigados a seguir, é mais uma sugestão que um sistema de IA pode ler ou simplesmente ignorar.
Ter um llms.txt faz o ChatGPT ou a Perplexity me citarem mais?
Não há evidência disso. A Semrush investigou a questão e relatou não ter encontrado correlação mensurável entre ter um arquivo llms.txt e um desempenho melhor ou mais citações nos mecanismos de busca de IA. Se alguém vender "otimização de llms.txt" como o centro de uma estratégia de GEO, isso não bate com o que foi medido.
Então por que vale a pena publicar mesmo assim?
Porque o custo é quase zero. Escrever um llms.txt leva poucos minutos, e não existe evidência de que ele atrapalhe. Trate como um extra barato ao lado do trabalho real de GEO, não como um substituto dele.
Se não é o llms.txt, o que realmente move as citações de IA?
Fatos que já estão no HTML puro antes de qualquer JavaScript rodar, dados estruturados FAQPage marcando pergunta e resposta de forma explícita, números com uma fonte nomeada em vez de estatística solta, e menções ao seu negócio em sites que não são seus, como avaliações, guias e fóruns.
Os rastreadores de IA leem minha página do jeito que um visitante vê no navegador?
Na maioria dos casos, não. GPTBot, ClaudeBot, PerplexityBot e CCBot não executam JavaScript, eles leem só o HTML puro que o servidor devolve. Se um fato só aparece na página depois que um script roda, nenhum desses rastreadores enxerga. O Gemini é a exceção, porque roda sobre o renderizador do próprio Google, que executa JavaScript.
O llms.txt funciona como o robots.txt?
Não. O robots.txt é um padrão consolidado que diz aos rastreadores quais partes de um site eles podem ou não visitar, e os buscadores respeitam essas regras há anos. O llms.txt não tem esse status. Nenhum grande provedor de IA confirmou publicamente que o rastreador dele usa o arquivo de forma estruturada para montar respostas.
O ChatGPT também depende de como está o meu HTML?
Sim, e depende de um passo anterior também: o ChatGPT em modo busca roda sobre o índice de busca do Bing. Se a sua página não está nesse índice, o ChatGPT em modo busca não consegue te citar, não importa quão bom seja o seu llms.txt ou o seu HTML.
