Ir para o conteúdo
Visibilidade em IA

O arquivo llms.txt ajuda a ser citado pela IA?

Publicado em

Nada demonstra que o arquivo llms.txt ajude a ser citado pelas IA. Trata-se de uma proposta de 2024, cujo uso para escolher fontes nenhum grande desenvolvedor de IA documenta, e o Google escreve em julho de 2026 que é inútil criar arquivos de texto para a IA. Nós medimos: nos sites trazidos pela pesquisa do ChatGPT, Claude e Gemini em uma dezena de setores de atividade, 17% publicam um llms.txt, e os sites citados não o publicam de forma nitidamente mais frequente do que os outros. No ChatGPT, é até ligeiramente o inverso.

Para que tipo de pergunta? Tudo depende do que se espera do arquivo. Para ser citado na resposta de uma IA a uma pergunta, nada demonstra que sirva. Ele foi proposto para ajudar ferramentas de IA a ler um site, por exemplo, uma documentação técnica, o que nós não medimos.

O que é o arquivo llms.txt

O arquivo llms.txt foi proposto por Jeremy Howard em 3 de setembro de 2024. A ideia é adicionar à raiz de um site um arquivo no formato Markdown, legível por modelos de linguagem, que apresente o site. O formato exige um título com o nome do site, depois, geralmente, um breve resumo e listas de links para as páginas importantes, com uma seção opcional para o que uma ferramenta pode ignorar quando faltar espaço.

Este arquivo é frequentemente apresentado nos conselhos de GEO como uma forma de guiar o ChatGPT, o Claude ou o Gemini para as páginas certas. Nas documentações da OpenAI, da Anthropic e do Google que lemos, nenhuma diz utilizá-lo para escolher suas fontes. Ele não substitui o arquivo robots.txt, que indica aos robôs o que eles têm permissão para ler.

O que dizem o Google e os estudos

O Google responde em seu guia sobre otimização para as suas funcionalidades de IA generativa, atualizado em 10 de julho de 2026: é inútil criar arquivos de texto para a IA, uma vez que a sua pesquisa não os utiliza. Já em abril de 2025, John Mueller, do Google, observava que, tanto quanto sabia, nenhum serviço de IA tinha afirmado utilizar esse arquivo, e que se pode ver nos logs do seu servidor que esses serviços nem sequer o procuram.

A SE Ranking publicou em novembro de 2025 uma análise de quase 300.000 domínios, dos quais cerca de 10% publicavam um llms.txt. Conclusão: ter este arquivo não tornava um domínio mais suscetível de ser citado pelos modelos de IA. No entanto, a empresa considera que a sua adoção apresenta baixo risco, em previsão de um uso futuro.

O que nós medimos

Analisamos os sites trazidos pela pesquisa do ChatGPT, Claude e Gemini em uma dezena de setores de atividade consultados em francês em 10 de setembro de 2026, e verificamos em 16 de setembro se cada um publicava um llms.txt válido, com o seu título no formato previsto. Antes da medição, tínhamos escrito a nossa previsão: menos de 10% dos sites publicariam um, e a diferença entre sites citados e não citados não ultrapassaria 3 pontos em nenhuma IA.

A primeira previsão caiu: 17% dos sites publicam um llms.txt, mais do que o previsto. As diferenças continuam baixas e não vão no mesmo sentido: no Claude, 16% dos sites citados contra 12% dos sites não citados; no ChatGPT, 14% dos sites citados contra 16% dos sites não citados. Um teste estatístico de permutação mostra que estas diferenças são compatíveis com o acaso. No Gemini, cuja API não distingue as páginas descartadas, 23% dos sites citados publicam um, sem ponto de comparação.

Por que o arquivo não pode fazer uma página ser citada

No ChatGPT e no Claude, uma página é primeiro encontrada por uma pesquisa que a própria IA escreve e, em seguida, é escolhida entre os resultados. O que conta nessas duas etapas, em nossas medições, é a posição da página nos resultados, as palavras da pergunta no seu título e no seu endereço, e parágrafos que respondam com o vocabulário da pesquisa. Um arquivo separado, que a pesquisa não lê, não intervém em nenhuma dessas etapas.

Este site publica ele mesmo um arquivo llms.txt, que lista as suas páginas. Não afirmamos que ele nos faça ser citados: é apenas mais um resumo, não uma alavanca medida.

O que isso muda para uma empresa

Se o seu site não tem um llms.txt, essa não é a razão da sua ausência nas IA. Comece pelo que se mede: o acesso dos robôs de pesquisa das IA ao seu site, páginas que respondam às perguntas dos seus clientes com as palavras deles, e uma presença nas fontes que as IA consultam.

Publicar um llms.txt não custa quase nada e não faz mal. Mas um prestador de serviços que o apresente como uma alavanca de citação vende uma promessa que nem o Google, nem os estudos, nem as nossas medições confirmam.

O que não sabemos

A nossa medição incide sobre os sites obtidos numa dezena de setores em francês, verificados seis dias após a recolha: um site pode ter adicionado ou removido o seu ficheiro entretanto. Ela compara sites citados e não citados, o que descreve uma associação, e não um efeito. Não medimos a utilização do ficheiro por agentes que leem uma documentação.

Fontes

  1. Jeremy Howard — « The /llms.txt file », proposta, .
  2. Google Search Central — « Optimizing your website for generative AI features on Google Search », .
  3. Search Engine Journal, Roger Montti — Google compara llms.txt à tag meta keywords, .
  4. SE Ranking, Yulia Deda — llms.txt e citações pelas IA, .
  5. Medições FaireDuBruit, de 4 a 16 de setembro de 2026 — ver « Como medimos ».

Perguntas relacionadas

Todas as perguntas sobre a visibilidade nas IAs · Nossa oferta