É preciso ser original ou dizer o que todos dizem para ser citado por uma IA?
Publicado em
Dizer o que as fontes sérias dizem primeiro, depois trazer o que você é o único a saber. No Claude, uma página cujo conteúdo coincide com o das outras páginas encontradas é citada até 1,5 vez mais frequentemente, e uma página encontrada por várias pesquisas diferentes para a mesma resposta é citada em 88% a 100% dos casos, dependendo do corpus, contra 50% a 60% para as outras. A originalidade por si só não faz com que uma página seja escolhida. Mas, uma vez selecionada a página, os dados próprios, os números e as fontes citadas são o que a diferencia.
Para que tipo de pergunta? Tudo depende da pergunta. Em uma pergunta de informação ou de mercado, a IA procura o ponto comum das fontes. Em uma pergunta sobre você, o seu produto ou os seus dados, é a sua fonte que ela vai buscar, e a originalidade torna-se a resposta.
O que medimos: o consenso vence no Claude
Para cada página encontrada pelo Claude, medimos até que ponto o seu vocabulário coincide com o das outras páginas trazidas para a mesma resposta. As páginas mais redundantes com o restante são citadas 1,5 vez mais frequentemente em engenharia de climatização e em inteligência artificial, 1,4 vez em cerca de dez setores em francês; o efeito continua presente em inglês, de forma mais fraca. Ao remover as páginas de um mesmo site, o efeito ainda se mantém, de 1,3 a 1,5 vez. E, entre as páginas citadas, a proporção de vocabulário próprio da página é menor do que nas páginas descartadas.
Um segundo sinal vai no mesmo sentido. Quando uma mesma página é trazida por duas pesquisas diferentes para a mesma resposta, o Claude quase sempre a cita: 100% dos casos em engenharia de climatização, 93% em inteligência artificial, 93% em cerca de dez setores em francês e 88% em inglês, contra 50% a 60% para uma página encontrada uma única vez. Uma página que responde a várias facetas da pergunta, com as palavras esperadas, é encontrada com mais frequência e selecionada com mais frequência.
O vocabulário do domínio no parágrafo
O consenso também é visível ao nível da passagem citada. No Claude, um parágrafo denso em vocabulário próprio do domínio tratado, os termos que as fontes do assunto compartilham, é citado 3 a 13 vezes mais frequentemente do que um parágrafo que não o contém, dependendo do corpus. A IA retém a passagem que fala a língua do assunto.
Isso não significa copiar os outros. Um parágrafo pode utilizar o vocabulário comum do domínio e dizer algo preciso, datado, quantificado. É o que fazem as páginas mais citadas: elas se enquadram no que o domínio diz e, depois, acrescentam algo.
O que a pesquisa diz sobre as receitas de originalidade
O artigo que lançou o termo GEO, apresentado na conferência KDD em 2024, testou modificações de conteúdo em um motor generativo simulado, baseado no GPT-3.5, em um banco de ensaio de 10.000 consultas. Adicionar citações, estatísticas e fontes aumentava a visibilidade em até 40%, enquanto a acumulação de palavras-chave quase não trazia nada. No Perplexity, em condições reais, o melhor ganho medido foi de 22%. Nesse contexto, a página já era fornecida ao motor: o estudo mede a participação da página na resposta, não as suas chances de ser encontrada.
Um banco de ensaio publicado na NeurIPS em 2025, o C-SEO Bench, conclui, pelo contrário, que a maioria dos métodos de otimização conversacional são amplamente ineficazes e têm frequentemente um efeito negativo, que os ganhos diminuem quando vários atores os adotam, e que as estratégias de SEO tradicionais são claramente mais eficazes. Os dois resultados não se contradizem necessariamente: enriquecer uma página ajuda depois de lida, mas não faz com que seja encontrada.
Por que a IA prefere o que é compartilhado
Uma IA que responde coloca em jogo a sua confiabilidade. Reter o ponto comum de várias fontes reduz o seu risco de errar, e uma página isolada que afirma algo diferente de todas as outras representa um risco. No ChatGPT, esse comportamento assume outra forma: o modelo nomeia na sua pesquisa as fontes que considera estabelecidas e cita primeiro essas.
Pesquisadores da Universidade de Toronto mediram em setembro de 2025 um viés sistemático dos motores de IA a favor dos meios de comunicação independentes e reconhecidos, em detrimento dos sites de marcas e das redes sociais. Para uma empresa, ser original no seu próprio site conta, portanto, menos do que ser coerente com o que as fontes terceiras dizem e ser mencionada por elas.
O que o Google chama de conteúdo "banal"
Google insiste no sentido oposto. O seu guia sobre a otimização para a IA generativa, atualizado em 10 de julho de 2026, recomenda um conteúdo “não banal”: opõe um conteúdo baseado em conhecimentos comuns, que poderia vir de qualquer pessoa e traz pouco, a um conteúdo que apresenta o ponto de vista de um especialista ou uma experiência vivida, além do comum. Segundo o Google, um conteúdo que as pessoas considerem único, convincente e útil influenciará provavelmente a presença de um site nas suas respostas de IA.
As nossas medições e esta recomendação não se contradizem. No Claude, cruzar o vocabulário do domínio ajuda uma página a ser encontrada e retida; no Google, repetir o que todos sabem não traz nada. Uma página útil faz as duas coisas: fala a língua do assunto e traz o que os outros não dizem.
O que isso muda para uma empresa
Uma página que quer ser citada começa por cobrir o que o domínio diz sobre a questão, com o seu vocabulário, em parágrafos desenvolvidos. Em seguida, traz aquilo que só ela pode trazer: uma medição, um número datado, uma experiência, um método. A originalidade vem depois da base, não no seu lugar.
Esta rubrica segue esta construção: cada página apresenta primeiro o que os outros estudos publicam, com o apoio de fontes, e depois as nossas próprias medições com o seu contexto. O consenso faz encontrar e reter a página; a medição própria é o que merece ser citado.
O que não sabemos
O cruzamento de vocabulário e a multiplicidade são medidos no Claude, que lê as páginas inteiras; no ChatGPT, não formalizámos estas medições. Os nossos relatórios descrevem associações na API dos modelos, não o efeito de uma reescrita de página.
Fontes
- Aggarwal et al. — “GEO: Generative Engine Optimization”, KDD 2024, .
- Puerto et al. — “C-SEO Bench: Does Conversational SEO Work?”, NeurIPS 2025, .
- Chen, Wang, Chen, Koudas (Universidade de Toronto) — “Generative Engine Optimization: How to Dominate AI Search”, .
- Google Search Central — “Optimizing your website for generative AI features on Google Search”, .
- Medições FaireDuBruit, de 4 a 16 de setembro de 2026 — ver « Como medimos ».
Perguntas relacionadas
- Qual trecho de uma página uma IA cita?
- Como o ChatGPT, o Claude e o Gemini escolhem as suas fontes?
- O que se lê sobre o GEO é verdade?
- O meu site de internet é suficiente para ser visível nas IA?
Todas as perguntas sobre a visibilidade nas IAs · Nossa oferta