GEO Universal Framework · Capítulo 12 de 29 · 22 min
Site grande: quando as suas próprias páginas competem entre si
Você sai diagnosticando quando duas páginas suas disputam a mesma busca, decidindo entre fundir, diferenciar ou não mexer, e recusando páginas geradas em massa antes que elas derrubem a confiança do Google no site inteiro.
Este capítulo faz parte do curso gratuito GEO Universal Framework. Para marcar como concluído e salvar o progresso, abra este capítulo na página do curso.
O concorrente mais frequente da sua melhor página é outra página sua, e a disputa prejudica as duas: os links de fora se dividem, o histórico vira duas séries curtas e o buscador troca de escolha sem que nenhuma se firme. Este módulo serve a quem aprova pauta, orçamento de conteúdo ou projeto de páginas em massa e precisa decidir, com o relatório na mão, entre fundir, diferenciar ou não mexer. Você sai com o diagnóstico de canibalização (duas páginas suas disputando a mesma busca) encomendado e com a régua para recusar SEO programático antes que ele contamine o site inteiro.
Para quem decide: este módulo destrava a escolha entre fundir, diferenciar ou não mexer em páginas que disputam a mesma busca, e a recusa de páginas geradas em massa. Errar custa o site inteiro: em 07/09/2026, John Mueller, do Google, disse a um dono de site com páginas em massa que os sistemas "possivelmente perderam a fé" no site como um todo. A pergunta para a equipe: qual consulta nossa alterna de URL há duas janelas de 28 dias?
1. Diagnosticar canibalização no Search Console (o relatório gratuito do Google sobre as buscas que chegam ao site), separando alternância real de flutuação normal. 2. Decidir entre fundir, diferenciar ou não mexer, com o critério escrito e uma consulta de controle. 3. Aprovar a estrutura de cluster (um tema, uma página central e páginas de apoio com intenção própria) em vez de pauta por palavra-chave. 4. Recusar páginas geradas em massa e duplicatas para caçar citação, com o custo no nível do site declarado.
Glossário rápido
Canibalização
Duas ou mais páginas do mesmo site competindo pela mesma intenção de busca. A existência de páginas parecidas não constitui o sintoma. O sintoma é a alternância: o buscador troca de URL para a mesma consulta ao longo do tempo, porque nenhuma se destaca como resposta óbvia.
Intenção
O que a pessoa quer resolver ao fazer a consulta. Duas páginas podem falar do mesmo assunto sem canibalizar, desde que sirvam a intenções diferentes (entender o conceito, comparar opções, executar o procedimento, contratar).
Pillar page
Página que cobre o tema em toda a sua extensão, com profundidade média, e serve de porta de entrada e de mapa do cluster. É o documento que responde à consulta ampla e distribui o leitor para o aprofundamento.
Cluster de tópico
Conjunto de páginas de um mesmo tema, com uma pillar e páginas de apoio ligadas a ela por links internos, em que cada apoio cobre uma intenção específica que a pillar apenas tangencia.
Consolidação
Reunir em um único endereço o conteúdo e os sinais que estavam dispersos. Operacionalmente costuma envolver reescrever a página que fica, redirecionar as que saem e refazer os links internos que apontavam para as antigas.
A cena típica: o time publica nove artigos sobre o tema central do negócio, todos bem escritos, e o tráfego do tema não sobe. A página que ranqueava há um ano cai, nenhuma das novas ocupa o lugar dela, e a mesma consulta aparece no Search Console ora com uma URL, ora com outra. Ninguém errou individualmente; o erro está na relação entre as nove peças, que ninguém desenhou. O diagnóstico natural ("precisamos publicar mais") piora exatamente o que está quebrado.
A intuição trata canibalização como empate: uma página ganha, a outra perde e o resultado líquido fica igual. A disputa prejudica as duas por três efeitos que se somam. Os links e as menções de fora se dividem entre dois endereços, e cada um acumula metade do que um único acumularia; num sistema em que o topo concentra, metade costuma significar fora do topo.
O histórico de desempenho de uma URL para uma consulta se constrói ao longo do tempo, e duas URLs alternando produzem duas séries curtas e ruidosas em vez de uma consistente. Diante de duas páginas suas quase equivalentes, qualquer sistema de seleção precisa escolher, e a escolha instável é o sintoma que aparece no relatório: nenhuma das duas se firma como a resposta daquele site para aquela pergunta.
Verificação rápida
Pré-teste, antes de ler o restante. Duas páginas do seu site disputam a mesma consulta no Search Console. A intuição diz que isso é um empate: uma ganha, a outra perde e o resultado do site para aquela consulta fica igual ao de ter uma página só. Essa leitura está correta?
Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
A concentração que o curso defende na etapa de distribuição vem de dado publicado. A amostragem repetida de Perplexity Search, SearchGPT e Gemini em arXiv 2603.08924 (v3, 26/08/2026) encontrou distribuição de citações em lei de potência: poucos domínios concentram a maior parte das citações, e a cauda é rala e instável. Os rankings de domínio citado são instáveis por todo o conjunto de domínios frequentemente citados, e boa parte da diferença entre marcas cabe dentro do ruído da medição.
A etapa de distribuição traduz isso em decisão de pauta: menos temas, e o topo de cada um. Este módulo traduz a mesma coisa em estrutura de site, e a tradução é literal. Se a distribuição premia quem ocupa o topo de um tema, dividir o seu material sobre esse tema em nove endereços equivalentes trabalha contra a estratégia que você aprovou. Concentração que existe no calendário editorial e não existe na arquitetura do site é concentração declarada, e declaração não é prática.
A avaliação de qualidade do Google é feita no nível do site, e páginas geradas em massa contaminam as boas. Em 07/09/2026, John Mueller, do Google, respondeu no Bluesky a um dono de site que gerou páginas em massa. Os sistemas, escreveu ele, "possivelmente perderam a fé" no site como fonte de valor para o usuário, por causa das páginas antigas. Na mesma resposta, SEO programático (páginas criadas por template a partir de uma base de dados, aos milhares) "muitas vezes leva a um site que é spam, quase spam ou de baixa qualidade".
A política de spam do Google, com a seção sobre reputação de site, foi atualizada em 28/08/2026, e o único evento de algoritmo do período foi o spam update de 18 a 21/08/2026. Não houve core update em agosto nem em setembro até 07/09. O critério de abuso de conteúdo em escala continua sendo escala sem valor agregado, avaliado pela utilidade de cada página, seja quem for o autor.
Para quem aprova projeto de mil páginas de bairro, de produto ou de comparação, a conta muda de lugar: o risco deixa de ser "essas páginas não vão ranquear" e passa a ser "as páginas boas do site perdem junto". Reduzir acervo contraria a métrica de volume que alguém defende internamente, e é a decisão mais barata do módulo.
Agora o exemplo trabalhado: o diagnóstico completo de uma suspeita de canibalização, com o raciocínio de decisão exposto. O que importa é a ordem das checagens, porque a maioria dos times pula direto para a conclusão e funde páginas que serviam a intenções diferentes.
# DIAGNÓSTICO DE CANIBALIZAÇÃO no Search Console, passo a passo.
# Consulta suspeita: "contrato de trabalho intermitente"
# PASSO 1. Isolar a consulta, e não a página.
# Performance > Resultados da pesquisa > filtro de CONSULTA exata.
# Depois abrir a aba PÁGINAS com esse filtro ativo.
# Por que começar pela consulta: canibalização é um fenômeno da
# consulta. Começar pela página mostra o que a página pega, e
# esconde com quem ela divide.
# PASSO 2. Ler a aba Páginas.
# Resultado observado (formato do relatório, valores do seu site):
# /guia-clt-intermitente -> impressões altas, posição média instável
# /blog/o-que-e-intermitente -> impressões médias, posição média instável
# /blog/intermitente-x-parcial-> impressões baixas, posição estável
#
# Leitura: DUAS páginas disputam. A terceira não entra na disputa,
# e o dado que sustenta isso é a posição ESTÁVEL dela.
# PASSO 3. Confirmar a alternância ao longo do tempo. ESTE É O PASSO
# QUE QUASE TODO MUNDO PULA.
# Comparar dois períodos de 28 dias e ver se a URL que aparece para
# a consulta TROCOU entre eles.
# Sem alternância, não há canibalização: há duas páginas do mesmo
# tema convivendo, o que é normal e desejável.
# Com alternância, o sistema está trocando de escolha, que é o
# sintoma real.
# Escolhi 28 dias porque janela menor confunde flutuação normal
# com troca de escolha, e este é o erro de diagnóstico mais caro
# do procedimento inteiro.
# PASSO 4. Ler a INTENÇÃO de cada página, com os próprios olhos.
# /guia-clt-intermitente -> intenção AMPLA (entender o regime)
# /blog/o-que-e-intermitente -> intenção AMPLA (entender o regime) <-- COLISÃO
# /blog/intermitente-x-parcial-> intenção COMPARATIVA (escolher entre dois)
#
# Sem este passo o diagnóstico erra em uma direção específica:
# funde páginas que competem no relatório mas servem a pessoas
# diferentes, e aí você perde a cobertura da segunda intenção.
# PASSO 5. Decidir. Duas páginas, MESMA intenção, alternância
# confirmada em 2 janelas de 28 dias -> FUNDIR.
#
# Qual fica: escolhi /guia-clt-intermitente, e não a de maior
# tráfego atual. O motivo: ela já concentra mais links externos e
# é a que faz sentido como pillar do cluster. Tráfego atual é
# fotografia; perfil de link é acúmulo. Fundir para a URL de maior
# tráfego é um erro comum que joga fora o ativo mais lento de
# reconstruir.
# PASSO 6. Executar a consolidação, na ordem.
# 6.1 Reescrever a página que FICA incorporando o que só existia
# na que sai. Fundir sem incorporar é só apagar conteúdo.
# 6.2 301 da URL que sai para a que fica.
# 6.3 Refazer os links internos que apontavam para a antiga.
# Deixar o 301 resolvendo link interno funciona e é preguiça
# que se acumula.
# 6.4 Atualizar o sitemap.
# 6.5 Registrar a data da mudança. Sem a data, a leitura do efeito
# daqui a dois meses vira adivinhação.
# NÃO USAR rel=canonical no lugar do 301 quando a página antiga vai
# deixar de existir. Canonical é um sinal considerado; o 301 é a
# mudança de endereço de fato. Canonical faz sentido quando as duas
# páginas PRECISAM continuar acessíveis (variações de parâmetro,
# versões de impressão), o que não é o caso aqui.Termômetro de canibalização (aplique a uma consulta por vez)
Pontue cada dimensão de 0 a 3 para uma consulta específica do seu site. A pontuação não substitui o diagnóstico do exemplo trabalhado, e serve para priorizar quais consultas merecem o diagnóstico completo primeiro. Pontuação alta indica colisão provável.
0 = a mesma URL aparece em todas as janelas observadas. 1 = trocou uma vez. 2 = trocou em janelas consecutivas. 3 = alterna de forma recorrente e nenhuma se firma.
0 = intenções claramente distintas (entender, comparar, executar, contratar). 1 = distintas com alguma sobreposição de escopo. 2 = muito próximas. 3 = as duas páginas respondem exatamente à mesma pergunta.
0 = formulações distintas e cada página declara o próprio recorte logo no início. 3 = títulos praticamente intercambiáveis e aberturas equivalentes.
0 = uma delas concentra claramente os links e a outra é periférica. 3 = links internos e externos distribuídos de forma parecida entre as duas, sem hierarquia declarada.
Provavelmente são páginas do mesmo tema convivendo, que é o estado normal e desejável de um cluster. Não funda nada. Se houver algum incômodo, ele costuma se resolver deixando cada página declarar o próprio recorte no título e no primeiro parágrafo, o que custa uma edição de dez minutos.
Pare e produza, sem voltar ao exemplo. Duas páginas suas aparecem para a mesma consulta, uma com o dobro das impressões da outra, e as posições médias das duas são estáveis há três meses, sem nenhuma troca de URL entre as janelas. Escreva: (a) isso é canibalização, e por quê; (b) o que você faria; (c) qual dado do relatório sustentou a sua resposta em (a). Se a sua resposta em (c) foi "as duas aparecem para a mesma consulta", releia o passo 3, porque esse dado sozinho não distingue colisão de convivência.
Quando o alvo é citação em resposta gerada, a alternância deixa de ser sinal. Numa lista de links, duas páginas suas ocupam duas posições e a troca é observável no relatório. Numa resposta gerada existe uma resposta que cita ou não cita, e a variação entre execuções é propriedade documentada do sistema; tratá-la como diagnóstico produz conclusão falsa. O diagnóstico continua sendo feito no Search Console, onde existe série temporal e denominador, e a arquitetura corrigida serve às duas superfícies.
Duplicar para caçar citação não funciona e passou a ser detectável. Em arXiv 2608.13956 (14/08/2026), redundância por duplicata e paráfrase por modelo de linguagem não melhoraram a correção da resposta do motor. Documentos diversos melhoraram a correção em 17% a 47%, e o ganho veio da diversidade de gênero (notícia, blog, documentação) sobre o mesmo fato.
O detector GEO-Flag (arXiv 2608.16824, v2 de 20/08/2026) separa página otimizada para IA de página apenas polida por IA com F1 de 0,944 (a medida que combina acerto e cobertura, em que 1 é perfeito). Ele estimou que 8,90% de 10.095 páginas recuperadas carregam intervenção de GEO, 16,36% entre as modificadas em 2026. Página duplicada com o texto reescrito para agradar o motor é risco mensurável com ganho esperado zero.
O que não tem medição publicada é o efeito de consolidar páginas canibalizadas sobre a taxa de citação em resposta gerada (corpus arXiv de maio a setembro de 2026). O argumento para consolidar assim mesmo é de mecanismo e de custo: evidência dividida entre cinco endereços rasos tem menos chance de ser recuperada como fonte destacada do que um endereço que a concentra. Isso é consistente com a distribuição concentrada que o paper documenta. É raciocínio, e apresentá-lo como medição seria o que este curso ensina a recusar em material de terceiro.
Duplicar páginas faz a IA citar mais?
+17% a +47%
correção da resposta do motor com documentos diversos sobre o mesmo fato
duplicata e paráfrase: sem ganho (arXiv 2608.13956)
8,90%
páginas recuperadas com intervenção de GEO
10.095 páginas (arXiv 2608.16824)
16,36%
entre as páginas modificadas em 2026
mesmo estudo
0,944
F1 do detector GEO-Flag ao separar intervenção de GEO de polimento por IA
acurácia no pior grupo: 0,883
Fonte: arXiv 2608.13956 (14/08/2026) e arXiv 2608.16824 v2 (20/08/2026)
Fundir, diferenciar ou não mexer?
| Situação observada | Decisão | Por quê | Risco de errar a decisão |
|---|---|---|---|
| Mesma intenção, alternância confirmada em duas janelas de 28 dias | Fundir | Nenhuma das duas vai se firmar enquanto ambas existirem, e a evidência externa continua dividida | Baixo, desde que a página que fica incorpore o conteúdo da que sai antes do redirecionamento |
| Intenções próximas mas distinguíveis, com conteúdo próprio em cada uma | Diferenciar | Existe cobertura de intenção a preservar, e ela se perde na fusão sem possibilidade de recuperação | Médio: diferenciar de forma superficial (trocar só o título) deixa a colisão de pé e consome uma janela de observação |
| Mesma consulta, posições estáveis, sem alternância | Não mexer | Convivência de páginas do mesmo tema é o estado normal de um cluster que funciona | Alto se você mexer: consolidação desnecessária destrói cobertura e não tem desfazer barato |
| Dezenas de páginas rasas geradas por variação de termo ou de localidade | Consolidar em bloco e reduzir | Escala sem valor agregado é o critério de abuso de conteúdo em escala, e a avaliação de qualidade é no nível do site (Mueller, 07/09/2026) | Baixo. O risco maior é político dentro da empresa, porque reduzir acervo contraria a métrica de volume que alguém defende |
| Página antiga com bom perfil de links e conteúdo desatualizado, mais página nova e correta | Fundir na antiga, reescrevendo o conteúdo dela | Perfil de links é o ativo mais lento de reconstruir; conteúdo se reescreve em um dia | Alto na direção contrária: fundir na URL nova por ela ter mais tráfego neste mês descarta o acúmulo |
O contra-exemplo que produz mais estrago em auditoria: o time roda uma ferramenta que lista "páginas canibalizando", recebe uma lista de sessenta pares e sai fundindo. Duas coisas quebram. Primeira, ferramentas detectam sobreposição de consulta, que é o passo 2 do diagnóstico, e não conseguem avaliar intenção, que é o passo 4 e depende de leitura humana. Fundir por sobreposição de consulta apaga cobertura de intenções legítimas, e o efeito aparece meses depois como queda em consultas que ninguém estava monitorando. Segunda, consolidação em lote muda dezenas de URLs de uma vez, o que torna impossível atribuir qualquer variação posterior a qualquer decisão específica. A fronteira operacional: consolide em lotes pequenos, com data registrada, e mantenha uma consulta de controle que você deliberadamente não tocou. Sem controle e sem data, você vai ter uma opinião sobre o que funcionou, e nunca um resultado.
Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
Heurística de praticante para desenhar cluster sem canibalizar desde o começo: antes de aprovar qualquer pauta nova, escreva em uma linha a pergunta exata que aquela página vai responder. Depois confira se alguma página existente já responde à mesma pergunta; se responder, a pauta vira edição da página existente. Esse único filtro, aplicado na hora da aprovação e antes de qualquer auditoria, elimina a maior parte da canibalização antes que ela custe alguma coisa. O efeito secundário é útil: ele obriga o time a formular a intenção em vez de aprovar pauta por palavra-chave, que é como acervos rasos nascem.
Sem consultar o texto, escreva o plano de duas semanas que você apresentaria para um cluster com onze páginas e sinais de colisão. O plano precisa conter quatro itens. Quais consultas você diagnostica primeiro e com qual critério de priorização. O que você mede antes de tocar em qualquer coisa. Qual consulta você deixa deliberadamente como controle. Como você vai saber daqui a dois meses se a decisão foi boa. Restrição: sem uma linha de base coletada antes da mudança e uma data registrada, o plano não vai produzir resposta nenhuma, e isso é motivo suficiente para reescrevê-lo.
Nas próximas 48 horas, escolha a consulta mais valiosa comercialmente do site que você opera e execute os passos 1 a 4 do diagnóstico, sem executar o passo 5. Ou seja: isole a consulta, leia a aba de páginas, compare duas janelas de 28 dias para confirmar ou descartar alternância, e leia com os próprios olhos a intenção de cada página que aparece. Critério de sucesso: você termina com um veredito escrito em uma frase (fundir, diferenciar ou não mexer) e com o dado específico do relatório que sustenta esse veredito, nomeado. Se você não conseguir nomear o dado, o veredito é palpite, e a decisão que ele geraria custaria mais caro do que a inação. Guarde o print das duas janelas com a data: ele é a linha de base que vai permitir ler o efeito de qualquer coisa que você fizer depois.
Faça agora (15 min)
Você precisa do Search Console, da lista de pautas do trimestre e de quem cuida do site.
Passo 1: Abra o Search Console, filtre a consulta mais valiosa do negócio e leia a aba Páginas
Se mais de uma URL sua aparece, anote as duas e as posições médias.
Deu certo quando: Você sabe quantas páginas suas disputam a consulta que paga o mês.
Erro comum: Começar pela página em vez da consulta.
Passo 2: Compare duas janelas de 28 dias e veja se a URL trocou
Sem troca, não há canibalização; há convivência.
Deu certo quando: Um veredito em uma linha: fundir, diferenciar ou não mexer.
Erro comum: Ler uma semana só e confundir flutuação com troca de escolha.
Passo 3: Peça ao time a pergunta exata que cada pauta nova do trimestre responde, em uma linha
Se uma página existente já responde, a pauta vira edição dela.
Deu certo quando: A lista de pautas encolhe e cada linha tem uma pergunta única.
Erro comum: Aprovar pauta por palavra-chave.
Passo 4: Pergunte a quem propõe páginas em massa qual informação única cada página carrega
Bairro, produto ou comparação sem dado próprio não justificam página.
Deu certo quando: Uma resposta por página, ou o projeto reduzido.
Erro comum: Aceitar "a ferramenta gera mil em uma hora" como argumento.
Passo 5: Escolha uma consulta de controle que ninguém vai tocar e registre a data de toda mudança
Sem controle e sem data, o efeito de daqui a dois meses vira opinião.
Deu certo quando: A ata tem a consulta de controle e a data de cada consolidação.
Erro comum: Fundir sessenta pares de uma vez.
No fim você tem: o veredito da consulta mais valiosa, a lista de pautas com uma pergunta única por linha, o projeto de páginas em massa reduzido ou justificado e uma consulta de controle com data.
Resumo em três linhas: Canibalização é alternância de URL para a mesma consulta em duas janelas de 28 dias, e a disputa prejudica as duas páginas porque divide links, histórico e a escolha do buscador. A qualidade é avaliada no nível do site: páginas geradas em massa contaminam as boas, e duplicata para caçar citação não melhora a resposta do motor e já é detectável. Na segunda-feira, filtre a consulta mais valiosa no Search Console, compare duas janelas de 28 dias e peça a pergunta única de cada pauta do trimestre.
Perguntas frequentes deste capítulo
Quantas páginas um cluster deve ter?
Consolidar páginas derruba tráfego no curto prazo?
Dá para diagnosticar canibalização olhando as respostas do ChatGPT ou do Perplexity?
Se eu tenho duas páginas ótimas sobre o mesmo tema, ocupar duas posições não é melhor do que uma?
Todos os capítulos de GEO Universal Framework
- 01GEO em quinze minutos: o que mudou e o que você decide
- 02Sete princípios com fonte: como este curso trata o problema
- 03O que é SEO e por que a base decide o resto
- 04Busca sem clique: o que os números de 2026 dizem de verdade
- 05O que é GEO e como ler os números do mercado
- 06Qual robô de IA pode ler o seu site: decida por escrito
- 07Sua empresa como entidade: o que o Google documenta, o que inventaram
- 08Dados estruturados depois da poda: o que ainda rende resultado
- 09O motor escolhe onde buscar antes de responder: entre na lista
- 10Busca local: endereço, perfil e o que a IA consegue ver
- 11Mais de um idioma: o que muda para ser citado lá fora
- 12Site grande: quando as suas próprias páginas competem entre si
- 13Conteúdo feito com IA: o que o Google proíbe e o que já é detectável
- 14Riscos que a diretoria assina: injeção de prompt, LGPD e log
- 15Permitir, cobrar ou bloquear os robôs de IA: a decisão por escrito
- 16ChatGPT Ads no Brasil: separar pago de orgânico antes de comprar
- 17Medir sem se enganar: três camadas e o relatório oficial do Google
- 18Ciclo mensal: quatro fases, portão de saída e relatório em cinco linhas
- 19Operar com agentes: qual modelo para qual tarefa, e quando não orquestrar
- 20Ler um case sem cair no conto: a rubrica dos cinco portões
- 21De onde veio esse número: quatro passos antes de repetir
- 22A proposta de GEO chegou: dez perguntas antes de assinar
- 23Etapa 1: o diagnóstico em 16 pilares e o portão de entrada
- 24Etapa 2: robô certo entra, página existe sem JavaScript, markup ainda serve
- 25Etapa 3: escrever o trecho citável e provar que a IA citou
- 26Etapa 4: concentrar presença fora do site, e o custo de pulverizar
- 27Etapa 5: o site que o agente consegue ler, comparar e comprar
- 28Etapa 6: medir sem se enganar, e decidir manter ou reverter
- 29Etapa 7: 90 dias, três dependências e o critério de parada