GEO Universal Framework · Capítulo 9 de 29 · 18 min
O motor escolhe onde buscar antes de responder: entre na lista
Você sai sabendo que o motor de resposta escolhe em quais domínios buscar antes de ler qualquer página, e com a lista do que coloca a sua marca entre os candidatos: reconhecimento, terceiros, feed e fonte preferida.
Este capítulo faz parte do curso gratuito GEO Universal Framework. Para marcar como concluído e salvar o progresso, abra este capítulo na página do curso.
Em 2026 o motor de resposta decide em quais sites vai procurar antes de ler qualquer página, e a sua empresa só é lida se estiver nessa lista de candidatos. Serve para quem aprova orçamento de marketing e recebe propostas de "otimizar o site para a IA": aqui está onde a decisão acontece e o que coloca uma marca na lista. Você ganha um teste de 15 minutos que diz se a sua marca entra ou fica de fora.
Para quem decide: pare de pagar por otimização de página enquanto a marca não está entre os domínios que o motor consulta, porque errar custa a verba inteira da frente de IA. No Shopping do ChatGPT, 61,54% das recomendações vinham do feed de produto em 10/07/2026, e o número de lojistas citados caiu mais de 20% no mesmo período. Pergunta para a equipe: em quais domínios o ChatGPT procura pela nossa categoria, e estamos em algum deles?
Ao final você consegue: (1) explicar em uma frase por que o motor escolhe domínios antes de ler páginas, com o número de 08/08/2026. (2) Diagnosticar, em três perguntas no ChatGPT, se a sua marca está entre os candidatos da sua categoria. (3) Separar marca mencionada de marca citada ao ler qualquer relatório de visibilidade em IA. (4) Priorizar as quatro portas de entrada (reconhecimento, terceiros, feed, fonte preferida) antes de aprovar qualquer reescrita de página.
A prova mais direta veio do próprio ChatGPT. Quando alguém faz uma pergunta com a busca ligada, o modelo dispara por trás várias buscas de apoio (o que o mercado chama de fan-out, o leque de consultas que o motor abre para uma pergunta só).
Em 08/08/2026, a fração dessas buscas que já saía com o operador site:, ou seja, restrita a um domínio escolhido antes, saltou de 0,3% a 0,5% para 16% a 17%. A medição é da Promptwatch, relatada por Simon Willison em 20/08/2026. O motor passou a decidir onde procurar antes de procurar.
Duas semanas depois, em 25/08/2026, Suganthan Mohanadasan documentou na Search Engine Journal que a ferramenta de busca do ChatGPT foi reescrita. Cada consulta de apoio passou a carregar quatro campos: tipo, texto, janela de frescor em dias e um espaço reservado para o domínio. O exemplo registrado foi fast|Zendesk AI agents pricing 2026|30|zendesk.com. O domínio virou campo da consulta. Para a sua empresa, a pergunta deixou de ser "a nossa página está boa?" e passou a ser "o nosso domínio aparece nesse campo quando perguntam pela nossa categoria?".
Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
O mesmo desenho aparece nos outros motores, com nomes diferentes. No Google, AI Overviews e AI Mode partem do índice do Googlebot, o robô que lê a web para a Busca. Dali abrem um leque de consultas de apoio que o guia oficial chama de query fan-out. A lista de candidatos, ali, é o índice inteiro, menos os sites que pediram para sair pelo Search Console, o painel gratuito do Google para donos de site.
O Google acrescentou uma porta escolhida pelo leitor. Desde 27/05/2026 qualquer pessoa pode marcar fontes preferidas, que ganham selo em Top Stories, AI Overviews e AI Mode. Em 20/08/2026 a empresa contava mais de 600 mil fontes escolhidas e lançou um botão que o site incorpora para pedir essa marcação. Só domínio ou subdomínio pode ser marcado; uma pasta dentro do site, não.
No Perplexity, o índice próprio é montado pelo PerplexityBot, e o Perplexity-User abre a página quando o usuário pede. No Claude, o Claude-SearchBot alimenta o índice de busca, e desde 01/09/2026 quem constrói um agente com a API da Anthropic pode fixar a lista de domínios permitidos ou bloqueados para a busca. Em todos eles, a página só é lida depois que o domínio passou por um filtro.
Onde cada motor procura antes de ler a sua página?
| Motor | Onde procura antes de ler | Como a marca entra na lista | Fonte e data |
|---|---|---|---|
| ChatGPT com busca ligada | Índice próprio do OAI-SearchBot; consultas de apoio com site: e slot de domínio; no Shopping, o feed de produto | Domínio consultado pelo nome; presença nos diretórios e terceiros que o motor lê; feed de produto enviado | OpenAI, documentação de robôs; Promptwatch via Willison, 20/08/2026; SEJ, 25/08/2026; Profound, 03/09/2026 |
| AI Overviews e AI Mode (Google) | Índice do Googlebot com consultas de apoio (query fan-out); fontes preferidas do leitor com selo | Estar indexado e não excluído no Search Console; ser marcado como fonte preferida pelo leitor | Google Search Central, guia atualizado em 10/07/2026; blog do Google, 27/05 e 20/08/2026 |
| Perplexity | Índice próprio do PerplexityBot; Perplexity-User busca a página a pedido do usuário | Liberar o PerplexityBot; o Perplexity-User ignora o robots.txt e só regra no servidor ou no WAF o barra | Documentação de robôs da Perplexity, aberta em 07/09/2026 |
| Claude | Índice do Claude-SearchBot; agentes construídos na API podem restringir a busca a domínios permitidos | Liberar o Claude-SearchBot; constar na lista de domínios que o construtor do agente permite | Anthropic, documentação de robôs de 07/04/2026 e release notes de 01/09/2026 |
Perplexity-User ignora o robots.txt, o arquivo em que o site diz a cada robô o que pode ler; quem quer barrá-lo precisa de regra no servidor ou no WAF, o firewall que fica na frente do site. Nas quatro linhas, a página é lida depois de o domínio ter passado pelo filtro.
Estar na lista de consulta ainda não é ser citado, e o Reddit é a prova de agosto. A participação do Reddit nas citações do ChatGPT caiu de 3,8% (18/07 a 07/08) para 0,5% (14 a 17/08/2026), queda de 86% em quatro dias. A medição é da Promptwatch, publicada pela Semrush em 26/08/2026, e o painel da Similarweb viu o mesmo movimento: de cerca de 12% em julho para 3% em meados de agosto (23/08/2026).
O ChatGPT continua consultando subreddits pelo nome, com janela de frescor de até 3.650 dias, e pode ler dezenas de threads sem citar nenhuma. Buscar não é citar: a fonte virou insumo invisível.
O segundo aviso vem do lado da marca. A Shero Commerce levantou, em 60 categorias de compra, 1.851 fontes citadas por AI Mode, ChatGPT e Perplexity. O estudo saiu na Search Engine Journal em 26/08/2026, antes de o AI Mode trocar de modelo em 02/09. As páginas da própria marca foram 2,8% dessas fontes. Sites de terceiros ficaram com 59% das citações, e das 159 recomendações de marca só 31% traziam a página da marca como fonte. O motor recomendou a marca lendo outra gente.
A Profound mediu o mesmo em preço. Em 7.600 respostas sobre preços das empresas da lista Cloud 100, coletadas de 29/07 a 10/08/2026 em seis motores, a página oficial de preços foi a primeira fonte em 12% dos casos. Vendr (18,7%), Reddit (18,6%) e G2 (15,9%) vieram antes dela. Os diretórios e comparadores são a lista que o motor consulta, e a página da empresa é a que ele confirma depois.
Daí a régua que separa relatório de slide. Participação em menções (mention share) é a fatia de respostas em que a sua marca é nomeada; participação em citações (citation share) é a fatia de fontes que apontam para o seu domínio. São duas linhas diferentes, e a Cloudflare, no painel de visibilidade em IA que lançou em 06/08/2026, reporta taxa de menção e taxa de citação em separado. Quando a proposta de um fornecedor traz uma só, pergunte qual das duas ele está mostrando e onde está a outra.
Quanto do filtro acontece antes da leitura?
16% a 17%
Buscas de apoio do ChatGPT já restritas a um domínio (site:)
Promptwatch via Simon Willison, desde 08/08/2026
61,54%
Recomendações do Shopping do ChatGPT vindas de feed de produto
Profound, 687 clientes, 10/07/2026
600 mil
Fontes preferidas escolhidas por leitores no Google
Google, 20/08/2026
2,8%
Fontes citadas que eram a página da própria marca, em 60 categorias
Shero Commerce via Search Engine Journal, 26/08/2026
Fonte: Simon Willison, 20/08/2026; Profound, 03/09/2026; Google, 20/08/2026; Shero Commerce via Search Engine Journal, 26/08/2026
No comércio, a lista de candidatos tem nome de arquivo. Depois do GPT-5.6, a recuperação por feed integrado no Shopping do ChatGPT passou de 8,26% para 61,54% das recomendações de produto em 10/07/2026. Os dez maiores lojistas subiram de 22,5% para 41,8% da participação. O número de lojistas únicos caiu de 13.524 para 10.607 entre 1º de julho e 24 de agosto, na base de 687 clientes da Profound (03/09/2026).
O feed de produto, o catálogo enviado em arquivo ao motor, virou a porta; a página do produto é lida depois. A especificação da OpenAI pede nove campos obrigatórios, entre eles identificador, título, marca, vendedor, disponibilidade e preço. Analistas de mercado dizem desde 04/09/2026 que o Shopping passou a mostrar só marcas com feed; a OpenAI não publicou essa regra, e a especificação não fala em exclusividade.
Para agentes que compram em nome do usuário, o site declara quem é em um endereço fixo. O Universal Commerce Protocol (UCP) é o protocolo de comércio que Google, Shopify, Amazon, Walmart, Microsoft, Meta, Etsy, Target, Stripe e outros co-desenvolvem. Ele pede que o lojista publique um perfil público em /.well-known/ucp, sem autenticação, segundo a documentação do Google atualizada em 25/08/2026. O Google faz a entrada pelo Merchant Center, em acesso antecipado nos Estados Unidos. É o mesmo raciocínio do feed: o agente lê a declaração antes de visitar a loja.
Somando as peças, o que um site declara para os motores em setembro de 2026 cabe em quatro linhas. O robots.txt diz a cada robô o que pode ler; o feed de produto entra se a empresa vende produto; o perfil UCP, se quer vender por agente; o botão de fonte preferida, se quer o selo no Google. Nenhum dos quatro é otimização de texto, e os quatro decidem antes do texto.
Otimizar a página ou entrar na lista?
Otimizar a página e esperar
Coluna a evitar
- Reescreve títulos, FAQs e parágrafos para "soar bem para a IA"
- Mede sucesso pela posição da própria página e por prompts com o nome da marca
- Não sabe em quais domínios o motor procura pela categoria
- Sem feed, o produto fica fora dos 61,54% das recomendações do Shopping que vêm de feed
- Trata Reddit, comparadores e diretórios como concorrentes
- Lê "marca mencionada" como se fosse "marca citada"
Entrar na lista de candidatos
Coluna recomendada
- Descobre, em três perguntas por motor, quais domínios são consultados na categoria
- Garante presença nos terceiros que o motor lê: comparadores, diretórios, marketplaces, imprensa do setor
- Envia o feed de produto e publica o perfil UCP quando vende produto
- Instala o botão de fonte preferida e pede a marcação a quem já é cliente
- Mantém o site aberto aos robôs de busca dos motores (OAI-SearchBot, Claude-SearchBot, PerplexityBot)
- Reporta menção e citação em duas linhas, com motor, modelo e data
Cenário ilustrativo: uma distribuidora de EPIs (equipamentos de proteção individual) com loja própria e 1.200 itens no catálogo gastou seis meses reescrevendo descrições de produto para a IA. Ao rodar três perguntas de compra no ChatGPT com busca ligada, a equipe vê os domínios consultados: dois marketplaces, um comparador do setor, o site de uma associação e um fabricante. A distribuidora não aparece em nenhum, e o Shopping não a mostra porque não há feed.
A conta muda de lugar. O feed sai em uma semana com o time de e-commerce e o cadastro no comparador custa uma tarde. A reescrita das 1.200 descrições volta para o fim da fila, porque age no passo em que o domínio já precisaria ter sido escolhido. Cenário ilustrativo, sem número de resultado: o teste do bloco seguinte é o que produz o número real da sua empresa.
Três erros que aparecem em proposta de fornecedor. Primeiro: prometer citação sem dizer em quais domínios o motor procura pela sua categoria; sem essa lista, a promessa é sobre o passo 3 de um funil que começa no passo 1. Segundo: apresentar "presença em IA" como um número só, misturando marca nomeada e página citada; peça as duas linhas. Terceiro: vender llms.txt (um arquivo de texto na raiz do site que descreve o conteúdo para modelos) como porta de entrada. O Google escreveu que ignora esse arquivo, e nenhum motor declarou usá-lo para escolher domínio.
Verificação rápida
O relatório de um fornecedor diz que a sua marca "aparece em 40% das respostas" do ChatGPT para a categoria. O que essa frase garante?
Faça agora (15 min)
Abra o ChatGPT com a busca ligada e reserve 15 minutos; o resultado é a lista de domínios da sua categoria e o lugar da sua marca nela.
Passo 1: Escreva três perguntas de compra da sua categoria, como um cliente escreveria
Uma de comparação (qual o melhor X para Y), uma de preço (quanto custa X) e uma de fornecedor (onde comprar X em Z).
Erro comum: Perguntar pelo nome da própria marca: isso testa reconhecimento, e não a lista de candidatos.
Passo 2: Rode cada pergunta no ChatGPT com a busca ligada e abra a lista de fontes
Anote os domínios consultados e os citados em duas colunas, e repita cada pergunta duas vezes, porque a resposta muda entre execuções.
Deu certo quando: Você tem entre 10 e 25 domínios anotados, com os que se repetem marcados.
Passo 3: Marque onde a sua marca aparece: nomeada, citada com link, ou ausente
Se ela é nomeada sem link, anote de qual domínio veio a informação; é esse terceiro que o motor está lendo no seu lugar.
Erro comum: Contar menção como citação. São duas linhas no relatório e duas ações diferentes.
Passo 4: Confira se o site tem o botão de fonte preferida do Google
Peça à equipe o link do botão incorporado ou a data prevista; só domínio ou subdomínio é elegível.
Deu certo quando: Há botão publicado, ou uma tarefa aberta com dono e data.
Passo 5: Se vende produto, confira se existe feed enviado e quem é o dono dele
Merchant Center, Shopify ou o feed da OpenAI com os nove campos obrigatórios; pergunte quantos itens vendidos estão no feed.
Erro comum: Descobrir que o feed existe e cobre uma fração do catálogo: cobertura de feed é o número a cobrar.
No fim você tem: a lista de domínios que o motor consulta na sua categoria, a posição da sua marca nela (nomeada, citada ou ausente) e duas verificações de infraestrutura (botão de fonte preferida e feed) com dono, o que basta para reordenar a proposta de qualquer fornecedor.
Resumo em três linhas: O motor escolhe em quais domínios buscar antes de ler qualquer página, e 16% a 17% das buscas de apoio do ChatGPT já nascem restritas a um domínio. A sua marca entra pela lista de candidatos (reconhecimento, terceiros, feed, fonte preferida), e menção e citação são duas linhas separadas no relatório. Na segunda-feira, rode as três perguntas no ChatGPT, anote os domínios e leve para a equipe a pergunta: estamos em algum deles, e quem é o dono do feed e do botão?
Perguntas frequentes deste capítulo
Se a minha página está muito bem escrita, ela não entra sozinha na lista?
Reddit e diretórios como G2 são concorrentes da minha página?
O botão de fonte preferida do Google muda o meu ranking?
Todos os capítulos de GEO Universal Framework
- 01GEO em quinze minutos: o que mudou e o que você decide
- 02Sete princípios com fonte: como este curso trata o problema
- 03O que é SEO e por que a base decide o resto
- 04Busca sem clique: o que os números de 2026 dizem de verdade
- 05O que é GEO e como ler os números do mercado
- 06Qual robô de IA pode ler o seu site: decida por escrito
- 07Sua empresa como entidade: o que o Google documenta, o que inventaram
- 08Dados estruturados depois da poda: o que ainda rende resultado
- 09O motor escolhe onde buscar antes de responder: entre na lista
- 10Busca local: endereço, perfil e o que a IA consegue ver
- 11Mais de um idioma: o que muda para ser citado lá fora
- 12Site grande: quando as suas próprias páginas competem entre si
- 13Conteúdo feito com IA: o que o Google proíbe e o que já é detectável
- 14Riscos que a diretoria assina: injeção de prompt, LGPD e log
- 15Permitir, cobrar ou bloquear os robôs de IA: a decisão por escrito
- 16ChatGPT Ads no Brasil: separar pago de orgânico antes de comprar
- 17Medir sem se enganar: três camadas e o relatório oficial do Google
- 18Ciclo mensal: quatro fases, portão de saída e relatório em cinco linhas
- 19Operar com agentes: qual modelo para qual tarefa, e quando não orquestrar
- 20Ler um case sem cair no conto: a rubrica dos cinco portões
- 21De onde veio esse número: quatro passos antes de repetir
- 22A proposta de GEO chegou: dez perguntas antes de assinar
- 23Etapa 1: o diagnóstico em 16 pilares e o portão de entrada
- 24Etapa 2: robô certo entra, página existe sem JavaScript, markup ainda serve
- 25Etapa 3: escrever o trecho citável e provar que a IA citou
- 26Etapa 4: concentrar presença fora do site, e o custo de pulverizar
- 27Etapa 5: o site que o agente consegue ler, comparar e comprar
- 28Etapa 6: medir sem se enganar, e decidir manter ou reverter
- 29Etapa 7: 90 dias, três dependências e o critério de parada