GEO Universal Framework · Capítulo 24 de 29 · 28 min
Etapa 2: robô certo entra, página existe sem JavaScript, markup ainda serve
Você sai sabendo o que a etapa técnica entrega e o que cobrar: o robô de citação atendido, o conteúdo presente sem JavaScript, os três limiares de velocidade e o markup que ainda tem função em 2026.
Este capítulo faz parte do curso gratuito GEO Universal Framework. Para marcar como concluído e salvar o progresso, abra este capítulo na página do curso.
A etapa técnica do GEO é o trabalho técnico de SEO feito com disciplina, mais uma decisão que o SEO antigo não tinha: qual robô de inteligência artificial entra no site. Serve para quem vai executar e para quem vai cobrar: você sai sabendo o que cada camada entrega, do acesso dos robôs à renderização (a montagem da página, no servidor ou no navegador), dos dados estruturados à notificação aos motores. Você ganha a matriz de robôs por função, os dois controles do Google lado a lado e a lista do markup que perdeu função em 2026.
Para quem decide: a decisão desta etapa é aprovar a política de acesso dos robôs e exigir que o conteúdo exista no HTML servido, antes de qualquer gasto com texto novo. Errar custa invisibilidade sem sintoma: um firewall que devolve 403 ao OAI-SearchBot tira a marca das respostas do ChatGPT e nenhum relatório de tráfego acusa. Pergunta para a equipe: qual código de resposta o servidor deu a OAI-SearchBot, Claude-SearchBot e PerplexityBot nos últimos sete dias?
Ao final você consegue: (1) Aprovar a matriz de robôs por fornecedor e função e decidir qual bloquear sem tirar a marca das respostas. (2) Cobrar a prova de acesso no log de servidor (o livro de visitas do site, que registra cada robô que entrou), em vez de um teste manual. (3) Decidir entre renderizar no servidor ou no navegador pelo argumento de 2026 e recusar o número falso sobre velocidade. (4) Priorizar o markup que ainda tem função e dimensionar o que muda na Cloudflare a partir de 15/09/2026.
Verificação rápida
Pré-teste, antes de ler o módulo. Cenário ilustrativo: uma agência publicou llms.txt (o arquivo de texto para modelos na raiz do site) em 14 domínios de clientes no primeiro trimestre de 2026 e listou o arquivo no relatório mensal como entrega de estruturação técnica de GEO. O que essa entrega realmente comprova?
Antes de qualquer implementação, a correção de postura vem da fonte mais autorizada que existe. O guia oficial do Google, publicado em 15/05/2026 e atualizado em 10/07/2026, afirma: "optimizing for generative AI search is optimizing for the search experience, and thus still SEO". A mesma página diz que não existe markup especial de schema.org (o vocabulário de dados estruturados que descreve a página para máquinas) a adicionar para IA generativa.
Isso reorganiza a etapa inteira. O trabalho técnico de GEO é o trabalho técnico de SEO executado com disciplina, mais uma preocupação que o SEO clássico não tinha: a matriz de crawlers. Crawlers são os robôs que leem o site, como um leitor que visita cada página; a matriz os separa pela função que cada um cumpre.
As quatro camadas desta etapa têm ordem de auditoria, e a figura seguinte mostra por quê: acesso primeiro, porque é a única camada capaz de produzir invisibilidade total sem sintoma em nenhuma outra ferramenta; renderização depois; estrutura em terceiro; notificação por último.
Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
O que você perde ao bloquear cada robô?
| Agente | Fornecedor | Função na matriz | O que o bloqueio produz |
|---|---|---|---|
| GPTBot | OpenAI | Treino | Sai do treino. A presença nas respostas de busca do ChatGPT permanece. |
| OAI-SearchBot | OpenAI | Busca e citação | Some das respostas com busca do ChatGPT. A OpenAI escreve que site excluído dele "will not be shown in ChatGPT search answers". |
| ChatGPT-User | OpenAI | Ação do usuário | Quebra a busca que o próprio usuário pediu ao abrir a sua URL. |
| OAI-AdsBot | OpenAI | Validação de anúncio | Só visita páginas enviadas como anúncio no ChatGPT. Bloqueado, a página de destino não passa na validação. |
| ClaudeBot | Anthropic | Treino | Sai do treino. A busca do Claude continua alcançando o site. |
| Claude-SearchBot | Anthropic | Busca e citação | Some das respostas com busca do Claude. |
| PerplexityBot | Perplexity | Busca e citação | Some do índice de citação da Perplexity. Respeita robots.txt. |
| Perplexity-User | Perplexity | Ação do usuário | Em geral ignora robots.txt; só firewall ou regra de servidor o detém, e deter quebra o pedido do usuário. |
| Meta-WebIndexer | Meta | Busca e citação | Some das citações do Meta AI (Instagram, WhatsApp, Facebook). A Meta diz que liberá-lo "helps Meta cite and link to that content". |
| Google-Extended | Treino e grounding de Gemini e Vertex AI | Sai do treino. Não impede aparição em AI Overviews nem em AI Mode e não afeta ranking. | |
| Googlebot | Busca, e alimenta as features generativas | Sai da busca inteira. Bloquear aqui para escapar da IA custa a indexação. |
A coluna de função é o que quase todo material de mercado erra. Ensinar a bloquear GPTBot para sair da IA prescreve a coluna errada: quem alimenta a resposta de busca é OAI-SearchBot. Só a linha de busca e citação se verifica com curl e log de servidor; as outras se declaram no robots.txt (o arquivo em que o site diz a cada robô o que pode ler) e nunca aparecem em relatório de tráfego.
Fonte: Documentação pública de crawlers de OpenAI, Anthropic, Perplexity, Meta e Google, aberta em 07/09/2026
Do lado do Google existem dois controles oficiais, e eles fazem coisas diferentes. Google-Extended, declarado no robots.txt, trata de treinamento e grounding (o uso do conteúdo para embasar respostas) nos Gemini Apps e no Vertex AI. A documentação de 14/07/2026 diz que ele não afeta a inclusão do site na Busca nem é usado como sinal de ranking.
O controle "Search generative AI" do Search Console (o painel gratuito do Google para donos de site) é o que tira o site de AI Overviews, AI Mode e recursos generativos do Discover. Tem três opções, incluir, excluir ou herdar da propriedade principal; vale no nível do site, não é sinal de ranking no restante da Busca, não afeta treinamento e faz efeito em um a dois dias. Foi anunciado em 03/06/2026 e está disponível para todos os sites do mundo desde 31/08/2026.
Para granularidade por página, os controles são os de sempre: nosnippet, data-nosnippet, max-snippet e noindex. Eles limitam o que a IA pode mostrar, com o efeito colateral de encolher também o snippet orgânico, o trecho que aparece abaixo do título no resultado clássico.
Os dois controles do Google lado a lado, e a granularidade por página
| Controle | O que faz | O que não faz |
|---|---|---|
| Google-Extended (robots.txt) | Retira o conteúdo do treinamento e do grounding em Gemini Apps e Vertex AI | Não tira o site de AI Overviews nem de AI Mode; não afeta inclusão nem ranking |
| Search generative AI (Search Console) | Exclui o site de AI Overviews, AI Mode e Discover generativo; incluir, excluir ou herdar; efeito em 1 a 2 dias | Não afeta treinamento (para isso, Google-Extended); não é sinal de ranking no restante da Busca |
| nosnippet, data-nosnippet, max-snippet, noindex (por página) | Limitam o trecho exibido, ocultam partes da página ou a tiram do índice | Não separam IA de orgânico: o snippet clássico encolhe junto |
A pergunta que decide qual controle usar é uma só: a empresa quer sair do treino ou sair da resposta? Treino é Google-Extended; resposta é o controle do Search Console; nenhum dos dois altera a posição orgânica.
Fonte: Google Search Central, documentação de crawlers comuns (14/07/2026) e de recursos de IA; Search Console Help, artigo 16908024; abertos em 07/09/2026
# Verificacao de acesso por crawler -- rode antes de qualquer diagnostico
# Cada linha deve devolver HTTP/2 200. Qualquer 403, 429 ou 5XX aqui e
# citação perdida de forma silenciosa: não aparece em nenhum outro relatório.
curl -A "OAI-SearchBot/1.0; +https://openai.com/searchbot" -I https://seudominio.com/pagina
curl -A "Claude-SearchBot" -I https://seudominio.com/pagina
curl -A "PerplexityBot" -I https://seudominio.com/pagina
curl -A "Meta-WebIndexer" -I https://seudominio.com/pagina
curl -A "Googlebot" -I https://seudominio.com/pagina
# Por que estes cinco e nao a lista inteira:
# escolhi so a coluna "busca e citacao" da matriz mais o Googlebot, porque sao
# os únicos com efeito de curto prazo sobre aparecer ou não em resposta gerada.
# Testar GPTBot aqui nao informa nada sobre visibilidade hoje.
# ATENÇÃO ao falso negativo: um curl que devolve 200 não prova acesso liberado.
# WAF e CDN costumam liberar por IP de origem e bloquear por assinatura de
# comportamento em volume. A prova real esta no log de servidor, filtrando por
# user agent e por faixa de IP publicada pelo operador, com retencao de 90 dias.
# Reporte apenas hits verificados por faixa de IP; user agent e falsificavel.
# Relatório semanal mínimo, em ordem de utilidade prática:
# 1. codigos de resposta por bot (acha bloqueio)
# 2. URLs mais rastreadas por bot de citacao (acha o que interessa a eles)
# 3. cobertura: paginas prioritarias nunca tocadas (acha buraco de descoberta)
# 4. latencia e peso da resposta (acha custo de crawl)
# 5. serie temporal por provedor (acha mudanca de comportamento)Sem consultar a matriz: um cliente pede para "tirar o site das IAs, mas continuar aparecendo no ChatGPT quando alguém busca". Escreva quais agentes você bloqueia, quais você mantém liberados e qual a única frase honesta que você diz sobre o que já foi treinado antes do bloqueio. Depois explique por que Google-Extended no robots.txt não atende esse pedido, e qual dos dois controles do Google atenderia um pedido parecido para o AI Mode.
O efeito de segunda ordem que quase ninguém ensina, e que muda a resposta do exercício acima. A Cloudflare (a camada de borda que fica entre o visitante e o servidor de boa parte dos sites) classifica bots em Search, Agent e Training desde 01/07/2026. A partir de 15/09/2026, em domínios novos, "bots classified as Training or as Agent will be blocked on pages that display ads, and Search will remain allowed". O detalhe caro está na frase seguinte da documentação: "Mixed-purpose crawlers that combine Search and Training will also be blocked by all configurations". Googlebot combina as duas funções. Em um site atrás da Cloudflare, ligar o bloqueio de treino pode derrubar a indexação de busca como efeito colateral, semanas depois, longe o bastante para ninguém ligar as duas coisas. O gatilho é domínio novo com página que exibe anúncio; o plano contratado não entra, e nenhum texto da Cloudflare fala em plano gratuito nem em "todos os robôs de IA". O changelog acrescenta que "All customers can opt out of the new defaults at any time before September 15". Desde 21/08/2026 o Bot Preference Sync, do plano gratuito ao Enterprise, escreve no robots.txt o que o painel decidir para as três categorias, e a linha de Content Signals ganhou a extensão content-use, ainda em teste. Antes de aprovar qualquer bloqueio, peça a configuração da borda e um teste em ambiente controlado. A decisão parece de conteúdo e é de infraestrutura.
Estamos em 08/09/2026. O jurídico da casa quer bloquear o treino de modelos sobre o acervo, a decisão foi tomada em reunião de conselho e o prazo é o fim do mês. O site roda atrás da Cloudflare, tem anúncios nas páginas de acervo aberto e a busca orgânica responde por boa parte das assinaturas novas. A partir de 15/09/2026 a Cloudflare aplica padrões novos a domínios novos; o seu domínio é antigo, então o que vale nele é a configuração que você mandar ligar. O time de tecnologia pergunta apenas qual chave ligar.
Qual encaminhamento você leva para a reunião de terça, considerando que a decisão de conselho já está tomada e que o prazo é curto?
Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
Camada 2, renderização, é onde o material de 2024 mais envelheceu. Existem três jeitos de montar a página: no servidor (SSR, o HTML chega pronto ao navegador), no navegador (CSR, o HTML chega vazio e o JavaScript monta o conteúdo depois) e a pré-renderização (uma cópia pronta, gerada antes, servida a quem pedir).
Em 04/03/2026 o Google removeu orientação obsoleta do "JavaScript SEO basics", porque renderiza JavaScript de forma confiável há anos, e o dynamic rendering (servir uma versão pronta só para robôs) segue classificado como contorno, sem virar recomendação.
O argumento a favor de renderizar no servidor continua válido em 2026, por dois motivos que não são o antigo. O primeiro é velocidade, que se paga em Core Web Vitals (as três medidas oficiais de velocidade e estabilidade da página) e em conversão. O segundo é que o Googlebot não é o único leitor que importa: os crawlers de busca e citação dos outros fornecedores não executam JavaScript com a mesma confiabilidade, e o comportamento varia por agente e por período.
Como não existe documentação pública estável sobre a capacidade de renderização de cada um deles, a postura defensável é conservadora: o conteúdo principal e o JSON-LD (o bloco de dados estruturados escrito dentro da página) devem existir no HTML servido. Isso é uma decisão de risco; afirmação categórica sobre o que cada crawler faz ninguém tem. Evite repetir a versão categórica que circula em material antigo ("crawlers de IA não renderizam JavaScript, exceto Gemini"): não há fonte primária que a sustente.
Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
Os três limiares oficiais de Core Web Vitals, sem mudança até 07/09/2026
2,5 s
LCP, limiar de bom
Largest Contentful Paint, o tempo até o maior elemento aparecer, medido no percentil 75
200 ms
INP, limiar de bom
Interaction to Next Paint, a demora para a página reagir a um toque. Substituiu o FID em março de 2024; a cifra de 150 ms que circula contradiz a documentação
0,1
CLS, limiar de bom
Cumulative Layout Shift, o quanto a página pula enquanto carrega, sem alteração no período
p75
Percentil de avaliação
A média aprova páginas que o percentil 75 reprova
Fonte: web.dev/articles/vitals, página atualizada em 31/10/2024, aberta em 07/09/2026
O percentil 75 costuma ser a parte ignorada e é a que muda a decisão. Otimizar a média esconde a cauda, e a cauda é composta pelos dispositivos e conexões dos usuários que você menos vê no seu próprio laptop. Uma página com média excelente e percentil 75 vermelho reprova.
A novidade real do período é a Soft Navigations API, em origin trial (teste aberto a sites inscritos) do Chrome 147 ao 149, com disponibilidade sem flag prevista para o Chrome 151. Ela importa para aplicações de página única, em que a navegação entre telas não dispara carregamento de documento e por isso escapa da medição clássica.
Ressalva oficial que precisa acompanhar qualquer menção: ainda não foi decidido como, ou se, essas navegações entram no CrUX, o painel de dados reais de uso do Chrome. Trate como capacidade emergente de instrumentação; em métrica de reporte ela ainda não virou.
Camada 4, notificação. O Google não aceita IndexNow: o protocolo, que avisa o motor de que uma URL mudou, serve Bing, Yandex, Naver, Seznam e Yep. Para o Google os canais continuam sendo sitemap (a lista de URLs do site) e Search Console. O protocolo segue útil por causa dos motores que o adotam, e o que passa a ser obrigatório é dizer no relatório qual motor foi notificado. Um deploy anunciado como "notifica os motores de busca automaticamente", apresentado ao cliente como ganho de indexação no Google, descreve algo que não acontece.
Qual marcação ainda serve em 2026?
| Item | Status em 07/09/2026 | O que fazer |
|---|---|---|
| FAQPage | Exibição encerrada em 07/05/2026 (changelog de 08/05); documentação removida em 15/06/2026 e a URL antiga redireciona para o changelog. Vocabulário válido, sem penalidade | Manter se já existe, sem priorizar. Priorizar pares de pergunta e resposta legíveis no HTML |
| HowTo | Fora da galeria oficial, descontinuado desde set/2023 | Remover do plano |
| Course info | Aposentado em jun/2025, enquanto Course list continua na galeria | Verificar qual dos dois você usa antes de remover |
| Book Actions | Aposentado em jun/2025 e depois desaposentado | Conferir a galeria vigente em vez da lista de aposentadoria |
| Practice Problems | Removido em jan/2026 | Remover do plano |
| Dataset | Alimenta o Dataset Search; o Google Search não o usa | Usar só quando o objetivo declarado é o Dataset Search |
| Organization, Article, Product, Breadcrumb, Video, Local business | Vigentes na galeria de 25 tipos, atualizada em 15/06/2026 | Base de qualquer implementação |
A pegadinha dupla está nas linhas de Course info e de Book Actions: listas de tipos aposentados circulam por anos sem revisão, e pelo menos um item já voltou. Consulte a galeria vigente antes de remover markup em produção, porque implementar markup sem função consome revisão e manutenção sem retorno, e remover markup vivo custa resultado.
Fonte: Google Search Central, changelog e galeria de resultados aprimorados (25 tipos, atualizada em 15/06/2026), abertos em 07/09/2026
Sobre sameAs (a propriedade que aponta para os perfis oficiais da empresa em outros sites), o que a fonte primária sustenta é modesto e ainda assim suficiente para justificar o trabalho. A documentação de Organization fala em URLs de páginas em outros sites com informação adicional sobre a organização, não menciona @id e não estabelece propriedades obrigatórias.
A prática defensável, então, é manter uma lista curta de perfis oficiais com nome exato idêntico e a mesma descrição-âncora em todos eles. Priorize Wikidata, Wikipedia e ORCID quando existirem, seguidos de LinkedIn, GitHub e o site oficial. O motivo é razoável e verificável em parte: consistência entre perfis reduz ambiguidade de desambiguação. O motivo que você não deve usar é uma pontuação de confiança de entidade, que não existe em documentação do Google.
Estrutura não salva página gerada em massa. Em 07/09/2026, no Bluesky, John Mueller, do Google, respondeu a um dono de site que gerou páginas em escala: "Our systems have possibly lost faith in your site providing good value to users based on the old pages". Ele acrescentou que SEO programático (páginas geradas por molde a partir de uma base de dados) "often leads to a site that's either spam, borderline spam, or low quality". É uma resposta individual, sem peso de documentação, mas descreve o mecanismo: a avaliação de qualidade é no nível do site, e as páginas ruins contaminam as boas. Antes de aprovar um lote de mil páginas, pergunte quantas delas alguém leria até o fim.
llms.txt serve para alguma coisa?
Como alavanca de busca, desmentido
Coluna a evitar
- O Google afirma que você não precisa criar arquivos legíveis por máquina, arquivos de texto para IA, markup ou Markdown novos para aparecer no Google Search.
- O changelog de 15/06/2026 registra que llms.txt não é necessário, não ajuda e não prejudica.
- John Mueller comparou publicamente o arquivo à meta tag keywords.
- Se o objetivo escrito no relatório é aparecer no ChatGPT, tire do escopo e realoque as horas para a camada 1, onde os bugs de verdade moram.
Como documentação para agentes, defensável
Coluna recomendada
- Agentes de IDE como Cursor, Claude Code, Copilot e Windsurf consomem sumários legíveis por máquina com resultado prático.
- Servidores MCP (o protocolo que conecta um modelo a ferramentas e documentos) usam o mesmo tipo de sumário para navegar documentação extensa.
- Se o seu produto tem API, SDK ou documentação para desenvolvedores, publicar custa pouco e ajuda quem integra.
- No relatório, este item entra como entrega de developer experience, com o efeito de busca declarado como nulo.
O tamanho do buraco na camada 1 tem medida de mercado. A SALT.agency auditou 50 sites grandes em três camadas, segundo a Search Engine Journal de 01/09/2026: recuperabilidade média de 74,4%, atribuição e significado em 38,5% e transação e descoberta por agente em 2,1%. Dos 48 sites com dado na terceira camada, 46 marcaram zero, e 70% dos 50 tinham JSON-LD. A leitura da auditoria é que quase dois terços deixam ao acaso a pergunta de qual robô de IA acessa qual conteúdo.
A terceira camada tem endereço desde 2026. O UCP (Universal Commerce Protocol, o padrão para agentes de compra conversarem com lojas) é co-desenvolvido por 21 empresas, entre elas Google, Shopify, Amazon, Walmart, Microsoft e Meta. O lojista publica o perfil em /.well-known/ucp, público e sem autenticação. O guia do Google de otimização para IA cita o UCP como opcional.
Para esta etapa, a decisão é só uma: se a empresa vende por agente, o perfil entra no backlog da camada 3; se não vende, a camada 3 não existe para ela, e o zero da auditoria não é defeito.
Heurística de priorização quando o tempo é curto: uma hora gasta lendo log de crawler rende mais que uma semana gasta em markup. Bloqueio inadvertido em CDN, WAF ou robots.txt é a causa raiz mais comum e mais barata de corrigir, e é a única que produz invisibilidade total sem sintoma visível em nenhuma outra ferramenta. Comece pelo 403, termine no JSON-LD.
Monte a matriz de crawlers do seu próprio site em quatro linhas: agente, função na matriz, status HTTP observado e origem da observação (curl ou log). Depois escreva a decisão de política de bloqueio que você recomendaria, com uma frase de justificativa e uma frase declarando o que essa decisão não resolve. Se o seu site está atrás da Cloudflare, acrescente o que muda a partir de 15/09/2026.
Tarefa: puxe sete dias de log de acesso do seu servidor ou da sua camada de borda e produza uma tabela de duas colunas. Coluna A, agentes de treino (GPTBot, ClaudeBot, CCBot, meta-externalagent). Coluna B, agentes de busca, citação e ação do usuário (OAI-SearchBot, Claude-SearchBot, PerplexityBot, Meta-WebIndexer, ChatGPT-User, Claude-User, Perplexity-User). Para cada agente registre volume de hits e distribuição de códigos de resposta. Em seguida, liste as páginas prioritárias que nenhum agente da coluna B tocou no período. Critério de sucesso: você identifica pelo menos um destes três achados, e todos são acionáveis no mesmo dia. Primeiro, algum agente da coluna B recebendo 403, 429 ou 5XX, o que é bloqueio a corrigir na borda. Segundo, uma página prioritária com zero hits da coluna B, o que é problema de descoberta e pertence à Etapa 4. Terceiro, nenhum dos dois, e nesse caso a camada de acesso está saudável e você pode gastar o próximo ciclo em estrutura com a consciência tranquila. Se o seu relatório atual somava tudo em uma única linha chamada "bots de IA", você acabou de recuperar a informação que essa soma destruía.
Faça agora (15 min)
Quinze minutos com quem administra o site; o resultado é a camada de acesso provada e a lista do que cobrar nas outras três.
Passo 1: Peça o código de resposta dado a quatro robôs de citação nos últimos sete dias
OAI-SearchBot, Claude-SearchBot, PerplexityBot e Meta-WebIndexer: total de acessos e quantos receberam 403, 429 ou 5XX, tirado do log ou do painel do CDN.
Deu certo quando: Quatro linhas com número; qualquer 403 vira tarefa de hoje.
Erro comum: Aceitar um teste manual de curl como prova: o firewall libera o teste e bloqueia o robô em volume.
Passo 2: Confira os dois controles do Google e quem decidiu cada um
No Search Console, o estado do controle Search generative AI (incluir é o padrão); no robots.txt, se Google-Extended está bloqueado e por quê.
Deu certo quando: Você sabe dizer o estado dos dois e o nome de quem decidiu.
Passo 3: Desligue o JavaScript no navegador e abra a página mais importante
Com JavaScript desativado, o texto principal, o preço e o contato precisam aparecer; se a tela fica em branco, o conteúdo depende de montagem no navegador.
Erro comum: Testar só a home: a página de produto ou de serviço é a que o robô de citação precisa ler.
Passo 4: Pegue os três números de velocidade no relatório do Search Console
Em Core Web Vitals, veja LCP, INP e CLS no percentil 75 de celular e compare com 2,5 s, 200 ms e 0,1.
Erro comum: Aceitar média em vez de percentil 75: a média aprova página que o Google reprova.
Passo 5: Se o site usa Cloudflare, agende a revisão de 15/09/2026 como mudança de SEO técnico
Peça a configuração das categorias Search, Agent e Training e um teste em subdomínio com log aberto antes de tocar no domínio principal.
Erro comum: Ligar Training como se fosse política de conteúdo: crawlers que combinam busca e treino podem ser bloqueados em todas as configurações.
No fim você tem: os códigos de resposta dos quatro robôs de citação, o estado dos dois controles do Google com dono, a prova de que a página principal existe sem JavaScript, os três números de velocidade no percentil 75 e, se houver Cloudflare, a revisão agendada.
Resumo em três linhas: A etapa técnica de GEO é SEO técnico com disciplina mais a matriz de robôs: bloquear o de treino não tira a marca das respostas, bloquear o de busca por engano tira, e só o log prova. No Google, Google-Extended trata de treino e o controle do Search Console tira o site de AI Overviews e AI Mode; renderização, velocidade no percentil 75 e markup vigente vêm depois do acesso. Na segunda-feira, peça os códigos de resposta dos quatro robôs de citação nos últimos sete dias, confira os dois controles e, se o site usa Cloudflare, agende a revisão de 15/09/2026.
Perguntas frequentes deste capítulo
Um curl que devolve 200 prova que o crawler está liberado?
Devo migrar o site para renderização no servidor por causa dos crawlers de IA?
Meu site está na Cloudflare. O que muda a partir de 15/09/2026?
Quem tira o site de AI Overviews e AI Mode: Google-Extended ou o Search Console?
Vale remover o markup FAQPage que já está em produção?
Todos os capítulos de GEO Universal Framework
- 01GEO em quinze minutos: o que mudou e o que você decide
- 02Sete princípios com fonte: como este curso trata o problema
- 03O que é SEO e por que a base decide o resto
- 04Busca sem clique: o que os números de 2026 dizem de verdade
- 05O que é GEO e como ler os números do mercado
- 06Qual robô de IA pode ler o seu site: decida por escrito
- 07Sua empresa como entidade: o que o Google documenta, o que inventaram
- 08Dados estruturados depois da poda: o que ainda rende resultado
- 09O motor escolhe onde buscar antes de responder: entre na lista
- 10Busca local: endereço, perfil e o que a IA consegue ver
- 11Mais de um idioma: o que muda para ser citado lá fora
- 12Site grande: quando as suas próprias páginas competem entre si
- 13Conteúdo feito com IA: o que o Google proíbe e o que já é detectável
- 14Riscos que a diretoria assina: injeção de prompt, LGPD e log
- 15Permitir, cobrar ou bloquear os robôs de IA: a decisão por escrito
- 16ChatGPT Ads no Brasil: separar pago de orgânico antes de comprar
- 17Medir sem se enganar: três camadas e o relatório oficial do Google
- 18Ciclo mensal: quatro fases, portão de saída e relatório em cinco linhas
- 19Operar com agentes: qual modelo para qual tarefa, e quando não orquestrar
- 20Ler um case sem cair no conto: a rubrica dos cinco portões
- 21De onde veio esse número: quatro passos antes de repetir
- 22A proposta de GEO chegou: dez perguntas antes de assinar
- 23Etapa 1: o diagnóstico em 16 pilares e o portão de entrada
- 24Etapa 2: robô certo entra, página existe sem JavaScript, markup ainda serve
- 25Etapa 3: escrever o trecho citável e provar que a IA citou
- 26Etapa 4: concentrar presença fora do site, e o custo de pulverizar
- 27Etapa 5: o site que o agente consegue ler, comparar e comprar
- 28Etapa 6: medir sem se enganar, e decidir manter ou reverter
- 29Etapa 7: 90 dias, três dependências e o critério de parada