A campanha não morre no leilão, morre na porta da página
Faltam 67 dias para a Black Friday de 27 de novembro de 2026. Nesse intervalo, o gestor de mídia paga revisa público, criativo, orçamento e curva de lance, e deixa de fora a única camada capaz de reprovar a campanha inteira sem alerta legível: a resposta HTTP que a landing page de oferta devolve para o robô que revisa o anúncio.
Minha tese é contraintuitiva para quem vive de painel de mídia. O problema quase nunca está no robots.txt. Está na camada que vem depois dele: CDN, firewall de aplicação, desafio de navegador (challenge), limite de requisição, geobloqueio, proteção anti-scraping do plugin de e-commerce. Essa camada é invisível para o time de performance e fica mais agressiva justamente quando o tráfego explode. A loja descobre o bloqueio no pior dia possível.
O contexto não ajuda. Segundo o Global Digital Shopping Index 2026 da Visa com a PYMNTS Intelligence, divulgado em 18 de setembro de 2026, 74% dos varejistas brasileiros esperam que agentes de IA respondam por ao menos 5% das vendas digitais em dois anos, e só 15% se dizem preparados. Na pesquisa do Google de 26 de agosto de 2026, 15% dizem que vão usar IA para avaliar se a promoção compensa.
As 18 perguntas abaixo são as que eu de fato recebo de gestor de mídia, na ordem em que o problema aparece. Aviso desde já: liberar o robô não aprova o seu anúncio nem garante que a IA vá citar a sua loja. Liberar o robô remove um motivo de reprovação, e só. É pouco, é obrigatório, e é barato perto de descobrir isso em 27 de novembro.
Quem é quem entre os robôs da OpenAI
Quatro nomes aparecem no seu log e fazem trabalhos diferentes. Tratar os quatro como um bloco único é a origem da maioria das decisões erradas que eu vejo.
Qual a diferença entre OAI-AdsBot, OAI-SearchBot, GPTBot e ChatGPT-User?
Finalidade. O OAI-AdsBot valida e revisa as landing pages dos anúncios do ChatGPT. O OAI-SearchBot faz descoberta para busca, resumos e trechos. O GPTBot coleta conteúdo para uso relacionado a potencial treinamento de modelo, e a decisão sobre ele é independente das outras. O ChatGPT-User busca uma página porque um usuário pediu naquele instante. Quatro finalidades, quatro decisões separadas, e o documento de bots da OpenAI descreve cada uma.
Qual robô precisa passar para o meu anúncio do ChatGPT ser aprovado?
O OAI-AdsBot. O guia para anunciantes da OpenAI exige o OAI-AdsBot e recomenda o OAI-SearchBot. A separação é útil: o primeiro é requisito da campanha paga, o segundo é a porta da presença orgânica dentro do ChatGPT. Quem libera só o AdsBot aprova anúncio e continua invisível quando o usuário pergunta sem clicar em nada. O GPTBot não entra nessa conta: é decisão editorial e jurídica, não requisito de aprovação, e derrubá-lo junto com o AdsBot por descuido é o erro que eu mais corrijo.
Se eu liberar o OAI-AdsBot, meu anúncio é aprovado?
Não. Liberar o acesso remove um motivo de reprovação, e só. A revisão continua avaliando política de conteúdo, oferta, categoria e página de destino. Permissão de acesso é pré-requisito, não veredito, e isso precisa estar na expectativa do cliente antes de a campanha subir.
O Allow no robots.txt e o 403 que vem depois
Aqui mora a tese. O robots.txt é declaração de intenção; o acesso real é decidido por outras cinco ou seis camadas, e nenhuma delas lê o seu robots.txt.
Coloquei Allow no robots.txt e a revisão continuou falhando. O que ficou faltando?
Um Allow no robots.txt não resolve um HTTP 403 posterior. O guia da OpenAI lista o caminho que a revisão precisa atravessar: robots.txt, CDN, firewall, desafios de verificação, autenticação e limites de requisição. O robots.txt é a primeira porta de seis. Se a CDN devolve 403, se o WAF devolve 406, se o challenge entrega tela de verificação em vez do HTML da oferta, a revisão vê um site que não entrega a página. E o arquivo continua dizendo Allow, com toda a razão e nenhum efeito.
Como eu descubro qual camada está devolvendo o bloqueio?
Pedindo a página com o user agent do robô, a partir de um IP que não seja o do escritório, e lendo a resposta. Anote quatro coisas por teste: código HTTP, tamanho do corpo, cabeçalhos de servidor e se a oferta aparece no HTML inicial. Um 200 que devolve tela de verificação é pior que um 403, porque parece sucesso no monitoramento. Cruze com o log do servidor e o painel da CDN no mesmo minuto: a camada culpada aparece na diferença.
O ChatGPT-User obedece ao meu robots.txt?
Pode não obedecer, e a documentação da OpenAI diz isso de forma direta: como a ação parte do usuário, as regras de robots.txt podem não se aplicar. Não é deslealdade, é outra categoria de requisição. A consequência é séria: se o seu plano de proteger uma área privada era escrever Disallow, o plano não existe. O FAQ de publishers e desenvolvedores da OpenAI também registra que esse fetcher não é critério de inclusão na busca.
Se o robots.txt não segura o ChatGPT-User, como eu protejo o que é privado?
Com controle real de acesso: autenticação, sessão, permissão por papel, verificação no servidor. O que é privado devolve 401 ou 403 para qualquer requisição sem credencial, humana ou não. O robots.txt orienta bots educados e nunca foi mecanismo de segurança. Escrevi sobre esse limite em como deixar o site pronto para agentes de IA sem virar vetor de prompt injection, e a régua vale inteira na temporada.
O que liberar e o que não liberar
A pressa produz dois extremos igualmente ruins: liberar tudo para parar de apanhar, ou liberar nada e culpar a plataforma. Nenhum dos dois é inventário.
Preciso liberar /admin, checkout ou API privada para a revisão passar?
Não. Nenhuma dessas áreas faz parte da revisão de uma landing page de oferta, e a orientação da OpenAI não autoriza liberar diretórios inteiros sem inventário. Libere o que a revisão precisa ver: a landing page, os recursos estáticos que ela carrega, as imagens e as páginas de produto ligadas à campanha. Painel administrativo, rota de checkout com dado de cliente e API interna ficam de fora, porque ampliam superfície de risco sem nenhum ganho de aprovação. Se alguém propuser um Allow na raiz para resolver rápido, é hora de dizer não por escrito.
Minha imagem de produto vem de outro domínio. Isso entra na conta?
Entra, e é uma das falhas mais frequentes que eu encontro. O guia da OpenAI orienta verificar também o host da imagem quando há feed de produto. É comum a loja estar em um domínio e as imagens num CDN de mídia, num bucket de objeto ou num subdomínio de terceiro, cada um com política própria e um WAF que ninguém lembra que existe. Teste o host da imagem pelo mesmo método da pergunta anterior: feed com imagem inacessível é anúncio de produto sem foto.
Tenho noindex em algumas páginas de oferta. Isso atrapalha a revisão?
Depende do que você quer, e o ponto técnico importa: o noindex só é obedecido se o robô conseguir buscar a página e ler a diretiva. Página bloqueada no acesso é página cujo noindex nunca foi lido, o pior dos dois mundos, com efeito incerto e diagnóstico impossível. Se a oferta precisa ficar fora da busca por decisão comercial, mantenha o acesso liberado e o noindex legível. Se a oferta precisa ser encontrada, tire o noindex agora, e não em 26 de novembro.
O que quebra no pico e só no pico
Tudo aqui funciona em outubro e falha na semana do evento, porque a defesa do site é adaptativa por desenho.
Por que a página passa em outubro e falha na semana da Black Friday?
Porque as camadas de proteção são sensíveis a volume. Limite de requisição por IP, bot management adaptativo, challenge que sobe de nível quando o tráfego foge da média, escalonamento que devolve 503, cache que passa a servir versão reduzida. Nenhuma dessas regras distingue o robô que revisa o seu anúncio de um raspador de preço de concorrente, e no pico os dois se parecem muito. Teste feito em dia calmo mede um site que não existe mais no dia 27.
Meu WAF liga proteção extra quando o tráfego sobe. Como eu evito derrubar o robô junto?
Três providências, nesta ordem. Uma regra explícita de permissão para os agentes que você decidiu liberar, validada por IP oficial e não só por texto de user agent, para que sobreviva ao modo agressivo. Uma exceção de limite de requisição para essas chamadas, porque limite genérico atinge robô educado antes de atingir abuso real. E monitoramento que grave hora a hora, entre 20 e 30 de novembro, a resposta dada a esses agentes. A mesma disciplina vale para o geobloqueio: a loja barra tráfego estrangeiro, o robô sai de infraestrutura fora do Brasil, e a lista de exceção precisa ser mais nova que a última alteração de regra.
Quanto tempo antes do dia 27 eu preciso ter isso resolvido?
A recomendação de mercado para o planejamento de Black Friday é começar de 45 a 60 dias antes, e ela cabe aqui. Hoje estamos a 67 dias. A minha régua: acesso resolvido e testado até 30 de outubro, congelamento de mudanças de infraestrutura a partir de 20 de novembro, e reteste diário entre 24 e 27 de novembro. Depois do dia 20, toda alteração de WAF vira risco sem tempo de diagnóstico. Prazo de infraestrutura não negocia com pressa de campanha.
A página de oferta que some depois da data
A landing page de Black Friday é o conteúdo mais perecível da loja e o mais mal gerenciado. Nasce em novembro, recebe todo o link da campanha e some em dezembro, levando junto tudo o que a IA havia aprendido sobre ela.
O que eu faço com a URL da oferta em 28 de novembro?
Mantenha a URL viva e transforme a página. No dia seguinte ela deixa de ser oferta e vira página de status: o que foi a promoção, que ela terminou, qual é a condição vigente agora e para onde ir. Mantenha o acesso liberado para os mesmos robôs. O motivo é mecânico: sistemas de IA guardam e repetem o que leram por um tempo, e uma URL morta devolve erro justamente enquanto a resposta antiga ainda circula. Página com data explícita e estado atual corrige a si mesma; página apagada só produz frustração medida em erro 404.
Posso apagar a landing page depois que a promoção acabar?
Pode, mas faça direito: redirecione com 301 para a categoria equivalente, nunca para a raiz. Redirecionar tudo para a home joga fora o sinal acumulado. Eu prefiro não apagar no primeiro ano: a URL de Black Friday acumula referência externa, e reaproveitá-la a cada edição concentra histórico e familiaridade em um endereço só, enquanto URL nova por ano nasce sem nada e vive só de mídia paga. Decida por escrito antes de novembro, senão a decisão acaba sendo tomada por um estagiário em 2 de dezembro. A lógica de ficha estável vale também para os produtos, como detalhei em a ficha de produto que o agente de IA lê.
Medição e atribuição, sem inventar certeza
A pergunta do diretor comercial chega em 1º de dezembro e precisa de resposta honesta. Permissão, recuperação da página, citação, clique e conversão são cinco eventos distintos, e nenhum prova o outro.
O utm_source=chatgpt.com mede a minha presença no ChatGPT?
Mede parte. Referrals vindos do ChatGPT podem trazer esse parâmetro, o que ajuda a atribuir a visita, mas isso não mede citação. Você enxerga quem clicou; não enxerga as citações sem clique, nem as vezes em que a resposta usou a sua informação sem link. É atribuição parcial, e chamar de parcial é o que separa relatório de propaganda. No Global Digital Shopping Index 2026, só 21% dos varejistas brasileiros conseguem identificar quando uma venda teve origem em uma plataforma de IA.
Onde eu vejo se o Google está me mostrando em AI Overviews e AI Mode?
Nos relatórios de IA generativa do Google Search Console, anunciados em 3 de junho de 2026 e com expansão mundial registrada em 31 de agosto de 2026. Leia os três limites que a documentação oficial registra: no relatório de Search a visão inclui AI Overviews e AI Mode e exclui experimentos do Search Labs; há impressões por página, país, dispositivo e data, mas a documentação não descreve cliques nem CTR dessa visão; e há ressalvas de disponibilidade e de volume mínimo. Zero impressões é ausência de impressões observadas naquele recorte, não ausência de indexação.
Como eu provo que o trabalho de liberar o robô deu resultado?
Separando o que cada instrumento mede. O log de acesso prova recuperação: o robô pediu a página e recebeu 200. O painel oficial prova impressão em um recorte definido. A ferramenta de análise prova visita com origem declarada. A conversão prova venda. Nenhum deles, sozinho, atribui uma venda a uma citação específica, e quem afirma isso está vendendo. Versione janela, extrator e denominador antes de comparar dois números. Detalhei os erros mais caros dessa mistura em cinco erros de medição que fabricam gap de citação em IA.
O que eu faço e o que eu recuso nos 67 dias
O que eu faço, em ordem, com um cliente de varejo que vai subir campanha. Primeiro, o inventário das URLs da campanha, com host de imagem e de recurso estático. Segundo, o teste de resposta por camada, com registro do código HTTP e do corpo devolvido, feito de fora da rede da empresa. Terceiro, a regra explícita de permissão no WAF e na CDN, validada por IP oficial. Quarto, o plano da URL de oferta depois do dia 27, decidido em setembro. Quinto, o monitoramento diário entre 24 e 27 de novembro.
O que eu recuso: liberar diretório inteiro para encerrar a discussão; tratar robots.txt como segurança; prometer citação ou receita a partir de permissão de acesso; e mexer em regra de firewall depois de 20 de novembro sem motivo grave. Recuso também o relatório que soma visita com utm_source e chama aquilo de presença em IA.
O terreno se mexe enquanto você lê. A OpenAI lançou o shopping research no ChatGPT, disponível inclusive na conta gratuita, que faz perguntas de esclarecimento sobre orçamento e uso pretendido, e alguns produtos elegíveis já aceitam finalizar a compra ali dentro. Anúncios no ChatGPT começaram a ser testados em 2026. Do outro lado, 70% dos consumidores brasileiros esperam usar agentes de IA para comprar nos próximos dois anos, segundo a Visa com a PYMNTS. Uma landing page que não responde ao robô fica fora dessa superfície inteira, e fica fora em silêncio.
Uma última honestidade, porque ela sustenta o texto todo: permissão de acesso é condição necessária e insuficiente. Não aprova o seu anúncio, não garante presença orgânica, não compra citação e não conserta oferta ruim. O que ela faz é eliminar o modo de falha mais caro da temporada, aquele em que a campanha estava certa, o produto estava certo, o preço estava certo, e a porta estava fechada. Para o resto, a régua começa no que a loja publica, e o GEO para e-commerce trata dessa estrutura.
Referências
- Advertiser guidance for allowing OpenAI web crawlers, OpenAI Help Center, 21 de setembro de 2026
- Publishers and developers FAQ, OpenAI Help Center, 21 de setembro de 2026
- Overview of OpenAI crawlers, OpenAI Developers, 21 de setembro de 2026
- ChatGPT shopping research, OpenAI, 21 de setembro de 2026
- Generative AI performance reports, Google Search Central, 3 de junho de 2026
- Relatórios de desempenho de IA generativa, Ajuda do Google Search Console, 21 de setembro de 2026
- Global Digital Shopping Index 2026, Visa e PYMNTS Intelligence, TI Inside, 18 de setembro de 2026
- Pesquisa do Google sobre a Black Friday 2026, E-Commerce Brasil, 26 de agosto de 2026