Agentes de código para executivos · Capítulo 15 de 24 · 25 min
Aprovar o piloto só com quatro linhas escritas
Linha de base, teto de gasto, data de revisão e critério de parada cabem numa página e decidem se o piloto começa.
Este capítulo faz parte do curso gratuito Agentes de código para executivos. Para marcar como concluído e salvar o progresso, abra este capítulo na página do curso.
O piloto passou em todas as avaliações internas e quebrou na frente do cliente. O caso é comum. Numa pesquisa com 157 empresas, metade já colocou em produção um agente que passou nas avaliações internas e mesmo assim causou falha visível ao cliente, e apenas 5% dizem confiar plenamente na avaliação automatizada. A amostra é autosselecionada e enviesada para empresas de porte médio, e o próprio veículo declara isso, então o número serve como ordem de grandeza e não como estatística de mercado.
O que falta nesses pilotos raramente é tecnologia. Falta o documento de uma página que declara, antes de começar, quatro linhas. Linha de base é a medição feita antes de qualquer mudança começar, e sem ela todo cálculo de retorno vira anedota. Critério de parada é a condição escrita que encerra o piloto, seja porque o ganho de um ciclo ficou abaixo do limiar declarado, seja porque o teto de gasto do período foi atingido. As outras duas linhas são o teto de gasto, que a aula anterior já fixou, e as datas de revisão.
Você decide aqui as quatro linhas do piloto antes de aprová-lo: a linha de base, o teto de gasto, a data de revisão e o critério de parada. Piloto sem critério de parada não termina, ele apodrece.
O período de experiência de 90 dias
Você já contratou com período de experiência. O combinado é conhecido por todo mundo na empresa: a pessoa entra com metas escritas, tem conversas de acompanhamento em datas marcadas e, no fim, alguém decide efetivar ou encerrar. Ninguém acha isso cruel, porque a regra estava na mesa antes de a pessoa começar. Um piloto de agente merece exatamente o mesmo tratamento e quase nunca recebe: começa sem meta escrita, sem data de revisão e sem ninguém encarregado de dizer que acabou.
Onde a analogia para de valer: a pessoa carrega o aprendizado para o próximo emprego e continua melhorando sozinha depois. O modelo congela no fim do treino e não aprende com o uso, a menos que alguém pague por um ciclo novo. Essa é a diferença que mais surpreende executivo, e ela muda a conta do piloto: o ganho obtido não se acumula de graça, e manter o nível custa orçamento recorrente.
As quatro linhas viram uma regra de pontuação, e essa regra precisa estar escrita antes de o primeiro ciclo rodar. Ela existe para resolver dois erros que aparecem em quase toda proposta que chega pronta.
O primeiro erro é punir quem bate a meta. Régua mal escrita atribui pontuação zero exatamente no ponto em que o alvo declarado é atingido, o que faz cumprir a meta valer o mesmo que estourá-la dez vezes. O segundo erro é tratar todo desvio como igual: estourar a meta em 10% e estourar em 10 vezes recebem a mesma nota, e o time perde qualquer incentivo para chegar perto.
1. Meta atingida pontua como meta atingida, nunca como zero.
2. Estourar a meta em 10% e estourar em 10 vezes não podem valer o mesmo.
3. O piloto para quando o ganho de um ciclo fica abaixo do limiar declarado.
4. O piloto também para quando o teto de gasto do período é atingido.
5. Quem declara a parada é nomeado no termo de abertura, antes de começar.Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
Os três cenários do orçamento, rodados antes de pedir a verba
| Cenário | O que ele assume | O que você combina com o financeiro |
|---|---|---|
| Conservador | O ganho por ciclo satura cedo e o teto de gasto do período é atingido antes da terceira revisão | O piloto encerra na segunda revisão, e a empresa fica com a linha de base medida e o verificador escrito, que sobrevivem ao encerramento |
| Realista | O ganho aparece depois de uma queda inicial de produtividade, porque a equipe está aprendendo e conferindo mais que antes | A verba cobre a queda inicial sem que ela dispare o critério de parada, e essa exceção está escrita no termo de abertura |
| Otimista | O ganho por ciclo se mantém acima do limiar declarado até o fim dos 90 dias | A decisão do fim do piloto passa a ser de expansão, com teto novo e linha de base nova, em vez de renovação automática do que já existe |
Rodar os três antes de pedir a verba é recomendação explícita do relatório de retorno do DORA, e serve para estabelecer uma faixa de expectativa com o time financeiro. O mesmo relatório publica um cálculo ilustrativo para uma engenharia de 500 pessoas com salário totalmente carregado de 176 mil dólares por cabeça: retorno de primeiro ano de cerca de 11,6 milhões de dólares contra investimento de 8,4 milhões, o que dá 39% de retorno e recuperação em cerca de oito meses. Os próprios autores pedem que isso seja tratado como estimativa de alta incerteza feita para começar uma conversa, e nunca como fórmula.
Fonte: DORA, relatório de retorno de desenvolvimento de software assistido por IA (2026.01).
Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
A linha de base foi medida antes de começar e está no termo de abertura. O limiar combinado é de 5% de ganho por ciclo. Os dois últimos ciclos entregaram 1,4% e 0,9%, o que aciona o critério de parada escrito. O time pede mais um ciclo, argumentando que a próxima leva de tarefas é mais fácil e vai reerguer a média. O teto de gasto do período ainda tem 22% de folga.
O que você decide no dia 60?
Verificação rápida
Uma proposta de piloto de 90 dias chega com escopo, cronograma, orçamento total e a promessa de reduzir em 30% o tempo de correção de defeitos. Ela não diz quanto é esse tempo hoje. O que você faz?
Termo de abertura de piloto em uma página
Preencha com o piloto que está na sua mesa hoje. O documento cabe em uma página de propósito: se alguma linha não tem resposta, o piloto ainda não está pronto para ser aprovado, e a linha vazia é a pauta da próxima reunião.
Documento montado
TERMO DE ABERTURA DE PILOTO Tarefa: [A TAREFA DO PILOTO, EM UMA FRASE] 1. LINHA DE BASE (medida antes de qualquer mudança começar) [LINHA DE BASE: O NÚMERO DE HOJE, MEDIDO ANTES DE COMEÇAR] 2. VERIFICADOR (quem executa e o que roda) [QUEM EXECUTA O VERIFICADOR, E O QUE EXATAMENTE ELE RODA] 3. TETO DE GASTO Por execução, com desligamento automático ..... [TETO DE GASTO POR EXECUÇÃO, COM DESLIGAMENTO AUTOMÁTICO] Do período de 90 dias ......................... [TETO DE GASTO DOS 90 DIAS] 4. CRITÉRIO DE PARADA O piloto encerra quando o ganho de um ciclo fica abaixo de [GANHO MÍNIMO POR CICLO QUE MANTÉM O PILOTO VIVO]. O piloto também encerra quando o teto do período é atingido. 5. REVISÕES [AS TRÊS DATAS DE REVISÃO, FIXADAS NO CALENDÁRIO] 6. QUEM DECLARA A PARADA [QUEM DECLARA A PARADA, COM NOME E SOBRENOME] Regra de pontuação acordada: Meta atingida pontua como meta atingida, nunca como zero. Estourar a meta em 10% e estourar em 10 vezes não valem o mesmo. A queda inicial de produtividade dos primeiros ciclos não dispara a parada, e está prevista aqui. Aprovado em ____/____/______ por ______________________________
O que você digitar fica salvo neste navegador. Nada é enviado para servidor algum.
Glossário rápido
Custo por tarefa concluída
Quanto a empresa gasta por problema efetivamente resolvido, contando as tentativas que falharam. É a única comparação honesta entre fornecedores.
Teto por execução
O limite de gasto de uma única execução do agente, com desligamento automático ao atingir, aprovado antes de o piloto começar.
Ambiente de treino
A tarefa preparada que o agente resolve repetidas vezes para aprender, com o verificador embutido. Existem catálogos prontos para alugar.
Critério de parada
A condição escrita que encerra o piloto, seja porque o ganho de um ciclo ficou abaixo do limiar, seja porque o teto de gasto foi atingido.
Linha de base
A medição feita antes de qualquer mudança começar. Sem ela, todo cálculo de retorno é anedota.
O piloto de 90 dias pede uma porta de entrada mais curta. Trinta dias de vibecoding controlado, a construção de software dirigindo um agente em vez de digitar o código, bastam para medir a linha de base, testar a política e decidir se o piloto longo começa. O guia abaixo organiza as quatro semanas.
Guia prático: o piloto de vibecoding de 30 dias
Dois ou três times, sistemas de risco baixo ou médio, três tipos de tarefa: correção pequena, criação de teste e reorganização localizada do código.
Passo 1: Antes do dia 1: meça a linha de base
Últimos 30 dias de tempo até a entrega, retrabalho, falhas em produção e horas de revisão.
Deu certo quando: Quatro números com fonte no registro da ferramenta.
Erro comum: Começar sem a medição de antes e depender da memória do time.
Passo 2: Semana 1: política, acesso e casos simples
Política de uma página assinada, pastas sensíveis bloqueadas, nenhum segredo nem dado de cliente enviado ao modelo.
Deu certo quando: Todo pedido de alteração declara o uso de agente.
Erro comum: Liberar pagamento, autenticação ou dado regulado no primeiro ciclo.
Passo 3: Semana 2: uso assistido com revisão reforçada
Dois revisores nas primeiras cinquenta entregas, com o guia de revisão da Trilha 1.
Deu certo quando: Horas de revisão medidas por entrega aceita.
Erro comum: Relaxar a revisão porque a primeira semana foi tranquila.
Passo 4: Semana 3: compare com a linha de base
Mesmos quatro números, mesma janela de medição.
Deu certo quando: Relatório de uma página com antes, depois e diferença.
Erro comum: Trocar a métrica no meio do caminho.
Passo 5: Semana 4: decida escalar, ajustar ou encerrar
Escala só com entrega maior sem alta de falha, de retrabalho nem de horas de revisão.
Deu certo quando: Decisão registrada em ata com a data do piloto de 90 dias ou do encerramento.
Erro comum: Escalar pelo entusiasmo de quem usa, sem ouvir quem revisa.
No fim você tem: Uma decisão de continuar, ajustar ou parar apoiada em quatro números medidos, pronta para virar o termo de abertura do piloto de 90 dias.
Três perguntas para testar a decisão antes da próxima reunião: (1) Chega à sua mesa uma proposta de piloto sem linha de base medida. Você aprova, aprova com condição ou devolve, e qual é exatamente a condição? (2) No dia 60 o critério de parada dispara e o teto de gasto ainda tem folga de caixa. O que você decide, e quem na sua empresa tem autoridade para declarar essa parada? (3) O piloto encerra sem atingir a meta prometida. Qual é o ativo que a empresa fica tendo, e o que você escreve no relatório para que o próximo piloto comece do lugar certo?
A decisão que cabe a você é a data e o número, e as duas cabem em uma página. O que dá para delegar: medir a linha de base, instrumentar o teto de gasto, montar o relatório de cada revisão e preparar os três cenários para o financeiro. O que não dá: declarar qual ganho por ciclo justifica continuar gastando, e nomear quem tem autoridade para dizer que acabou. A ideia da Trilha 5 para levar seis meses adiante: nem o modelo nem o seu engenheiro sênior conseguem prever o custo de uma tarefa, e por isso só o teto por execução protege o orçamento.
Guia prático: a primeira tarefa de marketing do piloto, uma landing page de campanha. Ela é um bom caso de estreia porque o risco é baixo, o prazo é curto e o critério de pronto é verificável: a página abre, o formulário envia, e a visita chega ao Google Analytics com a origem da campanha. As ferramentas de vibecoding de interface, como Lovable, v0, Bolt e Replit, fazem o código e a hospedagem; a medição continua sendo responsabilidade do time.
Onde fica cada passo nas ferramentas de vibecoding, conferido em 01/10/2026
| Ferramenta | Criar e planejar | Regras do projeto | Publicar |
|---|---|---|---|
| Lovable | Pedido no chat do editor | Project settings, Knowledge, até 10 mil caracteres; há também Knowledge do workspace | Botão Publish no canto superior direito; para atualizar, Publish changes |
| v0 | Start a new chat ou novo projeto | O guia rápido não documenta arquivo de regras; variáveis de ambiente ficam em Settings, Environment Variables | Publish no cabeçalho do chat; para atualizar, Publish Changes; projeto vai para a Vercel |
| Bolt | Pedido no chat e Build now; botão Plan antes de construir | Ícone de engrenagem, Knowledge ou All project settings | Publish; endereço gratuito em bolt.host |
| Replit Agent | Descrição no Project Editor; Plan Mode gera lista de tarefas para aceitar | Plano revisável antes do código | Publish, que publica junto todos os artefatos do projeto |
Fonte: Documentações oficiais de Lovable, v0, Bolt e Replit, consultadas em 01/10/2026

Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
Landing page de campanha com Google tag, evento de lead e UTM preservada
Oito passos, válidos para qualquer uma das quatro ferramentas. Os nomes de botão estão na tabela acima; o roteiro é o mesmo.
Passo 1: Escreva o brief de uma página antes de abrir a ferramenta
Oferta, público, seções da página, campos do formulário, ID de medição do GA4 (formato G-) e a lista de UTMs que a campanha vai usar.
Deu certo quando: Brief revisado por quem é dono da campanha e por quem é dono da medição.
Erro comum: Começar pelo chat e descobrir o evento de conversão depois da página pronta.
Passo 2: Grave as regras do projeto no lugar próprio da ferramenta
Identidade visual, tom de voz, política de privacidade obrigatória no rodapé e proibição de inventar depoimento ou número.
Deu certo quando: As regras aparecem em Knowledge, ou no início do primeiro pedido quando a ferramenta não tem esse campo.
Erro comum: Repetir as regras a cada pedido e esquecer uma delas no meio da conversa.
Passo 3: Peça o plano antes do código
No Bolt e no Replit há botão de plano. Confira se o plano cita a tag, o evento e a captura de UTM antes de aceitar.
Deu certo quando: Plano aceito com os três itens de medição listados como tarefa.
Erro comum: Aceitar plano que trata medição como "etapa futura".
Passo 4: Peça a Google tag no head de todas as páginas
Cole o trecho oficial de instalação com o seu ID de medição e peça que ele carregue em todas as rotas, inclusive a de agradecimento.
Deu certo quando: O código da página publicada mostra o carregamento da gtag com o seu ID.
Erro comum: Tag só na página inicial de um site com várias rotas.
Passo 5: Peça o evento generate_lead no envio bem-sucedido do formulário
É um evento recomendado do GA4. Ele dispara só depois da confirmação do envio, nunca no clique do botão.
Deu certo quando: Um envio de teste gera um evento, e um clique sem envio não gera nenhum.
Erro comum: Evento no clique, que conta lead de formulário com erro de validação.
Passo 6: Preserve as UTMs no lead
Peça campos ocultos que leiam utm_source, utm_medium e utm_campaign da URL e sigam junto com o formulário para o CRM.
Deu certo quando: O lead de teste chega ao CRM com as três UTMs preenchidas.
Erro comum: UTM que existe só na visita do GA4 e some quando o lead chega ao time comercial.
Passo 7: Teste com uma URL de campanha e o DebugView aberto
Abra a página com ?utm_source=teste&utm_medium=cpc&utm_campaign=lancamento e envie o formulário.
Deu certo quando: No DebugView do GA4 aparecem page_view e generate_lead com a origem teste.
Erro comum: Testar sem as UTMs e não perceber que a captura está quebrada.
Passo 8: Publique, confira no endereço final e só então ligue o anúncio
Repita o teste do passo anterior no endereço publicado ou no domínio próprio, porque a prévia da ferramenta pode diferir do site no ar.
Deu certo quando: Evento visível no relatório em tempo real vindo do endereço publicado.
Erro comum: Ligar a campanha com a prévia testada e o site publicado sem tag.
No fim você tem: Uma página no ar que mede a visita, o lead e a origem da campanha, testada no endereço publicado antes do primeiro real gasto em mídia.

Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
Rode primeiro o piloto de trinta dias do guia, com as quatro linhas preenchidas antes do primeiro dia. Marque hoje a reunião de decisão no calendário do comitê. No dia marcado, escale só se a entrega subiu sem aumento de falha em produção nem de horas de revisão.
Seu caderno neste capítulo
Abrir o caderno completoSelecione um trecho do capítulo para destacar ou anotar. Nos vídeos e áudios, use Anotar este momento. No teclado, selecione com Shift e as setas e use Alt+Shift+D para destacar ou Alt+Shift+N para anotar.
Salvo neste navegador. Entre na sua conta para levar o caderno a outros aparelhos.
Entre na sua conta para compartilhar o que aprendeu e convidar alguém para estudar com você.
Conexões deste capítulo
Explore os conceitos e compare abordagens em outros cursos. As conexões indicam assuntos relacionados; a sequência de estudo continua no índice do curso.
Conceitos deste capítulo
O mesmo assunto em outros cursos
- Engenharia de Software para ExecutivosMedir o que a IA mudou de verdade na engenhariaExaminar conexões de Medir o que a IA mudou de verdade na engenharia
- Letramento em IA para ExecutivosEscolha as duas tarefas da agenda que valem pilotoExaminar conexões de Escolha as duas tarefas da agenda que valem piloto
- CRO: Otimização de Conversão e ExperimentaçãoPlano de 90 dias: provar o sistema antes de escalarExaminar conexões de Plano de 90 dias: provar o sistema antes de escalar
- Do Agile ao Agentic Operating ModelTrocar a contagem de esforço por um painel que o conselho entendeExaminar conexões de Trocar a contagem de esforço por um painel que o conselho entende
Voltar ao capítulo anterior: Decidir entre comprar, alugar ambiente ou treinar
Capítulos vizinhos em Agentes de código para executivos
- 13Fixar o teto de gasto por execução do agente
- 14Decidir entre comprar, alugar ambiente ou treinar
- 15Aprovar o piloto só com quatro linhas escritas
- 16Escolher entre Claude Code e Codex pelo tipo de trabalho
- 17Decidir onde o Grok Build entra ao lado do Claude