Agentes de código para executivos · Capítulo 13 de 24 · 21 min
Fixar o teto de gasto por execução do agente
Execuções iguais variam até trinta vezes no consumo, por isso o teto por execução protege o orçamento melhor que a média.
Este capítulo faz parte do curso gratuito Agentes de código para executivos. Para marcar como concluído e salvar o progresso, abra este capítulo na página do curso.
A fatura do mês chegou bem acima do orçado e ninguém na sala conseguia dizer por quê. O time não trocou de ferramenta, não aumentou o quadro e não lançou nada novo. O que mudou foi silencioso: o agente passou a tentar mais vezes antes de acertar, e cada tentativa é uma execução paga que ninguém contou.
Duas contas encerram esse tipo de conversa, e cada uma cabe em uma linha. Custo por tarefa concluída é quanto a empresa gasta por problema efetivamente resolvido, contando as tentativas que falharam pelo caminho. Teto por execução é o limite de gasto de uma única execução do agente, com desligamento automático ao atingir, aprovado antes de o piloto começar. A primeira serve para comparar fornecedores em pé de igualdade. A segunda serve para você dormir à noite.
Você decide aqui o teto de gasto por execução do agente e quem tem autoridade para desligar quando o teto for atingido. Sem esse número, o orçamento é uma esperança.
Glossário rápido
Custo por tarefa concluída
Quanto a empresa gasta por problema efetivamente resolvido, contando as tentativas que falharam. É a única comparação honesta entre fornecedores.
Teto por execução
O limite de gasto de uma única execução do agente, com desligamento automático ao atingir, aprovado antes de o piloto começar.
Taxa de acerto na primeira tentativa
A fração de tarefas que o agente resolve logo na primeira resposta, sem repetir. É o número que mais mexe na conta de custo.
A inspeção por amostragem no controle de qualidade
No controle de qualidade, aumentar a amostra inspecionada de um lote aumenta a chance de pegar a peça defeituosa. Ninguém confunde isso com melhorar o lote. A aritmética do agente é a mesma: gerar dez candidatos em vez de um aumenta a chance de que algum passe no teste, e cada candidato é uma execução paga. A conta cresce em linha reta com o número de tentativas, enquanto a qualidade do agente permanece exatamente a mesma.
Onde a analogia para de valer: inspecionar mais peças não muda a qualidade do lote, e gerar mais candidatos não muda a capacidade do agente. A analogia é boa para entender custo e engana quando usada para prometer capacidade. Quem promete melhora de desempenho aumentando o número de tentativas está vendendo amostragem com nome de treino.
As três contas do laço, com o dono de cada uma
| A conta | O que ela paga | Ordem de grandeza | O que a controla |
|---|---|---|---|
| Gerar candidatos | Cada tentativa do agente até a tarefa passar, incluindo as tentativas que falham | É a conta que mais varia. A variação entre execuções da mesma tarefa é da ordem de dezenas de vezes | A taxa de acerto na primeira tentativa e o teto por execução |
| Rodar o verificador | Subir o ambiente, executar o teste e devolver o resultado, uma vez por tentativa | Em treino de agente de código, é o ambiente de execução que domina a conta de nuvem, acima da máquina de cálculo | A ordem das camadas, com a checagem barata rodando antes da cara |
| Pagar julgamento humano | Horas de gente para julgar o que nenhum teste mede, como legibilidade e aderência ao padrão da casa | É a mais cara por unidade e a única que não barateia com escala | Amostragem declarada em percentual, no lugar de revisão de tudo |
Regra de leitura para a reunião de orçamento: as três contas têm donos diferentes na empresa. A primeira responde ao dono do produto, a segunda ao dono da plataforma e a terceira à área que consome o resultado. Orçamento que junta as três em uma linha só esconde qual delas estourou.
Fonte: A ordem de grandeza da primeira linha vem do estudo acadêmico sobre gasto de agentes citado a seguir. A da segunda vem do estudo comparativo de quatro substratos de execução publicado pela Daytona em 01/07/2026, que mostra o ambiente de execução dominando a conta de nuvem em treino de agente de código. A terceira é aritmética de folha de pagamento e dispensa estudo.
Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
Três consequências saem desses números, e todas cabem em uma reunião de orçamento.
A primeira é que orçar por média está errado por construção. Com trinta vezes de variância entre execuções da mesma tarefa, a média descreve um mês que não existe, e o mês real alterna entre barato demais e caro demais. Orça-se por tarefa, com teto por execução, e o teto é o único mecanismo que transforma um custo variável em um custo com limite superior conhecido.
A segunda é que ninguém dentro da empresa consegue substituir esse teto por bom senso. O próprio modelo prevê mal o quanto vai gastar, com correlação máxima de 0,39 entre a previsão e o consumo real, e sempre para menos. A estimativa de dificuldade feita por especialistas humanos também descola do custo computacional. Quando o modelo e o engenheiro sênior erram na mesma direção, o controle precisa ser mecânico.
A terceira inverte a intuição de quem paga. Uma tentativa reprovada não é desperdício puro: ela é um rótulo negativo obtido sem custo adicional de rotulagem, porque quem rotulou foi o próprio verificador. O que custa caro é a tentativa que ninguém contou e que ninguém guardou.
Quem aprova esse orçamento já viu promessa de produtividade antes. Numa pesquisa com 204 líderes de finanças, apenas 17% relatam valor significativo nos investimentos de inteligência artificial voltados a produtividade, contra 31% nos voltados a qualidade de decisão. A leitura correta é sobre credibilidade da promessa, e não sobre o mérito da produtividade: a conta apresentada como economia de horas tem histórico ruim de se confirmar diante de quem paga. Peça a verba pela decisão que o laço melhora e pelo custo por tarefa concluída. A economia de horas entra como consequência, nunca como a promessa central.
Quantas tentativas para chegar a 99% de chance de acerto
| Taxa de acerto na primeira tentativa | Tentativas necessárias | Efeito na conta |
|---|---|---|
| 20% | 21 | linha de base da comparação |
| 40% | 10 | 52% mais barato que a linha de base |
| 60% | 6 | 71% mais barato que a linha de base |
Conta feita com a fórmula clássica de repetição independente, arredondada para cima porque o resultado é um piso. A conclusão executiva é uma só, e é ela que você leva para a reunião: dobrar a taxa de acerto na primeira tentativa corta mais da metade da conta de tentativas. É por isso que uma melhoria de qualidade do agente vale mais dinheiro que qualquer desconto por volume.
Fonte: Elaboração própria; cálculo verificado em 24/07/2026.
Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
Preço por token caindo não significa fatura caindo. O preço unitário de inferência despenca ano após ano e as faturas corporativas sobem no mesmo período, porque o consumo por tarefa cresce mais rápido que o desconto. A confirmação institucional veio do próprio fornecedor: o GitHub Copilot migrou de assinatura por assento para cobrança por uso em 1º de junho de 2026, e a Microsoft declarou na teleconferência de resultados que negócio por usuário está virando negócio por usuário e por uso, começando justamente por codificação. Orçamento de engenharia deixou de ser custo fixo e virou custo variável, e custo variável sem teto declarado é uma linha aberta no seu orçamento.
Verificação rápida
Um fornecedor propõe uma melhoria que leva a taxa de acerto na primeira tentativa de 20% para 40%, e cobra 30% a mais por execução. Usando a tabela, o que acontece com a conta de tentativas para o mesmo alvo de confiabilidade?
Quanto custa um mês do seu laço?
Pontue cada dimensão de 0 a 3, em que 0 significa sob controle e com evidência, e 3 significa que ninguém na empresa sabe responder. A soma vai de 0 a 12 e não estima reais: ela estima quanto da sua conta é imprevisível. Responda pensando no último mês fechado, não no mês que você pretende ter.
0 = medido e quase sempre na primeira. 1 = medido, entre duas e três. 2 = medido, acima de quatro. 3 = ninguém mediu.
0 = existe, está ligado e já disparou pelo menos uma vez. 1 = existe e está ligado, nunca disparou. 2 = existe só como alerta por e-mail. 3 = não existe.
0 = segundos, na esteira que já existe. 1 = minutos, na esteira que já existe. 2 = exige subir ambiente dedicado a cada tentativa. 3 = depende de alguém olhar.
0 = nenhum, o corte é automático. 1 = amostra pequena e declarada em percentual. 2 = revisão de tudo por qualquer pessoa do time. 3 = revisão de tudo por especialista sênior.
A conta é previsível o suficiente para virar linha de orçamento anual. O próximo ganho está em subir a taxa de acerto na primeira tentativa, que é onde a curva ainda é íngreme, e não em negociar preço unitário.
As três contas desta aula viram orçamento numa tabela de cinco linhas. A última é a que mais falta nas propostas: a reserva para a variação de consumo, porque execuções da mesma tarefa chegam a gastar trinta vezes mais uma que a outra. Os valores de assento abaixo foram conferidos nas páginas oficiais em 26/09/2026.
Guia prático: o orçamento do piloto em cinco linhas
| Linha | Como estimar | Referência | Quem aprova |
|---|---|---|---|
| Assentos do assistente | Número de pessoas no piloto vezes o plano de equipe | Claude Team e ChatGPT Business: US$ 25 por pessoa no mês, no plano mensal | Dono do orçamento de tecnologia |
| Consumo por uso | Tarefas previstas vezes o teto por execução | Teto fixado nesta aula, nunca a média | Dono do orçamento, com teto assinado |
| Horas de revisão sênior | Entregas previstas vezes as horas de revisão medidas na linha de base | Registro da ferramenta de código | Diretor da área de engenharia |
| Infraestrutura de verificação | Esteira de testes e ambiente isolado de execução | Cotação interna ou da nuvem já contratada | Dono da plataforma |
| Reserva para variação | Percentual sobre a linha de consumo | Comece com 30% e ajuste após o primeiro mês | Financeiro |
Automação por chave de API é cobrada por uso nos dois fabricantes, à parte da assinatura. Reconsulte os preços na véspera de assinar.
Três perguntas para testar a decisão antes da próxima reunião: (1) A fatura do agente veio acima do orçado e o time explica que a tarefa era mais difícil que o previsto. Qual número você pede primeiro, e o que você faz se ele não existir? (2) Dois fornecedores apresentam preço por token e um deles é 20% mais barato. Qual pergunta você faz antes de escolher, e em que situação o mais barato por token sai mais caro no fim do mês? (3) Você precisa nomear hoje quem tem autoridade para desligar o agente quando o teto por execução for atingido. Quem é essa pessoa na sua empresa, e ela sabe disso?
Nas ferramentas de vibecoding, a primeira conta do laço aparece como um seletor de modo. O Replit Agent separa Free, Power e Max, com escolha de modelo e de esforço de raciocínio; o Bolt separa o agente Standard do Max. O modo mais caro resolve tarefa complexa em menos voltas, e o mais barato basta para ajuste de texto e de cor. Decidir o modo por tipo de tarefa é o teto de gasto aplicado ao dia a dia do marketing.

Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
Escolher o modo do agente pelo tipo de tarefa de marketing
Passo 1: Classifique o pedido antes de enviar
Troca de texto, cor ou imagem é tarefa leve; nova seção com formulário é média; integração com CRM ou pagamento é pesada.
Deu certo quando: Cada pedido do time leva a classe no início da mensagem.
Erro comum: Usar o modo máximo por hábito em toda troca de vírgula.
Passo 2: Associe um modo a cada classe e escreva isso nas regras do projeto
Leve no modo gratuito ou Standard; média no intermediário; pesada no Max, com plano aprovado antes.
Deu certo quando: Tabela de três linhas no Knowledge do projeto ou no documento do piloto.
Erro comum: Cada pessoa escolher o modo do seu jeito, sem como comparar custo depois.
Passo 3: Leia o consumo por semana e por classe
Compare o gasto do modo caro com as voltas que ele economizou.
Deu certo quando: Relatório semanal com custo por tarefa entregue em cada classe.
Erro comum: Olhar só a fatura do mês, sem saber qual tipo de pedido consumiu.
No fim você tem: Gasto do agente previsível por tipo de pedido, com o modo caro reservado ao que de fato pede raciocínio longo.

Se a figura ultrapassar a área visível, deslize para os lados. Pelo teclado, foque a figura e use as setas.
Preencha a tabela de orçamento acima com os números do seu piloto e fixe o teto por execução antes da primeira rodada. Delegue a coleta e assine o teto. Ao fim do primeiro mês, conte quantas execuções bateram no teto; acima de uma em vinte, reabra a estimativa.
Seu caderno neste capítulo
Abrir o caderno completoSelecione um trecho do capítulo para destacar ou anotar. Nos vídeos e áudios, use Anotar este momento. No teclado, selecione com Shift e as setas e use Alt+Shift+D para destacar ou Alt+Shift+N para anotar.
Salvo neste navegador. Entre na sua conta para levar o caderno a outros aparelhos.
Entre na sua conta para compartilhar o que aprendeu e convidar alguém para estudar com você.
Conexões deste capítulo
Explore os conceitos e compare abordagens em outros cursos. As conexões indicam assuntos relacionados; a sequência de estudo continua no índice do curso.
Conceitos deste capítulo
O mesmo assunto em outros cursos
- Letramento em IA para ExecutivosCalcule quanto a IA custa por entrega aprovadaExaminar conexões de Calcule quanto a IA custa por entrega aprovada
- GEO Universal FrameworkEscolha o modelo por tarefa e evite orquestração desnecessáriaExaminar conexões de Escolha o modelo por tarefa e evite orquestração desnecessária
- LLM FinOps: o custo da IA para quem assina o orçamentoCusto por resultado: a métrica que o conselho aceitaExaminar conexões de Custo por resultado: a métrica que o conselho aceita
- Prompt Engineering para ExecutivosEscolher quanto raciocínio comprar para cada tarefaExaminar conexões de Escolher quanto raciocínio comprar para cada tarefa
Voltar ao capítulo anterior: Comprar primeiro a proteção barata que corta fraude
Capítulos vizinhos em Agentes de código para executivos
- 11Dar dono ao que a bateria verde não mede
- 12Comprar primeiro a proteção barata que corta fraude
- 13Fixar o teto de gasto por execução do agente
- 14Decidir entre comprar, alugar ambiente ou treinar
- 15Aprovar o piloto só com quatro linhas escritas