85,5% dos engenheiros confiam nos seus agentes. Metade deles esbarra em problemas todos os dias

26 de agosto de 2026
11 min de leitura

26 de agosto de 2026
11 min de leitura
A Temporal publicou esta semana o seu 2026 State of Development Report: AI Agents, e o número que circula é o da adoção: 80,8% dos engenheiros usam agora agentes todos os dias ou com mais frequência, contra 47,3% um ano antes — um salto relativo de 70,8%.
Esse número é real e não é muito interessante. As curvas de adoção sobem; esta subiu com força. Se estava à espera da confirmação de que os agentes se tornaram comuns na engenharia, aqui a tem, e pode deixar de esperar.
Os números interessantes estão duas páginas à frente, e não assentam confortavelmente lado a lado.
Antes das conclusões, a forma do instrumento, porque é ela que decide quanto peso o resto pode aguentar.
Metodologia, tal como publicada
Temporal, 2026 State of Development Report: AI Agents
É uma amostra respeitável para um inquérito de profissionais e estreita para uma afirmação sobre «os engenheiros». Pende para empresas médias e para o mundo anglófono, e é autosselecionada: quem responde a um inquérito sobre agentes de IA é quem tem opinião sobre agentes de IA.
Eis o par.
85,5% dos inquiridos dizem confiar, pelo menos até certo ponto, no que o agente produz. 91,1% dizem que os agentes melhoraram ou revolucionaram a sua produtividade.
E: 41,1% esbarram em problemas todos os dias. Outros 9,0% esbarram neles de forma contínua.
Pouco mais de metade da amostra esbarra em problemas todos os dias, e cerca de seis em cada sete confiam no resultado à mesma.
Os dois valores vieram das mesmas pessoas no mesmo instrumento. Nenhum é mentira. Mas lidos em conjunto descrevem uma coisa concreta, e essa coisa não é «os agentes funcionam bem».
Descrevem um desvio de calibração: uma confiança que avançou mais depressa do que a evidência que a sustenta. É um comportamento humano normal e bem documentado perante ferramentas que impressionam quase sempre e falham de forma imprevisível — e é exatamente a condição em que as pessoas deixam de verificar.
Porque «pelo menos até certo ponto» faz tanto trabalho
O valor da confiança é mole: a pergunta deixa contar tudo o que esteja acima da indiferença. É uma forma legítima de perguntar, e significa que 85,5% deve ler-se como «a maioria dos engenheiros não é hostil ao que um agente produz», e não como «a maioria poria isso em produção sem rever». O valor das falhas, pelo contrário, é uma contagem dura de comportamento: com que frequência algo correu mal. Comparar uma medida mole com uma dura é precisamente a razão pela qual ambas podem ser verdadeiras; é também a razão pela qual a mole merece menos peso do que o título lhe dá.
Mais um número em que vale a pena parar: os inquiridos operam uma mediana de 5 agentes e uma média de 10,7.
Quando a média é mais do dobro da mediana, a distribuição tem uma cauda longa à direita. Uma minoria opera muitíssimos agentes e puxa a média para cima, enquanto o engenheiro típico opera meia dúzia.
Isso importa para ler tudo o resto do relatório, porque essas duas populações não estão a viver a mesma experiência. Quem opera trinta agentes industrializou alguma coisa. Quem opera cinco usa agentes como se usa uma funcionalidade do IDE. Os valores agregados de satisfação fazem a média das duas, e o número resultante não descreve ninguém.
Se está a tentar perceber se a sua equipa está atrasada, a estatística relevante é a mediana, e é cinco.
51,3% dos inquiridos dizem ir de protótipo a produção em horas ou menos. 26,9% dizem em minutos ou menos.
Ponha isso ao lado dos 41,1% com problemas diários e a forma do risco fica clara. A restrição que antes ficava entre «isto funciona na minha máquina» e «isto está no ar» era tempo: tempo em que alguém lia o diff, corria a bateria de testes, pensava no caso limite. Os agentes comprimiram essa janela para minutos num quarto dos inquiridos.
A compressão só é um problema se a verificação não se tiver comprimido com ela. Em geral não se comprimiu: escrever código ficou dramaticamente mais barato, e confirmar que esse código está correto ficou um pouco mais barato. É na diferença entre esses dois ritmos que vivem os problemas diários.
É o mesmo mecanismo de que escrevemos em o estrangulamento da revisão: a geração escalou, a revisão não, e a fila mudou de sítio em vez de desaparecer. Este inquérito é a primeira evidência de amostra alargada que vi de que o padrão é agora a experiência mediana e não a queixa de quem adotou cedo.
Enterrada na secção sobre perceção de carreira está a conclusão com a consequência comercial mais direta para quem está a ler isto:
92,3% dos inquiridos já tentaram recriar software que já pagam.
Tentaram. Não conseguiram — o inquérito mede a tentativa, e essa distinção é a história toda. Mas nove em cada dez engenheiros recorrerem já ao «isto conseguíamos fazer nós» muda a postura por omissão em todas as conversas de compra que a sua equipa comercial terá no próximo ano.
Para um fundador que lança um MVP, a leitura prática não é «o SaaS morreu». É que o ónus da prova mudou de lado. Agora tem de explicitar porque comprar ganha a construir, porque o seu comprador já tentou construir — e a resposta honesta quase nunca é a lista de funcionalidades.
Quero ser direto quanto à fonte, porque ela muda o que vale a conclusão do relatório.
A Temporal vende execução durável: infraestrutura para fluxos de trabalho longos, com estado e repetíveis. O presidente executivo resume assim as conclusões:
As equipas que estão à frente são as que confiam mais nos seus sistemas, porque resolveram o estado, o custo e a fiabilidade.
Estado e fiabilidade são precisamente as duas coisas que o produto da Temporal existe para dar. Isso não torna a frase falsa, mas significa que a recomendação do relatório e a receita de quem o publica apontam na mesma direção, e convém descontar em conformidade. As percentagens em bruto são muito mais fiáveis do que a interpretação colocada por cima, o que costuma valer para toda a investigação de fornecedor.
A segunda ressalva é a idade. O trabalho de campo fechou a 25 de maio de 2026; a publicação é do final de agosto. Na maioria dos setores, um inquérito com três meses é atual. Neste, três meses abrangem vários lançamentos de modelos de fronteira e pelo menos uma mudança na forma como se usam os agentes de programação. O número da adoção é quase de certeza uma subestimativa a esta altura. Os da fiabilidade podem ter-se movido para qualquer lado, e ninguém — incluindo a Temporal — sabe para qual.
A única coisa que não faria é tratar os 80,8% como uma ordem. Os números de adoção são os mais citados e os menos acionáveis de qualquer inquérito: dizem-lhe o que é normal, e normal não é o mesmo que correto. Metade desses 80,8% esbarra em problemas todos os dias.
A conclusão de título é que o uso de agentes entre engenheiros praticamente duplicou num ano e é agora quase universal em termos diários. Dê isso por assente.
A conclusão que está por baixo é mais útil e menos confortável: a confiança ultrapassou a fiabilidade. 85,5% confiam no resultado enquanto pouco mais de metade esbarra em problemas diários ou contínuos, e metade da amostra publica em produção numa hora ou menos. Não é uma história sobre agentes maus. É uma história sobre uma camada de verificação que não escalou ao mesmo ritmo que a camada de geração, num ambiente em que ninguém tem tempo de reparar.
E o número a levar à próxima reunião de conselho é o que ninguém está a citar: 92,3% dos engenheiros já tentaram reconstruir alguma coisa que pagam. Na maioria falharam. Vão tentar outra vez com melhores ferramentas, e o seu argumento para que não o façam tem de valer mais do que uma comparação de funcionalidades.
Conte a sua própria taxa de falhas antes de confiar na de outro.
Fontes: Temporal Technologies, «Temporal Releases The 2026 State of Development Report: AI Agents» · Temporal Technologies · Todas as percentagens, a dimensão da amostra de mais de 550 pessoas e as datas de campo de 29 de abril a 25 de maio de 2026 são as publicadas pela Temporal; a interpretação e as ressalvas são minhas.

IdeaToMVP Academy
4-week live cohort for founders. Learn to ship AI agents, scope MVPs, and automate your business — taught by the same team that writes these guides.