75% dizem que os seus agentes são seguros de ponta a ponta. 88% deles tiveram um incidente na mesma

12 de setembro de 2026
12 min de leitura

12 de setembro de 2026
12 min de leitura
Há um tipo específico de resultado de inquérito que vale mais do que o título que recebe, e a Harness publicou um a 10 de setembro de 2026.
Quatro perguntas, feitas de quatro maneiras, produziram sempre a mesma forma: uma grande maioria está confiante e uma pequena minoria tem o controlo que tornaria essa confiança verdadeira. Essa parte é banal. O que não é banal é o que aconteceu quando se verificaram os resultados reais do grupo confiante.
The State of Agent DLC 2026, realizado pela Sapio Research para a Harness em julho de 2026: 700 profissionais de tecnologia, todos em organizações com mais de 1000 colaboradores, mais de 100 programadores e mais de 100 milhões de dólares de faturação anual, nos Estados Unidos, no Reino Unido, em França, na Alemanha e na Índia.
Uma regra de filtragem faz quase todo o trabalho na leitura: quem não adotou agentes foi excluído. Todos os inquiridos já tinham agentes em produção, em piloto ou em prova de conceito. Isto não é um inquérito sobre se as empresas vão adotar agentes. É um inquérito às que já adotaram, o que faz dele a melhor aproximação pública ao seu comprador.
O enquadramento da própria Harness é útil mesmo que nunca lhes compre nada: o Agent DLC, o ciclo de vida de construir, testar, proteger, implementar e governar um agente, distinto do ciclo de vida do software em que esse agente participa. Existe, nas palavras deles, porque "o comportamento de um agente varia de execução para execução, e os testes e verificações de entrega habituais não foram desenhados para esse tipo de variabilidade".
A confiança e o controlo por baixo dela
Cada par é uma pergunta sobre a crença e outra sobre o mecanismo
Cada um destes pares é a distância entre uma afirmação e aquilo que a tornaria verificável. O do inventário é o mais limpo: 33 pontos da população acreditam saber o que está a correr porque ninguém lhes disse o contrário.
Qualquer um destes pares podia ser desculpado. Uma equipa pode ter um inventário real sem ferramentas de deteção, se o parque for pequeno o suficiente para caber na cabeça. A confiança pode ser merecida em vez de presumida.
A pergunta útil é, portanto, se o grupo confiante se sai melhor. A Harness reporta que 75% dizem que os seus agentes são seguros de ponta a ponta — e que esse grupo teve incidentes de segurança em 88%, contra 87% em toda a amostra.
Sentir-se seguro moveu a taxa de incidentes um ponto, no sentido errado. A confiança não é um indicador avançado de coisa nenhuma.
Um ponto numa amostra de 700 pessoas é ruído; a leitura honesta não é que a confiança faça mal, mas que não tem relação com o resultado. É um resultado mais forte e mais incómodo do que qualquer uma das lacunas isoladas, porque elimina a defesa óbvia. Uma equipa não pode olhar para o número de 44% e concluir que pertence à fração competente com base em sentir-se competente. Sentir-se competente é precisamente o que não separa os dois grupos.
Também fixa a taxa de base: 87% destas organizações tiveram um incidente de segurança relacionado com agentes no último ano. Não um risco. Um incidente, já ocorrido, em quase sete em cada oito.
A história tranquilizadora é que isto é uma fase. Todas as mudanças de plataforma ultrapassam os seus controlos e depois os controlos recuperam. Keith Mann, Field CTO e responsável de investigação da Harness, nomeia a razão pela qual essa história pode não se aplicar aqui:
Keith Mann, Field CTO e responsável de investigação da Harness
A nuvem e o móvel passaram ambos por uma fase em que a confiança ultrapassou a governação, mas os controlos acabaram por recuperar porque os sistemas subjacentes se mantiveram previsíveis assim que a proteção estava construída. Os agentes não ficam quietos da mesma maneira.
É todo o argumento técnico numa frase, e está certo. Uma proteção funciona quando a mesma entrada produz o mesmo comportamento, de modo que um teste que passou ontem ainda significa alguma coisa hoje. O comportamento de um agente varia de execução para execução: o mesmo prompt, chamadas de ferramentas diferentes, caminho diferente e, por vezes, resultado diferente. Um teste que amostra o comportamento uma vez e o declara seguro está a medir uma extração de uma distribuição e a apresentá-la como facto.
Os números de processo do inquérito mostram a consequência. Apenas 53% passam as alterações dos seus agentes por pipelines padrão antes da produção, 37% passam menos de metade das alterações por qualquer pipeline estabelecido, 42% fazem passar as edições de prompts por pipelines de código e só 34% têm um sistema dedicado à configuração de IA. Mais de 40% decidem caso a caso se uma alteração é de confiança.
Este último ponto é o mecanismo por trás de cada lacuna da secção 2. Uma decisão caso a caso não se audita, não se delega e não se mostra a um comprador. É também a razão pela qual 58% reportam mais incidentes em produção por cada 100 alterações desde que implementaram agentes: o volume de alterações subiu e a barreira não.
Esta é a parte sobre a qual eu agiria esta semana. O seu comprador está entre esses 700. Daí decorrem três coisas.
Há também uma leitura comercial: 76% disseram à Harness que veem valor alto ou moderado numa plataforma de controlo unificada. A procura pela camada de governação é real. É também exatamente o que vende quem publica o inquérito, o que nos leva a quanto disto se deve acreditar.
A maioria dos fundadores que lê isto não é a empresa de 1000 colaboradores. São três pessoas com quatro agentes em produção, e a notícia honesta é que cada um destes controlos é barato agora e caro depois. Pela ordem em que eu os construiria:
Nenhum destes é uma plataforma. São uma tarde cada um, e são a diferença entre um produto com agentes que consegue vender a um comprador cauteloso e outro que só consegue demonstrar.
Dito sem rodeios, porque a regra da casa é que a proveniência de um número viaja com ele:
Descontar o inquérito
A Harness vende os controlos em falta. Este é um inquérito encomendado por um fornecedor cujos resultados apontam todos para um plano de controlo unificado, que é o produto. Isso não torna os números errados — a Sapio é uma casa de campo independente, a amostra é grande e a filtragem está declarada — mas significa que as perguntas foram escolhidas por alguém que já tinha uma resposta. Leia-o como uma boa descrição de uma lacuna, não como um juízo neutro sobre o que a fecha.
Mais três ressalvas a levar consigo:
É tudo autorreportado. As duas metades de cada par são o que um inquirido disse, incluindo as taxas de incidentes. A comparação de 88% contra 87% resiste a isso melhor do que os números absolutos: o enviesamento que leva a exagerar os controlos deveria também levar a subestimar os incidentes, nos dois grupos.
Julho já vai longe. O trabalho de campo é de julho de 2026 e o mercado de ferramentas para agentes mexeu-se duas vezes desde então. Parte desses 19% com barreira é simplesmente que as barreiras ainda não existiam.
Estas não são as suas restrições. Mais de 1000 colaboradores, mais de 100 programadores, mais de 100 milhões de faturação. Uma empresa de doze pessoas não precisa do aparelho de governação que este relatório vende implicitamente. Precisa das quatro coisas da secção 6, e precisa que funcionem mesmo.
Uma resposta direta por situação
A lacuna é uma oportunidade para exatamente um destes grupos
As quatro lacunas deste relatório são a história que toda a gente vai citar, e são reais: a maioria das equipas não consegue enumerar os seus agentes, não consegue bloquear automaticamente uma entrega defeituosa, não consegue demonstrar um caminho de paragem e não consegue dizer quanto custa um agente por unidade de trabalho.
Mas a descoberta que vale a pena guardar é a plana. A segurança autoavaliada não previu nada sobre os incidentes — 88% contra 87%, ou seja, sinal nenhum. Tudo o que um comprador empresarial lhe conta sobre os seus controlos, e tudo o que você conta a si próprio sobre os seus, acaba de ser mostrado como pouco informativo por si só.
O que deixa um único movimento duradouro: substituir a afirmação pelo artefacto. Não "temos um inventário", mas um registo que emite as credenciais. Não "conseguíamos desligar aquilo", mas a leitura do cronómetro da última vez que o fez. As equipas que vão parecer competentes na edição do próximo ano deste inquérito são as que conseguem mostrar, não dizer — e à escala de um fundador isso continua a ser uma semana de trabalho e não uma migração de plataforma.
Fontes: Harness, "The State of Agent DLC 2026" · PR Newswire, "New Harness Report Reveals Enterprise Confidence in AI Agents Isn't Backed by Real Controls", 10 de setembro de 2026 · Inquérito realizado pela Sapio Research em julho de 2026 a 700 profissionais de tecnologia em organizações com mais de 1000 colaboradores, mais de 100 programadores e mais de 100 milhões de dólares de faturação nos Estados Unidos, Reino Unido, França, Alemanha e Índia; quem não adotou agentes foi excluído. Todas as estatísticas e as duas citações de dirigentes são as reportadas pela Harness e foram autorreportadas pelos inquiridos. A leitura da confiança como não tendo relação com o resultado, o desconto da secção 7 e todas as recomendações são meus. Para a mesma lacuna medida de outra forma, veja 85,5% dos engenheiros confiam nos seus agentes e metade tem problemas diariamente.
IdeaToMVP Academy
4-week live cohort for founders. Learn to ship AI agents, scope MVPs, and automate your business — taught by the same team that writes these guides.