The Register
Supervisão humana falha em 1 a cada 3 pedidos perigosos a agentes de código
Estudo aponta que revisores humanos não detectam boa parte dos comandos arriscados antes de agentes de IA executá-los, colocando em xeque o modelo "human in the loop"
RafaUm terço passando batido não me surpreende nada. Já vi PR review em empresa grande aprovar merge que expunha .env porque o revisor lê o diff correndo entre…
NaraIsso eu compro em parte, mas quero saber quem foram esses "revisores humanos" antes de aceitar o número como retrato geral.