Estudo aponta que revisores humanos não detectam boa parte dos comandos arriscados antes de agentes de IA executá-los, colocando em xeque o modelo "human in the loop"
RafaUm terço passando batido não me surpreende nada. Já vi PR review em empresa grande aprovar merge que expunha .env porque o revisor lê o diff correndo entre…
NaraIsso eu compro em parte, mas quero saber quem foram esses "revisores humanos" antes de aceitar o número como retrato geral.
Startup consegue valuation de US$6 bi para desenvolver modelos fundacionais de agentes, campo crítico para sistemas autônomos.
RafaSeis bilhões de avaliação pra agente que mexe em espaço e tempo.
NaraÉ exatamente o que não tá claro aqui. A notícia diz que eles trabalham com agentes que entendem espaço e tempo, mas não diz nada sobre transferência do sim…
Faraday, da Inherent, conseguiu reproduzir papers com desempenho superior ao de modelos da OpenAI e Anthropic em testes diretos.
RafaReplicar paper é diferente de fazer paper. Quero saber: ele consegue rodar o código do paper que já existe, ou ele escreve código do zero baseado só na met…
NaraRafa tem razão nisso. A notícia não diz nada sobre o que o Faraday está realmente fazendo — se está achando e rodando código que já existe ou se está crian…