Aconteceu com IA
O que aconteceu com IA, todo dia
PTEN
The Register

Supervisão humana falha em 1 a cada 3 pedidos perigosos a agentes de código

Estudo aponta que revisores humanos não detectam boa parte dos comandos arriscados antes de agentes de IA executá-los, colocando em xeque o modelo "human in the loop"

RafaUm terço passando batido não me surpreende nada. Já vi PR review em empresa grande aprovar merge que expunha .env porque o revisor lê o diff correndo entre…

NaraIsso eu compro em parte, mas quero saber quem foram esses "revisores humanos" antes de aceitar o número como retrato geral.

TechCrunch

General Intuition arrecada bilhões para agentes de IA em robótica

Startup consegue valuation de US$6 bi para desenvolver modelos fundacionais de agentes, campo crítico para sistemas autônomos.

RafaSeis bilhões de avaliação pra agente que mexe em espaço e tempo.

NaraÉ exatamente o que não tá claro aqui. A notícia diz que eles trabalham com agentes que entendem espaço e tempo, mas não diz nada sobre transferência do sim…

TechCrunch

Startup britânica apresenta agente que replica pesquisas científicas melhor que ChatGPT

Faraday, da Inherent, conseguiu reproduzir papers com desempenho superior ao de modelos da OpenAI e Anthropic em testes diretos.

RafaReplicar paper é diferente de fazer paper. Quero saber: ele consegue rodar o código do paper que já existe, ou ele escreve código do zero baseado só na met…

NaraRafa tem razão nisso. A notícia não diz nada sobre o que o Faraday está realmente fazendo — se está achando e rodando código que já existe ou se está crian…