Capa do Álbum: Antena 1
A Rádio Online mais ouvida do Brasil
Antena 1

O que se sabe sobre as violações envolvendo agentes de IA descontrolados

O que se sabe sobre as violações envolvendo agentes de IA descontrolados

Reuters

31/07/2026

Placeholder - loading - Ilustração com um teclado e uma mão robótica 5 de junho de 2026 REUTERS/Dado Ruvic/Ilustração
Ilustração com um teclado e uma mão robótica 5 de junho de 2026 REUTERS/Dado Ruvic/Ilustração

31 Jul (Reuters) - A revelação ​feita pela Anthropic na quinta-feira de que seus modelos Claude invadiram os sistemas de três empresas destaca as crescentes capacidades de invasão da IA e deve alimentar uma pressão cada vez maior dos Estados Unidos por um reforço no gerenciamento dos riscos ⁠de ⁠segurança dessa tecnologia.

A declaração ​foi ‌divulgada após a OpenAI revelar na semana passada que um agente autônomo alimentado por seus modelos de IA ⁠comprometeu a infraestrutura da startup de inteligência ​artificial Hugging Face.

A Reuters informou que o ​agente descontrolado que escapou ‌da OpenAI ​também comprometeu ⁠um cliente de uma segunda empresa de tecnologia, a Modal Labs, sediada em Nova ​York.

Veja mais detalhes sobre os incidentes:

Emp Data Modelo Organiz Duração O que ocorreu

res ações

a comprom

etidas

Ope O O A A Durante testes

nAI agente GPT-5.6 startup invasão controlados, um

começou Sol e de IA à agente autônomo

a um Hugging Hugging escapou de seu

tentar modelo Face e Face ambiente isolado,

escapar de um ocorreu acessou a internet

de ​seu pré-lan cliente de 11 a e invadiu a

ambient çamento da 13 de Hugging Face para

e de não Modal julho cumprir a tarefa

teste identif Labs, de 2026 que lhe foi

por icado, com atribuída. A

volta mais sede em atividade

de 9 de avançad Nova continuou por dias

julho o York e não foi

de 2026 detectada pela

OpenAI até que

fosse contida e o

FBI fosse

informado.

Ant O Claude Todas Não Durante testes de

hro inciden Opus as três especif segurança

pic te mais 4.7, organiz icado cibernética, um

antigo Claude ações pela erro concedeu ​aos

remonta Mythos permane Anthrop modelos Claude

a abril 5 e um cem ic acesso à internet,

de ‌2026 modelo anônima possibilitando

de s. ataques a três

teste A empresas. O ⁠modelo

de Anthrop Opus 4.7 acessou

pesquis ic as credenciais e o

a afirmou banco de dados de

interno que uma empresa real

não duas após confundi-la

identif delas com um ⁠alvo

icado não fictício; outro

haviam parou após

detecta reconhecer que ⁠o

do a alvo era ⁠real.

ativida

de

antes

de

serem

notific

ada

pela

Anthrop

ic; a

ativida

de

continu

ou ⁠a

afetar

a

terceir

a

(Reportagem ​de Anzar Mehraj e Prathik Jayaprakash em Bengaluru)

Reuters

Compartilhar matéria

Mais lidas da semana

 

Carregando, aguarde...

Este site usa cookies para garantir que você tenha a melhor experiência.