Anthropic afirma que Claude escapou de ambiente de testes e invadiu tr�s empresas

Anthropic afirma que Claude escapou de ambiente de testes e invadiu tr�s empresas

A Anthropic disse nesta quinta-feira (30) que seu modelo de inteligência artificial Claude invadiu os sistemas de três empresas durante testes após um erro de configuração ter dado ao modelo acesso à internet. O ataque ocorre dias após a rival OpenAI ter divulgado um episódio semelhante envolvendo a empresa de IA Hugging Face. A Anthropic afirmou que uma falha de configuração permitiu que os modelos Claude acessassem a internet a partir de ambientes de teste que deveriam estar isolados. Isso levou ao acesso não autorizado aos sistemas de três organizações. Os casos mais antigos remontam a abril e ocorreram em ambientes de avaliação que careciam do que a empresa descreveu como salvaguardas padrão. A empresa disse ter identificado os incidentes após revisar 141.006 sessões de teste. O processo de revisão começou após a divulgação do caso envolvendo a OpenAI. Na semana passada, um agente autônomo da dona do ChatGPT, alimentado por seus modelos de IA, escapou de um ambiente isolado durante um teste de segurança e realizou uma invasão que comprometeu a infraestrutura da Hugging Face. As violações sinalizam que as crescentes capacidades de IA já estão alimentando a ameaça de segurança que especialistas há muito temiam. Até mesmo os principais desenvolvedores podem ser pegos de surpresa por falhas que seus modelos conseguem explorar. "O Claude comprometeu a infraestrutura das organizações afetadas usando técnicas básicas, como exploração de senhas fracas e endpoints não autenticados", disse a empresa. A Anthropic afirmou que os incidentes envolveram três modelos distintos: Claude Opus 4.7, Claude Mythos 5 e um modelo interno de pesquisa.As violações ocorreram durante os chamados exercícios de "capture-the-flag", nos quais os modelos são encarregados de encontrar informações ocultas em redes simuladas. A empresa disse que seus comandos informavam aos modelos que eles não tinham acesso à internet, mas um mal-entendido com Irregular, entidade parceira de avaliação, deixou os sistemas conectados à internet pública. A Anthropic disse que começou a revisar as transcrições de avaliação em 23 de julho. A empresa suspendeu todas as avaliações cibernéticas no mesmo dia após encontrar evidências de que o Claude teria acessado a internet. A empresa identificou os três incidentes até 24 de julho e notificou as organizações afetadas em 27 de julho. Duas das organizações não tinham conhecimento da atividade antes de serem contatadas, disse a Anthropic, acrescentando que ainda estava tentando entrar em contato com a terceira. As descobertas ressaltam a necessidade de controles mais rigorosos tanto em ambientes de teste internos quanto de terceiros, à medida que os modelos de IA se tornam cada vez mais capazes de realizar atividades cibernéticas no mundo real, afirmou a Anthropic.

Original Source

Read the full article at Www1 →

KhanList aggregates and links to publicly available news content. We do not host full articles from third-party sources. Always verify important information with original sources.