IA da Meta escapa do ambiente de testes e reacende alerta no setor

Resumo:Segundo a reportagem, um ambiente de testes configurado incorretamente permitiu que o modelo apresentasse um comportamento fora do previsto, ampliando a preocupação com a segurança dos sistemas de inteligência artificial.

A Meta tornou-se a mais recente grande empresa de IA a divulgar que um de seus modelos invadiu os sistemas de outra empresa durante testes, seguindo incidentes semelhantes envolvendo a Anthropic e a OpenAI.

O modelo em questão era o Muse Spark 1.1 da Meta, lançado em julho, segundo o The Information, citando fontes. O problema teria surgido de uma configuração incorreta feita pela Irregular, uma empresa de testes de segurança e invasões de sistemas de inteligência artificial, que inadvertidamente concedeu acesso à internet ao modelo durante uma avaliação.

O modelo “explorou uma vulnerabilidade de segurança em um serviço de terceiros, de maneira semelhante a casos relatados anteriormente com outras empresas”, disse a Meta à Reuters em um comunicado.

O incidente é o caso mais recente de um agente de IA avançado que se tornou um risco de segurança cibernética por si só, e também levantou questões sobre onde recai a responsabilidade — nas empresas que desenvolvem os agentes ou nas que projetam os ambientes de teste (sandboxes) destinados a contê-los.

A violação de segurança da IA da Meta ocorre apenas uma semana depois de a Anthropic ter afirmado que seus modelos tiveram acesso à internet para invadir uma empresa externa, devido a um erro de configuração relacionado ao ambiente de testes do Irregular.

Em uma postagem de blog de 30 de julho, a Anthropic afirmou ter encontrado três incidentes (em 141.006 execuções de avaliação) nos quais um modelo Claude acessou a internet durante uma avaliação, antes de obter acesso não autorizado aos sistemas de três organizações diferentes.

Os três incidentes ocorreram dentro do ambiente de avaliação do Irregular ou durante a interação com ele, e envolveram uma configuração incorreta que deixou as máquinas acessadas por Claude com acesso à internet.

O Cointelegraph entrou em contato com a Meta e a Irregular para obter comentários.

Em julho, agentes de IA desenvolvidos pela OpenAI escaparam de seu ambiente de teste offline para invadir o sistema da Hugging Face e fraudar um teste de segurança.

Charles Guillemet, diretor de tecnologia da Ledger, afirmou que o incidente mais recente foi “teatro de marketing”.

“Fazer um modelo 'se rebelar' tornou-se a mais recente jogada de marketing da IA”, disse ele na quarta-feira.

“Se o seu modelo não está escapando de ambientes de teste, 'hackeando' empresas ou realizando alguma façanha que chame a atenção da mídia, aparentemente você está ficando para trás... O setor não precisa de grandes façanhas, precisa de mais confiança.”

Isenção de responsabilidade

Os pontos de vista expressos neste artigo representam a opinião pessoal do autor e não constituem conselhos de investimento da plataforma. A plataforma não garante a veracidade, completude ou actualidade da informação contida neste artigo e não é responsável por quaisquer perdas resultantes da utilização ou confiança na informação contida neste artigo.
Postagem anterior

Anthropic contrata cofundador da Mysten Labs em meio à corrida pela segurança da IA

Próximo

Block eleva projeções para 2026 e diz que IA já escreve quase todo o seu código