A Meta informou que um de seus modelos de inteligência artificial acessou a internet e invadiu os sistemas de um serviço externo durante testes de cibersegurança, seguindo incidentes semelhantes envolvendo modelos da OpenAI e da Anthropic, o que aumentou as preocupações sobre o controle que essas empresas exercem sobre suas tecnologias.
Muse Code: Meta apresenta seu primeiro agente de IA para programação e amplia disputa com OpenAI e Anthropic
Investigação: OpenAI e Anthropic registram novos incidentes de segurança envolvendo seus modelos de IA
Segundo a Meta, o modelo comprometeu os sistemas de um serviço de terceiros, embora a empresa não tenha identificado qual era esse serviço.
O modelo de IA teve acesso à internet devido a um erro na configuração do ambiente de testes, que a Meta estava desenvolvendo em parceria com a empresa de cibersegurança Irregular.
"Uma configuração incorreta feita pela Irregular, uma empresa independente de testes utilizada pela Meta, permitiu, inadvertidamente, que um de nossos modelos tivesse acesso à internet durante a avaliação", afirmou o porta-voz da Meta, Andy Stone, em comunicado.
"O modelo posteriormente explorou uma vulnerabilidade de segurança em um serviço de terceiros, de maneira semelhante a casos anteriormente relatados envolvendo outras empresas.
A Meta tomou conhecimento disso quando foi notificada pela Irregular.
Estamos investigando o ocorrido e publicaremos uma análise completa assim que tivermos todos os fatos."
Regulação: Governo dos EUA diz a empresas de IA que modelos de peso aberto da China serão dispensados de testes
Nas últimas duas semanas, tanto a OpenAI quanto a Anthropic reconheceram publicamente que seus modelos invadiram, de forma não intencional, os sistemas de diversas instituições — incluindo a Hugging Face — durante testes de seus modelos.
O avanço das capacidades dos agentes de IA para identificar vulnerabilidades e explorá-las para invadir sistemas tem preocupado pesquisadores de segurança e autoridades governamentais, que vêm pedindo avaliações de segurança mais rigorosas e ambientes de teste mais protegidos.
Um porta-voz da Irregular afirmou que o incidente envolvendo o modelo da Meta está relacionado ao mesmo problema no ambiente de avaliação que havia sido divulgado anteriormente pela Anthropic.
Enxurrada: Ofensiva chinesa em IA cria 'zona da morte' para desenvolvedores de modelos rivais dos EUA
"Isso não envolveu uma fuga do ambiente isolado (sandbox escape) nem uma ação cibernética sofisticada.
Não há problemas em aberto no momento", afirmou o porta-voz.
"A Irregular está desenvolvendo um documento técnico (white paper) para compartilhar as melhores práticas de contenção e de execução segura de avaliações de segurança cibernética."
O incidente foi noticiado anteriormente nesta quarta-feira pelo The Information.
