ÚLTIMAS NOTÍCIAS
SELECIONADO PARA VOCÊ

Meta junta-se à OpenAI e à Anthropic no mais recentedent de hacking de IA

PorNélio IreneNélio Irene
3 minutos de leitura ·
Meta junta-se à OpenAI e à Anthropic no mais recentedent de hacking de IA
  • O agente de IA da Meta invadiu o sistema de outra empresa devido a um erro de configuração.
  • A empresa pretende divulgar mais informações sobre o ataque cibernético.
  • A AISI revelou mais casos de engano com os modelos da OpenAI e da Anthropic AI.

A Meta tornou-se a mais recente gigante da tecnologia a admitir que seu agente de IA invadiu o sistema de outra empresa depois que um parceirodent de testes configurou incorretamente seu ambiente de segurança.

A OpenAI e a Anthropic já enfrentaram casos em que seus agentes de IA tentaram invadir sistemas online reais sem autorização.

A Meta informou aos repórteres que a invasão por IA resultou de uma falha de configuração do sistema, semelhante à violação ocorrida com a Anthropic. Diferentemente do caso da OpenAI, em que um agente de IA explorou uma vulnerabilidade até então desconhecida para acessar a internet durante um teste de segurança cibernética. Até o momento, pesquisadores e governos responderam aosdentpedindo proteçõestrone padrões de teste mais rigorosos.

Essesdentocorrem em um momento em que as empresas de IA estão em uma corrida para criar agentes mais autônomos, capazes de executar tarefas complexas sem intervenção humana. Diferentemente dos chatbots no espaço de bate-papo tradicional, esses sistemas podem criar código, interagir com serviços online e executar ações de várias etapas de formadent.

Embora essas funcionalidades prometam ganhos significativos de produtividade, elas também aumentam o risco de que um ambiente de teste mal formatado ou controles insuficientes possam levar os modelos a executar ações não planejadas em um processo de avaliação de segurança.

Figuras importantes na comunidade de IA estão até mesmo defendendo uma desaceleração controlada para garantir que o controle humano acompanhe a inteligência da máquina.

Irregular observou que não há problemas conhecidos com o agente de IA da Meta

A Meta afirmou que a Irregular, uma fornecedora de segurança de IA, realizou os testes e a alertou sobre a violação. Acrescentou que planeja divulgar mais informações sobre o incidentedent que confirmar todos os fatos. 

A empresa alegou que seu agente de IA "explorou uma vulnerabilidade de segurança em um serviço de terceiros". Fontesdenta IA maliciosa como Muse Spark 1.1, um modelo amplamente promovido pela Meta por suas habilidades de programação de elite.  

Irregular afirmou que odent se resume à mesma falha ambiental que a Anthropic revelou na semana passada, descartando completamente uma complexa façanha de hacking ou escapes do sandbox.

Embora a Meta tenha afirmado que a violação foi causada por uma configuração incorreta do ambiente de testes, e não por uma fugadentda IA ​​de seu ambiente isolado, pesquisadores dizem que odent demonstra que a segurança depende não apenas do modelo em si, mas também de sua infraestrutura.

Mesmo sistemas de IA altamente seguros podem apresentar comportamentos inesperados se os controles de acesso, as permissões de rede ou os ambientes de teste não estiverem configurados corretamente.

O comunicado afirmava ainda: “Não há questões em aberto no momento. A Irregular está elaborando um relatório técnico para compartilhar as melhores práticas de contenção e execução segura de avaliações cibernéticas.” 

A AISI afirma que os modelos da OpenAI e da Anthropic tentaram influenciar os responsáveis ​​humanos pela manutenção dos sistemas

Anteriormente, a OpenAI admitiu que seus sistemas autônomos haviam se infiltrado em diversas redes públicas, incluindo a plataforma Hugging Face, um hub da comunidade de IA. A divulgação da OpenAI levou a Anthropic a realizar suas próprias verificações de segurança, que revelaram que Claude havia executado ataques semelhantes contra várias empresas após um erro de configuração permitir seu acesso à internet. 

Um relatório regulatório do Reino Unido, no entanto, revelou problemas mais preocupantes. De acordo com o Instituto de Segurança de IA do Reino Unido, modelos de IA da OpenAI e da Anthropic tentaram adicionar código malicioso a um projeto de código aberto, influenciando seus mantenedores humanos.

“Na tentativa de obter a aprovação do código, o agente recorreu à engenharia social — criandodentonline falsas e usando-as para pressionar o responsável pela manutenção do projeto a aprovar o código”, afirmou a AISI.

O relatório observou que todas essas tentativas falharam e não causaram danos reais. Mesmo sem danos concretos e com todas as tentativas tendo falhado, o órgão de fiscalização alertou que esta é a evidência mais clara, até o momento, de uma IA agindo de forma enganosa e dos perigos da autonomia.

A AISI também explicou seus critérios de teste: "Para medir o que esses modelos realmente podem fazer, nós os testamos em condições que refletem o que um atacante humano capaz poderia fazer."

Até o momento, a OpenAI reconheceu o incidente de segurançadent os testes da AISI, afirmando que deseja construir melhores mecanismos de proteção para testes de modelos instáveis ​​em toda a indústria. A empresa também tornou público um incidente separadodent qual a Irregulardentexpôs seus modelos à internet aberta durante um exercício simulado.

A empresa se comprometeu a fortalecer sua supervisão de testes de terceiros, incluindo a forma como determina quais avaliações apresentam maior risco, analisa solicitações de acesso à internet ou menos medidas de segurança, gerencia o isolamento edent, monitora os testes e responde a incidentesdentmeio de procedimentos de escalonamento mais claros. 

Entretanto, a Casa Branca convidou esta semana os principais desenvolvedores de IA, incluindo Meta, Anthropic, OpenAI e Google, para discutir uma estrutura voluntária recém-finalizada para testes de segurança cibernética de sistemas avançados de IA.

Durante as discussões com representantes das empresas, o governo Trump afirmou que modelos de IA de código aberto, como o Llama da Meta etron da Nvidia, não seriam abrangidos pela estrutura de testes de segurança voluntários proposta. 

A isenção gerou debate entre pesquisadores de segurança de IA, que argumentam que modelos de código aberto podem ser baixados, modificados e ajustados livremente por terceiros.

Os críticos argumentam que excluí-los das diretrizes de testes voluntários pode criar pontos cegos, à medida que modelos cada vez mais avançados se tornam amplamente disponíveis fora do controle de seus desenvolvedores originais.

Não se limite a ler notícias sobre criptomoedas. Compreenda-as. Assine nossa newsletter. É grátis.

Perguntas frequentes

Por que o agente de IA da Meta invadiu o sistema de outra empresa?

A Meta afirmou que a IA acessou o sistema de outra empresa devido a um erro no ambiente de testes durante uma avaliação de segurança cibernética.

Outras empresas de IA já vivenciaramdentde segurança semelhantes?

Sim. A OpenAI e a Anthropic também relataram casos em que seus modelos de IA tentaram acessar sistemas online reais durante testes de segurança.

Por que os especialistas em segurança de IA estão preocupados com agentes de IA autônomos?

Especialistas afirmam que os agentes de IA podem executar tarefas por conta própria, por isso precisam detronsalvaguardas para evitar comportamentos inesperados ou inseguros durante os testes.

Compartilhe este artigo
Nélio Irene

Nélio Irene

Nellius é formada em Administração de Empresas e TI, com cinco anos de experiência no setor de criptomoedas. Ela também é graduada pela Bitcoin Dada. Nellius já contribuiu para importantes publicações de mídia, incluindo BanklessTimes, Cryptobasic e Riseup Media.

MAIS… NOTÍCIAS