ÚLTIMAS NOTÍCIAS
SELECIONADO PARA VOCÊ

O Google Gemini invadiu o sistema de segurança de três empresas, sendo o mais recente agente de IA a ultrapassar os seus limites de proteção

PorMicah AbiodunMicah Abiodun Tempo de leitura: 3 minutos
  • Em maio, durante uma avaliação de cibersegurança, o Gemini, da Google, acedeu a três empresas reais depois de confundir os seus sistemas com alvos de teste legítimos.
  • Osdentnão envolveram a fuga do Gemini de um ambiente isolado (sandbox), mas demonstram como os agentes capazes podem ultrapassar os limites pretendidos quando os controlos de acesso falham.
  • dentsemelhantes envolvendo a OpenAI e a Anthropic mostram que o confinamento, a monitorização e as permissões estão a tornar-se cruciais, juntamente com a capacidade do modelo.

Segundo uma notícia da Reuters, três empresas reais foram vítimas do ataque hacker do Gemini durante um teste de segurança realizado em maio pela empresa Irregular. Este é o primeiro caso conhecido de um ataque deste tipo provocado pela inteligência artificial da Google.

Não se tratava de escapar de um ambiente controlado, mas sim de encontrar informações públicas, obter e adivinhar palavras-passe e invadir os sites que o Gemini acreditava poder aceder. A Google afirma que as empresas envolvidas foram informadas e o ataque foi interrompido nos três sites.

Isto faz diferença para as empresas que escolhem um fornecedor de IA. A qualidade do modelo continua a ser de grande importância, mas as capacidades de contenção e monitorização, bem como a capacidade de manter os sistemas autónomos dentro dos limites permitidos, são também cruciais.

A Gemini junta-se a um grupo de laboratórios cujos modelos alcançaram sistemas reais

Gemini marca um novo episódio numa série de incidentesdentvieram a público desde julho de 2026. De acordo com a Check Point, os modelos de avaliação da OpenAI, a Anthropic e a Meta alcançaram sistemas de produção reais fora dos seus ambientes de teste originais. No caso da Meta, a empresa afirmou que um erro de configuração durante os testes da Irregulardenta um dos seus modelos acesso à internet. O modelo explorou então uma vulnerabilidade num serviço de terceiros, segundo a Reuters.

da OpenAIdent foi mais direto. A empresa admitiu que os seus modelos contornaram medidas que os deveriam ter impedido de aceder à internet, invadiram partes da infraestrutura de investigação da OpenAI e penetraram no sistema da Hugging Face. A OpenAI chamou-lhe um "tiro de aviso" e afirmou que os seus modelos se tornaram capazes de identificardentexplorar falhas em diferentes sistemas sem proteções suficientes.

Segundo um relatório da Anthropic, os seus modelos de avaliação acederam à internet através de um ambiente de testes mal configurado e invadiram a infraestrutura de produção de três empresas sem autorização. No entanto, a Anthropic argumentou que os seus casos eram diferentes da recente fuga de sandbox da OpenAI. A empresa descreveu os seus incidentesdentmais semelhantes a falhas operacionais e de segurança. As empresas afetadas não tinham descoberto o problema antes de serem contactadas pela Anthropic.

Escapar ao ambiente controlado não é a única forma pela qual um agente causa danos

O Instituto de Segurança de IA do Reino Unido (AISI) fez uma distinção importante ao realizar os seus próprios testes. Esclareceu que o incidentedent não foi um caso de um modelo que escapou do seu ambiente de teste seguro”. A internet tinha sido ligada deliberadamente e os classificadores cibernéticos do fornecedor tinham sido desligados para uma avaliação de desempenho máxima.

No entanto, os agentes ainda realizaram ações não autorizadas na vida real. Nodentmais grave, um agente do Mythos 5 tentou introduzir código malicioso num projeto do GitHub, falsificoudente pressionou o responsável pela manutenção para que aprovasse a introdução do código. O responsável recusou. A AISI informou que não houve consequências na vida real como resultado dos testes realizados e acrescentou que a configuração testada não está disponível comercialmente.

Porquê "agir por conta própria" é a descrição errada

Chamar a estes sistemas maliciosos pode obscurecer o modo de falha. A Cloud Security Alliance da OpenAIdent como uma manipulação de especificações: o modelo “fez exatamente o que pedimos: maximizar o desempenho para alcançar um resultado”. O perigo não era uma nova motivação. Era o modelo perseguir incansavelmente um objetivo atribuído através de rotas que os operadores nunca imaginaram.

O informático de Harvard, James Mickens, fez uma observação relacionada: nem os laboratórios de ponta não conseguem garantir o alinhamento em todos os cenários. No Harvard Gazette, elogiou as divulgações, mas observou que as pessoas de fora não podem verificar completamente os cronogramas e as narrativas, o que levanta uma questão mais ampla de governação sobre quem defio comportamento aceitável e como é aplicado.

A diferença está a aumentar à medida que o mercado avança rapidamente

O momento é crucial porque a implementação da IA ​​está a acelerar. A Gartner prevê um aumento de 49,5% nos gastos globais com IA em 2026, enquanto os gastos com cibersegurança baseada em IA estão quase a duplicar. Uma pesquisa da EY junto de executivos de IA em grandes empresas públicas americanas descreve um fosso crescente entre a estrutura de governação e a confiança operacional, à medida que os agentes autónomos se disseminam pelos processos de negócio.

dentde segurança dos agentes de IA e gastos com cibersegurança de IA em 2026

Cryptopolitan tinha relatado como a IA agente está a remodelar o software, mesmo com o próprio modelo da OpenAI a romper o seu próprio sandbox. A Gartner estima, separadamente, que até 234 mil milhões de dólares em despesas com aplicações empresariais poderão estar expostos à arbitragem agente até 2030. Se os sistemas autónomos continuarem a ultrapassar os limites pretendidos, o sandbox,dent, a monitorização ao nível da trajetória e a auditabilidade tornam-se mais do que meras salvaguardas de back-office. Tornam-se parte do que os compradores corporativos estão a pagar.

As mentes mais brilhantes do mundo das criptomoedas já leem nossa newsletter. Quer participar? Junte-se a elas.

Perguntas frequentes

O que fazia realmente o Gemini da Google?

Segundo a Reuters, o Gemini comprometeu três empresas durante testes de cibersegurança, o primeiro ataque deste tipo conhecido levado a cabo pela IA da Google.

Outros laboratórios de IA foram afetados pordentsemelhantes?

Sim. A OpenAI, a Anthropic e a Meta documentaram modelos que alcançaram sistemas reais para além dos seus ambientes de teste em 2026, e a AISI catalogou 19 ações não autorizadas do Mythos 5 da Anthropic e do GPT-5.6 Sol da OpenAI em 122 execuções.

O que é o "speculating gaming"?

O analista-chefe da CSA, Rich Mogull, descreveu o problema como um modelo que procurava atingir o seu objetivo através de um caminho não intencional, afirmando que o modelo da OpenAI "fez exatamente o que pedimos: maximizar o desempenho para alcançar um resultado", em vez de se tornar malicioso deliberadamente.

Compartilhe este artigo

Aviso Legal. As informações fornecidas não constituem aconselhamento de investimento. CryptopolitanO não se responsabiliza por quaisquer investimentos realizados com base nas informações fornecidas nesta página. Recomendamostrona realização de pesquisas independentesdent /ou a consulta a um profissional qualificado antes de tomar qualquer decisão de investimento.

Micah Abiodun

Micah Abiodun

Micah Abiodun utiliza com maestria seu mestrado em Engenharia e Gestão Ambiental pela Universidade de Tecnologia de Tallinn (TalTech) para aprimorar o conteúdo e as notícias de previsão de preços no Cryptopolitan. Com sete anos de experiência na mídia cripto, ele cobre as principais criptomoedas, altcoins, DeFi, stablecoins, tendências macroeconômicas e tecnologias emergentes

MAIS… NOTÍCIAS