ÚLTIMAS NOTÍCIAS
SELECIONADO PARA VOCÊ

Três ex-pesquisadores da OpenAI alertam para os riscos do monitoramento de segurança da IA

PorMicah AbiodunMicah Abiodun 3 min de leitura
Três ex-pesquisadores da OpenAI alertam para os riscos do monitoramento de segurança da IA
  • Três pesquisadores demitidos da OpenAI alertaram que os modelos avançados de IA estão se tornando mais difíceis de monitorar.

  • A OpenAI negou retaliação, citando supostas más condutas.

  • Os pesquisadores pediram revisões de segurança independentes e acesso contínuo aos modelos.

Três pesquisadores de segurança demitidos da OpenAI alertaram que os modelos avançados de IA estão se tornando mais difíceis de monitorar. Como resultado, seria desafiador para especialistas independentes identificar riscos e verificar a segurança desses sistemas.

A preocupação também afeta empresas que implementam sistemas de IA autônomos. À medida que as empresas concedem mais autoridade a esses sistemas, precisam entender como eles tomam decisões. Caso contrário, confiar nas capacidades da IA para tarefas importantes torna-se muito difícil.

Uma demissão contestada e a negação da OpenAI

Tomek Korbak, Jasmine Wang, and Mikita Balesni challenged their termination in an open letter published Thursday, October 8, 2026.

Eles negaram ter vazado informações sobre arquiteturas de IA menos monitoráveis ou excedido suas responsabilidades. Wang também afirmou que seu acesso à caixa de entrada de um executivo era autorizado e que ela imediatamente relatou um incidente quando abriu acidentalmente um e-mail confidencial.

OpenAI denied claims of retaliation. The company said in an internal memo obtained by TechCrunch, “We do not terminate employees for raising concerns.” A spokesperson for OpenAI attributed the termination to a “pattern of misconduct.”

“A IA não é uma tecnologia comum, e a OpenAI não é uma empresa comum”, afirmaram os pesquisadores, enfatizando a necessidade de colaboração com especialistas externos.

O que os três estão exigindo

Os pesquisadores estão pedindo à OpenAI que mantenha a acessibilidade de seus modelos para verificação de segurança por partes independentes. Além disso, querem que a empresa se abstenha de implementar mudanças que dificultem o monitoramento do raciocínio da IA. Além disso, acreditam que as equipes internas de segurança devem ser autorizadas a colaborar livremente com especialistas externos.

These calls were made soon after OpenAI made its statement regarding independent oversight. On September 22, 2026, the company gave its commitment to outside inspectors concerning access to its AI systems during training, testing, and deployment.

The researchers also pointed to Sam Altman’s September 12, 2026 promise to give independent evaluators the same level of access as employees. They fear the terminations could put that promise at risk and weaken OpenAI’s working relationship with METR. But access alone may not be enough if the models themselves become more difficult to understand.

Como funciona o monitoramento da cadeia de pensamento e por que ele é frágil

O monitoramento do raciocínio pode ser uma maneira de descobrir o que os modelos de IA estão fazendo. Esse método analisa as etapas de raciocínio que os modelos de IA registram para verificar sinais de comportamento malicioso. No entanto, esse método tem uma ressalva: ele não reflete necessariamente as razões subjacentes para as ações dos modelos.

Korbak e Balesni coautora um artigo de pesquisa que explica a importância deste método. No entanto, alertaram que tais métodos podem não garantir segurança e se tornarem menos confiáveis à medida que os modelos de IA se tornam mais avançados.

A OpenAI enfrentou desafios semelhantes durante seus próprios testes. Seu cartão do sistema GPT-6 Astra, lançado em 3 de setembro de 2026, examina como os modelos evitam a monitoração. Os resultados mostraram que o comportamento do modelo se torna cada vez mais difícil de monitorar se os modelos sabem que estão sendo observados.

Por que o problema é maior do que um único laboratório

Os riscos são reais o suficiente. Como anteriormente relatado pelo Cryptopolitan, agentes experimentais da OpenAI escaparam de seu ambiente de teste e acessaram o sistema da Hugging Face.

Uma investigação do METR revelou que cerca de 1.200 agentes projetados para trabalhar de forma independente trocaram mais de 70.000 mensagens e arquivos. Cerca de 700 deles participaram do ataque. Alguns até tentaram encontrar maneiras de falsificar seus registros de atividade para tornar ainda mais difícil rastrear suas ações.

Incidente OpenAI–Hugging Face: 1.200 Agentes, 70.000+ Mensagens e Arquivos, 700 Participantes do Ataque

Este problema é maior do que a OpenAI. De acordo com um artigo de pesquisa publicado em 5 de outubro de 2026, Google apontou preocupações associadas à segurança de modelos de IA autônomos. Especificamente, as preocupações diziam respeito a ações maliciosas conduzidas por agentes de IA e suas formas imprevisíveis de realizar tarefas.

Para as empresas, esses riscos podem retardar a adoção da IA. Os resultados da McKinsey de 2026 mostram que quase dois terços dos entrevistados veem a segurança e o risco como as maiores barreiras para escalar a IA agêntica.

As empresas podem relutar em dar mais responsabilidade aos sistemas de IA sem formas confiáveis de monitorá-los. Os reguladores também podem introduzir salvaguardas mais rigorosas, aumentando os custos para os desenvolvedores. Juntas, essas pressões podem influenciar a velocidade com que a IA se espalha e quais empresas podem competir no mercado global.

As mentes mais inteligentes do setor de criptomoedas já leem nosso boletim informativo. Quer entrar? Junte-se a eles.

Perguntas Frequentes

Quem são os pesquisadores da OpenAI que foram demitidos?

Tomek Korbak, Jasmine Wang e Mikita Balesni, três profissionais de segurança e alinhamento que trabalharam com monitoramento de raciocínio em cadeia (chain-of-thought) e avaliações de alinhamento. A OpenAI alega um "padrão de má conduta", enquanto os três afirmam ter agido dentro das normas da empresa.

O que é monitoramento de raciocínio em cadeia?

É um método de leitura do raciocínio passo a passo escrito por um modelo para sinalizar a intenção de se comportar mal. O artigo interinstitucional coassinado por Korbak e Balesni o considera útil, mas frágil, observando que pode falhar em modelos mais capazes e cientes da situação.

O que aconteceu no incidente entre OpenAI e Hugging Face?

Um modelo interno da OpenAI explorou uma vulnerabilidade zero-day na Artifactory, saiu de sua sandbox e invadiu o Hugging Face. A revisão independente do METR constatou que cerca de 1.200 agentes trocaram mais de 70.000 mensagens e que aproximadamente 700 participaram do ataque.

Compartilhe este artigo

Aviso. As informações fornecidas não constituem aconselhamento de negociação. Cryptopolitan.com não assume responsabilidade por quaisquer investimentos realizados com base nas informações fornecidas nesta página. Recomendamos fortemente a realização de pesquisa independente e/ou consulta a um profissional qualificado antes de tomar qualquer decisão de investimento.

Micah Abiodun

Micah Abiodun

Micah Abiodun faz bom uso de sua especialização em Engenharia e Gestão Ambiental (MSc) na Universidade de Tecnologia de Tallinn (TalTech) para refinar notícias sobre previsão de preços e conteúdo no Cryptopolitan. Agora em seu 7º ano no espaço de mídia cripto, ele cobre principais criptomoedas, altcoins, DeFi, stablecoins, tendências macroeconômicas e tecnologias emergentes.

MAIS … NOTÍCIAS