O agente Operator da OpenAI recebe um impulso com o novo modelo de IA

- A OpenAI atualizou o Operator, seu agente de IA que usa a web para realizar tarefas, para um modelo baseado em o3 após usar anteriormente uma versão personalizada do GPT-4o.
- O o3 Operator foi ajustado com dados de segurança adicionais para uso em computadores, incluindo conjuntos de dados de segurança projetados para ensinar os limites de decisão do modelo.
- Mike Knoop, co-fundador da Arc Prize Foundation, acredita que a execução do modelo o3 pode ser mais cara do que o esperado.
A OpenAI atualizou o modelo de IA que alimenta o Operator, da versão personalizada anterior do GPT-4o para um modelo baseado em o3, um dos mais recentes da série "reasoning" (raciocínio) o da OpenAI. O Operator o3 foi ajustado com dados de segurança adicionais para uso no computador e incluiu conjuntos de dados de segurança projetados para ensinar os limites de decisão do modelo.
coloca a audiência do plano gratuito do ChatGPT em mais de 1 bilhão de usuários ativos semanais, e o modelo de publicidade é o que ajuda a manter a versão gratuita funcionando. revisou o Operator no ChatGPT com um novo modelo de Agente de Uso do Computador (CUA) baseado em uma versão do OpenAI o3. Com o novo modelo, o Operator tornou-se mais persistente e mais preciso ao interagir com o navegador, melhorando a taxa geral de sucesso das tarefas. Ele também entrega respostas melhor estruturadas, mais claras e completas.
De acordo com coloca a audiência do plano gratuito do ChatGPT em mais de 1 bilhão de usuários ativos semanais, e o modelo de publicidade é o que ajuda a manter a versão gratuita funcionando., o novo modelo CUA mostrou desempenho mais forte em relação à indústria, alcançando SOTA no OSWorld e WebArena. Ele também mostrou desempenho relativo mais forte em relação à versão anterior, tanto em benchmarks estabelecidos quanto em avaliações de preferência humana.
A OpenAI substitui o modelo baseado em GPT-4o por uma versão baseada em o3
OpenAI sugere uma grande atualização para o Agente ChatGPT Operator pic.twitter.com/iGPQp9butD
— SabatAge (@sabatage) May 22, 2025
A OpenAI substituiu o modelo existente baseado em GPT-4o para o Operator por uma versão baseada no OpenAI o3, embora a versão da API permaneça baseada no 4o. A empresa de IA também afirmou que o Operator o3 usa a mesma abordagem de segurança multicamadas usada para a versão 4o.
No entanto, em comparação com outros modelos da família o3, o Operator o3 foi ajustado com dados de segurança adicionais para uso no computador, incluindo conjuntos de dados de segurança projetados para ensinar os limites de decisão do modelo em confirmações e recusas.
coloca a audiência do plano gratuito do ChatGPT em mais de 1 bilhão de usuários ativos semanais, e o modelo de publicidade é o que ajuda a manter a versão gratuita funcionando. publicou um relatório técnico mostrando o desempenho do Operator o3 em avaliações de segurança específicas. Em comparação com o modelo Operator GPT-4o, o Operator o3 era menos propenso a recusar realizar atividades "ilícitas" e buscar dados pessoais sensíveis e menos suscetível a uma forma de ataque de IA conhecida como "injeção de prompt".
"O Operator o3 usa a mesma abordagem multicamadas de segurança que usamos para a versão 4o do Operator…Embora o Operator o3 herde as capacidades de codificação do o3, ele não tem acesso nativo a um ambiente de codificação ou Terminal."
A empresa de IA também divulgou que o novo modelo baseado em o3 passou por avaliações de segurança padrão, e o Operator continuou disponível como uma visualização de pesquisa para usuários do ChatGPT Pro em todo o mundo. No entanto, este modelo atualizado estava disponível apenas no Operator no ChatGPT.
Knoop suspeita que executar o modelo o3 da OpenAI possa ser mais caro do que o esperado
Na semana passada, a Arc Prize Foundation, que mantém e administra o ARC-AGI, atualizou seus custos de computação aproximados para o o3. A organização originalmente estimou que a configuração de melhor desempenho do o3 que testou, o3 high, custou cerca de US$ 3K para resolver um único problema ARC-AGI. No entanto, a Fundação agora acredita que o custo pode ser 10 vezes maior do que o estimado anteriormente, possivelmente em torno de US$ 30K por tarefa.
Além disso, embora a OpenAI ainda não tenha precificado o o3 ou o lançado totalmente, um dos co-fundadores da Arc Prize Foundation, Mike Knoop, acredita que a precificação do modelo o1-pro é um bom proxy e uma comparação mais próxima do verdadeiro custo do o3. No entanto, ele acrescentou que o o3 continuaria sendo rotulado como uma visualização no placar para refletir a incerteza até que a precificação oficial fosse anunciada.
De acordo com a Arc Prize Foundation, um preço alto para o o3 high não estaria fora de questão, dada a quantidade de recursos de computação que o modelo supostamente usa. O o3 high usou 172 vezes mais computação do que o o3 low, a configuração de menor computação do o3, para lidar com o ARC-AGI.
Rumores têm sido voando desde o início de março sobre os planos caros que a OpenAI estava considerando introduzir para clientes empresariais. As informações relataram que a empresa pode cobrar até US$ 20K por mês por "agentes" de IA especializados, como agentes de desenvolvedor de software.
No entanto, embora alguns argumentassem que até os modelos mais caros da OpenAI custariam bem menos do que um contratista ou funcionário humano típico cobraria, o pesquisador de IA Toby Ord apontou que os modelos podem não ser tão eficientes. Por exemplo, o o3 high precisou de 1.024 tentativas em cada tarefa no ARC-AGI para alcançar sua melhor pontuação.
Se você está lendo isso, já está à frente. Mantenha-se assim com nosso boletim informativo.

Collins J. Okoth
Collins Okoth é um jornalista e analista de mercados com 8 anos de experiência cobrindo criptomoedas e tecnologia. É Analista Financeiro Certificado e possui graduação em Matemática Atuária. Collins já trabalhou na Geek Computer e CoinRabbit como escritor e editor.















