L'agente Operator di OpenAI riceve un impulso con il nuovo modello AI

- OpenAI ha aggiornato Operator, il suo agent AI che utilizza il web per eseguire attività, a un modello basato su o3, dopo aver utilizzato in precedenza una versione personalizzata di GPT-4o.
- L'operatore o3 è stato affinato con dati di sicurezza aggiuntivi per l'uso del computer, inclusi dataset di sicurezza progettati per insegnare al modello i confini decisionali.
- Mike Knoop, co-fondatore della Arc Prize Foundation, ritiene che l'esecuzione del modello o3 potrebbe essere più costosa del previsto.
OpenAI ha aggiornato il modello AI che alimenta Operator dalla precedente versione personalizzata di GPT-4o a un modello basato su o3, uno dei più recenti nella serie o di modelli "ragionevoli" di OpenAI. L'Operator o3 è stato affinato con dati di sicurezza aggiuntivi per l'uso del computer e includeva dataset di sicurezza progettati per insegnare al modello i confini decisionali.
pone il pubblico del piano gratuito di ChatGPT a più di 1 miliardo di utenti attivi settimanali, e il modello pubblicitario è ciò che aiuta a mantenere in funzione la versione gratuita. ha aggiornato l'Operator in ChatGPT con un nuovo modello Agente per l'Uso del Computer (CUA) basato su una versione di OpenAI o3. Con il nuovo modello, l'Operator è diventato più persistente e più accurato quando interagisce con il browser, migliorando il tasso di successo complessivo delle attività. Fornisce anche risposte più strutturate che sono più chiare e complete.
Secondo pone il pubblico del piano gratuito di ChatGPT a più di 1 miliardo di utenti attivi settimanali, e il modello pubblicitario è ciò che aiuta a mantenere in funzione la versione gratuita., il nuovo modello CUA ha mostrato prestazioni più forti rispetto all'industria, raggiungendo SOTA su OSWorld e WebArena. Ha anche mostrato prestazioni relative più forti rispetto alla versione precedente, sia nei benchmark consolidati che nelle valutazioni della preferenza umana.
OpenAI sostituisce il modello basato su GPT‑4o con una versione basata su o3
OpenAI accenna a un grande aggiornamento per ChatGPT Operator Agent pic.twitter.com/iGPQp9butD
— SabatAge (@sabatage) Maggio 22, 2025
OpenAI ha sostituito il modello esistente basato su GPT‑4o per Operator con una versione basata su OpenAI o3, sebbene la versione API rimarrà basata su 4o. L'azienda di AI ha anche affermato che l'Operator o3 utilizza lo stesso approccio di sicurezza multilivello utilizzato per la versione 4o.
Tuttavia, rispetto ad altri modelli nella famiglia o3, l'Operator o3 è stato affinato con dati di sicurezza aggiuntivi per l'uso del computer, inclusi dataset di sicurezza progettati per insegnare al modello i confini decisionali su conferme e rifiuti.
pone il pubblico del piano gratuito di ChatGPT a più di 1 miliardo di utenti attivi settimanali, e il modello pubblicitario è ciò che aiuta a mantenere in funzione la versione gratuita. ha rilasciato un rapporto tecnico che mostra le prestazioni dell'Operator o3 su valutazioni di sicurezza specifiche. Rispetto al modello Operator GPT-4o, l'Operator o3 era meno probabile che rifiutasse di eseguire attività "illecite" e di cercare dati personali sensibili ed era meno suscettibile a una forma di attacco AI nota come "prompt injection."
«L’operatore o3 utilizza lo stesso approccio di sicurezza multilivello che abbiamo adottato per la versione 4o di Operator… Sebbene l’operatore o3 erediti le capacità di codifica di o3, non ha accesso nativo a un ambiente di codifica o al Terminale.»
L'azienda di AI ha anche rivelato che il nuovo modello basato su o3 ha superato le valutazioni di sicurezza standard, e Operator è rimasto disponibile come anteprima di ricerca per gli utenti di ChatGPT Pro in tutto il mondo. Tuttavia, questo modello aggiornato era disponibile solo in Operator in ChatGPT.
Knoop sospetta che l’esecuzione del modello o3 di OpenAI possa essere più costosa del previsto
La scorsa settimana, la Arc Prize Foundation, che gestisce e amministra ARC-AGI, ha aggiornato i suoi costi di calcolo approssimativi per o3. L’organizzazione aveva inizialmente stimato che la configurazione con le migliori prestazioni di o3 testata, o3 high, costasse circa 3.000 $ per risolvere un singolo problema ARC-AGI. Tuttavia, la Fondazione ritiene ora che il costo potrebbe essere 10 volte superiore alle stime precedenti, raggiungendo forse i 30.000 $ per attività.
Inoltre, sebbene OpenAI non abbia ancora fissato il prezzo di o3 né lo abbia rilasciato completamente, uno dei co-fondatori della Arc Prize Foundation, Mike Knoop, ritiene che la tariffazione del modello o1-pro sia un buon proxy e un confronto più accurato del vero costo di o3. Ha però aggiunto che o3 continuerà a essere etichettato come anteprima nella classifica per riflettere l’incertezza fino all’annuncio ufficiale dei prezzi.
Secondo la Arc Prize Foundation, un prezzo elevato per o3 high non sarebbe affatto fuori luogo, dato l’enorme quantitativo di risorse di calcolo che il modello, secondo quanto riportato, utilizza. o3 high ha impiegato 172 volte più potenza di calcolo rispetto a o3 low, la configurazione a minor consumo di o3, per affrontare ARC-AGI.
Le voci sono state in circolo dall’inizio di marzo riguardo ai piani costosi che OpenAI stava valutando di introdurre per i clienti enterprise. Le informazioni riportate indicavano che l’azienda potrebbe addebitare fino a 20.000 $ al mese per “agent” AI specializzati, come agent per sviluppatori software.
Tuttavia, mentre alcuni sostenevano che anche i modelli più costosi di OpenAI costerebbero ben meno di quanto richiederebbe un tipico collaboratore o dipendente umano, il ricercatore AI Toby Ord ha sottolineato che i modelli potrebbero non essere così efficienti. Ad esempio, o3 high ha bisogno di 1.024 tentativi per ogni attività in ARC-AGI per ottenere il punteggio migliore.
Se stai leggendo questo, sei già avanti. Resta così con la nostra newsletter.

Collins J. Okoth
Collins Okoth è un giornalista e analista di mercati con 8 anni di esperienza nella copertura di criptovalute e tecnologia. È un Analista Finanziario Certificato e possiede una laurea in Matematica Attuariale. Collins ha precedentemente lavorato con Geek Computer e CoinRabbit come scrittore e redattore.















