DERNIÈRES ACTUALITÉS
SÉLECTIONNÉ POUR VOUS

L'agent Operator d'OpenAI reçoit un coup de pouce avec un nouveau modèle d'IA

ParCollins J. OkothCollins J. Okoth 3 min de lecture
L'agent Operator d'OpenAI reçoit une impulsion grâce à un nouveau modèle d'IA
  • OpenAI a mis à niveau Operator, son agent IA qui utilise le web pour effectuer des tâches, vers un modèle basé sur o3 après avoir précédemment utilisé une version personnalisée de GPT-4o.
  • L'opérateur o3 a été affiné avec des données de sécurité supplémentaires pour l'utilisation informatique, y compris des ensembles de données de sécurité conçus pour enseigner les limites de décision du modèle.
  • Mike Knoop, co-fondateur de la fondation Arc Prize, estime que l'exécution du modèle o3 pourrait coûter plus cher que prévu.

OpenAI a mis à jour le modèle d’IA alimentant Operator, passant de la version personnalisée précédente de GPT-4o à un modèle basé sur o3, l’un des derniers de la série « reasoning » (raisonnement) d’OpenAI. L’opérateur o3 a été affiné avec des données de sécurité supplémentaires pour l’utilisation informatique et comprenait des ensembles de données de sécurité conçus pour enseigner au modèle les limites de décision.

OpenAI a relevé l’opérateur dans ChatGPT avec un nouveau modèle d’agent utilisant l’ordinateur (CUA) basé sur une version d’OpenAI o3. Avec le nouveau modèle, l’opérateur est devenu plus persistant et plus précis lors de l’interaction avec le navigateur, améliorant ainsi le taux de réussite global des tâches. Il fournit également des réponses mieux structurées, plus claires et plus complètes.

Selon OpenAI, le nouveau modèle CUA a montré des performances plus fortes par rapport à l’industrie, atteignant l’état de l’art (SOTA) sur OSWorld et WebArena. Il a également montré des performances relatives plus fortes par rapport à la version précédente, tant dans les benchmarks établis que dans les évaluations de préférence humaine.

OpenAI remplace le modèle basé sur GPT‑4o par une version basée sur o3

OpenAI a remplacé le modèle existant basé sur GPT‑4o pour Operator par une version basée sur OpenAI o3, bien que la version API reste basée sur 4o. L’entreprise d’IA a également affirmé que l’opérateur o3 utilise la même approche de sécurité multicouche que celle utilisée pour la version 4o.

Cependant, par rapport aux autres modèles de la famille o3, l’opérateur o3 a été affiné avec des données de sécurité supplémentaires pour l’utilisation informatique, y compris des ensembles de données de sécurité conçus pour enseigner au modèle les limites de décision sur les confirmations et les refus.

OpenAI a publié un rapport technique montrant les performances de l’opérateur o3 sur des évaluations de sécurité spécifiques. Par rapport au modèle d’opérateur GPT-4o, l’opérateur o3 était moins susceptible de refuser d’effectuer des activités « illicites » et de rechercher des données personnelles sensibles, et était moins susceptible à une forme d’attaque IA connue sous le nom d’« injection de prompt ». 

« L’opérateur o3 utilise la même approche multicouche de sécurité que celle que nous avons utilisée pour la version 4o de l’opérateur… Bien que l’opérateur o3 hérite des capacités de codage d’o3, il n’a pas un accès natif à un environnement de codage ou à un Terminal. »

–OpenAI

L’entreprise d’IA a également divulgué que le nouveau modèle basé sur o3 a subi des évaluations de sécurité standard, et que Operator est resté disponible en tant qu’aperçu de recherche pour les utilisateurs de ChatGPT Pro dans le monde entier. Cependant, ce modèle amélioré n’était disponible que dans Operator sur ChatGPT.

Knoop soupçonne que l’exécution du modèle o3 d’OpenAI pourrait coûter plus cher que prévu

La semaine dernière, la Fondation Arc Prize, qui maintient et administre ARC-AGI, a mis à jour ses coûts de calcul approximatifs pour o3. L’organisation avait initialement estimé que la configuration la mieux performante d’o3 qu’elle a testée, o3 high, coûtait environ 3 000 $ pour résoudre un seul problème ARC-AGI. Cependant, la Fondation croit désormais que le coût pourrait être 10 fois supérieur aux estimations précédentes, soit environ 30 000 $ par tâche.

De plus, bien qu’OpenAI n’ait pas encore fixé le prix d’o3 ni ne l’ait entièrement publié, l’un des co-fondateurs de la Fondation Arc Prize, Mike Knoop, estime que le prix du modèle o1-pro est un bon proxy et une comparaison plus proche du coût réel d’o3. Il a toutefois ajouté que o3 continuerait d’être étiqueté comme une version d’aperçu sur le tableau de classement pour refléter l’incertitude jusqu’à ce que le prix officiel soit annoncé.

Selon la Fondation Arc Prize, un prix élevé pour o3 high ne serait pas hors de question, compte tenu de la quantité de ressources de calcul que le modèle utiliserait apparemment. o3 high a utilisé 172 fois plus de calcul que o3 low, la configuration de o3 utilisant le moins de calcul, pour résoudre ARC-AGI.

Les rumeurs ont été depuis début mars au sujet des plans coûteux qu’OpenAI envisageait d’introduire pour les clients d’entreprise. L’information rapportée indiquait que l’entreprise pourrait facturer jusqu’à 20 000 $ par mois pour des « agents » IA spécialisés, comme des agents de développement logiciel.

Cependant, bien que certains aient fait valoir que même les modèles les plus chers d’OpenAI coûteraient bien moins cher qu’un contracteur humain ou un employé typique, le chercheur en IA Toby Ord a souligné que les modèles pourraient ne pas être aussi efficaces. Par exemple, o3 high a nécessité 1 024 tentatives pour chaque tâche dans ARC-AGI pour atteindre son meilleur score.

Les esprits les plus brillants du secteur crypto lisent déjà notre newsletter. Vous aussi ? Rejoignez-les.

Partager cet article
Collins J. Okoth

Collins J. Okoth

Collins Okoth est journaliste et analyste de marché avec 8 ans d'expérience dans la couverture de la crypto-monnaie et de la technologie. Il est Analyste Financier Certifié et détient un diplôme en mathématiques actuarielles. Collins a précédemment travaillé chez Geek Computer et CoinRabbit en tant qu'auteur et rédacteur.

PLUS D'ACTUALITÉS…