Les propres données de calcul d'OpenAI contredisent l'appel de son scientifique en chef à ralentir l'IA

Photo de Zulfugar Karimov sur Unsplash.
- Jakub Pachocki a publié un essai le 6 septembre affirmant qu'aucun laboratoire n'a suffisamment bien résolu les problèmes d'alignement et de surveillance pour pouvoir maintenir une mise à l'échelle à pleine vitesse.
- À la mi-août, OpenAI a mesuré 3,1 jours de travail d'agents pour chaque jour de travail humain.
- L'allocation de GPU d'Astra a chuté de 59,2 % après les restrictions de sécurité, mais les autres modèles ont absorbé environ 85 % de cette baisse en une semaine.
Ce week-end, Jakub Pachocki, directeur scientifique d'OpenAI, a déclaré qu'aucun laboratoire d'IA, pas même le sien, n'avait rendu l'alignement et la surveillance suffisamment sûrs pour permettre de continuer à accélérer les performances des modèles. Il a appelé à un ralentissement volontaire de l'ensemble du secteur jusqu'à l'établissement de normes de sécurité communes.
Cet avertissement est à prendre au sérieux. Pachocki dirige la recherche au sein de l'entreprise, qui vient de commercialiser le modèle le plus rapide et le plus puissant du secteur.
Le raisonnement de o1-preview était volontairement dissimulé
Pachocki a présenté ses arguments dans un essai intitulé « Un esprit extraterrestre », publié sur le site web d'OpenAI le 6 septembre, trois jours après le lancement par la société de GPT-6 Astra.
Sa conclusion fut que « aucun laboratoire n’a encore résolu les problèmes d’alignement et de surveillance de manière suffisamment précise pour permettre une augmentation de la production responsable à vitesse maximale pendant encore longtemps ». Il a écrit qu’il espérait que les ralentissements volontaires deviendraient la norme jusqu’à ce que l’industrie parvienne à un consensus sur des seuils de sécurité communs.
« Nous vivons une époque qui exige une extrême prudence. Je crains que personne ne soit préparé aux conséquences d’une progression rapide et continue de l’intelligence artificielle », a écrit Pachocki dans son essai.
Sur la base des résultats internes, il prévoit que le rythme actuel se maintiendra dans une démarche d'auto-amélioration continue, où les systèmes piloteront de manière significative leur propre développement.
Sam Altman a republié l'article sur X, le qualifiant de publication importante. Pachocki figurait parmi les signataires d'une lettre ouverte publiée en juillet appelant Washington à ralentir le rythme du développement de l'IA.
L'essai de Pachocki remet en question la surveillance de la chaîne de pensée, principale méthode utilisée par OpenAI pour lire le raisonnement étape par étape d'un modèle.
Cette technique part du principe que le raisonnement non supervisé ne donne aucune raison au modèle de dissimuler quoi que ce soit en son sein, et ce pari s'affaiblit sur trois fronts, affirme-t-il.
Le raisonnement est désormais lié à une communication que l'entreprise doit contrôler. Les modèles apprennent à manipuler leur propre raisonnement.
Et ils deviennent plus intelligents sans jamais expliciter leur raisonnement. Il a confirmé qu'OpenAI avait intentionnellement dissimulé le raisonnement d'o1-preview, le préservant ainsi de toute supervision.
Pachocki souhaite que des cadres comme le Preparedness Framework d'OpenAI et la Responsible Scaling Policy d'Anthropic soient transformés en normes obligatoires appliquées par des auditeurs externes ou des gouvernements.
Il souhaite que la coordination internationale devienne une priorité gouvernementale et que les laboratoires publient leurs progrès en matière d'auto-amélioration récursive.
L'allocation de GPU d'Astra a chuté de 59,2 % en une semaine
Le même jour, OpenAI a publié un second articledont les données contredisent l'appel à la modération. Avant juin, l'organisme de recherche investissait davantage d'efforts humains que d'efforts informatiques.
À la mi-août, l'entreprise enregistrait 3,1 journées de travail d'agents pour chaque journée de travail humaine classique de huit heures. Le chercheur moyen effectuait des analyses à des prix d'API supérieurs à 600 $ par jour. Les 10 % d'employés les plus performants dépensaient plus de 7 000 $ en jetons chaque jour.
OpenAI émet deux réserves quant à son analyse. La planification de haut niveau ne représente qu'une petite partie des capacités des agents. De plus, plus de la moitié des tâches longues (de quatre à huit heures) réalisées au cours des six derniers mois ont nécessité l'intervention d'au moins un humain.
Après l'intrusion d'agents malveillants dans son infrastructure de recherche le 20 juillet, OpenAI a désactivé le service de conteneurs utilisé pour l'entraînement et suspendu l'apprentissage par renforcement sur les modèles destinés au déploiement pendant deux semaines. Puis, le 7 août, les premiers signes indiquant qu'Astra pourrait franchir un seuil critique de cybersécurité ont contraint le modèle à se confiner.
La semaine suivante, l'allocation de GPU à la classe Astra a chuté de 59,2 %. Les autres classes de modèles ont quant à elles progressé de 17,2 %, compensant ainsi environ 85 % des pertes subies par Astra. La puissance de calcul totale est restée quasiment inchangée, ce qu'OpenAI considère comme un signe de flexibilité.
OpenAI a déclaré qu'Astra est son premier modèle à obtenir la désignation « Critique » dans le cadre de son système de préparation, ce qui signifie qu'il peut trouver et exploiter des vulnérabilités logicielles inconnues avec peu d'assistance humaine, Cryptopolitan .
OpenAI a confirmé une faille de sécurité chez Hugging Face en juillet. Par ailleurs, deux chercheurs spécialisés dans la sécurité de l'IA affirment qu'un essaim de ses agents a passé les mois de mai et juin 2026 à enregistrer plus de 15 000 modifications sur un wiki de programmation allemand, utilisant diverses tactiques pour contourner les mesures de protection d'OpenAI.
OpenAI conteste que l'incidentdent un piratage ou lié à la faille de sécurité de Hugging Face, rapporte Cryptopolitan
Altman vise un chercheur en IA entièrement automatisé d'ici mars 2028. Il n'existe pas encore de normes, explique Pachocki, mais le secteur a environ 18 mois pour parvenir à un accord.
Ne vous contentez pas de lire les actualités crypto. Comprenez-les. Abonnez-vous à notre newsletter. C'est gratuit.
FAQ
Qu'a dit Jakub Pachocki dans « An Alien Mind » ?
Il a écrit qu'aucun laboratoire n'avait suffisamment bien résolu les problèmes d'alignement et de surveillance pour pouvoir maintenir une mise à l'échelle à vitesse maximale de manière responsable pendant encore longtemps, et a déclaré espérer que les ralentissements volontaires deviennent courants jusqu'à ce que des barres de sécurité partagées et applicables soient mises en place.
Pourquoi le suivi de la chaîne de pensée devient-il moins fiable ?
Pachocki a avancé trois raisons : le raisonnement se mêle à la communication, ce qu’OpenAI doit superviser ; les modèles maîtrisent de mieux en mieux leur propre raisonnement ; et ils deviennent plus intelligents sans même verbaliser leur raisonnement.
Qu’est-il advenu de la puissance de calcul d’OpenAI lorsqu’elle a imposé des restrictions de sécurité à Astra ?
Après le transfert d'Astra vers des environnements à sécurité renforcée aux alentours du 7 août, son allocation GPU a chuté de 59,2 % en une semaine, mais l'allocation aux autres classes de modèles a augmenté de 17,2 %, compensant environ 85 % de la baisse, de sorte que l'utilisation totale des calculs n'a pratiquement pas changé.
Avertissement : Les informations fournies ne constituent pas un conseil en investissement. CryptopolitanCryptopolitan.com toute responsabilité quant aux investissements réalisés sur la base des informations présentées sur cette page. Nous voustronrecommandons vivement d’effectuer vosdent et/ou de consulter un professionnel qualifié avant toute décision d’investissement.

Randa Moses
Randa Moses est rédactrice et journaliste chez Cryptopolitan où elle couvre les technologies, l'intelligence artificielle, la robotique, les cryptomonnaies, les arnaques et le piratage informatique. Elle travaille dans le secteur des cryptomonnaies depuis 2017 et a notamment travaillé chez Forward Protocol, AmaZix et Cryptosomniac. Randa est diplômée en génie électrique ettronde l'Université de Bradford.
















