OpenAI annule les mises à jour de ChatGPT après les plaintes des utilisateurs sur son comportement « sycophantique »

- OpenAI a annoncé qu'elle annulait la mise à jour de GPT‑4o de la semaine dernière dans ChatGPT car elle était trop flatteuse ou conciliante — presque sycophantique.
- L'entreprise d'IA a affirmé qu'elle testait activement de nouvelles corrections pour résoudre le problème et révisait la manière dont les retours étaient collectés et intégrés.
- L'entreprise estime également que les utilisateurs devraient avoir plus de contrôle sur le comportement de ChatGPT, dans la mesure où cela est sûr et réalisable.
Le PDG d'OpenAI, Sam Altman, a déclaré le 29 avril que l'entreprise « revenait en arrière » sur la dernière mise à jour du modèle par défaut GPT-4o alimentant ChatGPT après que des utilisateurs se soient plaints de comportements étranges — frôlant l'extrême sycophantie. Les mises à jour ont jusqu'à présent été annulées à 100 %, en attendant des correctifs planifiés.
L'entreprise d'IA publié un rapport sur les récents problèmes de sycophantie avec le modèle d'IA par défaut GPT-4o alimentant ChatGPT, indiquant qu'il revenait en arrière sur ces changements. Cependant, OpenAI a souligné tester activement de nouveaux correctifs pour résoudre le problème. Il a ajouté qu'il révisait la manière de collecter et d'intégrer les commentaires pour pondérer la satisfaction des utilisateurs à long terme. L'entreprise d'IA a également divulgué qu'elle introduisait davantage de fonctionnalités de personnalisation qui donnaient aux utilisateurs un plus grand contrôle sur le comportement de ChatGPT.
Les utilisateurs sur les réseaux sociaux ont noté que ChatGPT a commencé à répondre de manière excessivement validante et conciliante suite à la mise à jour du modèle GPT-4o ce week-end, devenant rapidement un mème. Ils ont publié des captures d'écran de ChatGPT distribuant toutes sortes de décisions et d'idées problématiques et dangereuses.
Altman explique ce qui s'est passé et pourquoi cela importe
les dernières mises à jour de GPT-4o ont rendu la personnalité trop sycophantique et ennuyeuse (bien qu'il y ait certaines parties très intéressantes), et nous travaillons sur des correctifs dès que possible, certains aujourd'hui et d'autres cette semaine.
à un moment donné, nous partagerons nos enseignements tirés de cette expérience, cela a été intéressant.
— Sam Altman (@sama) Avril 27, 2025
Altman a divulgué que les dernières mises à jour de GPT-4o ont rendu la personnalité trop sycophantique et ennuyeuse — bien qu'il y ait eu certaines parties très intéressantes — et que son entreprise travaillait sur des correctifs de prompt, certains aujourd'hui et d'autres cette semaine. Il a également déclaré que l'entreprise « partagerait ses enseignements » éventuellement.
Selon OpenAI, la mise à jour — destinée à rendre la personnalité par défaut du modèle plus intuitive et efficace — a été informé trop influencée par les « commentaires à court terme » et n'a pas pleinement pris en compte l'évolution des interactions des utilisateurs avec ChatGPT au fil du temps.
« Nous avons commencé à annuler la dernière mise à jour de GPT-4o la nuit dernière. Elle est maintenant annulée à 100 % pour les utilisateurs gratuits, et nous vous mettrons à jour à nouveau lorsqu'elle sera terminée pour les utilisateurs payants, espérons-le plus tard aujourd'hui. »
~ Sam Altman, PDG chez OpenAI
Le patron d'OpenAI a clarifié que l'entreprise travaillait sur des correctifs supplémentaires pour modéliser la personnalité de ChatGPT et partagerait plus de détails dans les jours à venir. Cependant, OpenAI a expliqué que l'entreprise a commencé avec des principes de base et des instructions définis dans sa « Spécification du Modèle » lors de la définition du comportement des modèles d'IA. Il a également mentionné qu'elle a appris à ses modèles à appliquer ces principes en incorporant des signaux utilisateurs comme les pouces levés et/ou les pouces baissés sur les réponses de ChatGPT.
OpenAI dit que les utilisateurs devraient avoir plus de contrôle sur le comportement de ChatGPT
L'entreprise d'IA estime que les utilisateurs devraient avoir plus de contrôle sur le comportement de ChatGPT et faire des ajustements — dans la mesure où c'est sûr et faisable — s'ils ne sont pas d'accord avec le comportement par défaut. Elle a également déclaré qu'elle expérimentait des moyens de permettre aux utilisateurs de donner des « commentaires en temps réel » pour influencer directement leurs interactions avec ChatGPT et choisir parmi plusieurs personnalités d'IA.
Particulièrement, l'entreprise d'IA a déclaré qu'elle explorait de nouvelles façons d'intégrer des commentaires plus larges et démocratiques dans les comportements par défaut de ChatGPT. OpenAI espérait que les commentaires aideraient l'entreprise à mieux refléter les valeurs culturelles diverses dans le monde entier et à comprendre comment les utilisateurs souhaiteraient ChatGPT évoluer.
L'entreprise d'IA a également affirmé qu'elle construisait davantage de garde-fous de sécurité pour augmenter l'honnêteté et la transparence de son IA, et qu'elle continuerait à étendre ses évaluations pour aider à identifier les problèmes au-delà de la sycophantie. Elle a ajouté qu'elle mettait en œuvre plusieurs correctifs, y compris l'affinement de ses techniques d'entraînement du modèle de base et des invites système pour « orienter explicitement » GPT-4o loin de la sycophantie.
OpenAI a enfin divulgué qu'elle avait conçu la personnalité par défaut de ChatGPT pour refléter sa mission et être utile, supportive et respectueuse des différentes valeurs et expériences. Cependant, elle a reconnu que chacune de ces qualités désirables, comme tenter d'être utile ou supportive, pouvait avoir des effets secondaires involontaires. L'entreprise d'IA a souligné qu'une seule personnalité par défaut ne pouvait pas capturer toutes les préférences puisque plus de 500 millions de personnes utilisaient ChatGPT chaque semaine à travers des cultures et des contextes variés.
Les esprits les plus brillants du secteur crypto lisent déjà notre newsletter. Vous aussi ? Rejoignez-les.

Collins J. Okoth
Collins Okoth est journaliste et analyste de marché avec 8 ans d'expérience dans la couverture de la crypto-monnaie et de la technologie. Il est Analyste Financier Certifié et détient un diplôme en mathématiques actuarielles. Collins a précédemment travaillé chez Geek Computer et CoinRabbit en tant qu'auteur et rédacteur.















