OpenAI perturbe une campagne liée à Moon alors que la guerre de distillation de l'IA s'intensifie

- OpenAI indique avoir identifié des efforts de distillation de données associés à Moonshot.
- Elle a suspendu certains comptes liés à cette campagne de distillation.
- Anthropic a également signalé que Moonshot avait ciblé ses modèles Claude.
OpenAI a porté des accusations de grattage de données contre son concurrent chinois, Moonshot AI. Elle a relié une vague massive d'activités de sondage, conçues pour décoder la façon dont ses modèles résolvent des problèmes complexes, à des milliers de tentatives émanant d'utilisateurs affiliés à Moonshot.
Dès la première semaine de juillet, la campagne coordonnée associée à Moonshot a atteint 16 000 requêtes provenant de plus de 4 000 utilisateurs en seulement deux jours, a révélé OpenAI. Le créateur de ChatGPT a fini par cartographier davantage d'activités connexes impliquant un cluster de plus de 15 000 utilisateurs, toutes entièrement perturbées au 28 juillet.
Selon l'analyse de l'entreprise, la campagne n'a entraîné aucune compromission de base de données, aucun bris de cryptage ni aucune exposition des conversations utilisateur stockées. Cependant, les attaquants ont exploité des invites et des manipulations du modèle, leur permettant de dupliquer visiblement des capacités de raisonnement interdites grâce à une opération élaborée et à grande échelle qui violait les conditions d'utilisation.
OpenAI indique avoir mis en place davantage de mesures de protection pour prévenir la distillation
Selon OpenAI, il a détecté et a interrompu certaines opérations au cours desquelles des utilisateurs tentaient de voler une logique cachée en transférant des informations de raisonnement cryptées entre différentes conversations, puis en les décryptant dans une autre conversation.
La majorité de ces opérations étaient liées à Moonshot. Parallèlement, d'autres chercheurs tiers ont signalé à l'entreprise des vulnérabilités similaires, notamment des problèmes de transfert inter-modèles et de compactage des données.
Jusqu'à présent, le développeur de ChatGPT a qualifié cet événement récent de « distillation adversariale » et a mis en garde contre le fait que la distillation de la logique pourrait permettre à des opposants de imiter des technologies avancées.
Elle a ajouté qu'un processus de distillation à grande échelle pourrait considérablement réduire le temps nécessaire au développement d'une capacité d'IA avancée, sans aucun engagement en matière de sécurité et d'alignement.
Jusqu'à présent, pour faire face à la tendance de la distillation, OpenAI a mis en place des pénalités sur les comptes, renforcé l'infrastructure et noué des partenariats.
De plus, elle a même suspendu des comptes suspects, renforcé le processus d'inscription et la sécurité back-end, et élargi sa surveillance de la communauté utilisateur.
Par ailleurs, elle a mis en œuvre des protections plus robustes contre la raison cachée, qui s'appliquent à tous les utilisateurs, espaces de travail, organisations d'entreprise et architectures de modèles.
Caroline Zier, responsable des initiatives stratégiques en matière de politique de sécurité nationale chez OpenAI, a ajouté qu'ils continueront à investir dans des protections plus solides. Elle a déclaré : « Notre préoccupation porte sur la violation de nos conditions d'utilisation, et non sur les modèles ouverts ou la distillation légitime. »
Pourquoi la distillation des modèles d'IA suscite une inquiétude croissante
La distillation de modèles permet aux développeurs d'utiliser les sorties d'un système d'IA plus performant pour améliorer ou reproduire les performances d'un autre modèle.
Bien qu'une distillation légitime puisse être utilisée pour créer des systèmes plus petits et plus efficaces, OpenAI soutient que l'extraction à grande échelle non autorisée peut donner aux concurrents accès à des capacités qui ont nécessité d'importants investissements en ressources.
La société a indiqué que la dernière campagne était particulièrement préoccupante car les acteurs ne se contentaient pas d'utiliser ChatGPT pour des tâches ordinaires. Au contraire, ils auraient conçu des flux de travail automatisés pour interroger répétitivement les modèles et transférer les réponses utiles vers d'autres systèmes.
En collectant suffisamment de sorties, les attaquants pourraient potentiellement reproduire certains aspects du raisonnement, de la programmation et des capacités de résolution de problèmes d'un modèle sans accéder directement à ses poids sous-jacents ou à son infrastructure.
Les divulgations d'OpenAI mettent en lumière un défi croissant pour les entreprises d'IA alors que des modèles de plus en plus performants deviennent largement accessibles via des API et des produits grand public. Les fournisseurs doivent équilibrer l'accès large à leurs systèmes avec des mesures de protection conçues pour empêcher l'extraction systématique de capacités propriétaires.
Anthropic a également identifié la campagne de distillation de Moonshot
Au cours des derniers mois, Anthropic a également a découvert et a stoppé plusieurs campagnes cybernétiques où des acteurs malveillants ciblaient Claude.
Ces auteurs comprenaient des groupes de renseignement présumés soutenus par des États, des pirates informatiques motivés financièrement et des activistes politiques, les incidents s'étant produits entre décembre 2025 et août 2026.
Leurs attaques spécifiques visaient à extraire les compétences à haute valeur ajoutée de Claude : son raisonnement logique, sa programmation, l'évaluation des données et ses flux de travail automatisés d'agents.
Selon des informations, cinq processus de distinction différents ont abouti à près de 200 millions requêtes illégales. La majorité des requêtes de distillation provenait d'une campagne d'Alibaba, que Anthropic a qualifiée du plus grand effort de collecte de données de l'histoire de la société. Cette campagne particulière a généré 151 millions de requêtes enregistrées de mai à juillet 2026, atteignant un pic de près de 3 millions par jour.
Une seconde campagne de Moonshot AI aurait transmis directement des requêtes provenant de l'armée chinoise à Anthropic. Sur une période de 10 jours, l'entreprise a enregistré près de 300 000 requêtes provenant de 5 000 comptes, la plupart étant dirigées vers le modèle Opus.
Moonshot fait l'objet d'une attention considérable à Washington en raison de la rapidité avec laquelle elle a dépassé ses concurrents américains.
Bien que Pékin ait déjà ignoré les accusations précédentes de la Silicon Valley et de l'administration Trump concernant ses activités de collecte de données, il a menacé de prendre des mesures de rétorsion en cas de sanctions de Washington.
Ne vous contentez pas de lire les actualités crypto. Comprenez-les. Abonnez-vous à notre newsletter. C'est gratuit.
FAQ
Qu'est-ce que la distillation de modèle d'IA ?
La distillation de modèle d'IA est un processus où les développeurs utilisent les sorties d'un modèle d'IA plus performant pour entraîner ou améliorer un autre modèle. OpenAI indique qu'une distillation non autorisée à grande échelle peut permettre à d'autres de reproduire des capacités avancées sans accéder directement aux systèmes sous-jacents du modèle original.
La campagne Moonshot AI a-t-elle compromis les systèmes d'OpenAI ?
OpenAI a déclaré que la campagne n'avait pas compromis ses bases de données, brisé le cryptage ni exposé les conversations stockées des utilisateurs. Au contraire, l'entreprise a indiqué que les utilisateurs s'étaient appuyés sur des invites répétées et sur la manipulation du modèle pour extraire des informations sur les capacités de raisonnement de ses modèles.
Combien de requêtes Anthropic a-t-il associées à la campagne Moonshot AI ?
Anthropic a déclaré qu'une campagne liée à Moonshot avait généré près de 300 000 requêtes provenant d'environ 5 000 comptes sur une période de 10 jours, la plupart des requêtes ciblant son modèle Claude Opus.

Nellius Irene
Nellius est diplômée en gestion d'entreprise et en informatique, avec cinq ans d'expérience dans l'industrie des cryptomonnaies. Elle est également diplômée de Bitcoin Dada. Nellius a contribué à des publications médiatiques de premier plan, dont BanklessTimes, Cryptobasic et Riseup Media.
















