Fuite de DeepSeek, les conversations des agents IA sont-elles exposées ?

- DeepSeek a stocké les journaux de conversation et d'autres données utilisateur dans des bases de données non sécurisées accessibles via Internet, utilisant ClickHouse.
- Les bases de données ont été fermées après que des chercheurs de Wiz aient alerté DeepSeek, mais la collecte de données se poursuit.
- Les agents IA dans l'espace crypto commencent à utiliser DeepSeek pour attirer davantage l'attention, mais les sceptiques considèrent l'adoption massive du LLM comme un risque de sécurité à long terme.
DeepSeek, l’IA qui a surpris le monde par sa productivité, est désormais scrutinée pour avoir stocké des données non protégées dans des bases de données accessibles au public. Cette fuite de données remet en question tous les agents IA qui ont rapidement adopté ce modèle de langage.
Quelques jours seulement après avoir gagné en popularité, DeepSeek a été exposé comme risqué, laissant fuir des journaux de données vers une base de données ClickHouse accessible publiquement et non protégée. Les données exposées contenaient des journaux de conversation et des informations sensibles sur les utilisateurs, ce qui pourrait exposer les comptes et les mots de passe. ClickHouse, un outil de base de données analytique de l’entreprise informatique russe Yandex, a été utilisé pour acheminer le trafic sans protection supplémentaire.
Les données de conversation divulguées pourraient contenir des mots de passe et des fichiers locaux, bien que les chercheurs de la société de cybersécurité Wiz n’aient pas effectué de requêtes pour des informations potentiellement sensibles. Il est possible que la base de données contienne des clés secrètes d’API. Au total, plus d’un million de lignes de données ont été découvertes par les chercheurs après avoir suivi toutes les connexions ouvertes pendant une session DeepSeek.
À partir de ce point – valider l’exposition était assez simple, en regardant l’API ClickHouse – nous avons pu accéder à l’API HTTP qui permet d’interroger directement la base de données MySQL
Il y a eu une exposition significative de données, en particulier de la table log_stream, sur… pic.twitter.com/NhS2gyfBpJ
— Nagli (@galnagli) Janvier 29, 2025
La fuite a été découverte après avoir suivi l’interface de chat principale, découvrant jusqu’à 30 sous-domaines qui effectuaient principalement des tâches techniques inoffensives pour l’outil d’IA. Après la fin des tests de vulnérabilité, certaines des bases de données les plus controversées sont désormais protégées et inaccessibles.
L’équipe de DeepSeek a pris contact après les tests, affirmant qu’aucune des découvertes n’a été rendue publique avant la réparation de la sécurité. Cependant, quelques heures avant que la fuite de la base de données ne soit rendue publique, un autre utilisateur anonyme de X a signalé un problème avec des bases de données non sécurisées, ce qui a été considéré à l’époque comme une tentative d’appât ou d’arnaque.
À ce stade, on ignore si d’autres acteurs malveillants ont trouvé quelque chose de valeur dans les données. Cependant, la collecte de données à partir des conversations d’IA souligne également la perte potentielle de vie privée lors de l’utilisation de l’outil. Il existe plusieurs points de terminaison pour interagir avec DeepSeek, de son site officiel et son application à l’hébergement local ou à tout autre wrapper utilisé avec le modèle de langage (LLM) et le moteur de raisonnement.
La fuite de DeepSeek affectera-t-elle les agents IA ?
Les modèles de langage peuvent être utilisés avec plus de confidentialité en les exécutant localement, ce pour quoi DeepSeek est bien adapté. Chaque nouvelle personnalité d’agent IA dispose de ses propres outils pour envelopper le modèle de langage et le présenter aux utilisateurs.
Venice.AI, l’un des agents IA les plus prominents, prétend offrir une confidentialité maximale. Cependant, les utilisateurs ont découvert que Venice.AI envoie également des données en texte clair à ses serveurs centraux, bien qu’au moins pas en utilisant des outils supplémentaires exposés au public.
Contrairement à leur affirmation, il n’y a pas d’IA privée dans https://t.co/bR5IfvDdvI
Toutes les requêtes d’inférence sont envoyées à leur serveur central en texte clair, sans aucun chiffrement ni confidentialité.
Tous les tampons reçus sont également en texte clair.
Vérifiez-le vous-même en consultant l’onglet Réseau dans Chrome. pic.twitter.com/WDRxog6E5O
— Smit (@0xSmit) Janvier 27, 2025
L’approche de Venice.AI reste relativement plus confidentielle par rapport à la fuite de données de DeepSeek.
De plus, Venice.AI répondrait à certaines requêtes sans la censure généralement imposée sur le site centralisé de DeepSeek. Bien qu’il soit encore à ses débuts, il a l’intention de devenir un hub pour à développer des agents IA supplémentaires en fournissant le modèle de langage et des ressources.
La course à la création de plus d’agents utilisant DeepSeek pourrait être un vecteur qui propage d’autres risques inconnus provenant du modèle de langage et du moteur de raisonnement. Presque chaque heure, de nouveaux agents sont annoncés, prétendant utiliser les capacités de DeepSeek pour un meilleur contenu à un coût inférieur.
DeepSeek s’oppose à l’éthique crypto « Made in USA »
Construire des agents IA et les tokeniser tout en s’appuyant sur DeepSeek est considéré comme un risque inhérent à l’utilisation d’un modèle de langage relativement nouveau et non testé. DeepSeek est devenu l’application la plus téléchargée ces derniers jours, mais la communauté crypto a appelé à la prudence lors de l’utilisation de ce LLM pour construire des produits.
La vision la plus extrême considère le modèle DeepSeek comme intrinsèquement risqué, même lorsqu’il est utilisé comme un LLM auto-hébergé.
https://twitter.com/ryan_trat/status/1884860338807722351
Les tokens liés aux agents IA sont toujours considérés comme risqués et plus proches de l’hype des memes, n’étant actuellement pas considérés comme des actifs sérieux à inclure dans la tendance crypto « Made in USA ».
Cependant, l’utilisation de DeepSeek pourrait disqualifier des projets et soulever des soupçons quant à leurs capacités de collecte de données et leur potentiel de propagation de logiciels malveillants. Les agents construits avec DeepSeek pourraient publier des informations erronées ou se comporter de manière erratique.
Un utilisateur de X a publié :
« Les agents construits avec DeepSeek sont les agents du chaos parfaits : boucles à l’infini, vous nourrissent de données inutiles, et vous font tomber (ainsi que leur compte X) au lieu de ça. »
D’autres partisans généraux de la crypto ont que quelqu'un avait créé une fausse page sur GitHub qui ressemblait à une offre de téléchargement du populaire modèle d'IA Qwen. La page promettait de manière convaincante une IA entièrement hors ligne qui garderait les données des utilisateurs privées, mais le piège a été révélé par la taille du fichier. mis en garde contre l’engagement avec DeepSeek à ce stade, en particulier via l’application officielle. Même quelques jours avant la fuite de données, des analystes en cybersécurité ont averti de possibles fonctionnalités d’espionnage, car DeepSeek est lié lié au Parti communiste chinois par son fondateur, Liang Wengfeng.
Suite à l’interdiction de TikTok aux États-Unis par crainte de collecte de données, l’adoption rapide de DeepSeek a été considérée comme une menace similaire pour la sécurité des données.
Si vous lisez ceci, vous êtes déjà en avance. Restez ainsi grâce à notre newsletter.
Avertissement. Les informations fournies ne constituent pas des conseils en matière d'investissement. Cryptopolitan.com ne saurait être tenue responsable des investissements réalisés sur la base des informations fournies sur cette page. Nous recommandons vivement de mener vos propres recherches et/ou de consulter un professionnel qualifié avant de prendre toute décision d'investissement.

Hristina Vasileva
Hristina Vasileva se spécialise dans les actualités liées à la DeFi, aux entreprises et à l'économie. Elle est diplômée de l'Université de Sofia avec un master en philosophie, après avoir obtenu une licence de quatre ans en administration des affaires, journalisme et communication de masse. Elle a travaillé pour l'un des principaux journaux du pays, couvrant les matières premières et les résultats d'entreprises. Actuellement, Hristina est auteure contributrice chez Cryptopolitan.
















