DERNIÈRES ACTUALITÉS
SÉLECTIONNÉ POUR VOUS

Des chercheurs français et une startup américaine contestent l'affirmation d'OpenAI sur le droit d'auteur

ParJames KinotiJames Kinoti 2 min de lecture
OpenAI
  • Des chercheurs français et une startup américaine ont contesté la nécessité pour OpenAI de données protégées par le droit d'auteur dans l'entraînement des IA.
  • Ils ont proposé des alternatives, telles que d'immenses bases de données du domaine public et un modèle d'IA certifié.
  • Cela bouleverse les normes du secteur et s'aligne sur les réglementations mondiales, incitant à repenser l'utilisation des données en IA.

Dans un tournant révolutionnaire, un consortium de chercheurs français soutenus par le gouvernement et une startup américaine ont contesté l'affirmation de OpenAI selon laquelle l'entraînement des modèles d'IA de pointe sans recourir à des matériaux protégés par le droit d'auteur est « impossible ». Ce défi à la norme de l'industrie a provoqué des remous dans la communauté de l'IA, déclenchant des débats et des discussions sur l'avenir de l'entraînement des modèles d'IA et des réglementations sur l'utilisation des données.

De nouvelles preuves émergent

Des annonces récentes ont apporté des preuves convaincantes contraires à la revendication d'OpenAI. Le groupe de recherche français a dévoilé ce qui est considéré comme le plus grand ensemble de données d'entraînement d'IA composé entièrement de textes du domaine public. Ce développement indique un changement significatif dans l'approche du sourcing de données pour l'entraînement des modèles d'IA, réduisant potentiellement la dépendance aux matériaux protégés par le droit d'auteur.

De plus, une startup américaine, 273 Ventures, a obtenu la certification de l'organisation à but non lucratif Fairly Trained pour avoir développé un modèle de langage large (LLM) sans enfreindre le droit d'auteur. Le modèle, nommé KL3M, a été entraîné à l'aide d'un ensemble de données méticuleusement sélectionné de documents juridiques, financiers et réglementaires, démontrant la faisabilité de l'entraînement de modèles d'IA tout en respectant les réglementations sur le droit d'auteur.

Contester les normes de l'industrie

L'émergence de ces initiatives remet en question la norme de l'industrie prévalente consistant à utiliser des matériaux protégés par le droit d'auteur pour l'entraînement des modèles d'IA. Avec Fairly Trained offrant une certification aux entreprises qui démontrent des pratiques éthiques d'utilisation des données, il y a une impulsion croissante pour les entreprises d'explorer des approches alternatives de sourcing de données.

Ce développement s'aligne également sur les efforts mondiaux pour réglementer l'utilisation des données de l'IA. Des pays comme la Chine ont proposé des listes noires de sources jugées inadaptées à l'entraînement des modèles d'IA générative, tandis que l'Inde a mis en œuvre des mesures pour restreindre l'accès à ses ensembles de données aux modèles d'IA de confiance. Ces initiatives réglementaires soulignent l'importance des pratiques éthiques des données dans le développement et le déploiement des technologies d'IA.

Implications pour OpenAI

OpenAI, un acteur majeur de l'industrie de l'IA, se retrouve au centre de ce discours. L'affirmation de l'entreprise selon laquelle des services comme ChatGPT seraient « impossibles » sans utiliser des œuvres protégées par le droit d'auteur a été remise en question par ces développements récents. Elon Musk, critique vocal des stratégies de sourcing de données d'OpenAI, a exprimé des préoccupations concernant l'approche de l'entreprise suite aux révélations de son CTO, Mira Murati.

Alors que le paysage de l'IA continue d'évoluer, il est évident que les pratiques éthiques des données et la conformité aux réglementations sur le droit d'auteur joueront un rôle pivot dans la façonnement de l'avenir du développement de l'IA. L'émergence d'initiatives telles que l'ensemble de données d'entraînement d'IA du groupe de recherche français et le modèle certifié Fairly Trained de 273 Ventures signifie un changement de paradigme dans l'industrie, incitant les parties prenantes à réévaluer leurs approches de sourcing de données et d'entraînement des modèles.

Le défi lancé par des chercheurs français et une startup américaine à l’affirmation d’OpenAI concernant la nécessité de matériaux protégés par le droit d’auteur pour l’entraînement des modèles d’IA marque une étape importante dans la quête de pratiques de développement d’IA éthiques et transparentes. Alors que les efforts réglementaires mondiaux gagnent en ampleur et que les normes de l’industrie sont remises en question, la communauté de l’IA fait face à un tournant critique où l’innovation doit être équilibrée avec des considérations éthiques et le respect des réglementations en matière de droit d’auteur.

Si vous lisez ceci, vous êtes déjà en avance. Restez ainsi grâce à notre newsletter.

Partager cet article

Avertissement. Les informations fournies ne constituent pas des conseils en matière d'investissement. Cryptopolitan.com ne saurait être tenue responsable des investissements réalisés sur la base des informations fournies sur cette page. Nous recommandons vivement de mener vos propres recherches et/ou de consulter un professionnel qualifié avant de prendre toute décision d'investissement.

James Kinoti

James Kinoti

Passionné de crypto, James prend plaisir à partager ses connaissances sur la fintech, la cryptomonnaie ainsi que la blockchain et les technologies de pointe. Les dernières innovations dans l'industrie crypto, les jeux cryptos, l'IA, la technologie blockchain et d'autres technologies occupent ses pensées. Sa mission : rester à la page des applications transformatrices dans divers secteurs.

PLUS D'ACTUALITÉS…