KI kann ohne menschliches Wissen nicht gedeihen – Eine Entschädigung für die ursprünglichen Schöpfer ist unerlässlich

- Das Training von KI-Modellen erfordert große Datensätze, und es ist besser, wenn sie auf menschlichem Wissen basieren.
- Zeitungen und Forschungseinrichtungen sowie Webportale investieren ihre Ressourcen in das Sammeln und Veröffentlichen von Informationen.
- Eine Vergütung für die ursprünglichen Schöpfer von Inhalten ist unabdingbar, da KI-Firmen nun Inhalte von Unternehmen lizenzieren.
Das Training von KI-Modellen erfordert enorme Datenmengen, und ihre Fähigkeit, gute Ergebnisse zu liefern, hängt direkt von den Daten ab, die dem System zugeführt wurden. Informationen sind nicht kostenlos, und hier geht es um eine Menge von Rechten des geistigen Eigentums.
KI-Unternehmen denken jedoch nicht in diesen Kategorien; sie nehmen das von Generationen von Schriftstellern produzierte Wissen als selbstverständlich hin; ihr Konzept der „fair use“ (angemessene Nutzung) unterscheidet sich auch von der ursprünglichen Wahrnehmung; und sie zahlen ungern an die Schöpfer von Inhalten, die ihre Modelle zu dem gemacht haben, was sie heute sind.
Diebstahl menschlichen Wissens
Bei der Produktion der Inhalte, die wir in Zeitungen, Zeitschriften, Büchern, Online-Archiven und Forschungsarbeiten sehen, stecken viel harte Arbeit und Schweiß, aber das ist ohne Schriftsteller, Redakteure, Forscher und Verleger nicht möglich, die dies in verschiedenen Formen der Öffentlichkeit zugänglich gemacht haben.
Solche mühsam erworbene Anerkennung und Wissen sollten nicht kostenlos zur Ausbeutung durch ein Unternehmen zur Verfügung stehen, wie es geschehen ist.
„Informationen, die im Internet öffentlich verfügbar sind.“
Quelle: OpenAI.
Ja, das ist es, was OpenAI sagt, wenn man nach den Inhalten fragt, die es zur Schulung seiner KI-Systeme verwendet hat, zusammen mit den Informationen, die es von Drittanbietern lizenziert hat, und den Informationen, die seine Benutzer und menschlichen Trainer bereitstellen.
Was die lizenzierten Inhalte betrifft, suchen Unternehmen diese jetzt, aber wir haben keine Informationen darüber, ob OpenAI vor dem Start seines ersten GPT-Modells Informationen von einem Anbieter lizenziert hat. Das Modell muss auf urheberrechtlich geschütztem Material trainiert worden sein, das nicht kostenlos für kommerzielle Zwecke genutzt werden durfte.

Entschädigung für ursprüngliche Schöpfer
Bis vor einem Jahr wurde der Großteil des online oder offline geschriebenen Textes mit menschlicher Anstrengung verfasst. Trotz Clickbait und qualitativ minderwertigen Inhalten war dies zumindest von Menschen erstellt, die die menschliche Psyche und den Denkprozess verstanden, und generative KI-Anwendungen wurden auf der Grundlage solcher Informationen aufgebaut.
Heute stehen Unternehmen jedoch vor einem neuen Problem beim Training ihrer KI-Modelle, und das ist der vorherrschende maschinengenerierte Inhalt im gesamten Internet, der in keiner Weise als qualitativ hochwertiger Inhalt angesehen wird. Solche Inhalte plagen die für das Training von KI-Modellen verfügbaren Ressourcen, da sie keine qualitativ hochwertigen Ergebnisse liefern können, wenn sie mit nutzlosem, ausschweifendem Text trainiert werden, so wie diese Modelle normalerweise Inhalte produzieren. KI, die auf KI trainiert wird, ist ein Prozess, der oft als KI-Kannibalismus oder Klonen bezeichnet wird.
Um dies zu verhindern, müssen KI-Unternehmen ihre Quellenmaterialien auf vertrauenswürdige Quellen beschränken, bei denen es sich um nichts anderes als Zeitungen, Zeitschriften und öffentliche Foren handelt, die eine Fülle von menschlich produzierten Wissen beherbergen. Ein paar mehr können ebenfalls gezählt werden, wie oben erwähnt, aber diese Notwendigkeit und Klagen von Zeitungen haben sie gezwungen, Inhalte zu lizenzieren und für die Ausbeutung, die sie betrieben haben, zu zahlen.
Unternehmen wie Reddit, ein großes webbasiertes öffentliches Forum, erwägen ebenfalls die Lizenzierung ihrer Inhalte an KI-Unternehmen. In einer Erklärung hieß es, dass sie Geschäfte vor Klagen bevorzugen, aber Klagen nicht ausschließen, falls die Geschäftsgeschehen scheitern. Wenn Sie kein urheberrechtlich geschütztes Soundtrack in Ihr YouTube-Video einfügen dürfen, warum sollte dann einem KI-Unternehmen erlaubt sein, dies für das Training ihrer Modelle für kommerzielle Zwecke zu nutzen?
Das Urheberrecht ist hier ein Problem, da KI-Unternehmen es weiterhin verletzen. Andererseits ist KI nicht in der Lage, selbstständig neue Nachrichten zu sammeln; es bedarf menschlicher Anstrengung, Nachrichten zu sammeln und von verschiedenen Quellen zu bestätigen, bevor sie veröffentlicht werden. Erst dann kann ein KI-Modell diese Informationen nutzen, und die menschlichen Ressourcen in diesem Fall nicht zu entschädigen, ist eine Ausbeutung.
Die klügsten Krypto-Köpfe lesen bereits unseren Newsletter. Lust dabei? Mach mit.
Haftungsausschluss: Die bereitgestellten Informationen stellen keine Anlageberatung dar. Cryptopolitan.com übernimmt keine Haftung für Investitionen, die auf der Grundlage der auf dieser Seite bereitgestellten Informationen getätigt werden. Wir empfehlen dringend, vor jeder Anlageentscheidung unabhängige Recherchen durchzuführen und/oder einen qualifizierten Fachmann zu konsultieren.

Aamir Sheikh
Aamir ist Tech-Journalist mit fast sechs Jahren Erfahrung in der Krypto- und Technologiebranche. Er absolvierte sein Studium an der MAJ University mit einem MBA in Finanzen und Marketing. Heute arbeitet er für Cryptopolitan, wo er über die neuesten Entwicklungen in den Kryptowährungsmärkten und Preisprognosen berichtet.
















