AKTUELLE NACHRICHTEN
FÜR SIE AUSGEWÄHLT

Top-KI-Chatbots „hochgradig anfällig" , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ", " , ", " : ",   

VonJeffrey GogoJeffrey Gogo 2 Min. Lesezeit
KI-Chatbots

● KI-Chatbots lassen sich leicht dazu verleiten, schädliche Antworten zu generieren

● Forscher haben festgestellt, dass fünf führende LLMs 'hochgradig anfällig' für Jailbreaks sind

● KI-Unternehmen betonen die integrierten Sicherheitsmechanismen ihrer Modelle

KI-Chatbots wie ChatGPT oder Gemini können laut einer neuen Studie des britischen AI Safety Institute (AISI) leicht dazu gebracht werden, Anfragen zu erfüllen, die schädliche Antworten generieren.

Die Regierungsforscher testeten die Integrität großer Sprachmodelle (LLMs) – der Technologie hinter den KI-Chatbots – gegen Angriffe auf die nationale Sicherheit.

Die Ergebnisse liegen vor dem AI Seoul Summit, der am 21. und 22. Mai in Südkorea vom britischen Premierminister Rishi Sunak mitgeleitet wird.

Auch lesen: Sicherheit wird ein Top-Thema auf dem Seoul AI Summit sein  

KI-Chatbots anfällig für toxische Antworten

AISI testete einfache ‚Jailbreaks‘ – Text-Prompts, die darauf abzielen, Schutzmaßnahmen gegen illegale, toxische oder explizite Ausgaben zu umgehen – gegen fünf führende LLMs. Das Institut nannte die KI-Systeme nicht, stellte jedoch fest, dass alle von ihnen „hochgradig verwundbar“ sind.

„Alle getesteten LLMs bleiben hochgradig anfällig für einfache Jailbreaks, und einige werden schädliche Ausgaben selbst ohne gezielte Versuche liefern, ihre Schutzmaßnahmen zu umgehen“, heißt es in der Studie.

Laut dem Bericht können „relativ einfache“ Angriffe, wie das Auffordern des Chatbots, „Sicher, ich helfe gerne“ zu sagen, große Sprachmodelle dazu bringen, Inhalte bereitzustellen, die in vielerlei Hinsicht schädlich sind.

Die Inhalte könnten Selbstverletzung, gefährliche chemische Lösungen, Sexismus oder die Leugnung des Holocaust fördern, so die Studie. AISI nutzte öffentlich verfügbare Prompts und entwickelte für die Studie privat weitere Jailbreaks.

Das Institut testete auch die Qualität der Antworten auf biologisch und chemisch thematisierte Anfragen.

Während Expertenwissen in diesen Bereichen auch zum Guten genutzt werden kann, wollten die Forscher wissen, ob KI-Chatbots für schädliche Zwecke wie die Kompromittierung kritischer nationaler Infrastrukturen genutzt werden können.

„Mehrere LLMs demonstrierten Expertenwissen in Chemie und Biologie. Die Modelle beantworteten über 600 private, von Experten verfasste Fragen zu Chemie und Biologie auf einem ähnlichen Niveau wie Menschen mit einer Promotion in diesen Bereichen“, stellten die Forscher fest.

KI-Chatbots
KI-Chatbots können mit Prompts umgangen werden

KI stellt nur eine begrenzte Cybersicherheitsbedrohung dar

In Bezug auf die potenzielle Weaponisierung von KI-Chatbots für Cyberangriffe sagte die Studie, dass die LLMs einfache Cybersicherheitsaufgaben, die für Gymnasiasten konzipiert sind, mühelos bewältigten.

Die Chatbots hatten jedoch Schwierigkeiten mit Aufgaben, die auf Hochschulstudenten abzielten, was auf ein begrenztes böswilliges Potenzial hindeutet.

Ein weiterer Bereich der Sorge war, ob die Chatbots als Agenten eingesetzt werden können, um autonom eine Reihe von Aktionen in einer Weise durchzuführen, die „für Menschen schwer kontrollierbar sein könnte“.

„Zwei LLMs absolvierten Agent-Aufgaben mit kurzem Horizont (wie einfache Softwareentwicklungsprobleme), waren jedoch nicht in der Lage, Sequenzen von Aktionen für komplexere Aufgaben zu planen und auszuführen“, bemerkte die Studie.

Auch lesen: „Der „Vater der KI“ will ein bedingungsloses Grundeinkommen für Jobverluste  

Der britische Unterstaatssekretär für das Department for Science, Innovation and Technology, Saqib Bhatti MP, wurde kürzlich zitiert mit der Aussage, dass die Gesetzgebung in angemessener Zeit Gestalt annehmen wird und durch Tests informiert sein wird.

Unternehmen behaupten, schlechte Inhalte zu filtern

Unternehmen wie Claude-Ersteller Anthropic, Meta, das Llama entwickelte, und OpenAI, der Entwickler von ChatGPT, haben die integrierten Sicherheitsmechanismen ihrer jeweiligen Modelle betont.

OpenAI gibt an, dass es nicht erlaubt, seine Technologie „zur Erzeugung von hassverbreitenden, belästigenden, gewalttätigen oder adulten Inhalten“ zu nutzen. Anthropic erklärte, dass es „die Vermeidung schädlicher, illegaler oder unethischer Antworten priorisiert, bevor sie auftreten“.

Die Ergebnisse des AI Safety Institute werden voraussichtlich auf dem Seoul-Gipfel vor Tech-Executives, Regierungsvertretern und KI-Experten zur Debatte stehen.


Cryptopolitan Berichterstattung von Jeffrey Gogo

Wenn Sie dies lesen, sind Sie bereits einen Schritt voraus. Bleiben Sie mit unserem Newsletter auf dem Laufenden.

Diesen Artikel teilen

Haftungsausschluss. Die bereitgestellten Informationen stellen keine Anlageberatung dar. Cryptopolitan.com übernimmt keine Haftung für Investitionen, die auf Basis der auf dieser Seite bereitgestellten Informationen getätigt werden. Wir empfehlen dringend eine unabhängige Recherche und/oder Beratung durch einen qualifizierten Fachmann, bevor Sie Anlageentscheidungen treffen.

Jeffrey Gogo

Jeffrey Gogo

Jeffrey Gogo ist Journalist mit 20 Jahren Erfahrung in den Bereichen Wirtschaft, Finanzen sowie Klima- und Analyseberichterstattung. Seine Arbeiten wurden vom Thomson Reuters Foundation, The Zimbabwe Herald und mehreren Online-Publikationen veröffentlicht. Er hat zudem umfassend über KI und das Metaverse geschrieben und begann 2017, die Kryptomärkte zu begleiten. Gogo studierte Journalismus und Massenkommunikation an der CCOSA in Harare.

MEHR … NACHRICHTEN