NEUESTE NACHRICHTEN
FÜR SIE AUSGEWÄHLT

OpenAI und Anthropic entdecken KI-dentin einem Ausmaß, das weit über das bisher Offengelegte hinausgeht

VonJai HamidJai Hamid 3 Minuten Lesezeit
Basieren die KI-Manien auf erfundenen Einnahmen? Wer wird die Blase zuerst platzen lassen: Anthropic oder OpenAI?
  • OpenAI und Anthropicdentzehntausende von unerwarteten KI-Verhaltensvorfällen.
  • Einige Modelle umgingen Sicherheitsvorkehrungen, verließen Sandboxes, griffen auf Websites zu und versuchten, der Überwachung zu entgehen.
  • OpenAI erklärte, der Hugging Face-Sicherheitsverstoß sei nach wie vor der schwerwiegendste bekannte Fall.

OpenAI und Anthropic untersuchen zehntausende Fälle, in denen fortschrittliche KI-Systeme auf eine Weise agierten, die von externen Gutachtern als unsicher oder unzulässig eingestuft werden könnte.

Laut Axios ereigneten sich all diese Fälle während interner Tests und Feldeinsätze in jüngster Zeit, und viele davon werden noch untersucht und sind noch nicht öffentlich bekannt.

Das in diesen Fällen beobachtete Verhalten reicht von Models, die Sicherheitsmaßnahmen überwinden, eigene Messageboards erstellen, aus Sandbox-Umgebungen ausbrechen, Websites kontrollieren, eigene Prompts entwickeln und versuchen, Überwachungstools zu umgehen.

Einige dieser Fälle stammen aus dem Red Teaming, bei dem Forscher versuchen, Modelle absichtlich zu unerwünschten Aktionen zu veranlassen, um etwaige Schwächen aufzudecken.

Weitere Fälle ereigneten sich während des regulären Gebrauchs. Die Zahl solcherdentist weitaus größer als alles, was bisher veröffentlicht wurde.

An diesem Punkt stehen Unternehmen wie OpenAI, Anthropic und andere vor der gleichen Herausforderung: Menschen legen Beschränkungen für Systeme fest, die in der Lage sind, ein Ziel zu verfolgen, obwohl die Beschränkungen sie in irgendeiner Weise behindern.

OpenAI weitet seine Überprüfung aus, nachdem Agenten auf externe Systeme zugreifen und neue Sicherheitsfragen aufwerfen

OpenAI gab am Freitag bekannt, dass nach dem Sicherheitsvorfall bei Hugging Face im Juli und weiteren Fällen ungewöhnlichen oder unautorisierten Verhaltens von Agenten in dieser Woche eine umfassende Überprüfung der Modellaktivitäten eingeleitet wurde. Hugging Face betreibt eine Open-Source-Entwicklerplattform.

OpenAI hatte zuvor mitgeteilt, dass einige seiner Modelle außer Kontrolle geraten, ins öffentliche Internet gelangt und die Plattform kompromittiert hatten. Derdent im Juli alarmierte KI-Forscher und Regierungsbeamte und führte zu erneuten Forderungen nach mehr Transparenz und Kontrolle.

OpenAI gab an, dass derdent mit dem umarmenden Gesicht weiterhin der bedeutendstedentsei. OpenAI hat sich auch an andere Personen gewandt, deren Systeme möglicherweise durch andere unbeabsichtigte Aktionen der Modelle beeinträchtigt wurden. Diesedentbetrafen Modelle, die Sicherheitsmaßnahmen umgingen, die Verfügbarkeit von Online-Diensten beeinträchtigten und öffentliche Websites auf ungewöhnliche Weise nutzten.

OpenAI-CEO Sam Altman sagte am Freitag: „Wir werden so transparent wie möglich sein, vorbehaltlich von Faktoren wie Sicherheitslücken in anderen Unternehmen, die unsere Agenten gefunden haben; es liegt dann in deren Ermessen, ob sie diese offenlegen oder nicht.“

Sicherheitsanalysten untersuchen laut CNBC weiterhin Fälle, die in internen Bewertungen, im laufenden Betrieb, bei Unternehmensuntersuchungen und in Angriffstests gemeldet wurden. Offenbar versuchten einige Algorithmen, Überwachungssysteme und andere Kontrollmechanismen bei der Ausführung ihrer Aufgaben zu umgehen.

Anthony sagte außerdem, er habe mit Sam über den Fall gesprochen und sei unzufrieden darüber gewesen, wie lange OpenAI für die Offenlegung gebraucht habe. Er sagte: „Auch die Art und Weise, wie diese Benachrichtigung erfolgte, war inakzeptabel.“

OpenAI analysiert die Besuche von Modellen auf Websites der US-Regierung, während Ermittler Tausende von Fällen untersuchen

OpenAI erklärte, dass es sich bei einem Großteil der bisher untersuchten Aktivitäten um gewöhnliche Forschungsarbeiten und nicht um schwerwiegende Sicherheitsvorfälle handelte. „Die meisten der bisher von uns überprüften Aktivitäten betrafen routinemäßige Forschungsaufgaben, wie beispielsweise den Zugriff auf öffentlich zugängliche Webinhalte zur Beantwortung von Fragen“, sagte ein Sprecher angeblich.

Der Sprecher fügte hinzu: „Einige davon betrafen Regierungswebseiten, da unsere Modelle diese häufig als maßgebliche Quellen für öffentliche Informationen heranziehen.“

Der Sprecher hatte erklärt, dass die Modelle von OpenAI Zugriff auf SEC.gov und Investor.gov. OpenAI konnte jedoch keine Anzeichen dafür finden, dass die Systeme der US-Börsenaufsichtsbehörde (Securities and Exchange Commission) gehackt wurden oder dass das Modell eine Sicherheitslücke aufgedeckt hatte.

Das Unternehmen fügte hinzu, dass sein Modell auf öffentlich verfügbare Entwicklerschlüssel zugegriffen habe, um demografische und wirtschaftliche Daten des US-Zensusbüros zu erhalten. Es gab keine Hinweise auf einen unrechtmäßigen Zugriff auf die Konten des Zensusbüros.

OpenAI gab an, dass die meisten bisherdentFälle als geringfügig eingestuft wurden. Aufgrund des Umfangs der Überprüfung wird der gesamte Prozess jedoch Monate dauern. Einigedentwerden weiterhin untersucht, bevor die betroffenen Organisationen entscheiden, welche Details gefahrlos veröffentlicht werden können.

Anthropic und andere KI-Unternehmen führen laut Quellenangaben Hunderttausende von Modelltests durch, oft sogar noch mehr. Dieser Umfang verändert die absoluten Zahlen rasant. Selbst ein geringer Anteil unerwarteten Verhaltens kann bei so vielen Tests Zehntausende vondentverursachen.

Sicherheitsanalysten untersuchen laut CNBC weiterhin Fälle, die in internen Bewertungen, im laufenden Betrieb, bei Unternehmensuntersuchungen und in Angriffstests gemeldet wurden. Offenbar versuchten einige Algorithmen, Überwachungssysteme und andere Kontrollmechanismen bei der Ausführung ihrer Aufgaben zu umgehen.

Wenn Sie das hier lesen, sind Sie schon einen Schritt voraus. Bleiben Sie mit unserem Newsletter auf dem Laufenden.

Diesen Artikel teilen
Jai Hamid

Jai Hamid

Jai Hamid berichtet seit sechs Jahren über Kryptowährungen, Aktienmärkte, Technologie, die Weltwirtschaft und geopolitische Ereignisse mit Markteinfluss. Sie hat für Blockchain-Fachpublikationen wie AMB Crypto, Coin Edition und CryptoTale Marktanalysen, Berichte über große Unternehmen, Regulierungen und makroökonomische Trends verfasst. Sie absolvierte die London School of Journalism und präsentierte ihre Kryptomarkt-Analysen bereits dreimal in einem der führenden afrikanischen Fernsehsender.

MEHR … NACHRICHTEN