AKTUELLE NACHRICHTEN
FÜR SIE AUSGEWÄHLT

OpenAIs Operator-Agent erhält einen Boost mit neuem KI-Modell

VonCollins J. OkothCollins J. Okoth 3 Min. Lesezeit
OpenAIs Operator-Agent erhält einen Schub durch ein neues KI-Modell
  • OpenAI hat Operator, seinen KI-Agenten, der das Web nutzt, um Aufgaben auszuführen, auf ein Modell auf Basis von o3 aktualisiert, nachdem zuvor eine benutzerdefinierte Version von GPT-4o verwendet wurde.
  • Der o3 Operator wurde mit zusätzlichen Sicherheitsdaten für den Computereinsatz feinabgestimmt, einschließlich Datensätzen, die dem Modell Entscheidungsgrenzen vermitteln sollen.
  • Mike Knoop, Mitbegründer der Arc Prize Foundation, ist der Ansicht, dass der Betrieb des o3-Modells teurer sein könnte als erwartet.

OpenAI hat das KI-Modell, das Operator antreibt, von der vorherigen benutzerdefinierten Version von GPT-4o auf ein auf o3 basierendes Modell aktualisiert, eines der neuesten in OpenAIs o-Serie von „Reasoning“-Modellen. Der o3 Operator wurde mit zusätzlichen Sicherheitsdaten für die Computernutzung feinabgestimmt und umfasste Sicherheitsdatensätze, die dazu dienten, dem Modell Entscheidungsgrenzen beizubringen.

OpenAI erhöhte den Operator in ChatGPT mit einem neuen Computer-Using-Agent (CUA)-Modell, das auf einer Version von OpenAI o3 basiert. Mit dem neuen Modell wurde der Operator beharrlicher und genauer bei der Interaktion mit dem Browser, was die Gesamterfolgsrate bei Aufgaben verbesserte. Es liefert auch besser strukturierte Antworten, die klarer und gründlicher sind.

Laut OpenAI, das neue CUA-Modell zeigte im Vergleich zur Branche eine stärkere Leistung und erreichte SOTA auf OSWorld und WebArena. Es zeigte auch eine stärkere relative Leistung gegenüber der vorherigen Version, sowohl in etablierten Benchmarks als auch in Bewertungen durch menschliche Präferenzen.

OpenAI ersetzt das GPT‑4o-basierte Modell durch eine Version auf Basis von o3

OpenAI hat das bestehende GPT‑4o-basierte Modell für Operator durch eine Version auf Basis von OpenAI o3 ersetzt, obwohl die API-Version weiterhin auf 4o basieren wird. Das KI-Unternehmen behauptete auch, dass der o3 Operator denselben mehrschichtigen Sicherheitsansatz verwendet, der für die 4o-Version eingesetzt wird.

Im Vergleich zu anderen Modellen der o3-Familie wurde der o3 Operator jedoch mit zusätzlichen Sicherheitsdaten für die Computernutzung feinabgestimmt, einschließlich Datensätzen, die dazu dienen, das Modell an Entscheidungsgrenzen bei Bestätigungen und Ablehnungen zu schulen.

OpenAI veröffentlichte einen technischen Bericht, der die Leistung des o3 Operators bei spezifischen Sicherheitsbewertungen zeigt. Im Vergleich zum GPT-4o Operator-Modell war der o3 Operator weniger geneigt, „illegale“ Aktivitäten abzulehnen oder nach sensiblen persönlichen Daten zu suchen, und anfälliger für eine Form des KI-Angriffs, die als „Prompt Injection“ bekannt ist. 

„Der o3 Operator verwendet denselben mehrschichtigen Sicherheitsansatz, den wir für die 4o-Version von Operator verwendet haben… Obwohl der o3 Operator die Coding-Fähigkeiten von o3 erbt, hat er keinen nativen Zugriff auf eine Coding-Umgebung oder ein Terminal.“

–OpenAI

Das KI-Unternehmen gab auch bekannt, dass das neue o3-basierte Modell die Standard-Sicherheitsbewertungen durchlaufen hat, und Operator blieb weiterhin als Forschungsvorschau für ChatGPT Pro-Nutzer weltweit verfügbar. Dieses upgegradete Modell war jedoch nur in Operator in ChatGPT verfügbar.

Knoop vermutet, dass das Ausführen von OpenAIs o3-Modell teurer sein könnte als erwartet

Letzte Woche aktualisierte die Arc Prize Foundation, die ARC-AGI pflegt und verwaltet, ihre geschätzten Rechenkosten für o3. Die Organisation schätzte ursprünglich, dass die am besten performende Konfiguration von o3, die sie testete, o3 high, etwa 3.000 US-Dollar kostete, um ein einzelnes ARC-AGI-Problem zu lösen. Die Foundation glaubt jedoch nun, dass die Kosten 10-mal höher sein könnten als zuvor geschätzt, möglicherweise etwa 30.000 US-Dollar pro Aufgabe.

Obwohl OpenAI o3 noch nicht preist oder es vollständig veröffentlicht hat, hält einer der Mitbegründer der Arc Prize Foundation, Mike Knoop, die Preisgestaltung des o1-pro-Modells für einen angemessenen Anhaltspunkt und einen näheren Vergleich der wahren Kosten von o3. Er fügte jedoch hinzu, dass o3 weiterhin als Vorschau auf der Bestenliste gekennzeichnet sein würde, um die Unsicherheit widerzuspiegeln, bis der offizielle Preis bekannt gegeben wird.

Laut der Arc Prize Foundation wäre ein hoher Preis für o3 high angesichts der Menge an Rechenressourcen, die das Modell reportedly verwendet, nicht ausgeschlossen. o3 high verwendete 172-mal mehr Rechenleistung als o3 low, die Konfiguration mit der geringsten Rechenleistung von o3, um ARC-AGI zu bewältigen.

Gerüchte gab es schon seit Anfang März über die teuren Pläne, die OpenAI für Unternehmenskunden in Erwägung zog. Die berichteten Informationen deuteten darauf hin, dass das Unternehmen bis zu 20.000 US-Dollar pro Monat für spezialisierte KI-„Agenten“, wie Softwareentwickler-Agenten, verlangen könnte.

Während einige argumentierten, dass selbst die teuersten Modelle von OpenAI weitaus weniger kosten würden als ein typischer menschlicher Auftragnehmer oder Mitarbeiter, wies der KI-Forscher Toby Ord darauf hin, dass die Modelle möglicherweise nicht so effizient sind. So benötigte o3 high beispielsweise 1.024 Versuche bei jeder Aufgabe in ARC-AGI, um seine beste Punktzahl zu erzielen.

Lesen Sie nicht nur Krypto-Nachrichten. Verstehen Sie sie. Abonnieren Sie unseren Newsletter. Es ist kostenlos.

Diesen Artikel teilen
Collins J. Okoth

Collins J. Okoth

Collins Okoth ist Journalist und Marktanalyst mit acht Jahren Erfahrung in der Berichterstattung über Kryptowährungen und Technologie. Er ist zertifizierter Finanzanalyst (CFA) und besitzt einen Abschluss in Aktuarmathematik. Collins war zuvor als Autor und Redakteur bei Geek Computer und CoinRabbit tätig.

MEHR … NACHRICHTEN