Musk deutet mit Grok 5 eine AGI an, obwohl Version 4.7 hinter den neuesten Modellen von Anthropic und OpenAI zurückliegt

Foto von Salvador Rios via Unsplash.
- Musk sagte auf X, dass xAIs noch unveröffentlichtes Grok 4.7 ungefähr auf dem Niveau von Anthropics Opus 5.0 sei, hinter dem neueren Opus 5.1 liege.
- Er sagte, es seien noch multimodale Korrekturen nötig, nachdem am Freitag eine Verzögerung beim Reinforcement Learning festgestellt worden war.
- Er skizzierte einen schnellen Folgepfad über Grok 4.8, 4.9 und 5 und versprach, dass die letztgenannte „vielleicht besser als alles andere“ sei
Elon Musk hat die Erwartungen an das verzögerte Grok 4.7-Modell von xAI bereits vor dessen Veröffentlichung gedämpft und in X-Posts eingeräumt, dass das Modell besser mit Anthropics Opus 5.0 harmoniert als mit dem neueren Opus 5.1-Modell, Fable oder sogar Astra von OpenAI.
Musk räumte außerdem ein, dass die multimodale Leistung noch verbessert werden müsse. Diese Aussagen und die bisherige Leistung stehen im Gegensatz zu dem Hype, den der Tesla-Chef üblicherweise vor der Markteinführung seiner Produkte schürt.
Was sagte Musk über Grok 4.7?
Auf die Frage, wie sich Grok 4.7 im Vergleich zur Konkurrenz schlägt, schrieb Musk, dass es „etwa auf dem Niveau von Opus 5.0, nicht 5.1“ sein sollte. Der SpaceX-Chef fügte hinzu, dass es „in mancher Hinsicht besser, in anderer schlechter“ sei.
Musk erklärte am Freitag , dass Grok 4.7 noch einige Tage Entwicklungszeit benötige, da das Team die Antwortlänge beim Reinforcement Learning offenbar zu stark bestraft habe. Dadurch gebe das neue Modell schwierige Aufgaben, die es bewältigen könne, zu früh auf, und seine Fähigkeit zur Selbstkontrolle sei noch nicht ausreichend.
Grok 4.7, ursprünglich für den 12. September geplant war, wird als ein Modell mit rund 2,1 Billionen Parametern beschrieben, das durch technische Daten von SpaceX ergänzt wurde. Sollten sich diese Angaben bestätigen, wäre das neueste Modell 40 % größer als Grok 4.6, das Berichten zufolge etwa 1,5 Billionen Parameter umfasst.
Bewertungen von Anthropics Claude Fable 5.1 durch Dritte berichten bereits von einer Punktzahl von 52,6 % im Terminal-Bench-Science-Test und einem veröffentlichten Preis von 10 US-Dollar pro Million Input-Token und 50 US-Dollar pro Million Output-Token.
Für die noch nicht veröffentlichte Grok 4.7 liegen weder bestätigte Benchmark-Ergebnisse noch ein festgelegter Token-Preis vor. Zum jetzigen Zeitpunkt ist die Behauptung, sie könnte bis zu zehnmal günstiger sein als ein Konkurrenzmodell, noch unbestätigt.
Musk verspricht bereits AGI
Musk ließ nicht lange auf sich warten und kehrte zu seinem ambitionierten Beitrag zurück, in dem er eine rasche Veröffentlichungssequenz skizzierte, die auf das noch unveröffentlichte Modell 4.7 folgen sollte.

Grok 4.8, so erklärte er, sei ein Modell mit 2,5 Billionen Parametern, das mit dem neuen C++-Software-Stack von xAI trainiert wurde. Das Training werde diese Woche abgeschlossen, anschließend beginne das Reinforcement Learning. Er bezeichnete es als „deutliche Verbesserung“ gegenüber Version 4.7.
Musk behauptete, Grok 4.9 werde wahrscheinlich zur „Astra/Fable-Klasse“ gehören, eine Anspielung auf OpenAIs GPT-6 Astra und Anthropics Fable-Reihe. Er beschrieb das aktuelle 2,5-T-Modell als besser als eine frühere 2,1-T-Version, die mit Jax trainiert wurde und Fehler aufwies, die „erst mitten im Training korrigiert wurden“. Er kündigte einen bevorstehenden Durchlauf mit 3 Billionen Parametern an, der mit verbesserter interner Trainingssoftware und saubereren Daten durchgeführt werden soll.
Die größte Aussage behielt er sich für das Topmodell vor. Musk sagte, Grok 5 sei „vielleicht besser als alles andere“, schränkte aber ein: „Wir werden sehen.“ In einer separaten Antwort an einen Nutzer, der nach einer bestimmten Funktion fragte, antwortete er lediglich: „Das wird Grok 5 sein.“
Musk nannte kein Datum für die Veröffentlichung und lieferte außer dieser Behauptung keine Beweise. Aktuell bleibt Grok 4.6 die messbare Basis, und die von Musk selbst als Maßstab genannten Modelle Opus 5.1 und OpenAIs Astra sind bereits auf dem Markt, während Grok 4.7 noch auf seine Markteinführung wartet.
Die klügsten Köpfe der Krypto-Szene lesen bereits unseren Newsletter. Möchten Sie auch dabei sein? Dann schließen Sie sich ihnen an.
Häufig gestellte Fragen
Wie schneidet Grok 4.7 im Vergleich zu den Modellen von Anthropic ab?
Musk sagte, Grok 4.7 sei in etwa mit Opus 5.0 vergleichbar, nicht mit dem neueren Opus 5.1, und sei „in mancher Hinsicht besser, in anderer schlechter“, wobei die multimodale Leistung noch verbessert werden müsse.
Warum wurde Grok 4.7 verschoben?
Am Freitag sagte Musk, das Modell brauche noch ein paar Tage, da das Reinforcement Learning die Antwortlänge möglicherweise zu stark bestraft habe, wodurch es anfällig dafür sei, schwierige Aufgaben frühzeitig aufzugeben und seine Arbeit nicht gründlich genug zu überprüfen.
Was ist Grok 4.8?
Laut Musk handelt es sich bei Grok 4.8 um ein 2,5 Billionen Parameter umfassendes Modell, das auf dem neuen C++-Software-Stack von xAI trainiert wurde und dessen Training diese Woche abgeschlossen sein wird. Anschließend soll das Reinforcement Learning beginnen, was er als eine deutliche Verbesserung gegenüber Version 4.7 bezeichnete.

Hannah Collymore
Hannah ist Autorin und Redakteurin mit fast zehn Jahren Erfahrung im Bloggen und der Eventberichterstattung im Kryptobereich. Bei Cryptopolitanschreibt sie für die Nachrichtenseite und berichtet und analysiert die neuesten Entwicklungen in den Bereichen DeFi, RWA, Kryptoregulierung, KI und Zukunftstechnologien. Sie hat an der Arcadia University Betriebswirtschaftslehre studiert.













