Google-Mitarbeiter greifen angesichts steigender KI-Kosten auf Gemini 3.8 Flash zurück

- Berichten zufolge testen Google-Mitarbeiter intern die Gemini 3.8 Flash Preview, obwohl Google weder das Modell noch den Veröffentlichungstermin offiziell bestätigt hat.
- Google beschleunigt die Veröffentlichung neuer Flash-Versionen: Gemini 3.6 Flash und 3.7 Flash erscheinen im Abstand von nur wenigen Wochen, da das Unternehmen auf kostengünstigere KI-Workloads mit hohem Datenvolumen abzielt.
- Die Kosten für KI stehen zunehmend unter Druck: Gartner rechnet damit, dass die Ausgaben für KI-Plattformen und -Modelle im Jahr 2026 64,25 Milliarden US-Dollar erreichen werden, während Unternehmen immer häufiger messbare Ergebnisse fordern.
Berichten zufolge haben Google-Mitarbeiter begonnen, die Gemini 3.8 Flash Preview auf der eigenen Codierungsplattform zu testen. Dies ist eine weitere Bestätigung dafür, dass die führenden KI-Unternehmen in bemerkenswertem Tempo an innovativen und kostengünstigen Modellen arbeiten.
Geschwindigkeit ist für Unternehmen angesichts der steigenden KI-Kosten entscheidend. Laut Gartner werden die weltweiten Ausgaben für KI-Plattformen und -Modelle im Jahr 2026 voraussichtlich 64,25 Milliarden US-Dollar erreichen, was einem jährlichen Anstieg von 63,4 % gegenüber 2025 entspricht, da Unternehmen immer wählerischer hinsichtlich des Kosten-Nutzen-Verhältnisses ihrer Ausgaben werden.
Business Insider erfuhr anhand von Bildern, dass das Modell „Gemini 3.8 Flash Preview“ auf Googles interner Jetski-Plattform veröffentlicht wurde. Ein Mitarbeiter berichtete, es scheine besser als Flash Version 3.7 zu sein, warnte jedoch davor, dass diese Einschätzung möglicherweise nicht korrekt sei. Google lehnte eine Stellungnahme ab. Daher sind Versionsnummer und Veröffentlichungsdatum weiterhin unbekannt.
Ein nahezu monatlicher Rhythmus, der auf das Niedrigpreissegment abzielt
Google war fleißig. Gemini 3.6 Flash wurde am 21. Juli vorgestellt, und 3.7 Flash war ab dem 13. August verfügbar – alles innerhalb von etwas mehr als drei Wochen.
Das geschieht mit Absicht. Während der Telefonkonferenz zu den Ergebnissen des zweiten Quartalserklärte Alphabet-CEO Sundar Pichai, dass Google während der Entwicklung von Gemini 4 voraussichtlich „nahezu monatlich“ neue Modelle veröffentlichen werde.
Flash ist auch der Bereich, in dem Google seine größten Preisbemühungen unternimmt. Google bezeichnet die Flash-Serie als „Arbeitspferd“ für Codierung und Agenten – Anwendungen, bei denen die wiederholte Verwendung des Sprachmodells zu erheblichen Token-Kosten führt.
Gemini 3.7 Flash wurde mit einem Einführungspreis von 0,75 US-Dollar pro Million Input-Token und 3,75 US-Dollar pro Million Output-Token bis Ende 2026 eingeführt. Das ist genau die Hälfte des Einführungspreises von Gemini 3.6 Flash von 1,50 US-Dollar Input und 7,50 US-Dollar Output.
Ein Wettlauf um den Preis, weil die Grenze außer Reichweite ist
Googles Vorgehen wirddent wenn man bedenkt, dass sein öffentliches Produktportfolio Lücken im Premiumsegment aufweist. Am 19. Mai gab das Unternehmen bekannt, dass das Gemini 3.5 Pro intern getestet werde und im Juni auf den Markt kommen solle. Am 21. Juli befand sich das Modell jedoch noch immer in der Testphase mit Partnern, und Google kündigte an, es erst nach Abschluss der Tests öffentlich zugänglich zu machen.
Das bedeutet vorerst, dass Google im Wettbewerb um den besten Preis und die schnellste Markteinführung steht, solange das Flaggschiffmodell noch aussteht.
Artificial Analysis gibt dem Gemini 3.7 Flash bei hohem Denkaufwand einen Intelligenzindexwert von 56, verglichen mit 61 für den GPT-5.6 Sol bei maximalem Aufwand und 62 für den Claude Fable 5.
OpenAIs Luna-Tarif ist mit 0,20 US-Dollar pro Million Input-Token und 1,20 US-Dollar pro Million Output-Token weiterhin deutlich günstiger als Googles Flash-Angebot. Generell zeigt der Vergleich die große Preisspanne im Bereich KI: von Centbeträgen bis hin zu mehreren zehn Dollar pro Million Token, abhängig vom Funktionsumfang.
Warum die Käufer die Bedingungen festlegen
Das Marktumfeld trägt zum Verständnis von Googles Vorgehensweise bei. Gartner erwartet in diesem Jahr einen deutlichen Anstieg der Ausgaben für KI-Modelle und -Plattformen. Analystin Arunasree Cheparthi erklärte jedoch, dass Unternehmensbudgets einer „stärkeren Überprüfung“ unterliegen, wobei Effizienz, Kostenkontrolle und messbare Ergebnisse stärker im Fokus stehen.
Die Ausgabendaten von Ramp zeigen, wie dieser Druck selbst leistungsstarke Modelle beeinträchtigen kann. Im ersten Monat machte Claude Fable 5 lediglich 6 % der von Unternehmen bei Anthropic gekauften Token und 11,4 % der gesamten Modellausgaben von Anthropic aus, obwohl es im KI-Ranking von Artificial Analysis an der Spitze stand. Anthropic berechnet für das Modell 10 US-Dollar pro Million Input-Token und 50 US-Dollar pro Million Output-Token.
Der Wirtschaftswissenschaftler Ara Kharazian von Ramp erklärte, dieses Muster deute darauf hin, dass es eine Obergrenze für die Zahlungsbereitschaft von Unternehmen für reine Leistungsfähigkeit gebe. Dies begünstige Modelle, die günstig, schnell und für den jeweiligen Zweck ausreichend gut seien – genau den Marktbereich, den Google erobern wolle.
Die Veröffentlichung von Gemini 3.8 Flash ist weiterhin ungewiss. Aktuell stammen die Informationen zu einer Demonstration aus Berichten von Business Insider, was bedeutet, dass Google dies noch nicht offiziell bestätigt hat. Dies ist angesichts der häufig wechselnden Modellnamen und Veröffentlichungstermine auf dem Markt von größter Bedeutung.
Die klügsten Köpfe der Krypto-Szene lesen bereits unseren Newsletter. Möchten Sie auch dabei sein? Dann schließen Sie sich ihnen an.
Häufig gestellte Fragen
Was ist Gemini 3.8 Flash?
Laut Business Insider handelt es sich um ein noch unveröffentlichtes KI-Modell von Google, das Mitarbeiter des Unternehmens auf Googles interner Programmierplattform Jetski testen. Ein Mitarbeiter gab an, es fühle sich besser an als Flash 3.7, doch Google lehnte eine Stellungnahme ab, und eine öffentliche Veröffentlichung ist nicht garantiert.
Warum konzentriert sich Google auf Flash-Modelle anstatt auf ein Flaggschiffmodell?
Googles im Mai angekündigtes Flaggschiff Gemini 3.5 Pro wurde nie ausgeliefert. Laut Cryptopolitansteht das Unternehmen damit ohne ein zukunftsweisendes Modell da, das von Anthropic und OpenAI angeführt wird. Stattdessen setzt Google verstärkt auf seine günstigeren und schnelleren Flash-Modelle für Programmierung und KI-gestützte Anwendungen.
Was kostet Gemini 3.7 Flash?
Google hat den Preis für 3.7 Flash bis Ende 2026 auf 0,75 US-Dollar pro Million Input-Token und 3,75 US-Dollar pro Million Output-Token festgelegt – die Hälfte der Einführungskosten von 3.6 Flash, wie Google mitteilte. Die Luna-Stufe von GPT-5.6 von OpenAI ist mit 0,20 US-Dollar bzw. 1,20 US-Dollar noch günstiger.
Haftungsausschluss. Die bereitgestellten Informationen stellen keine Anlageberatung dar. Cryptopolitan/ übernimmt keine Haftung für Investitionen, die auf Grundlage der Informationen auf dieser Seite getätigt werden. Wirtronempfehlen dringend, vor jeder Anlageentscheidung eigene Recherchen durchzuführendent oder einen qualifizierten Fachmann zu konsultieren

Ashish Kumar
Ashish Kumar ist Krypto- und Finanzjournalist mit acht Jahren Redaktionserfahrung. Er berichtet über aktuelle Entwicklungen auf den Kryptomärkten, Regulierungen, DeFiund Börsenökosystemen. Er hat bereits für Coingape, Todayq und Newsroompost gearbeitet. Ashish besitzt ein Postgraduate Diploma in English Journalism vom IIMC. Er hat außerdem Branchengrößen wie Arthur Hayes, Yat Siu, Austin Federa und andere interviewt.
















