Zum Inhalt springen
Tech & Tacheles„Klartext zu KI, Security und Crypto"
← Alle Beiträge
Künstliche Intelligenz September 7, 2026

Gemini 3.8 Flash: Googles neues KI-Modell – gleicher Preis, bis Jahresende

Gemini 3.8 Flash ist da: mehr Leistung zum Preis von 3.7 Flash – aber nur bis 31. Dezember. Dazu Flash Cyber, das Schwachstellen findet und nur für geprüfte Verteidiger freigegeben ist.

Gemini 3.8 Flash: Googles neues KI-Modell – gleicher Preis, bis Jahresende

Google hat am 2. September Gemini 3.8 Flash vorgestellt – das dritte Flash-Modell in nur sechs Wochen. Der Preis bleibt vorerst gleich, die Leistung steigt laut Google deutlich, vor allem bei langen Coding- und Agenten-Aufgaben. Parallel erscheint eine Variante namens Gemini 3.8 Flash Cyber, die Schwachstellen findet und patcht – und die Google bewusst nicht frei verfügbar macht, sondern nur geprüften Verteidigern über ein neues Programm zugänglich macht.

Gemini 3.8 Flash: gleicher Preis, mehr Rechenaufwand

Gemini 3.8 Flash kostet im Gemini API 0,75 US-Dollar pro Million Eingabe-Token und 3,75 US-Dollar pro Million Ausgabe-Token – identisch mit 3.7 Flash. Allerdings hat dieser Preis jetzt ein Ablaufdatum: Ab dem 1. Januar 2027 verdoppelt sich beides auf 1,50 bzw. 7,50 US-Dollar. Google nennt das „Einführungspreis”, faktisch ist es eine angekündigte Preiserhöhung.

Newsletter

Klartext ins Postfach

KI, Security & Crypto – die wichtigsten Analysen, kein Spam. Jederzeit abbestellbar.

Das Modell verarbeitet Text, Bild, Audio, Video und PDF, hat ein Kontextfenster von einer Million Token und ist laut Google auf lange, mehrstufige Aufgaben getrimmt. Auf dem Benchmark DeepSWE v1.1 für langlaufende Software-Engineering-Aufgaben soll es die meisten größeren Frontier-Modelle übertreffen, auf HLE-Verified erreicht es 54,9 Prozent. Interessant ist ein Nebensatz in Googles Ankündigung: 3.8 Flash „arbeitet härter” – es macht mehr Denkschritte und ruft Werkzeuge häufiger auf. Das kann bei hohen Effort-Stufen mehr Token verbrauchen als der Vorgänger. Wer auf Kosten optimiert, soll niedrigere Effort-Stufen wählen oder bei 3.7 Flash bleiben, das weiter unterstützt wird.

Verfügbar ist 3.8 Flash ab sofort in AI Studio, dem Gemini API, Google Antigravity, Gemini Enterprise sowie in der Gemini-App für Pro- und Ultra-Abonnenten. Zum Vergleich: Erst im Juli hatten wir über Gemini 3.6 Flash berichtet – Google dreht die Versionsschraube inzwischen im Drei-Wochen-Takt.

Flash Cyber: Schwachstellensuche nur für Eingeladene

Die zweite Variante, Gemini 3.8 Flash Cyber, ist das eigentlich spannende Stück. Auf dem Benchmark CyberGym für autonome Schwachstellensuche liegt sie laut Google auf Frontier-Niveau, auf einem internen Test über 20 Programmiersprachen bei über 70 Prozent Erfolgsquote. Beim Patchen (CWE-Bench) erreicht sie 47,2 Prozent Pass@1 – knapp unter einem führenden Frontier-Modell mit 47,8 Prozent, aber deutlich günstiger. Googles Chrome-Security-Team berichtet von 2,6-mal mehr korrekten Patches für Chrome-Lücken als bei den besten kommerziellen Modellen; Wiz nennt 7,5 bis 9,7 Prozent mehr Recall in Pentest-Tests.

Der Zugang läuft über das neue „Fairwind Program”: Behörden, Betreiber kritischer Infrastruktur und Software-Maintainer bekommen priorisierten Zugriff. Das Standardmodell 3.8 Flash trägt die üblichen Schutzmechanismen gegen Cyber-Offensive und CBRN-Missbrauch; die Cyber-Variante lockert die Cyber-Schranken (nicht die CBRN-Schutzmechanismen) – deshalb die Zugangskontrolle. Das ist derselbe Weg, den OpenAI mit GPT-6 Astra geht: Die Fähigkeit, Exploits zu finden, existiert – gezeigt wird sie nur ausgewählten Partnern.

Was das für dich bedeutet

Für Entwickler und kleine Teams ist die Nachricht zweischneidig. Positiv: Für den Preis eines Flash-Modells gibt es jetzt Leistung, die laut Google an teurere Frontier-Modelle heranreicht. Wer Agenten baut, die lange Aufgaben autonom abarbeiten, bekommt ein günstiges Arbeitspferd. Negativ: Die Preisverdopplung zum Jahreswechsel ist bereits fixiert, und das „härtere Arbeiten” des Modells kann die Token-Rechnung schon vorher treiben. Aus meiner Erfahrung mit KI-Integration im Berufsalltag ist genau dieser Effekt der häufigste Kostentreiber: Nicht der Listenpreis, sondern der stille Mehrverbrauch pro Aufgabe.

Aus Security-Sicht ist die Cyber-Variante ein Signal. Die großen Anbieter haben inzwischen Modelle, die reale Schwachstellen in Stunden finden – Googles Cloud-Vulnerability-Team spricht von einer kritischen Grundlagenlücke in unter zwei Stunden statt Monaten. Diese Fähigkeit bleibt nicht exklusiv. Offene Modelle ziehen mit Verzögerung nach, und Angreifer brauchen keinen Fairwind-Zugang. Für Admins heißt das: Das Zeitfenster zwischen Patch-Veröffentlichung und funktionierendem Exploit schrumpft weiter. Wer heute noch Wochen zum Patchen braucht, wird das nicht durchhalten.

Konkrete Empfehlungen

  • Kosten messen, bevor du migrierst: Lass denselben Workload einmal mit 3.7 und einmal mit 3.8 Flash laufen und vergleiche die tatsächlichen Token-Zahlen – nicht die Listenpreise. Setze bei 3.8 den Effort-Parameter bewusst.
  • Preiserhöhung einplanen: Kalkuliere Projekte, die über den 31. Dezember 2026 hinauslaufen, mit 1,50/7,50 US-Dollar. Die „Einführungsphase” ist kein Dauerzustand.
  • Nicht in eine Modellversion einbetonieren: Bei drei Releases in sechs Wochen sollte der Modellname in deiner Anwendung eine Konfigurationsvariable sein, kein hartkodierter String. Prüfe Prompts und Tests nach jedem Wechsel.
  • Eigene Codebasis prüfen lassen: Wer als Software-Maintainer kritische Infrastruktur betreut, kann sich für das Fairwind-Programm bewerben. Alle anderen sollten spätestens jetzt regelmäßige, automatisierte Schwachstellen-Scans etablieren – die Gegenseite wird sie haben.
  • Lokal statt Cloud? Wer sensible Daten nicht an eine API schicken will oder Preisrisiken scheut, findet in unserem Ratgeber zu Hardware für lokale KI und LLMs die Alternativen.

Gemini 3.8 Flash ist ein starkes Modell zu einem Preis, der nur noch vier Monate gilt. Die Cyber-Variante zeigt, wohin die Reise geht: KI-gestützte Schwachstellensuche wird Standard – auf beiden Seiten.

Quellen

Dranbleiben

Diese Analysen als Newsletter

Ein Mal pro Woche Klartext zu KI, Security & Crypto – direkt in dein Postfach.

Jetzt anmelden