Zum Inhalt springen
Tech & Tacheles„Klartext zu KI, Security und Crypto"
← Alle Beiträge
Künstliche Intelligenz July 22, 2026

Gemini 3.6 Flash: Googles neues KI-Modell wird schneller und günstiger

Google startet Gemini 3.6 Flash: gleiche Intelligenz, aber 17 Prozent weniger Token, bessere Coding-Werte und ein halbierter Preis. Dazu eine Variante für Security-Teams.

Gemini 3.6 Flash: Googles neues KI-Modell wird schneller und günstiger

Google hat am 21. Juli 2026 mit Gemini 3.6 Flash eine neue Version seines schnellen KI-Modells vorgestellt. Zusammen mit den Varianten 3.5 Flash-Lite und 3.5 Flash Cyber zielt das Update klar auf Entwickler und agentische Arbeitslasten – also auf KI, die eigenständig Werkzeuge bedient. Der Fokus liegt weniger auf mehr Intelligenz als auf mehr Effizienz pro Token.

Was Gemini 3.6 Flash neu macht

Gemini 3.6 Flash wird zum neuen Standardmodell für Coding, Wissensarbeit und multimodale Aufgaben. Es bietet ein Kontextfenster von einer Million Token, bis zu 64.000 Token Ausgabe, native multimodale Eingaben und eingebaute Werkzeuge, darunter die Computer-Use-Funktion. Der Wissensstand reicht nun bis März 2026 statt wie bisher bis Januar 2025.

Newsletter

Klartext ins Postfach

KI, Security & Crypto – die wichtigsten Analysen, kein Spam. Jederzeit abbestellbar.

Beim Artificial-Analysis-Intelligence-Index erreicht das Modell einen Wert von 50 und liegt damit gleichauf mit dem Vorgänger 3.5 Flash. Der eigentliche Fortschritt steckt woanders: Gemini 3.6 Flash verbraucht rund 17 Prozent weniger Ausgabe-Token, in Einzelfällen wie dem DeepSWE-Benchmark bis zu 65 Prozent. Weil sich der Preis pro Aufgabe daran bemisst, sinken die Kosten spürbar.

Bessere Coding-Werte, halbierter Preis

Bei der Softwareentwicklung legt das Modell zu: Auf SWE-Bench Pro erreicht Gemini 3.6 Flash 58,7 Prozent gegenüber 55,1 Prozent beim Vorgänger. Die Ausgabegeschwindigkeit gibt Google mit 303,6 Token pro Sekunde an. Am deutlichsten fällt die Preissenkung aus: Statt 9,00 US-Dollar kostet die Million Ausgabe-Token jetzt 7,50 US-Dollar, die Million Eingabe-Token liegt bei 1,50 US-Dollar.

Damit setzt Google die Linie fort, die schon Gemini 3.5 Pro geprägt hat: schnelle Iteration statt seltener Großsprünge. Gleichzeitig deutet der Konzern bereits ein kommendes Gemini 4 an.

Eine eigene Variante für Sicherheitsteams

Interessant für Security-Verantwortliche ist die dritte Variante: 3.5 Flash Cyber ist auf sicherheitsnahe Arbeitslasten zugeschnitten. Das passt zum Trend, KI gezielt in die Abwehr einzubinden – etwa für Log-Analyse, Triage oder das Auswerten von Schwachstellen. Wie belastbar diese Spezialvariante im Alltag ist, muss die Praxis zeigen.

Cloud oder lokal?

Günstigere Token machen Cloud-KI attraktiver, doch für sensible Daten bleibt die Frage nach der Kontrolle. Wer Modelle unabhängig vom Anbieter und ohne Datenabfluss betreiben will, findet in unserem Ratgeber zu Hardware für lokale KI und LLMs die passenden Grundlagen. Beide Wege haben ihren Platz – die Wahl hängt vom Schutzbedarf ab.

Quellen

Dranbleiben

Diese Analysen als Newsletter

Ein Mal pro Woche Klartext zu KI, Security & Crypto – direkt in dein Postfach.

Jetzt anmelden