Google hat seine beliebte Flash-Modellfamilie ordentlich überarbeitet und gleich drei neue KI-Spezialisten vorgestellt. Der Fokus liegt diesmal ganz klar auf höherer Effizienz, geringeren Token-Kosten und optimierten KI-Agenten. Egal ob du nach einem starken Allrounder, enormer Geschwindigkeit für Massenaufgaben oder maximaler Code-Sicherheit suchst – hier ist für jeden Anwendungsfall etwas dabei.
1. Gemini 3.6 Flash – Das neue Arbeitstier
Das neue Standardmodell Gemini 3.6 Flash baut direkt auf den Erfahrungen des Vorgängers (3.5 Flash) auf. Es glänzt besonders beim Programmieren, bei komplexen Wissensaufgaben und der autonomen Computernutzung.
- Smarter Token-Verbrauch: Je nach Aufgabe verbraucht 3.6 Flash zwischen 17 % und 65 % weniger Output-Token als sein Vorgänger. Das bedeutet: Mehr Leistung für weniger Geld.
- Stark in Multi-Step-Workflows: Das Modell benötigt weniger Zwischenschritte und Werkzeugaufrufe, um komplexe Aufgaben eigenständig zu lösen.
- Preis: 1,50 USD pro 1M Input-Token / 7,50 USD pro 1M Output-Token.
2. Gemini 3.5 Flash-Lite – Extrem schnell & extrem günstig
Wenn es dir bei deinen Projekten vor allem auf Durchsatz, niedrige Latenz und minimalen Preis ankommt, ist Gemini 3.5 Flash-Lite dein Modell der Wahl.
- Rasanter Durchsatz: Mit durchschnittlich 350 Output-Token pro Sekunde verarbeitet es Massenanfragen in Rekordzeit.
- Kleine Version zieht an Vorgängern vorbei: Auf einigen Benchmarks für Coding und KI-Agenten überholt die kleine Flash-Lite-Variante sogar ältere, deutlich größere Modelle wie Gemini 3 Flash.
- Preis: Unschlagbare 0,30 USD pro 1M Input-Token / 2,50 USD pro 1M Output-Token.
3. Gemini 3.5 Flash Cyber – Maximale Sicherheit für Code
Mit Gemini 3.5 Flash Cyber bringt Google ein hochspezialisiertes Modell auf den Markt, das gezielt auf Cybersicherheit, das Aufspüren von Sicherheitslücken und automatische Code-Fixes optimiert wurde.
- Einsatz in CodeMender: Das Modell arbeitet Hand in Hand mit Googles Agenten-Infrastruktur CodeMender zusammen, um Bedrohungen abzuwehren.
- Limitierter Zugang: Da spezialisierte Cyber-Modelle auch Risiken bergen, ist der Zugriff aktuell exklusiv über ein Pilotprojekt für Behörden und ausgewählte Partner geregelt.
Fazit: Ein großer Schritt für KI-Agenten
Google macht mit diesem Trio deutlich, dass reine Modellgröße nicht mehr alles ist. Die Anpassungen zeigen klar in Richtung praxistauglicher, bezahlbarer und hochgradig spezialisierter KI-Agenten für den täglichen Einsatz.
Quellenangabe
Informationen und Leistungsdaten basieren auf den offiziellen Ankündigungen im
Google Blog sowie Berichten von
The Decoder und
DataCamp (Juli 2026).













