Google hat heute drei neue KI-Modelle veröffentlicht. Sie basieren alle auf der Gemini 3.5 Flash-Basis. Das Ziel hier ist Effizienz. Geschwindigkeit. Zuverlässigkeit. Das Unternehmen drängt allgemein auf eine geringere Token-Nutzung. Wenn Sie jedoch auf das Flaggschiff-Modell Gemini 3.5 Pro gewartet haben, ist dieses Schiff noch nicht abgesegelt. Es ist noch im Ofen.
Hier erfahren Sie, worauf es in der Ankündigung vom Dienstag tatsächlich ankommt.
Warum Gemini 3.6 Flash das neue Arbeitstier ist
Google nennt dies das „Arbeitstier“. Das ist ein geladener Begriff. Normalerweise bedeutet das, dass es langweilig, aber wichtig ist. In diesem Fall soll die Codierung und Wissensarbeit intelligenter sein. Auch die multimodale Leistung wurde gesteigert.
Aber das eigentliche Verkaufsargument sind die Kosten.
Das Modell reduziert den Token-Verbrauch im Vergleich zum Vorgänger um bis zu 17 %. Weniger Token. Niedrigere Kosten. Das ist ein direkter Schlag für die Entwicklerbudgets. Google sagt, dass sie diese Änderungen auf der Grundlage des Feedbacks von Personen erstellt haben, die die Tools tatsächlich verwenden. Benchmarks untermauern diese Behauptung und zeigen neben den Token-Einsparungen auch Leistungssteigerungen.
Wenn Sie wissen möchten, wie Gemini 3.6 Flash die Effizienz verbessert, liegt die Antwort in dieser Reduzierung um 17 %. Es erledigt die Arbeit, ohne Credits zu verbrennen.
Gemini 3.5 Flash-Lite: Geschwindigkeit für Agenten-Workflows
Für diese Geschwindigkeit gibt es einen Kompromiss. Gemini 3.5 Flash-Lite gibt 350 Token pro Sekunde aus. Das ist schnell. Es ist auch die kostengünstigste Option von Google.
Warum ist Geschwindigkeit gerade jetzt wichtig? Aufgrund der Agenten-Workflows. Diese Modelle beginnen, Aufgaben zu übernehmen, die eine schnelle, sequenzielle Entscheidungsfindung erfordern. In diesem speziellen Bereich übertrifft die Lite-Version frühere Generationen.
Es verfügt auch über eine integrierte „Computernutzung“. Es kann wie ein Mensch durch Schnittstellen navigieren, um Dinge zu erledigen. Hier geht es nicht nur um Chat. Es geht um Aktion.
Wo Gemini 3.5 Flash Cyber hineinpasst
Dies ist eine Nische, aber im besten Sinne gefährlich. Gemini 3.5 Flash Cyber legt den Schwerpunkt auf Sicherheit. Es findet Schwachstellen. Es behebt sie.
Es funktioniert mit einem Infrastrukturagenten namens CodeMender. Gemeinsam helfen sie Teams, Probleme schnell zu beheben.
Die Ergebnisse sind bereits in Google. Das Modell sucht nach Fehlern in Android, Chrome und YouTube. Aber Sie können sich noch nicht einfach anmelden und Zugang erhalten.
Derzeit ist es auf Regierungen und vertrauenswürdige Partner beschränkt. Der Umfang wird später erweitert. Dies verdeutlicht einen Wandel in der Art und Weise, wie Google sensible Modelle einführt. Sie beginnen mit den internen Codebasen. Sie testen gründlich. Sie begrenzen den externen Zugriff, bis Vertrauen hergestellt ist.
Die Verzögerung von Gemini 3.5 Pro
Das Flaggschiffmodell. Der, den jeder wollte. Gemini 3.5 Pro ist noch nicht bereit.
Google gibt an, dass es sich derzeit mit Partnern in der Testphase befindet. Sie werden es verfügbar machen, „sobald es fertig ist“. Dieser Satz ist gefährlich. Das bedeutet, dass das Datum nicht definiert ist. Es könnte Wochen dauern. Es könnte Monate dauern.
Während wir warten, blickt Google bereits über die aktuelle Generation hinaus. Das Vortraining für Gemini 4 hat begonnen. Das Erscheinungsdatum dieses Modells ist ebenfalls unbestimmt.
Dadurch entsteht eine seltsame Lücke. Die effizienten Modelle gibt es hier. Die Nischen-Sicherheitstools werden eingeführt. Aber die erstklassige Argumentationsmaschine, von der man erwarten könnte, dass sie das Ökosystem verankert, fehlt immer noch.
So greifen Sie auf diese neuen Modelle zu
Für die allgemeinen Flash-Modelle benötigen Sie keine Einladung.
- Gemini 3.6 Flash ist live in der Gemini API, Google AI Studio und Android Studio. Es ist auch in Google Antigravity verfügbar.
- Gemini 3.5 Flash-LITE wird für die Gemini-App und die Google-Suche eingeführt.
Der Unterschied zwischen den beiden ist klar. Verwenden Sie 3.6 Flash für komplexe Aufgaben, bei denen Kosten und Codierung eine Rolle spielen. Verwenden Sie 3.5 Flash-Lite für großvolumige, temporeiche Agentenarbeit, bei der jede Millisekunde und jeder Cent zählt.
Die Pro-Version bleibt am Horizont. Uns bleiben leistungsstarke Zwischenprodukte und ein Versprechen, was als nächstes kommt. Die KI-Landschaft verändert sich schnell. Heute bekommen wir mehr Werkzeuge. Morgen kommt vielleicht das Flaggschiff. Bis dahin übernimmt die Flash-Serie die Schwerstarbeit.





























