Googles neue Gemini-Flash-Modelle sind für KI gebaut, die sich selbst steuert
Google DeepMinds 3.6 Flash und 3.5 Flash-Lite versprechen günstigere und schnellere KI-Agenten. Das bedeutet das für Apps und Spiele, die du tatsächlich nutzt.

Wichtigste Punkte
- Google DeepMind kündigte Gemini 3.6 Flash und Gemini 3.5 Flash-Lite am Veröffentlichungstag an, um KI-Agenten im großen Maßstab auszuführen.
- Google gibt an, dass 3.6 Flash laut Artificial Analysis Index 17% weniger Output-Token als 3.5 Flash verwendet, bei $1,50 pro Million Input-Token und $7,50 pro Million Output-Token.
- Gemini 3.5 Flash-Lite läuft mit 350 Output-Token pro Sekunde, preiswert bei $0,30 pro Million Input-Token und $2,50 pro Million Output-Token.
- Bei der OSWorld-Verified-Benchmark, die die Fähigkeit einer KI testet, einen echten Computer zu bedienen, erzielte 3.6 Flash 83,0% gegenüber 78,4% für 3.5 Flash.
- Google DeepMind bestätigte, dass das Pre-Training für Gemini 4, sein nächstes Flaggschiff-Modell, begonnen hat.
Google hat gerade die Rechnung für alle verändert, die eine KI bauen, die Dinge für dich erledigt.
Am Veröffentlichungstag stellte Google DeepMind zwei neue Versionen seiner Gemini-Familie vor: Gemini 3.6 Flash und Gemini 3.5 Flash-Lite. Gemini ist Googles Reihe von KI-Modellen, die Softwaregrundlagen für Chatbots und zunehmend für KI-Agenten (Programme, die mehrstufige Aufgaben in deinem Auftrag ausführen, wie Reisen buchen oder Code reparieren).
Die Schlagzeile ist kein größeres, intelligenteres Monster-Modell. Es ist das Gegenteil. Das sind die Arbeitspferde.
Warum sollte ein normaler Mensch ein günstigeres KI-Modell interessieren?
Weil Preis und Geschwindigkeit entscheiden, ob die clevere Demo, die du letztes Jahr sah, tatsächlich in den Apps landet, die du nutzt.
Ein großes KI-Modell zu betreiben kostet Geld jedes Mal, wenn es antwortet. Diese Kosten werden in Token gemessen, die einfach Textabschnitte sind, die das Modell liest und schreibt. Google gibt an, dass Gemini 3.6 Flash laut dem unabhängigen Artificial Analysis Index 17% weniger Output-Token als das vorherige 3.5 Flash nutzt, um die gleiche Aufgabe zu erledigen. Bei einem Coding-Test namens DeepSWE erreichte die Einsparung 65%.
In klarer Sprache: das Modell schweift weniger ab und kommt schneller auf den Punkt. Das senkt die Rechnung für das Unternehmen, das deine App baut, wodurch Features wie ein KI-Begleiter im Spiel oder ein intelligenter Kundenservice-Bot finanziell möglich werden.
Die Preise liegen bei $1,50 pro Million Input-Token und $7,50 pro Million Output-Token. Eine Million Token sind ungefähr 750.000 Wörter.
Das kleine Geschwisterkind könnte die eigentliche Geschichte sein
Gemini 3.5 Flash-Lite ist das kleine, schnelle Modell. Google taktiert es mit 350 Output-Token pro Sekunde, preiswert bei $0,30 pro Million Input-Token und $2,50 pro Million Output-Token.
Diese Geschwindigkeit ist wichtig für alles, das sich sofort anfühlen muss. Denke an einen KI-Gegner in einem Spiel, der in Echtzeit reagieren muss, oder ein Dokumentenverarbeitungstool, das tausende Rechnungen über Nacht verarbeitet.
Bei Terminal-Bench 2.1, einem Test, der misst, wie gut eine KI eine Computer-Befehlszeile bedienen kann, sprang Flash-Lite von 31% auf 54%. Bei OSWorld-Verified, das die KI auffordert, einen Desktop wie ein Mensch zu bedienen, erreichte sie 74%.
Beide neuen Modelle enthalten jetzt „Computerverwendung" als eingebautes Tool. Das bedeutet, die KI kann Schaltflächen anklicken, Formulare ausfüllen und einen Cursor bewegen, ohne dass ein Entwickler es manuell verdrahten muss.
Was ist mit Sicherheit?
Google gibt an, dass 3.6 Flash mit stärkeren Schutzmaßnahmen gegen Missbrauch in chemischen, biologischen, radiologischen, kernwaffenbezogenen und Cyber-Straftat-Szenarien ausgeliefert wird. Es wurde auch trainiert, weniger harmlose Anfragen abzulehnen, eine häufige Beschwerde bei früheren Gemini-Versionen, die manchmal zu alltäglichen Fragen Nein sagten.
Es gibt auch einen spezialisierten Cousin. Gemini 3.5 Flash Cyber betreibt CodeMender, Googles Agent, der nach Sicherheitslücken in Softwarecode sucht.
Was kommt als nächstes?
Gemini 3.5 Pro, das größere Flaggschiff-Modell, ist immer noch in Tests mit Partnern. Und Google bestätigte das Interessante am Ende: Pre-Training für Gemini 4 hat begonnen.
Für Spieler, Entwickler und alle, die auf KI-Features warten, die nicht ein Vermögen kosten, ist die Richtung klar. Die Grenze erhält die Schlagzeilen. Die Flash-Modelle werden ausgeliefert.



