Gemini 3.6 Flash: 17 % weniger Tokens, 65 % weniger bei DeepSWE – und ein Cyber-Modell für CodeMender
Gemini 3.6 Flash, 3.5 Flash-Lite, and 3.5 Flash Cyber

Google stellt drei neue Gemini-Modelle vor: 3.6 Flash senkt den Output-Token-Verbrauch laut Artificial Analysis Index um 17 % gegenüber 3.5 Flash und erreicht in Benchmarks wie DeepSWE bis zu 65 % weniger Token – bei niedrigerem Preis. 3.5 Flash-Lite ist mit 350 Output-Tokens pro Sekunde das schnellste Modell der 3.5-Serie und übertrifft in Agentik- und Coding-Evals sogar 3 Flash. Zudem kündigt Google 3.5 Flash Cyber an, ein spezialisiertes Modell für Cybersicherheit, das exklusiv über CodeMender für Regierungen und vertrauenswürdige Partner verfügbar sein wird. 3.5 Pro befindet sich in Tests, und der Pre-Training-Lauf für Gemini 4 hat begonnen.
Laut Artificial Analysis Index verbraucht 3.6 Flash 17 % weniger Output-Tokens als 3.5 Flash – und in einigen Benchmarks wie DeepSWE von Datacurve beobachten wir sogar bis zu 65 % weniger, und das zu geringeren Kosten pro Output-Token.