Google hat neue Versionen seiner KI-Modelle vorgestellt, darunter Gemini 3.6 Flash, das das erst im Mai eingeführte Gemini 3.5 Flash ersetzt. Zudem wurden Gemini 3.5 Flash Lite für hohe Effizienz und Gemini 3.5 Flash Cyber für Cybersicherheitsanwendungen angekündigt. Das ursprünglich für Juni erwartete Gemini 3.5 Pro ist weiterhin verzögert.
Verbesserungen bei Gemini 3.6 Flash
Gemini 3.6 Flash ersetzt das Gemini 3.5 Flash, das bei der Google I/O präsentiert und nun eingestellt wurde. Google gibt an, dass 3.6 Flash verbesserte Fähigkeiten bietet, insbesondere im Bereich der Codegenerierung und bei multimodalen Funktionen. Diese Anpassungen erfolgen aufgrund von Nutzerfeedback, da Gemini 3.5 Flash die Erwartungen an die Codegenerierung nicht vollständig erfüllte.
- Im DeepSWE-Test für Codierung erreicht 3.6 Flash eine Leistung von 49 Prozent, gegenüber 37 Prozent bei 3.5 Flash.
- Das neue Modell unterstützt standardmäßig die Computernutzung über die Gemini API. Im OSWorld-Test für Computernutzung steigt der Wert von 78,4 Prozent auf 83 Prozent.
- Ein Schwerpunkt liegt weiterhin auf Effizienz: Gemini 3.6 Flash verbraucht rund 17 Prozent weniger Token als sein Vorgänger.
- In autonomen Abläufen, sogenannten „agentic workflows“, soll 3.6 Flash Aufgaben präziser, in weniger Schritten und mit geringerem Token-Verbrauch erledigen.
- Die API-Kosten sinken auf 1,50 US-Dollar pro Million Input-Token und 7,50 US-Dollar pro Million Output-Token, verglichen mit 1,50 US-Dollar und 9 US-Dollar für 3.5 Flash.
Die Einführung von Gemini 3.6 Flash in der API und der Gemini-App beginnt ab sofort.
Gemini 3.5 Flash Lite für hohe Effizienz
Gemini 3.5 Flash Lite ist Googles effizienteste moderne KI und erreicht eine Geschwindigkeit von 350 Token pro Sekunde. Es wird als ideal für die Skalierung von autonomen Systemen beworben. Die Benchmark-Ergebnisse von Flash Lite liegen fast auf dem Niveau von Spitzenmodellen, die vor etwa einem Jahr aktuell waren, jedoch zu niedrigeren Kosten.
Die Preise betragen 0,30 US-Dollar pro Million Input-Token und 2,50 US-Dollar pro Million Output-Token. Dies ist eine leichte Erhöhung gegenüber dem vorherigen 3.1 Flash Lite (0,25 US-Dollar und 1,50 US-Dollar). Gemini 3.5 Flash Lite ist für Entwickler und in der Gemini-App verfügbar und wird auch in Google Search für die „AI Overviews“ eingesetzt, wo seine Geschwindigkeit vorteilhaft ist.
Gemini 3.5 Flash Cyber für Cybersicherheit
Gemini 3.5 Flash Cyber ist Googles erstes großes Sprachmodell (LLM), das speziell für Cybersicherheitsanwendungen optimiert wurde. Google gibt an, dass dieses Modell bei der Identifizierung und Behebung von Cybersicherheitsproblemen fast so leistungsfähig ist wie das größere und teurere Claude Mythos, dabei aber die Effizienz eines Flash-Modells bietet.
Aufgrund der sogenannten „Dual-Use“-Natur solcher Modelle, die auch für bösartige Zwecke genutzt werden könnten, wird Gemini 3.5 Flash Cyber nicht öffentlich zugänglich gemacht. Stattdessen startet es bald als begrenztes Pilotprojekt im CodeMender-Agenten von Google DeepMind, welcher exklusiv vertrauenswürdigen Partnern und Regierungen zur Verfügung steht.
Verzögerung bei Gemini 3.5 Pro und Ausblick auf Gemini 4
Das auf der I/O für Juni angekündigte Gemini 3.5 Pro ist weiterhin nicht veröffentlicht. Google hat dazu keine detaillierten Informationen gegeben, außer dass es sich derzeit in Tests mit ungenannten Partnern befindet und „sobald es fertig ist“ veröffentlicht wird. Frühere Berichte deuteten darauf hin, dass die Verzögerung auf Schwierigkeiten bei der Anpassung an konkurrierende Modelle in der Codierung zurückzuführen sein könnte.
Google hat zudem mit dem Vortraining für Gemini 4 begonnen. Dieser Prozess wird als ambitionierter beschrieben als frühere KI-Bemühungen. Ein Zeitplan für die Veröffentlichung von Gemini 4 wurde nicht genannt.
Thema: Gemini. Quelle/Inspiration: Ars Technica.