Google bringt Gemini 3.8 Flash und Gemini 3.8 Flash Cyber für Entwickler, Unternehmen und Sicherheitsteams
Google hat am 2. September Gemini 3.8 Flash und Gemini 3.8 Flash Cyber vorgestellt. Die neuen Modelle sind für agentische Arbeitsabläufe, Programmierung und Sicherheitsaufgaben gedacht. Dabei positioniert Google Gemini 3.8 Flash nicht nur für Unternehmen, sondern zugleich für Entwickler, Unternehmenskunden und Endnutzer in mehreren eigenen Angeboten.
Nach Angaben des Unternehmens ist Gemini 3.8 das bislang stärkste eigene Flash-Modell für Schlussfolgern und Programmierung. Google nennt dabei dieselbe Geschwindigkeit und dieselben Einführungspreise wie bei 3.7 Flash. Für Gemini 3.8 Flash veranschlagt der Konzern 0,75 US-Dollar pro 1 Million Eingabe-Token und 3,75 US-Dollar pro 1 Million Ausgabe-Token. Diese Einführungspreise gelten bis zum 31. Dezember 2026, ab dem 1. Januar 2027 sollen 1,50 beziehungsweise 7,50 US-Dollar pro 1 Million Token fällig werden.
Gemini 3.8 erscheint in zwei Varianten. Gemini 3.8 Flash beschreibt Google als besonders leistungsfähiges Alltagsmodell für Softwareentwicklung, agentische Aufgaben und kritische mehrstufige Schlussfolgerungen in spezialisierten Fachgebieten. Gemini 3.8 Flash Cyber ist auf Cybersicherheit zugeschnitten und soll bei der Erkennung von Schwachstellen sowie bei automatisierten Fehlerbehebungen ein sehr hohes Leistungsniveau erreichen. Beide Veröffentlichungen basieren laut Google-Blog auf derselben grundlegenden Modellbasis.
Zugang für Entwickler, Unternehmen und Endnutzer
Google verteilt Gemini 3.8 Flash über mehrere Zugangswege. Entwickler können das Modell über die Gemini API in Google AI Studio und Android Studio nutzen sowie Arbeitsabläufe in Google Antigravity erproben oder Oberflächen in Stitch erzeugen. Unternehmen erhalten Zugriff über Gemini Enterprise. Für Endnutzer steht 3.8 Flash laut Google für Abonnenten von Google AI Pro und Ultra in der Gemini-App, im KI-Modus der Google-Suche und in Gemini in Google Sheets bereit.
Bei den Leistungswerten verweist Google auf deutliche Fortschritte gegenüber 3.7 Flash. Auf HLE-Verified erreicht Gemini 3.8 Flash demnach 54,9 Prozent. In Benchmarks wie DeepSWE v1.1, Vals Finance Agent V2 und Harvey’s Legal Agent Benchmark soll das Modell ebenfalls stärker abschneiden. Google führt die Zuwächse darauf zurück, dass 3.8 Flash bei komplexen Aufgaben mehr zusätzliche Schlussfolgerungsschritte ausführt und Werkzeuge wiederholt einbindet. Das kann nach Unternehmensangaben auch zu höherem Tokenverbrauch führen. Für besonders sparsame Anwendungen empfiehlt Google niedrigere Einsatzstufen oder weiterhin 3.7 Flash.
Cyber-Variante mit Zugang über das Fairwind Program
Gemini 3.8 Flash Cyber wird nicht allgemein freigeschaltet, sondern über das neue Fairwind Program an vertrauenswürdige Verteidiger vergeben. Dazu zählt Google insbesondere staatliche Stellen, Betreiber kritischer Infrastruktur und Software-Maintainer. Das Modell soll eine stärker freigegebene Sicherheitskonfiguration besitzen und deshalb nur an diese Gruppe gehen.
Für die autonome Suche nach Schwachstellen nennt Google auf dem Branchenmaßstab CyberGym ein Leistungsniveau an der Spitze des Feldes. Gegenüber 3.5 Flash Cyber und auch gegenüber deutlich größeren Grenzmodellen soll 3.8 Flash Cyber besser abschneiden. In einem internen Test über komplexe Codebasen in 20 Programmiersprachen hinweg gibt Google eine Erfolgsquote von mehr als 70 Prozent an.
Schwachstellen beheben und Googles Code absichern
Auch bei automatisierten Fehlerbehebungen meldet Google hohe Werte. Auf CWE-Bench habe Gemini 3.8 Flash Cyber einen pass@1-Wert von 47,2 Prozent erreicht. Ein führendes Grenzmodell liege dort bei 47,8 Prozent, allerdings zu deutlich höheren Kosten. Google betont zudem, dass bei 3.8 Flash Cyber die Behebung von Schwachstellen bewusst Vorrang vor offensiven Fähigkeiten wie Ausnutzung erhalten habe.
Für den Praxiseinsatz innerhalb des Konzerns nennt Google mehrere Beispiele. Das Chrome-Sicherheitsteam habe mit Gemini 3.8 Flash Cyber 2,6-mal mehr korrekte Patches für Schwachstellen erzeugt als mit den besten wesentlich größeren kommerziellen Modellen. Wiz habe auf einem internen Maßstab für Penetrationstests eine um 7,5 bis 9,7 Prozent höhere Trefferquote bei 2,3- bis 5,2-mal geringeren Kosten gemessen. Zudem habe Googles Cloud Vulnerability Research Team mit dem Modell eine kritische grundlegende Schwachstelle in weniger als zwei Stunden gefunden, obwohl Forschung und Entdeckung in solchen Fällen üblicherweise Monate dauern könnten.
Neben den neuen Modellen verweist Google auch auf Schutzmechanismen gegen Missbrauch in CBRN-Bereichen und bei Cyberangriffen sowie auf verbesserte Widerstandsfähigkeit gegen Prompt-Injection-Angriffe, gemessen von Gray Swan.
Dieser Artikel wurde KI-generiert erstellt. Die Themenauswahl trifft die Redaktion, die redaktionelle Verantwortung liegt bei KI-Prüfstand.