Im Rahmen einer kontinuierlichen Produktoffensive hat Google am 2. September 2026 das Modell Gemini 3.8 Flash vorgestellt. Es handelt sich dabei um das dritte Modell innerhalb der Flash-Serie, das der Konzern in einem Zeitraum von sechs Wochen veröffentlicht hat. Die Neuvorstellung umfasst zwei spezialisierte Varianten: eine Standardausführung sowie eine dedizierte Version für Cybersicherheit, die unter der Bezeichnung „Cyber“ geführt wird.
Leistungsdaten und spezialisierte Sicherheitsfunktionen
Gemini 3.8 Flash ist für die Verarbeitung umfangreicher Datenmengen optimiert und unterstützt ein Kontextfenster von 1 Million Token bei drei verschiedenen Denkintensitäten. In Benchmark-Tests zeigt das Modell eine hohe Wettbewerbsfähigkeit.
Laut Angaben von Google erreicht Gemini 3.8 Flash im DeepSWE v1.1 Benchmark einen Wert von 73,7 %. Damit positioniert es sich knapp hinter Claude Opus 5, das 74,0 % erzielt, jedoch über GPT-5.6 Sol mit 72,7 % und dem Vorgängermodell 3.7 Flash mit 65,3 %. Im HLE-Verified-Test kommt das Modell auf 54,9 %.
Branchenanalysten von Artificial Analysis weisen dem Modell einen Intelligenz-Index von 59 zu, was die bislang höchste gemessene Denkintensität in dieser Serie darstellt und das Modell 3.7 Flash um drei Punkte übertrifft. Die Cyber-Variante des Modells wurde speziell für Sicherheitsanwendungen entwickelt und erzielt 86,2 % in CyberGym sowie 47,2 % im CWE-Bench (pass@1). Gray Swan IPI beziffert die Angriffsrate bei der Cyber-Version auf 5,5 %.
Praktische Anwendungen der Sicherheitsvariante zeigten bereits erste Ergebnisse: Das Sicherheitsteam von Chrome berichtete von einer 2,6-fach höheren Rate an korrekten Patches. Zudem identifizierte das Cloud-Team eine kritische Schwachstelle in weniger als zwei Stunden. Der Zugang zur Cyber-Version ist vorerst auf vertrauenswürdige Tester und Regierungen über das sogenannte Fairwind-Programm beschränkt.
Wer sich mit den neuesten Entwicklungen im Bereich der digitalen Sicherheit befasst, muss auch die rechtlichen Rahmenbedingungen im Blick behalten. Dieser kostenlose Report klärt auf, welche Pflichten und Bedrohungen Unternehmer durch neue KI-Gesetze jetzt kennen müssen. Report zu neuen Cyberrisiken kostenlos anfordern
Preisstruktur und breite Verfügbarkeit in Entwicklerumgebungen
Das Modell Gemini 3.8 Flash ist seit der Ankündigung in verschiedenen Umgebungen wie der Gemini App, AI Studio, Antigravity, Android Studio, Stitch und Gemini Enterprise verfügbar.
Für die Nutzung der Programmierschnittstelle (API) gilt bis zum 31. Dezember 2026 ein Einführungspreis. Dieser liegt bei 0,75 US-Dollar pro Million Input-Token und 3,75 US-Dollar pro Million Output-Token. Ab Januar 2027 ist eine Anpassung der Preise auf 1,50 US-Dollar für den Input und 7,50 US-Dollar für den Output vorgesehen.
Analysen beziffern die Kosten pro Aufgabe derzeit auf 0,58 US-Dollar, was einer Steigerung von etwa 40 % gegenüber dem Modell 3.7 Flash entspricht. Parallel zur Einführung der neuen Modelle hat Google zudem ein agentisches Video-Verständnis für die Versionen Gemini 3.7 Flash, 3.6 Flash und 3.5 Flash-Lite gestartet. Diese Neuerung soll den Token-Verbrauch um bis zu 88 % und die Kosten um bis zu 66 % senken, während die Genauigkeit um bis zu 7 % steigt.
Angesichts der zunehmenden Professionalität von Cyberangriffen ist ein proaktiver Schutz für kleine und mittelständische Unternehmen unerlässlich. Erfahren Sie in diesem Experten-E-Book, wie Sie Sicherheitslücken effektiv schließen und Ihr Unternehmen langfristig absichern. Gratis-E-Book: Cyberbedrohungen abwenden
Wettbewerbsumfeld und Ausblick auf künftige Entwicklungen
Zeitgleich zur Veröffentlichung von Google brachte Meta am 2. September 2026 das Modell Muse Spark 1.3 auf den Markt. Mit 75,4 % im DeepSWE v1.1 Benchmark und einem Intelligenz-Index von 62 positioniert sich Meta damit ebenfalls im Spitzenfeld der aktuellen KI-Entwicklungen.
Muse Spark 1.3 ist über Muse Code und die Meta Model API verfügbar, wobei der Preis im Vergleich zur Version 1.2 unverändert bei 1,25 US-Dollar für Input- und 4,25 US-Dollar für Output-Token (jeweils pro Million) bleibt.
Während Meta derzeit die Veröffentlichung der Gewichte für die Version 1.2 vorbereitet, befindet sich nach Unternehmensangaben das nächste große Modell unter dem Codenamen „Watermelon“ bereits in der Entwicklung.
Auch Anthropic hat sein Angebot Anfang September aktualisiert. Das Modell Claude Fable 5.1 ist seit dem 1. September 2026 allgemein auf AWS verfügbar. Für Unternehmenskunden bietet Anthropic spezielle Schutzmaßnahmen an, die eine Datenaufbewahrung von null Tagen bis zum Jahresende 2026 ermöglichen.
In technischen Tests erreichte Fable 5.1 im Terminal-Bench 4.0 einen Wert von 55,8 %, während die Kosten für Cache-Reads um 75 % auf 0,25 US-Dollar pro Million Token gesenkt wurden.

