Google I/O: Gemini Omni verarbeitet Text, Bild, Video und Audio

Google stellt Gemini 3.5 mit Omni-Modell vor und bringt nur Wochen später Gemini 3.7 Flash auf den Markt. Die neuen Modelle bieten mehr Effizienz und niedrigere Kosten.

Im Rahmen der Entwicklerkonferenz Google I/O hat Google die Einführung der Gemini-3.5-Serie sowie ein neues KI-Modell zur Simulation der physikalischen Welt bekannt gegeben. Die neuen Modelle sollen die Effizienz steigern und die Kosten für Entwickler senken, während gleichzeitig die Veröffentlichungszyklen deutlich beschleunigt werden.

Demis Hassabis von Google DeepMind stellte dabei Gemini Omni vor, das bisher umfassendste Modell der Produktfamilie. Die Architektur ist darauf ausgelegt, Text, Bild, Video und Audio gleichermaßen zu verarbeiten.

In Demonstrationen verdeutlichte das Unternehmen die Multimodalität unter anderem durch interaktives Fischzeichnen, die Erkennung von Skizzen Schwarzer Löcher sowie die Analyse von Proteinfaltungen. Gemini Omni ist als Standardmodul fest in die Gemini-App integriert.

Effizienzsteigerung durch Flash-Modelle

Ein zentraler Bestandteil der neuen Strategie ist Gemini 3.5 Flash. Dieses Modell soll preislich bei der Hälfte oder sogar unter den Kosten bisheriger Top-Modelle liegen und fungiert künftig als Standardmodell in der Gemini-App. Parallel dazu wurde das Modell Gemini 3.5 Pro angekündigt, das sich zunächst in einer internen Testphase befindet, bevor eine öffentliche Freigabe im Verlauf des Sommers erfolgen soll.

Für spezialisierte Anwendungen startete zudem der Gemini-Spark-Agent in einer Beta-Phase. Ergänzt wird das Portfolio durch ein sogenanntes Omni-Weltmodell, das physikalische Abläufe simuliert. Diese Technologie kommt unter anderem in Gemini Flash, Flow sowie bei YouTube Shorts zum Einsatz.

Anzeige

Wer sich mit der rasanten Entwicklung neuer KI-Systeme befasst, muss auch die rechtlichen Rahmenbedingungen im Blick behalten. Dieser kostenlose Ratgeber bietet Unternehmen einen kompakten Überblick über alle Anforderungen, Pflichten und Fristen der neuen EU-KI-Verordnung. EU AI Act in 5 Schritten verstehen: Fristen, Pflichten und Risikoklassen kompakt erklärt

Markteinführung von Gemini 3.7 Flash

Nur wenige Wochen nach den ersten Ankündigungen der 3.5-Serie brachte der Konzern bereits Gemini 3.7 Flash heraus. Dies markiert die dritte Flash-Veröffentlichung innerhalb eines Zeitraums von weniger als acht Wochen. Das Modell ist in mehr als 160 Ländern verfügbar und wurde bereits in GitHub Copilot für Nutzer von Copilot Pro, Business und Enterprise integriert. Zudem steht es über Gemini Spark, AI Studio und Android Studio zur Verfügung.

Für die Nutzung von Gemini 3.7 Flash gilt bis zum 31. Dezember 2026 ein Einführungspreis von 0,75 US-Dollar pro Million Input-Tokens sowie 3,75 US-Dollar pro Million Output-Tokens. Nach Ablauf dieser Frist ist eine Verdopplung der Preise vorgesehen.

Das Modell unterstützt eine Kontext-Kapazität von einer Million Tokens bei maximal 65.536 Output-Tokens. Für die Version Gemini 3.5 Pro liegt zum aktuellen Zeitpunkt noch kein konkretes Veröffentlichungsdatum vor.

Anzeige

Die zunehmende Integration von KI-Systemen in den Geschäftsalltag stellt Unternehmen vor neue Herausforderungen bei der Risikobewertung. Erfahren Sie in diesem kostenlosen Report, welche KI-Systeme konkret als Hochrisiko eingestuft werden und welche Dokumentationspflichten jetzt gelten. Kostenlosen Umsetzungsleitfaden zum EU AI Act jetzt sichern

Leistungsdaten und Sicherheitsmerkmale

In verschiedenen Benchmarks verzeichnet die aktuelle Flash-Version erhebliche Leistungssteigerungen gegenüber dem Vorgängermodell Gemini 3.6 Flash. Im Bereich FrontierCode 1.1 Main erreichte das Modell 43,6 Prozent, während der Vorgänger bei 34,4 Prozent lag.

Besonders deutlich fiel der Zuwachs im AutomationBench aus, wo Gemini 3.7 Flash einen Wert von 30,4 Prozent erzielte, verglichen mit 17,0 Prozent der Vorgängerversion. Im Test WebDev Arena wurde ein Elo-Wert von 1588 gemessen.

Zusätzlich zu den Leistungsaspekten hat das Unternehmen die Sicherheitsvorkehrungen überarbeitet. Die neuen Schutzmaßnahmen beziehen sich insbesondere auf die Abwehr von Cyber-Bedrohungen sowie Risiken im Bereich chemischer, biologischer, radiologischer und nuklearer Gefahren (CBRN).