In einer weitreichenden Aktualisierung seines Entwickler-Werkzeugs Copilot integriert GitHub neue Sprachmodelle der führenden KI-Anbieter Anthropic und Google. Damit bricht die Plattform die bisherige Exklusivbindung an die Modelle von OpenAI auf und bietet Entwicklern eine größere Auswahl an spezialisierten Architekturen für die Softwareentwicklung.
Multi-Modell-Strategie und intelligente Steuerung
GitHub stellt für die Tarife Pro+, Max, Business und Enterprise das Modell Claude Fable 5.1 von Anthropic zur Verfügung. Nutzer des Pro-Tarifs erhalten zudem Zugriff auf Gemini 3.8 Flash von Google.
Kernstück dieser Erweiterung ist das sogenannte „Project HydraFusion“, ein Multi-Modell-Router innerhalb von Copilot. Dieses System ermöglicht verschiedene Betriebsmodi, darunter Single-, Cascade- und Critique-Modi, um die Effizienz der Code-Generierung zu steigern.
Interne Benchmarks im Vergleich zu Claude Opus 5 verdeutlichen die Performance-Optimierung durch diese neue Architektur. Im TerminalBench 2.1 erzielte das System eine Steigerung um 4,9 Punkte bei gleichzeitiger Kostensenkung von 67 Prozent.
Bei DeepSWE wurde ein minimaler Rückgang von 1,5 Punkten verzeichnet, während die Kosten um 36 Prozent sanken. Ähnliche Effizienzgewinne zeigten sich beim CheckpointBench mit einem marginalen Minus von 0,1 Punkten bei einer Kostenreduktion von 65 Prozent.
Wer sich mit der Implementierung solcher KI-Systeme im Unternehmen befasst, muss neben der Performance auch die rechtlichen Rahmenbedingungen im Blick behalten. Dieser kostenlose Umsetzungsleitfaden bietet einen kompakten Überblick über alle Anforderungen, Pflichten und Fristen der EU-KI-Verordnung. EU AI Act in 5 Schritten verstehen
Leistungsdaten von Gemini und Claude im Detail
Die Integration erfolgt vor dem Hintergrund einer hohen Dynamik im Modellmarkt. Google veröffentlichte Gemini 3.8 Flash sowie eine spezialisierte „Flash Cyber“-Variante Anfang September. Das Modell wird zu einem Preis von 0,75 US-Dollar pro Million Tokens für den Input und 3,75 US-Dollar für den Output angeboten, wobei dieser Preis laut Anbieter bis Ende 2026 stabil bleiben soll.
In Benchmark-Tests wie DeepSWE v1.1 erreichte Gemini 3.8 Flash einen Wert von 73,7 Prozent, was eine deutliche Steigerung gegenüber der Vorgängerversion 3.7 darstellt. Die Cyber-Variante erzielte im CWE-Bench pass@1 eine Quote von 47,2 Prozent.
Anthropic brachte Claude Fable 5.1 sowie das Modell Mythos 5.1 am 1. September auf den Markt. Fable 5.1 zeigt signifikante Fortschritte in technischen Disziplinen: Im Terminal-Bench-Science stieg der Wert von 24,7 Prozent auf 52,6 Prozent.
Die Kosten für Eingabe und Ausgabe liegen bei 10 US-Dollar beziehungsweise 50 US-Dollar pro Million Tokens. Besonders hervorzuheben ist die Preisgestaltung für Cache-Reads, die mit 0,25 US-Dollar pro Million Tokens um 75 Prozent reduziert wurden.
Die rasante Entwicklung bei Hochrisiko-KI-Systemen stellt Unternehmen vor neue Herausforderungen bei der Dokumentation und Qualitätssicherung. Erfahren Sie in diesem praxisnahen Report, welche konkreten Schritte jetzt für eine rechtskonforme Nutzung notwendig sind. Kostenlosen Report zu Risikoklassen anfordern
OpenAI lanciert GPT-6 Astra als neuen Leistungsstandard
Parallel zur Expansion von GitHub hat OpenAI am 3. September sein neues Flaggschiff-Modell GPT-6 Astra vorgestellt. Das Modell ist bereits für ChatGPT-Work- und Codex-Nutzer in den Tarifen Pro, Enterprise und Business Premium verfügbar. Die Preisgestaltung liegt bei 10 US-Dollar für den Input und 50 US-Dollar für den Output pro Million Tokens, womit das Modell preislich über der Vorgängerversion GPT-5.6 Sol liegt.
GPT-6 Astra setzt neue Bestmarken in verschiedenen Benchmarks, darunter 98 Prozent in FrontierMath Tier 4 und 100 Prozent im ExploitBench. In der praktischen Anwendung demonstrierte OpenAI, wie das Modell mithilfe der Funktion „Computer-Use“ komplexe Aufgaben wie die Erstellung eines Porträts in der Design-Software Canva übernimmt. Replit kündigte bereits an, GPT-6 Astra unmittelbar nach dem Release in seine eigene Plattform zu integrieren.
Breitflächige Integration in Produktivitätsanwendungen
Der Trend zur Einbindung mehrerer KI-Modelle erfasst die gesamte Branche der Produktivitätssoftware. Adobe gab bekannt, mehr als 70 kreative Tools, darunter Firefly und Photoshop, direkt in die Kommunikationsplattform Slack für Business+- und Enterprise+-Nutzer zu bringen.
Hierbei können Anwender Befehle in natürlicher Sprache an einen Slackbot richten. Auch Plattformen wie Monday.com setzen verstärkt auf KI-Agenten für das Projektmanagement. Docusign öffnete Ende September seine MCP-Server für alle gängigen KI-Agenten, um die Integration mit Claude, ChatGPT, Gemini und Copilot zu vertiefen.

