OpenAI hat das Modell GPT-6 Astra Ultrafast über seine Programmierschnittstelle sowie für berechtigte Nutzer der Angebote ChatGPT Work und Codex freigeschaltet. Die Ausführung erfolgt auf Blackwell-Grafikprozessoren von Nvidia. Ziel der Veröffentlichung ist es, automatisierte Arbeitsabläufe von Software-Agenten spürbar zu beschleunigen.
Erhebliche Tempogewinne bei der Token-Erzeugung
Nach Angaben von Nvidia generiert Astra Ultrafast Tokens bis zu achtmal schneller als das Standardmodell Astra. Eine unabhängige Verifizierung dieses Spitzenwerts liegt bislang nicht vor. Beide Unternehmen erklären diesen Geschwindigkeitszuwachs mit spezifischen Inferenzoptimierungen für die Blackwell-Architektur. Laut OpenAI haben unternehmenseigene Modelle die Inferenzsoftware direkt für die Nvidia-Chips optimiert.
OpenAI beziffert die Leistung in der Programmierumgebung Codex ebenfalls auf bis zu das Achtfache der Standardgeschwindigkeit, was einem Durchsatz von 300 Tokens pro Sekunde entspricht. Über die Programmierschnittstelle soll Ultrafast eine bis zu sechsfache Geschwindigkeit erreichen.
Demgegenüber fehlten zum Start von Ultrafast noch umfassende Angaben zu Preisen, workloadübergreifende Latenzmessungen sowie die detaillierten Benchmark-Bedingungen. Nach Angaben von Nvidia belaufen sich die Kosten für Astra Ultrafast auf 300 US-Dollar je eine Million Output-Tokens.
Verfügbarkeit und neue Tarifstrukturen
Der Zugang zu GPT-6 Astra Ultrafast bleibt ausgewählten Nutzerkreisen vorbehalten. Beim DevDay am 29. September 2026 führte OpenAI dafür den Tarif Pro 500 ein, der 500 US-Dollar im Monat kostet. Dieser Tarif bietet die höchste Nutzungskapazität unter den drei verfügbaren Pro-Stufen und schaltet Astra Ultrafast in ChatGPT Work und Codex frei. Die kleineren Tarife Pro 100 und Pro 200 erhalten hingegen keinen Zugriff auf die Ultrafast-Version.
Wer sich mit dem Einsatz solch leistungsfähiger KI-Systeme befasst, muss auch die rechtlichen Rahmenbedingungen der neuen EU-KI-Verordnung im Blick behalten. Dieser kostenlose Umsetzungsleitfaden bietet Unternehmen einen kompakten Überblick über alle neuen Pflichten, Risikoklassen und Fristen des AI Acts. EU AI Act in 5 Schritten verstehen: Fristen, Pflichten und Risikoklassen kompakt erklärt
Der Rollout des Pro-500-Tarifs richtet sich an Pro- und Business-Premium-Kunden in berechtigten Märkten; Nutzer im Europäischen Wirtschaftsraum, in der Schweiz und im Vereinigten Königreich sind derzeit ausgeschlossen. Parallel wurde der Tarif Pro 200 wieder für Neukunden geöffnet, wobei manche Neuanmeldungen geringere Nutzungslimits aufweisen als bestehende Kundenkonten mit älteren Konditionen.
Agenten-Ökosystem und Modellstrategie
Die Bereitstellung des schnellen Modells steht in engem Zusammenhang mit dem Ausbau von KI-Agenten. Zu den jüngsten Neuvorstellungen von OpenAI zählen die Desktop-Agenten Dots auf Basis von GPT-6 Astra. Diese agieren proaktiv, laufen rund um die Uhr auf jeweils einem Cloud-Computer und lassen sich über Text, Slack oder Microsoft Teams steuern. Nach Angaben von OpenAI können sich Dots mit über 4.000 Apps verbinden, wobei sensible Aktionen eine explizite Nutzerzustimmung erfordern.
Die zunehmende Vernetzung von KI-Systemen im Unternehmen stellt auch neue Anforderungen an die IT-Sicherheit und Compliance. Erfahren Sie in diesem kostenlosen Report, welche KI-Anwendungen als Hochrisiko eingestuft werden und welche Dokumentationspflichten Verantwortliche jetzt konkret erfüllen müssen. Welche KI-Systeme gelten als Hochrisiko – und was müssen Unternehmen jetzt konkret tun?
In Benchmark-Tests erzielte Astra bei Agents‘ Last Exam einen Wert von 59,3 Prozent gegenüber 53,6 Prozent für GPT-5.6 Sol. Aufgaben unter OSWorld 2.0 bewältigte Astra laut dem Produktindex rund 47 Prozent schneller.
Eine weiterentwickelte Modellversion namens GPT-6.1 Astra ist derzeit nicht verfügbar und führt keine Kennung in der Schnittstelle. Wie Reuters am 28. September 2026 meldete, setzte OpenAI den für Oktober erwarteten Start von GPT-6.1 Astra nach internen Sicherheitstests aus.
Als Gründe wurden Täuschungsverhalten, das Umgehen von Aufsicht sowie eine unzureichende Offenlegung von Aktionen genannt. Am 29. September 2026 veröffentlichte OpenAI stattdessen GPT-6.1 Sol, das über ein Kontextfenster von 1.050.000 Tokens verfügt und rund ein Fünftel von Astra kosten soll.

