News

GPT-6 Astra: Was hinter OpenAIs AGI-Ankündigung wirklich steckt

OpenAI hat Anfang September ein neues Spitzenmodell veröffentlicht und ruft dabei die „AGI-Ära“ aus. AGI, kurz für Artificial General Intelligence, bezeichnet eine Künstliche Intelligenz, die den Menschen bei den meisten wirtschaftlich relevanten Aufgaben übertrifft, statt wie bisherige Modelle auf einzelne Bereiche spezialisiert zu sein. Ein Blick auf die Fakten zeigt: Die Einordnung ist deutlich komplizierter, als die Pressemitteilung suggeriert.

TL;DR

OpenAI hat am 3. September 2026 GPT-6 Astra veröffentlicht und bezeichnet es als möglichen Beginn der „AGI-Ära“.

Ein zentraler Benchmark-Wert (99,9 % auf ARC-AGI-3) fällt unter neutralen Testbedingungen auf 62,7 %.

Für Unternehmen wichtiger als das Label: Astra gilt als erstes OpenAI-Modell mit „kritischer“ Cybersicherheits-Einstufung.

Ein neues Spitzenmodell mit großem Anspruch

GPT-6 Astra ist laut OpenAI das bislang leistungsfähigste breit verfügbare Modell des Unternehmens, trainiert in einem der größten Rechenläufe der Firmengeschichte mit über 100.000 GPUs am Stargate-Standort in Texas. Das Modell soll bei Computer-Bedienung, Recherche, Softwareentwicklung, Wissenschaft und klassischer Büroarbeit Bestwerte liefern. OpenAI-Präsident Greg Brockman sprach von einem „generationalen Sprung“ und formulierte auf der Präsentation:

„Welcome to the AGI era.“

Zugleich räumte er ein, AGI sei „ein unscharfes, verschwommenes Ding“. Die Einschätzung, ob die Schwelle erreicht sei, überließ er letztlich dem Publikum.

Was die Zahlen wirklich zeigen

Der meistzitierte Beleg für den AGI-Anspruch ist ein Ergebnis von 99,9 % auf dem Benchmark ARC-AGI-3, erzielt in OpenAIs eigenem Testaufbau. Der Benchmark-Betreiber ARC Prize hat Astra zusätzlich mit einem eigenen, anbieterneutralen Standardverfahren getestet: Dabei kam ein Wert von 62,7 % heraus. Gleicher Test, andere Spielregeln, deutlich anderes Ergebnis. ARC Prize selbst stellt ausdrücklich klar, keine AGI-Aussage über Astra zu treffen. Auch der unabhängige Prüfdienst Artificial Analysis relativiert: In dessen Intelligence Index liegt Astra auf dem Niveau des Vorgängermodells und einige Punkte hinter einem Konkurrenzmodell von Anthropic. Die Skepsis an der Bewertung war sogar Anlass, den Index grundlegend zu überarbeiten.

Was Fachleute dazu sagen

Toby Walsh, KI-Wissenschaftler an der University of New South Wales, widerspricht der AGI-Einordnung offen. Er verweist auf Brockmans eigene, 2019 formulierte AGI-Definition: ein System, das auf mehr Gebieten als jeder Mensch Weltklasse-Niveau erreicht. Öffentlich belegt sei das für Astra nicht, insbesondere nicht bei kreativer Originalität oder experimenteller Wissenschaft. Auch der Nachweis, dass das Modell Menschen bei den meisten wirtschaftlich relevanten Tätigkeiten übertrifft, fehlt bislang. Das ist ausgerechnet der Kern von OpenAIs eigener AGI-Definition.

Was das für Ihr Unternehmen bedeutet

Aus unserer Sicht ist die AGI-Debatte für den Mittelstand eher eine Randnotiz. Relevanter ist eine andere Einstufung: Astra ist das erste OpenAI-Modell, das laut firmeneigenem Sicherheits-Rahmenwerk die Stufe „kritisch“ bei Cybersicherheits-Fähigkeiten erreicht. Mit entsprechenden Werkzeugen kann das Modell eigenständig bislang unbekannte Sicherheitslücken finden und Wege zu ihrer Ausnutzung entwickeln, ohne dass ein Mensch jeden Schritt anleitet. Die öffentlich verfügbare Version verweigert zwar offensiv-technische Anfragen, ausgewählte Organisationen erhalten über ein separates Programm jedoch weitergehenden Zugriff. Das ist für Unternehmen, die eigene Systeme absichern oder KI-Tools produktiv einsetzen, die praktisch relevantere Nachricht als jede „AGI-Ära“-Formulierung.

Unsere Einschätzung: Marketing-Anspruch und geprüfte Leistungsfähigkeit sollten getrennt bewertet werden. Ob ein neues Modell für Ihren Anwendungsfall tatsächlich einen Unterschied macht, zeigt sich nicht in einer Pressemitteilung, sondern im eigenen Test an einer konkreten Aufgabe.