Die Gerüchteküche brodelte heftig, doch nun ist es offiziell: OpenAI hat sein neues Spitzenmodell GPT-6 Astra vorgestellt. Wer im Vorfeld dachte, der Konkurrent Anthropic würde hier das Rennen machen, wurde eines Besseren belehrt. Astra soll nicht mehr nur Fragen beantworten, sondern als echter Agent agieren, der selbstständig Softwareoberflächen bedienen, Formulare ausfüllen, Kalender organisieren und komplexe Programmieraufgaben lösen kann. Der Übergang vom reinen Text-Assistenten zum autonomen digitalen Mitarbeiter zeichnet sich damit immer deutlicher ab.

Beeindruckende Benchmarks und die AGI-Frage

Die von OpenAI veröffentlichten Leistungsdaten klingen spektakulär. Das Modell erzielt laut einem Bericht von VentureBeat unter anderem 72,6 Prozent in einem Offline-Teil des OSWorld-2.0-Benchmarks, der die Steuerung von Betriebssystemen misst. Bei mathematischen und programmiertechnischen Tests wie FrontierMath und DeepSWE werden ebenfalls Spitzenwerte vermeldet. OpenAI-Führungskräfte sprechen in diesem Zusammenhang bereits vom Beginn der AGI-Ära. Diese Einschätzung sollte jedoch mit Vorsicht genossen werden: Es handelt sich um herstellereigene Messungen in kontrollierten Umgebungen und nicht um eine unabhängig validierte Erreichung einer allgemeinen künstlichen Intelligenz.

Sicherheitsrisiken und die kritische Schwelle

Ein besonders brisanter Aspekt der Veröffentlichung ist die Einstufung von Astra im Rahmen des hauseigenen Preparedness Frameworks. Das Modell hat erstmals die kritische Schwelle für Cybersicherheitsrisiken erreicht. Astra zeigt laut Entwicklerangaben fortgeschrittene Fähigkeiten beim Aufspüren und Ausnutzen von bisher unbekannten Software-Schachstellen. Aufgrund dieses Gefahrenpotenzials hat OpenAI angekündigt, hochgradig autonome Cybersecurity-Funktionen vorerst nur stark eingeschränkt und unter strenger Überwachung bereitzustellen. Der Spagat zwischen maximaler Produktivität und dem Verhindern von Missbrauch wird für die Branche zur Zerreißprobe.

Fazit

Mit GPT-6 Astra zeigt OpenAI eindrucksvoll, wohin die Reise der KI-Entwicklung geht. Weg vom passiven Chat-Fenster, hin zum aktiven Akteur auf unseren Bildschirmen. Ob die Sicherheitsvorkehrungen im Alltag halten, was sie versprechen, wird sich erst beim schrittweisen Rollout zeigen.