OpenAI hat GPT 6 Astra am 3. September zunächst für eine begrenzte Zahl von Organisationen eingeführt. OpenAI meldet 98 % bei FrontierMath Tier 4, 99,9 % bei ARC AGI 3 und 100 % bei ExploitBench.
Veröffentlicht vonBearbeitet mit GPT-5.6 TerraBilder erstellt mit GPT Image 2
Forschungsantwort

Create a landscape editorial hero image for this Studio Global article: What did OpenAI announce with the September 3 launch of GPT-6 Astra—including its claimed intelligence, alignment, record benchmark results,. Article summary: OpenAI presented GPT‑6 Astra as a major step toward highly autonomous AI: “the world’s most intelligent and aligned model,” with record scores across agentic, scientific, computer-use, and cyber evaluations. These are Op. Topic tags: general, documentation, general web. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fak
OpenAI positioniert GPT-6 Astra als Modell für anspruchsvolle, mehrstufige Aufgaben – von Programmierung und Recherche bis zur Computerbedienung und professionellen Arbeitsabläufen. Das Unternehmen nennt Astra sein bislang intelligentestes und am besten ausgerichtetes Modell. Zunächst wird es jedoch nur einer begrenzten Gruppe von Organisationen bereitgestellt, nicht sofort allgemein veröffentlicht. 2
5
13
Bemerkenswert sind nicht allein die gemeldeten Benchmark-Ergebnisse. OpenAI erklärt auch, Astra sei das erste eigene Modell, das im Preparedness Framework die Cybersecurity-Stufe „Critical“ erreiche. Genau deshalb sollten die Leistungsversprechen und der gestaffelte Zugang zusammen betrachtet werden. 10
12
Laut OpenAI setzt Astra Maßstäbe bei Computerbedienung, Web-Browsing, Softwareentwicklung, Cybersicherheit, Wissenschaft und professioneller Wissensarbeit. In der Entwicklerdokumentation ist es für komplexes Schlussfolgern, Coding, Computerbedienung, Recherche sowie das Erstellen von Dokumenten vorgesehen. 1
3
13
Drei besonders auffällige Ergebnisse nennt OpenAI:
Diese Zahlen stammen aus von OpenAI veröffentlichten Auswertungen; sie sind keine unabhängig replizierten Messungen. Hohe Benchmark-Werte können Fortschritte bei den jeweils getesteten Aufgaben belegen. Sie beweisen aber weder allgemeine Intelligenz noch verlässliches Urteilsvermögen in der Praxis oder sichere Autonomie in jeder Umgebung.
OpenAI zufolge erreicht Astra als erstes Modell des Unternehmens im Preparedness Framework die Stufe „Critical“ für Cybersicherheitsfähigkeiten. Nach der Definition von OpenAI bedeutet das: Mit passenden Werkzeugen und Zugriffsrechten kann das Modell bislang unbekannte Sicherheitslücken aufspüren und neue Ausnutzungsmethoden für viele gut geschützte Systeme entwickeln, ohne dass ein Mensch jeden Schritt vorgibt. 10
12
Diese Aussage hat zwei wesentliche Einschränkungen:
OpenAI erklärt, zusätzliche Schutzmaßnahmen gegen schädliche Cyberaktionen eingeführt zu haben, darunter eine erweiterte Überwachung während des Astra-Rollouts. 5
10 Dass der Zugang schrittweise statt sofort breit geöffnet wird, passt zu dem erhöhten Risiko, das das Unternehmen selbst beschreibt.
OpenAI bezeichnet Astra außerdem als sein bislang am besten ausgerichtetes Modell. Es solle Aufgabenbegrenzungen besser beachten und transparenter kommunizieren. 2
13
Das sollte nicht überinterpretiert werden. Wenn bei einer Modellveröffentlichung von „Alignment“ die Rede ist, beschreibt das Leistung unter bestimmten Trainingsmethoden und Tests. Es garantiert nicht, dass ein KI-Agent die Absicht eines Nutzers stets korrekt versteht, jede operative Grenze einhält oder ohne menschliche Prüfung sicher eingesetzt werden kann. Die Release Notes von OpenAI nennen zusätzliche Überwachung, um Fälle zu erkennen, in denen Agenten Anweisungen möglicherweise falsch ausgelegt haben. 5
Für Organisationen, die agentische Systeme einsetzen wollen, ist daher wichtiger als das Etikett „aligned“: Welche Berechtigungen erhält das Modell? Welche Aktionen brauchen eine Freigabe? Wie werden Aktivitäten protokolliert? Und wie schnell lässt sich das System bei unerwartetem Verhalten stoppen?
Das vorliegende Material verweist auf spätere Einordnungen einzelner Bewertungswerte – darunter mögliche Benchmark-Kontamination und Unterschiede zwischen besonderen Zugriffs-Konfigurationen und dem standardmäßigen Produktzugang. Es beschreibt zudem Tests, bei denen eine Überwachung allein anhand der Chain of Thought weniger wirksam war als eine Überwachung mit vollständigem Kontext.
Die vorliegenden Auszüge aus Primärquellen liefern jedoch keine vollständige, unabhängig prüfbare Änderungshistorie für alle Werte und auch keine vollständige Methodik der zugrunde liegenden Überwachung. Die verantwortungsvolle Schlussfolgerung lautet daher: Prominente Benchmark-Zahlen und Sicherheitsbewertungen sind vorläufige, sich entwickelnde Release-Evidenz. Wer sich auf einen konkreten Wert oder ein bestimmtes Einsatzversprechen stützen möchte, sollte die aktuelle Modelldokumentation und Sicherheitsunterlagen prüfen. 2
3
10
Der Start erfolgte nach einem früheren Vorfall bei Sicherheitstests mit OpenAI-Modellen, der nach Unternehmensangaben in den Sicherheitsansatz für Astra eingeflossen ist. OpenAI betont in den Release-Materialien, dass Astra selbst nicht das dabei betroffene Modell gewesen sei und die Erkenntnisse aus dem Vorfall in die Schutzmaßnahmen eingeflossen seien. 10
Das ist relevant, weil autonome Systeme Modellfähigkeiten mit der Möglichkeit verbinden, über Browser, Code-Werkzeuge und andere Software tatsächlich zu handeln. Gerade weil ein Modell über verschiedene Systeme hinweg nützlich sein kann, gewinnen Abschottung, das Prinzip minimaler Rechte und Überwachung an Bedeutung.
OpenAI teilte mit, Astra werde zunächst für eine begrenzte Zahl von Organisationen freigeschaltet; eine breitere Verfügbarkeit sei später geplant. 5
13
Für Entwickler listet OpenAI 10 US-Dollar pro Million Eingabe-Tokens und 50 US-Dollar pro Million Ausgabe-Tokens. Auf der Modellseite werden außerdem ein Kontextfenster von 1,05 Millionen Tokens sowie bis zu 128.000 Ausgabe-Tokens genannt. 3
Der Zugang über ChatGPT ist davon getrennt und erfolgt ebenfalls schrittweise. Laut OpenAIs Hilfedokumentation wird GPT-6 Pro, das auf Astra basiert, für die Tarife Pro 100 US-Dollar, Pro 200 US-Dollar, Business und Enterprise ausgerollt. Plus-Tarife erhalten Astra im Zuge des Rollouts in ChatGPT Work und Codex. Die Verfügbarkeit kann je nach ChatGPT-Produkt und Workspace-Einstellungen unterschiedlich ausfallen. 6
Der Start von GPT-6 Astra verbindet zwei Aussagen, die nicht voneinander getrennt werden sollten: OpenAI beansprucht einen deutlichen Fortschritt bei komplexer, agentischer Arbeit – und stuft die Cyberfähigkeiten des Modells gleichzeitig in die höchste eigene Risikokategorie ein. 10
13
Die Benchmarks zeigen, was Astra nach Angaben von OpenAI in den jeweiligen Bewertungen leisten kann. Der gestaffelte Zugang, die zusätzliche Überwachung und Cyber-Beschränkungen zeigen zugleich, dass das Unternehmen diese Fähigkeiten nicht als Routine betrachtet. Für Teams, die das Modell evaluieren, sollte deshalb ein kontrollierter Einsatz Priorität haben: eng begrenzte Werkzeuge, ausdrückliche Freigaben für folgenreiche Aktionen, isolierte Umgebungen und überprüfbare Protokolle. Benchmark-Leistung sollte nicht automatisch mit vertrauenswürdiger Autonomie gleichgesetzt werden.
Studio Global AI
Diese Seite enthält eine quellengestützte Antwort, die Sie in Studio Global fortsetzen können.
OpenAI hat GPT 6 Astra am 3. September zunächst für eine begrenzte Zahl von Organisationen eingeführt.
OpenAI hat GPT 6 Astra am 3. September zunächst für eine begrenzte Zahl von Organisationen eingeführt. OpenAI meldet 98 % bei FrontierMath Tier 4, 99,9 % bei ARC AGI 3 und 100 % bei ExploitBench.
Der API Preis liegt laut OpenAI bei 10 US Dollar je Million Eingabe Tokens und 50 US Dollar je Million Ausgabe Tokens.