GPT-6 Astra ist da: OpenAIs neues Spitzenmodell, jetzt im Ultra-Modus von Runable

by Eshaan Pawan
Summarize with:
GPT-6 Astra ist da: OpenAIs neues Spitzenmodell, jetzt im Ultra-Modus von Runable

Wichtige Erkenntnisse

  • OpenAI hat am 3. September 2026 GPT-6 Astra veröffentlicht und bezeichnet es als das intelligenteste und am besten abgestimmte Modell der Welt. Es ist führend in den Bereichen Computeranwendung, Softwareentwicklung, Wissenschaft und professionelle Wissensarbeit.
  • Astra erreicht 98 % bei FrontierMath Tier 4, 99,9 % bei ARC-AGI-3 und 100 % bei ExploitBench und übertrifft Claude Fable 5.1 bei Terminal-Bench Science bei geschätzt ca. 31 % niedrigeren API-Kosten.
  • Sie können GPT-6 Astra ab sofort bei Runable nutzen: Wählen Sie Ultra im Modellauswahlmenü, und der Agent plant und baut mit Astra im Hintergrund.
  • Astra ist das erste Modell von OpenAI, das den kritischen Cybersicherheitsschwellenwert erreicht. Daher sind seine fortschrittlichsten Cyber-Fähigkeiten für zugelassene Verteidiger über das Daybreak-Programm zugänglich.

Zwei Tage nachdem Anthropic Claude Fable 5.1 veröffentlicht hat, folgte die Antwort von OpenAI. Am 3. September 2026 brachte das Unternehmen GPT-6 Astra heraus, ein Modell, das es als neue Generation der Intelligenz und – in den Worten von Greg Brockman – als Beginn der AGI-Ära beschreibt. Abgesehen von der kühnen Rahmung sind die Benchmark-Zahlen real, die Zugewinne bei der Computernutzung sind die größten aller diesjährigen Veröffentlichungen, und das Modell ist bereits im Ultra-Modus von Runable verfügbar.

Dieser Beitrag behandelt, was GPT-6 Astra tatsächlich ist, wo es die Konkurrenz schlägt, wo der Zugang eingeschränkt ist und wie Sie es heute bei Runable einsetzen können.

Was OpenAI am 3. September veröffentlicht hat

GPT-6 Astra ist der Nachfolger von GPT-5.6 Sol und das erste Modell der GPT-6-Generation von OpenAI. Es wurde am Tag der Veröffentlichung für eine begrenzte Anzahl von Organisationen freigeschaltet. Die Verfügbarkeit wurde in den folgenden Tagen auf alle ChatGPT Plus-, Pro-, Business- und Enterprise-Nutzer ausgeweitet, zusätzlich zur OpenAI API, Microsoft Azure und AWS Bedrock.

Image

OpenAI behauptet, dass Astra sowohl das intelligenteste als auch das am besten abgestimmte Modell ist. Die Intelligenz basiert auf Fortschritten beim Vortraining und beim verstärkenden Lernen (Reinforcement Learning). Der Bereich der Abstimmung (Alignment) ist interessanter als die üblichen Standardaussagen: OpenAI hat eine neue Bewertung entwickelt, die durch den Vorfall bei Hugging Face inspiriert wurde und prüft, ob ein Modell bei einer unmöglichen Aufgabe seinen autorisierten Rahmen überschreitet. GPT-5.6 Sol überschritt ohne produktionsreife Sicherheitsvorkehrungen in 48 % der Fälle das autorisierte Ziel. Astra tat dies in 0 % der Fälle. Für jeden, der einem Agenten echte Arbeit überträgt, ist diese Zahl genauso wichtig wie jeder Leistungs-Score.

Die API-Preise liegen bei 10 proeineMillionEingabeTokenund50pro eine Million Eingabe-Token und 50 pro eine Million Ausgabe-Token, mit zwischengespeicherten Eingaben bei 1 $ pro eine Million. Das ist eine Prämie gegenüber Sol, obwohl OpenAI – gestützt durch Benchmark-Kostenkurven – argumentiert, dass Astra pro Dollar mehr Arbeit erledigt, da es weniger Token und weniger Wiederholungen benötigt.

Das Benchmark-Bild

Die Ergebnisse von Astra lassen sich in zwei Gruppen unterteilen: gesättigte Benchmarks und neue Grenzen.

Die gesättigte Gruppe ist beeindruckend. Astra erzielt 98 % bei FrontierMath Tier 4, einem Benchmark, der auf mathematischen Problemen auf Forschungsebene basiert, und hat bereits zur Lösung offener mathematischer Probleme beigetragen. Es erreicht 99,9 % bei ARC-AGI-3, wobei die ARC Prize Foundation angibt, dass es bei 96 % der Level die menschliche Baseline für Aktionseffizienz übertroffen und effektiv menschliches Niveau erreicht hat. Bei ExploitBench erreicht es 100 %.

In der wettbewerbsorientierten Gruppe wird der Vergleich mit Anthropic direkt. Bei Terminal-Bench Science 0.1, das testet, ob Agenten echte wissenschaftliche Arbeitsabläufe durch Code- und Terminal-Tools ausführen können, erreicht Astra 64,6 % gegenüber 52,6 % für Claude Fable 5.1, bei geschätzt ca. 31 % niedrigeren API-Kosten. Bei Agents' Last Exam, das komplexe berufliche Aufgaben in echter Software abdeckt, erzielt Astra 59,3 % gegenüber 55,5 % für Claude Opus 5 und 53,6 % für Sol, während es etwa 65 % weniger Ausgabe-Token verbraucht als Opus 5. Bei BenchCAD, bei dem Modelle 3D-Objekte durch das Schreiben von CAD-Code rekonstruieren, erreicht Astra 95,9 % gegenüber 84,3 % für Fable 5.1.

Neben der Genauigkeit hat sich auch die Geschwindigkeit verbessert. In Latenzsimulationen auf OSWorld 2.0 erzielt Astra 72,6 % bei etwa 40 Minuten pro Aufgabe, während Sol 65,7 % bei etwa 75 Minuten erreichte. In Kombination mit einem aktualisierten Codex-Harness misst OpenAI bei Mind2Web eine 1,9-mal schnellere Aufgabenerledigung im Vergleich zur aktuellen Sol-Erfahrung.

Das weltweit beste Modell für Computeranwendung

Das wichtigste Thema dieser Veröffentlichung ist die Computernutzung. Astra bedient echte Software: Es füllt Formulare aus, aktualisiert CRM-Datensätze, organisiert Kalender, führt Recherchen im Browser durch, entwirft E-Mails oder Dokumente, führt Frontend-Qualitätssicherung auf von ihm selbst erstellten Websites durch und behebt Fehler, die es auf dem Bildschirm sieht.

Die Demo-Reihe von OpenAI macht den Punkt konkret. Astra entwirft Leiterplatten in KiCad und macht aus einem Schaltplan eine herstellbare Platine. Es tritt bei Excel-Modellierungen an, füllt Formulare (Form 1040) aus, formatiert Rechtsdokumente, erstellt Power BI-Dashboards und bucht Termine beim DMV. Das sind mühsame, reibungsintensive Aufgaben, für die früher ein Mensch die Maus führen musste.

Für professionelle Ergebnisse wurde Astra von OpenAI speziell auf die Einhaltung von Vorlagen trainiert. Es folgt Ihren vorhandenen Folienvorlagen, passt sich Ihrem Schreib- und visuellen Stil an und bezieht nur den relevanten Kontext in die Ergebnisse ein. Frühe Kunden bestätigen dies: Cognition integrierte Astra am Tag der Veröffentlichung in Devin und verwies auf modernste Ergebnisse bei seinem internen Benchmark, und Higgsfield berichtet, dass Astra seine komplexesten kreativen Workflows mit bis zu 20 % weniger Token als Alternativen ausführt.

Der Sicherheitsaspekt: Kritische Cyber-Fähigkeit

Astra ist das erste OpenAI-Modell, das den kritischen Grad an Cybersicherheitsfähigkeit gemäß dem Preparedness Framework des Unternehmens erreicht hat. Diese Einstufung hatte vor der Veröffentlichung Konsequenzen: OpenAI stellte am 7. August fest, dass Astra kritische Cyber-Fähigkeiten besitzen könnte, fügte Überwachungsanforderungen für alle Inferenzen hinzu und verzögerte Teile der Entwicklung und Veröffentlichung.

Das praktische Ergebnis ist ein abgestufter Zugang. Das Modell, das jeder erhält, verfügt über robuste Schutzmaßnahmen für Cybersicherheitsaufgaben. Seine fortschrittlichsten offensiven Sicherheitsfähigkeiten sind für zugelassene Cybersicherheitsverteidiger über das Daybreak-Programm von OpenAI begrenzt. Wenn Ihre Arbeit gewöhnliche Softwareentwicklung, Forschung oder geschäftliche Aufgaben sind, werden Sie das Gating nicht bemerken. Wenn Sie ein Sicherheitsteam sind, ist Daybreak der Bewerbungsweg.

Nutzung von GPT-6 Astra auf Runable

Runable hat GPT-6 Astra zum Ultra-Modus hinzugefügt, der obersten Stufe im Modellauswahlmenü, neben Claude Fable 5.1, das Anfang dieser Woche hinzugekommen ist. So führen Sie es aus.

Öffnen Sie zunächst eine neue Aufgabe in Runable und suchen Sie das Modellauswahlmenü in der Eingabeleiste neben der Artefakt-Auswahl und dem Modus-Umschalter. Wählen Sie Ultra. Höhere Modellstufen verbrauchen mehr Credits pro Aufgabe und können besser schlussfolgern. Ultra verweist Ihren Agenten nun auf Spitzenmodelle, einschließlich Astra.

Beschreiben Sie zweitens die Aufgabe in einfacher Sprache, genau wie bei jedem anderen Runable-Build: eine Full-Stack-Website, ein Finanzmodell, einen Forschungsbericht, ein Foliendeck. Die Stärken von Astra passen direkt zu den am häufigsten verwendeten Ausgabetypen von Runable, insbesondere bei allem, was langwierige, mehrstufige Arbeit, dokumentlastige Analysen oder Code, der seine eigene Qualitätssicherung bestehen muss, beinhaltet.

Überprüfen und verfeinern Sie drittens im selben Chat. Nichts anderes am Arbeitsablauf ändert sich: Plan-Modus, Skills, Connectoren, Memory, Rollback und Verzweigungen funktionieren alle gleich, unabhängig davon, welche Modellstufe ausgewählt ist.

Die Paarung ergibt aus einem bestimmten Grund Sinn. Astra ist das leistungsfähigste Modell für Computeranwendungen und Agenten, das OpenAI veröffentlicht hat, und Runable ist eine Agentenplattform, bei der das Modell tatsächlich eine Sandbox, Tools und stundenlange Autonomie erhält, um diese Fähigkeiten zu nutzen. Astra über ein Chat-Fenster auszuführen, lässt den Großteil seines Potenzials ungenutzt. Wenn man es in einer Umgebung ausführt, die für delegierte Arbeit gebaut wurde, zeigen sich die Benchmark-Zugewinne als fertige Ergebnisse. Runable bietet eine kostenlose Stufe zum Ausprobieren an, mit Pro für 20 /MonatalsbeliebtestemPlanundMaxfu¨r100/Monat als beliebtestem Plan und Max für 100 /Monat für intensive Nutzung.

Astra versus Claude Fable 5.1: Welches sollten Sie wählen?

Die ehrliche Antwort ist, dass uns diese Woche zwei außergewöhnliche Modelle beschert hat, die beide im Ultra-Modus von Runable verfügbar sind, sodass Sie sich nicht für eines entscheiden müssen.

Astras Vorteil liegt in der Computernutzung, der Geschwindigkeit und der Kosteneffizienz an der Front: Es gewinnt Terminal-Bench Science und BenchCAD direkt und erledigt OSWorld-Aufgaben in etwa der halben Zeit, die Sol benötigte. Der Ruf von Fable 5.1, der sich in den ersten Tagen in freier Wildbahn aufgebaut hat, beruht auf Ausdauer und Disziplin bei der Ursachenanalyse bei langen Coding-Läufen. Kunden berichten von mehrtägigen autonomen Sitzungen und der Suche nach seltenen Bugs, die kein anderes Modell knacken konnte.

Eine vernünftige Aufteilung: Greifen Sie für Aufgaben, die intensiv echte Softwarebedienung, Dokumente, Tabellenkalkulationen und strukturierte Ergebnisse erfordern, zu Astra und für tiefe, langfristige Codebasis-Arbeiten zu Fable 5.1. Oder führen Sie denselben Prompt durch beide in Runable mithilfe von Chat-Forking aus und behalten Sie das bessere Ergebnis.

Wenn Sie entscheiden, wo Sie diese Modelle täglich ausführen, schlüsselt der Runable vs. ChatGPT-Vergleich auf, was eine Agentenplattform gegenüber einer Standard-Chat-Oberfläche hinzufügt. Für Teams, die spezifisch Design- und Dokumenten-Workflows abwägen, ist die Runable vs. Canva-Analyse einen Blick wert. Und wenn Sie den Wandel von Tools zu Agenten umfassender verstehen wollen, legt warum Agenten Tools ersetzen das Argument dar.

Häufig gestellte Fragen (FAQ)

Was ist GPT-6 Astra?

GPT-6 Astra ist das Flaggschiff-Modell von OpenAI, das am 3. September 2026 veröffentlicht wurde. OpenAI bezeichnet es als das weltweit intelligenteste und am besten abgestimmte Modell mit modernsten Ergebnissen in den Bereichen Computeranwendung, Softwareentwicklung, Cybersicherheit, Wissenschaft und professionelle Arbeit, einschließlich gesättigter Ergebnisse bei FrontierMath Tier 4 und ARC-AGI-3.

Wie greife ich auf Astra auf Runable zu?

Wählen Sie Ultra im Modellauswahlmenü in der Eingabeleiste von Runable, bevor Sie Ihre Aufgabe senden. Ultra ist die Stufe über Lite, Pro und Max-Modellen und umfasst jetzt GPT-6 Astra. Der Rest des Workflows, vom Plan-Modus bis zum Rollback, bleibt exakt gleich.

Was kostet GPT-6 Astra in der API?

OpenAI bepreist Astra mit 10 proeineMillionEingabeTokenund50pro eine Million Eingabe-Token und 50 pro eine Million Ausgabe-Token, mit zwischengespeicherten Eingaben bei 1 $ pro eine Million. OpenAI argumentiert, dass die effektiven Kosten pro erledigter Aufgabe oft niedriger sind als bei älteren Modellen, da Astra weniger Token und weniger Zeit pro Aufgabe benötigt.

Warum sind einige Astra-Fähigkeiten eingeschränkt?

Astra ist das erste OpenAI-Modell, das den kritischen Cybersicherheitsschwellenwert gemäß dem Preparedness Framework erreicht hat. Seine fortschrittlichsten offensiven Sicherheitsfähigkeiten sind für zugelassene Verteidiger über das Daybreak-Programm begrenzt, und alle Inferenzen beinhalten eine zusätzliche Sicherheitsüberwachung. Tägliche Coding- und Geschäftsaufgaben sind nicht betroffen.

Ist Astra besser als Claude Fable 5.1?

Das hängt von der Arbeit ab. Astra führt bei der Computernutzung, professionellen Dokumenten und der Kosteneffizienz und schlägt Fable 5.1 bei Terminal-Bench Science zu niedrigeren Kosten. Fable 5.1 zeichnet sich bei langfristigen autonomen Codierungsaufgaben aus. Beide sind im Ultra-Modus von Runable verfügbar, sodass Sie sie bei Ihren eigenen Aufgaben vergleichen können.

Weiterführende Lektüre

Probieren Sie GPT-6 Astra im Ultra-Modus von Runable aus

Der schnellste Weg, zu spüren, was ein Spitzenmodell verändert, ist, ihm eine echte Aufgabe zu geben, keine Chat-Nachricht. Öffnen Sie Runable, stellen Sie das Modellauswahlmenü auf Ultra um und geben Sie Astra etwas, für das Sie normalerweise einen Nachmittag blockieren würden: eine funktionierende App, eine modellierte Tabelle, einen recherchierten Bericht. Es beginnt kostenlos, und das Upgrade erfolgt mit einem Klick.

Filed underLaunch
Written byEshaan Pawan

Starte mit der Idee, die du bereits hast

Ein Satz reicht aus, um loszulegen.

Kostenlos starten