Zum Inhalt springen
OpenAI

GPT-6 Astra

OpenAIs Flagship, preislich fünfmal über GPT-6 Sol, mit seinen cyber-fähigen Features hinter einer Trusted-Access-Schranke.

Qualität

Modalität

Multimodal

Context

1.05M tokens

Zugang

Geschlossen

Fabians Take

FM

"Sehr fähig, und den Hype verstehe ich nicht. Der Abstand war nicht gross genug, um mich von Fable wegzulocken, und bei der Arbeit, die wirklich Astra statt Sol braucht, frisst es mein Token-Budget im Nu auf, manchmal in einem einzigen Prompt. Wo ich tatsächlich zu ihm greife, ist als zweite Meinung bei Dingen, die wirklich wichtig sind, und seine Tool-Nutzung in der Desktop-App ist momentan besser als bei Claude."

OpenAI hat GPT-6 Astra am 3. September 2026 angekündigt, zuerst für eine begrenzte Gruppe von Organisationen und danach über ChatGPT Plus, Pro, Business und Enterprise, die API und AWS. Pro-, Business- und Enterprise-Pläne bekommen zusätzlich eine Astra-Pro-Variante. Die API-Modell-ID ist gpt-6-astra.

Was es kostet

10 Dollar pro Million Eingabe-Tokens und 50 Dollar pro Million Ausgabe-Tokens, fünfmal so viel wie GPT-6 Sol kostet. Batch- und Flex-Verarbeitung laufen zum halben Preis. Der Fast-Modus verdoppelt das nochmals. Prompts über 272K Tokens werden für die gesamte Anfrage zum höheren Satz abgerechnet, wenn du die Arbeit also aufteilen kannst, ohne denselben Context doppelt zu senden, können zwei Aufrufe unter der Grenze günstiger sein als einer darüber.

Beim Preis allein ist Astra die teure Option, und GPT-6 Sol und Luna decken Volumenarbeit für einen Bruchteil davon ab. Der Haken, auf den ich gestossen bin: Die Arbeit, die wirklich Astra statt Sol braucht, ist genau die Arbeit, die es teuer macht: schwierige, offene Prompts, bei denen es lange nachdenkt. Bei so einem Prompt kann es einen erheblichen Teil eines Token-Budgets verbrennen.

Wie ich es tatsächlich nutze

Nicht als tägliches Arbeitspferd. Fable ist für mich immer noch das liebste, und Astra hat den Abstand nicht genug verkleinert, um mich umzustimmen. Wofür es gut ist: eine unvoreingenommene zweite Meinung zu etwas Wichtigem, ein spezifischer und unterschätzter Job. Ich habe darüber geschrieben, warum ein zweites Modell deine Arbeit besser liest als das, das sie geschrieben hat.

Das andere, was sich zu erwähnen lohnt, ist die Tool-Nutzung. In der Desktop-App geht Astra mit Tools aktuell besser um als Claude. Wenn deine Arbeit bedeutet, dass der Assistent nach anderen Dingen greift statt nur zu antworten, zeigt sich dieser Unterschied schnell.

Die Safety-Geschichte

OpenAIs System Card stuft Astra unter seinem Preparedness Framework für Cyber-Fähigkeit als Critical ein, das erste seiner Modelle mit dieser Einstufung. Die Konsequenz: Seine cyber-sensiblen Fähigkeiten erscheinen hinter einem Trusted-Access-Programm statt für alle, und OpenAI hat im selben Dokument einen Vergleich veröffentlicht, wie gut sich Astra und GPT-5.6 Sol jeweils gegen Jailbreaks behaupten.

Nicht das andere Astra

Google DeepMind betreibt einen Forschungsprototyp namens Project Astra, dessen Fähigkeiten nach und nach in Gemini Live einfliessen. Andere Firma, andere Sache, gleiches Wort. Wenn du «Astra» in einem Google-Kontext siehst, ist es nicht dieses Modell.

Das Fazit

Am besten für: Arbeit, bei der die Antwort beim ersten Mal stimmen muss und die Token-Rechnung nicht die Einschränkung ist.

Pro

  • Nach eigenen Benchmarks das fähigste Modell, das OpenAI je veröffentlicht hat
  • Batch- und Flex-Stufen halbieren den Preis für Arbeit, die warten kann
  • Verfügbar in den bezahlten ChatGPT-Plänen, über die API und auf AWS

Contra

  • Fünfmal so teuer wie GPT-6 Sol, und der Fast-Modus verdoppelt das nochmals
  • Prompts über 272K Tokens werden für die gesamte Anfrage zum höheren Satz abgerechnet
  • Cyber-sensible Fähigkeiten liegen hinter einem Trusted-Access-Programm
  • Bei wirklich schwieriger Arbeit kann es einen grossen Teil deines Token-Budgets in einem einzigen Prompt verbrennen

Specs

  • Preis $10/M Eingabe, $50/M Ausgabe · Cache-Eingabe $1/M · Batch und Flex $5/$25 · Fast-Modus $20/$100 · Prompts über 272K Tokens werden mit $20/$75 abgerechnet
  • Kostenstufe Premium
  • ⚡
    Geschwindigkeit Moderat
  • Lizenz Proprietär
Entwickler-Doku

Zugriff auf dieses Modell über