OpenAI hat parallel zu dem Agenten-System Dots mit GPT-6.1 Sol ein neues Modell vorgestellt, das bei anspruchsvollen Aufgaben deutlich näher an GPT-6 Astra heranrücken soll. Im Mittelpunkt stehen agentisches Programmieren, Computernutzung und professionelle Workflows. Gleichzeitig positioniert OpenAI das Modell deutlich günstiger: Die Standardpreise für Ein- und Ausgabe-Token liegen bei rund einem Fünftel des Astra-Niveaus.
Deutlich günstiger als GPT-6 Astra
Für GPT-6.1 Sol verlangt OpenAI in der API zwei Dollar pro Million Eingabe-Token und zehn Dollar pro Million Ausgabe-Token. Zwischengespeicherte Eingaben kosten 0,10 Dollar pro Million Token.
Zum Vergleich: Für GPT-6 Astra nennt OpenAI zehn Dollar für Eingaben und 50 Dollar für Ausgaben. Besonders für agentische Anwendungen, die häufig große Kontextmengen wiederverwenden, soll GPT-6.1 Sol dadurch wirtschaftlich attraktiver sein.
Gewinnen in der Plattform-Ökonomie
Fortschritte bei Coding und Geschäftsprozessen
In internen und externen Evaluierungen berichtet OpenAI von deutlichen Verbesserungen gegenüber GPT-6 Sol. Bei DeepSWE 1.1, einem Benchmark für komplexe Softwareentwicklungsaufgaben, lag GPT-6.1 Sol um 6,4 Prozentpunkte vor dem Vorgängermodell und näherte sich GPT-6 Astra an.
Auch bei mehrstufigen Geschäftsprozessen schneidet das neue Modell besser ab. Im AutomationBench lag GPT-6.1 Sol auf mittlerer Reasoning-Stufe 4,8 Prozentpunkte über GPT-6 Sol und zugleich vor Opus 5.5, bei niedrigeren Kosten pro Aufgabe.
Computernutzung und Wissenschaft profitieren ebenfalls
Bei OSWorld 2.0, das längere Arbeitsabläufe am Computer misst, erreichte GPT-6.1 Sol mit maximalem Reasoning ein Ergebnis nur 2,1 Prozentpunkte unter Astra. Die Kosten pro Aufgabe lagen laut OpenAI dabei bei rund einem Siebtel.
Auch bei wissenschaftlichen Aufgaben legte das Modell deutlich zu. Im Terminal-Bench Science 0.1 kostete GPT-6.1 Sol bei maximalem Reasoning im Durchschnitt 5,47 Dollar pro Aufgabe, während Astra auf 23,80 Dollar kam. GPT-6 Astra blieb dort mit 68,1 Prozent dennoch das leistungsstärkste getestete Modell.
Sachliche Fehlerquote nähert sich Astra an
OpenAI meldet zudem Fortschritte bei der faktischen Zuverlässigkeit. Bei besonders schwierigen Prompts lag die Quote von Antworten mit mindestens einem sachlichen Fehler bei 4,1 Prozent. GPT-6 Sol kam auf 4,5 Prozent, GPT-6 Astra auf 4,0 Prozent.
Auch in Alignment-Tests soll GPT-6.1 Sol besser abschneiden. Das Modell weist laut OpenAI häufiger auf defekte Tools hin, hält Vorgaben zuverlässiger ein und vermeidet unautorisierte Aktionen öfter als GPT-6 Sol.
GPT-6.1 Astra wird nicht veröffentlicht
Bemerkenswert ist zugleich, dass OpenAI GPT-6.1 Astra entgegen früheren Erwartungen nicht veröffentlicht. Berichten zufolge war das Modell in internen Sicherheitstests durch problematisches Verhalten aufgefallen, darunter stärkeres täuschendes Verhalten und eine Tendenz, Aufgaben ohne ausreichende Zustimmung fortzusetzen.
GPT-6 Astra bleibt damit vorerst das leistungsfähigste verfügbare Frontier-Modell von OpenAI. GPT-6.1 Sol soll vor allem das Verhältnis aus Leistung, Geschwindigkeit und Kosten verbessern.




