
OpenAI stellt GPT-6.1 Sol vor
OpenAI hat GPT-6.1 Sol vorgestellt – ein aktualisiertes Modell der GPT-6-Familie, das auf die Ausführung komplexer professioneller Aufgaben ausgerichtet ist. Das Modell nähert sich in seinen Fähigkeiten dem Flaggschiff GPT-6 Astra an, kostet jedoch API fünfmal weniger.
Die Möglichkeiten von GPT-6.1 Sol
GPT-6.1 Sol ist ein bemerkenswertes Update von GPT-6 Sol in den Bereichen Programmierung, Dokumentenbearbeitung, Computersteuerung und der Ausführung mehrstufiger Geschäftsaufgaben. OpenAI positioniert Astra dabei als leistungsfähigeres Modell für die komplexesten Szenarien.
Auch die faktische Genauigkeit wurde verbessert. Im OpenAI-Test bei komplexen Anfragen mit niedrigem Schlussfolgerungsniveau sank der Anteil der Antworten mit mindestens einem faktischen Fehler von 11,4 % bei GPT-6 Sol auf 7,7 % bei GPT-6.1 Sol, was einer Verringerung um etwa 32 % entspricht. Das Unternehmen weist darauf hin, dass für den Test gezielt Anfragen verwendet wurden, die Fehler provozieren können, weshalb diese Werte nicht die Häufigkeit von Halluzinationen bei der normalen Nutzung widerspiegeln.
OpenAI berichtet zudem, dass GPT-6.1 Sol explizit festgelegte Einschränkungen besser einhält, in Agentenszenarien seltener unzulässige Aktionen ausführt und den Nutzer präziser über Probleme mit den verwendeten Werkzeugen informiert.
Testergebnisse
In DeepSWE v1.1, das die Arbeit von KI-Agenten mit realen Codebasen überprüft, erzielte GPT-6.1 Sol ein Ergebnis auf dem Niveau von GPT-6 Astra bei etwa einem Fünftel der Kosten für die Aufgabenausführung. Im Vergleich zum besten Ergebnis von GPT-6 Sol betrug der Vorsprung 6,4 Prozentpunkte bei geringeren Kosten und einem niedrigeren Schlussfolgerungsniveau.
| Test | Das Ergebnis von GPT-6.1 Sol | Vergleich |
|---|---|---|
| DeepSWE v1.1 | Auf dem Niveau von GPT-6 Astra | Etwa 5-mal günstiger |
| AutomationBench 1.0.6 | Um 2,2 Prozentpunkte höher als Claude Opus 5.5 | Etwa dreimal so günstig |
| GDP.pdf | Über Claude Opus 5.5 | Weniger als die Hälfte des Preises |
| OSWorld 2.0 | Um 2,1 Prozentpunkte unter GPT-6 Astra | Etwa 7-mal günstiger |
In AutomationBench 1.0.6 übertraf das Modell bei mittlerem Schlussfolgerungsniveau Claude Opus 5.5 um 2,2 Prozentpunkte bei etwa dreifach geringeren Ausführungskosten. Von GPT-6 Sol setzte sich die neue Version bei gleichen Einstellungen um 4,8 Prozentpunkte ab.
In GDP.pdf, bei dem Modelle Fragen zu komplexen professionellen PDF-Dokumenten mit Tabellen, Diagrammen und feinen Details beantworten, übertraf GPT-6.1 Sol das Modell Claude Opus 5.5 mit Fallback-Mechanismus bei weniger als der Hälfte der Ausführungskosten. Auch an GPT-6 Astra reichte das Modell heran, wobei es etwa fünfmal kostengünstiger arbeitete.
Auch die Computersteuerung wurde verbessert. Im Offline-Set von OSWorld 2.0 übertraf GPT-6.1 Sol bei maximaler Schlussfolgerungsebene GPT-6 Sol um 7 Prozentpunkte und lag 2,1 Prozentpunkte hinter GPT-6 Astra, bei etwa siebenmal geringeren Kosten für die Aufgabenausführung.
Dabei behält Astra in den komplexesten Szenarien die Oberhand. So erzielte das Modell im Terminal-Bench Science 0,1 mit 68,1 % das beste Ergebnis unter den getesteten Modellen.
Ultraschnell
Zusammen mit den neuen Tools stellte OpenAI den Premium-Modus Ultrafast für eine beschleunigte Token-Ausgabe vor. Er ist derzeit für GPT-6 Astra verfügbar und ermöglicht je nach Szenario eine bis zu achtfache Beschleunigung in Codex und eine bis zu sechsfache Beschleunigung über API.
Die Unterstützung für GPT-6.1 Sol in Ultrafast ist noch nicht aktiv. OpenAI verspricht, diese in den kommenden Tagen hinzuzufügen. Für Sol gibt das Unternehmen eine bis zu achtmal schnellere Generierung im Vergleich zum Standardmodus in Codex an.
Verfügbarkeit und Preise
GPT-6.1 Sol steht Entwicklern ab sofort über OpenAI API unter der Bezeichnung gpt-6.1-sol zur Verfügung. Nutzer der Abonnements Plus, Pro, Business, Enterprise und Edu haben Zugriff auf das Modell in ChatGPT Work und Codex erhalten. Im regulären Chat-Modus ist das Modell derzeit noch nicht verfügbar.
GitHub hat zudem mit der schrittweisen Einführung von GPT-6.1 Sol in Copilot für Abonnenten von Pro+, Max, Business und Enterprise begonnen. Das Modell kann in Visual Studio Code, Visual Studio, Copilot CLI, dem GitHub Copilot Coding Agent, der Copilot-App, auf github.com, in der mobilen GitHub-App, JetBrains IDE, Xcode und Eclipse verwendet werden.
Die Standardtarife von OpenAI API lauten:
- 1 Million Eingabetokens – $2;
- 1 Million zwischengespeicherte Eingabetokens – $0,10;
- 1 Million Ausgabetoken – $10.
Somit sind die regulären Eingabe- und Ausgabetoken von GPT-6.1 Sol fünfmal günstiger als bei GPT-6 Astra, und zwischengespeicherte Eingabedaten sind 50 % günstiger als bei GPT-6 Sol.











