OpenAI heeft GPT-6.1 Sol gepresenteerd, een bijgewerkt model uit de GPT-6-familie dat is gericht op het uitvoeren van complexe professionele taken. Het model benadert de mogelijkheden van het vlaggenschip GPT-6 Astra, maar is API 5 keer goedkoper.

Mogelijkheden van GPT-6.1 Sol

GPT-6.1 Sol is een opvallende update van GPT-6 Sol op het gebied van programmeren, werken met documenten, computerbeheer en het uitvoeren van zakelijke taken in meerdere stappen. Tegelijkertijd positioneert OpenAI Astra als een krachtiger model voor de meest complexe scenario’s.

Ook de feitelijke nauwkeurigheid is verbeterd. In de test van OpenAI met complexe verzoeken bij een laag redeneerniveau daalde het aandeel antwoorden met ten minste één feitelijke fout van 11,4% bij GPT-6 Sol naar 7,7% bij GPT-6.1 Sol, een afname van ongeveer 32%. Het bedrijf waarschuwt dat voor de test specifiek verzoeken werden gebruikt die fouten kunnen uitlokken, waardoor deze cijfers niet de frequentie van hallucinaties bij normaal gebruik weerspiegelen.

OpenAI meldt ook dat GPT-6.1 Sol zich beter houdt aan expliciet opgelegde beperkingen, minder vaak ongeoorloofde acties uitvoert in agentscenario’s en de gebruiker nauwkeuriger informeert over problemen met de gebruikte tools.

Testresultaten

In DeepSWE v1.1, dat de prestaties van AI-agents met echte codebases test, behaalde GPT-6.1 Sol een resultaat op het niveau van GPT-6 Astra tegen ongeveer een vijfde van de kosten voor het uitvoeren van de taak. Vergeleken met het beste resultaat van GPT-6 Sol bedroeg het voordeel 6,4 procentpunt bij lagere kosten en een lager redeneerniveau.

TestResultaat van GPT-6.1 SolVergelijking
DeepSWE v1.1Op het niveau van GPT-6 AstraOngeveer 5 keer goedkoper
AutomationBench 1.0.62,2 procentpunt hoger dan Claude Opus 5.5Ongeveer drie keer zo goedkoop
GDP.pdfBoven Claude Opus 5.5Minder dan de helft van de prijs
OSWorld 2.02,1 procentpunt lager dan GPT-6 AstraOngeveer 7 keer goedkoper

In AutomationBench 1.0.6 presteerde het model op het gemiddelde redeneerniveau 2,2 procentpunt beter dan Claude Opus 5.5, bij ongeveer een derde van de kosten per taak. Ten opzichte van GPT-6 Sol liep de nieuwe versie met dezelfde instellingen 4,8 procentpunt uit.

In GDP.pdf, waar modellen vragen beantwoorden over complexe professionele PDF-documenten met tabellen, diagrammen en kleine details, overtrof GPT-6.1 Sol de Claude Opus 5.5 met fallback-mechanisme tegen minder dan de helft van de kosten voor het uitvoeren van de taak. Het model kwam ook dicht in de buurt van GPT-6 Astra, terwijl het ongeveer vijf keer goedkoper was.

Ook de computerbesturing is verbeterd. In de offline-set van OSWorld 2.0 presteerde GPT-6.1 Sol bij het maximale redeneerniveau 7 procentpunt beter dan GPT-6 Sol, en bleef het 2,1 procentpunt achter bij GPT-6 Astra, terwijl de kosten per taak ongeveer zeven keer lager waren.

Daarbij behoudt Astra het voordeel in de meest complexe scenario’s. In Terminal-Bench Science 0.1 behaalde het bijvoorbeeld het beste resultaat van 68,1% onder de geteste modellen.

Ultrasnel

Samen met de nieuwe tools introduceerde OpenAI de premiummodus Ultrafast voor versnelde token-output. Deze is nu beschikbaar voor GPT-6 Astra en zorgt voor een tot acht keer hogere snelheid in Codex en tot zes keer sneller via API, afhankelijk van het scenario.

Ondersteuning voor GPT-6.1 Sol in Ultrafast is nog niet geactiveerd. OpenAI belooft deze in de komende dagen toe te voegen. Voor Sol claimt het bedrijf een versnelling van de generatie tot acht keer in vergelijking met de standaardmodus in Codex.

Beschikbaarheid en prijzen

GPT-6.1 Sol is nu beschikbaar voor ontwikkelaars via OpenAI API onder de naam gpt-6.1-sol. Gebruikers met een Plus-, Pro-, Business-, Enterprise- en Edu-abonnement hebben toegang gekregen tot het model in ChatGPT Work en Codex. In de normale Chat-modus is het model nog niet beschikbaar.

GitHub is ook begonnen met de gefaseerde uitrol van GPT-6.1 Sol in Copilot voor Pro+-, Max-, Business- en Enterprise-abonnees. Het model kan worden gebruikt in Visual Studio Code, Visual Studio, Copilot CLI, de GitHub Copilot coding agent, de Copilot-app, op github.com, in de mobiele GitHub-app, JetBrains IDE, Xcode en Eclipse.

De standaardtarieven van OpenAI API zijn:

  • 1 miljoen inputtokens – $2;
  • 1 miljoen gecachte inputtokens – $0,10;
  • 1 miljoen output-tokens – $10.

Zo zijn de standaard input- en outputtokens van GPT-6.1 Sol vijf keer goedkoper dan die van GPT-6 Astra, en zijn gecachte invoergegevens 50% goedkoper dan bij GPT-6 Sol.

Volg MobiDevices
Telegram