
OpenAI ha presentato il modello GPT-6.1 Sol
OpenAI ha presentato GPT-6.1 Sol, un modello aggiornato della famiglia GPT-6, orientato all’esecuzione di complesse attività professionali. Il modello si avvicina per capacità al flagship GPT-6 Astra, ma costa 5 volte meno tramite API.
Funzionalità di GPT-6.1 Sol
GPT-6.1 Sol rappresenta un aggiornamento significativo di GPT-6 Sol nella programmazione, nella gestione dei documenti, nel controllo del computer e nell’esecuzione di attività aziendali complesse. Allo stesso tempo, OpenAI posiziona Astra come un modello più performante per gli scenari più complessi.
Anche l’accuratezza fattuale è migliorata. Nel test di OpenAI su richieste complesse con un basso livello di ragionamento, la percentuale di risposte con almeno un errore fattuale è scesa dall’11,4% di GPT-6 Sol al 7,7% di GPT-6.1 Sol, ovvero circa il 32% in meno. L’azienda avverte che per il test sono state utilizzate appositamente richieste in grado di provocare errori, pertanto questi dati non riflettono la frequenza delle allucinazioni durante l’uso normale.
OpenAI riferisce inoltre che GPT-6.1 Sol rispetta meglio i vincoli esplicitamente definiti, esegue meno azioni non autorizzate negli scenari basati su agenti e informa l’utente in modo più preciso sui problemi relativi agli strumenti utilizzati.
Risultati nei test
In DeepSWE v1.1, che valuta le prestazioni degli agenti IA con basi di codice reali, GPT-6.1 Sol ha ottenuto risultati paragonabili a GPT-6 Astra a circa un quinto del costo di esecuzione del compito. Rispetto al miglior risultato di GPT-6, Sol ha registrato un vantaggio di 6,4 punti percentuali con costi inferiori e un livello di ragionamento più basso.
| Test | Risultato di GPT-6.1 Sol | Confronto |
|---|---|---|
| DeepSWE v1.1 | Al livello di GPT-6 Astra | Circa 5 volte più economico |
| AutomationBench 1.0.6 | Di 2,2 p.p. superiore a Claude Opus 5.5 | Circa tre volte più economico |
| GDP.pdf | Superiore a Claude Opus 5.5 | Meno della metà del costo |
| OSWorld 2.0 | Di 2,1 p.p. inferiore a GPT-6 Astra | Circa 7 volte più economico |
In AutomationBench 1.0.6, il modello di ragionamento di livello medio ha superato Claude Opus 5.5 di 2,2 punti percentuali, con un costo di esecuzione del compito circa tre volte inferiore. Rispetto a GPT-6 Sol, con le stesse impostazioni, la nuova versione ha ottenuto un vantaggio di 4,8 punti percentuali.
Nel GDP.pdf, dove i modelli rispondono a domande su complessi documenti PDF professionali contenenti tabelle, grafici e dettagli minuti, GPT-6.1 Sol ha superato Claude Opus 5.5 con meccanismo di fallback a meno della metà del costo di esecuzione dell’attività. Il modello si è avvicinato anche a GPT-6 Astra, risultando circa cinque volte più economico.
Anche la gestione del computer è migliorata. Nel set offline di OSWorld 2.0, al massimo livello di ragionamento, GPT-6.1 Sol ha superato GPT-6 Sol di 7 punti percentuali, mentre ha registrato un ritardo di 2,1 punti percentuali rispetto a GPT-6 Astra, con un costo di esecuzione del compito circa sette volte inferiore.
Allo stesso tempo, Astra mantiene un vantaggio negli scenari più complessi. Ad esempio, nel Terminal-Bench Science 0,1 ha ottenuto il miglior risultato tra i modelli testati, pari al 68,1%.
Ultraveloce
Insieme ai nuovi strumenti, OpenAI ha presentato la modalità premium Ultrafast per un output accelerato dei token. Attualmente è disponibile per GPT-6 Astra e garantisce un’accelerazione fino a otto volte superiore in Codex e fino a sei volte tramite API, a seconda dello scenario.
Il supporto per GPT-6.1 Sol in Ultrafast non è ancora attivo. OpenAI promette di aggiungerlo nei prossimi giorni. Per Sol, l’azienda dichiara un’accelerazione della generazione fino a otto volte superiore rispetto alla modalità standard di Codex.
Disponibilità e prezzi
GPT-6.1 Sol è già disponibile per gli sviluppatori tramite OpenAI API con il nome gpt-6.1-sol. Gli utenti degli abbonamenti Plus, Pro, Business, Enterprise ed Edu hanno ottenuto l’accesso al modello in ChatGPT Work e Codex. Nella modalità Chat standard, il modello non è ancora disponibile.
GitHub ha inoltre avviato il rilascio graduale di GPT-6.1 Sol in Copilot per gli abbonati Pro+, Max, Business ed Enterprise. Il modello può essere utilizzato in Visual Studio Code, Visual Studio, Copilot CLI, nell’agente di programmazione GitHub Copilot, nell’app Copilot, su github.com, nell’app mobile di GitHub, JetBrains IDE, Xcode ed Eclipse.
Le tariffe standard di OpenAI API sono:
- 1 milione di token di input – $2;
- 1 milione di token di input memorizzati nella cache – $0,10;
- 1 milione di token in uscita – $10.
Di conseguenza, i token di input e output standard di GPT-6.1 Sol costano cinque volte meno rispetto a quelli di GPT-6 Astra, mentre i dati di input memorizzati nella cache costano il 50% in meno rispetto a GPT-6 Sol.











