
OpenAI présente le modèle GPT-6.1 Sol
OpenAI a présenté GPT-6.1 Sol, une version mise à jour de la famille GPT-6, conçue pour l’exécution de tâches professionnelles complexes. La capacité de ce modèle se rapproche de celle du produit phare GPT-6 Astra, mais il coûte 5 fois moins cher via API.
Les capacités de GPT-6.1 Sol
GPT-6.1 Sol constitue une mise à jour notable de GPT-6 Sol en matière de programmation, de traitement de documents, de contrôle informatique et d’exécution de tâches professionnelles complexes. Parallèlement, OpenAI présente Astra comme un modèle plus performant pour les scénarios les plus exigeants.
La précision factuelle a également été améliorée. Dans le test d’OpenAI sur des requêtes complexes avec un faible niveau de raisonnement, la part des réponses contenant au moins une erreur factuelle est passée de 11,4 % pour GPT-6 Sol à 7,7 % pour GPT-6.1 Sol, soit une baisse d’environ 32 %. L’entreprise prévient que des requêtes spécifiquement conçues pour provoquer des erreurs ont été utilisées pour le test, et que ces chiffres ne reflètent donc pas la fréquence des hallucinations lors d’une utilisation courante.
OpenAI indique également que GPT-6.1 Sol respecte mieux les restrictions explicitement définies, effectue moins souvent des actions non autorisées dans les scénarios d’agents et informe plus précisément l’utilisateur des problèmes liés aux outils utilisés.
Résultats des tests
Dans DeepSWE v1.1, qui évalue les performances des agents IA sur des bases de code réelles, GPT-6.1 Sol a atteint un résultat équivalent à celui de GPT-6 Astra pour environ un cinquième du coût d’exécution de la tâche. Par rapport au meilleur résultat de GPT-6, Sol a obtenu un avantage de 6,4 points de pourcentage avec des coûts moindres et un niveau de raisonnement inférieur.
| Test | Résultat de GPT-6.1 Sol | Comparaison |
|---|---|---|
| DeepSWE v1.1 | Au niveau de GPT-6 Astra | Environ 5 fois moins cher |
| AutomationBench 1.0.6 | 2,2 points de pourcentage au-dessus de Claude Opus 5.5 | Environ trois fois moins cher |
| GDP.pdf | Au-dessus de Claude Opus 5.5 | Moins de la moitié du prix |
| OSWorld 2.0 | 2,1 points de pourcentage en dessous de GPT-6 Astra | Environ 7 fois moins cher |
Dans AutomationBench 1.0.6, le modèle a surpassé Claude Opus 5.5 de 2,2 points de pourcentage au niveau de raisonnement intermédiaire, pour un coût d’exécution environ trois fois moindre. Par rapport à GPT-6 Sol, la nouvelle version a creusé l’écart de 4,8 points de pourcentage avec les mêmes paramètres.
Dans GDP.pdf, où les modèles répondent à des questions sur des documents PDF professionnels complexes contenant des tableaux, des graphiques et des détails précis, GPT-6.1 Sol a surpassé Claude Opus 5.5 avec un mécanisme de repli pour moins de la moitié du coût d’exécution de la tâche. Le modèle s’est également rapproché de GPT-6 Astra, tout en coûtant environ cinq fois moins cher.
Le contrôle de l’ordinateur a également été amélioré. Dans la suite hors ligne OSWorld 2.0, avec le niveau de raisonnement maximal, GPT-6.1 Sol a surpassé GPT-6 Sol de 7 points de pourcentage, tout en restant à 2,1 points de pourcentage derrière GPT-6 Astra, pour un coût d’exécution de tâche environ sept fois inférieur.
Astra conserve toutefois l’avantage dans les scénarios les plus complexes. Par exemple, dans Terminal-Bench Science 0.1, elle a obtenu un résultat de 68,1 %, le meilleur parmi les modèles testés.
Ultra-rapide
Parallèlement à ses nouveaux outils, OpenAI a présenté le mode premium Ultrafast pour une génération accélérée de jetons. Il est désormais disponible pour GPT-6 Astra et permet d’atteindre une accélération jusqu’à huit fois supérieure dans Codex et jusqu’à six fois via API, selon le scénario.
La prise en charge de GPT-6.1 Sol dans Ultrafast n’est pas encore lancée. OpenAI promet de l’ajouter dans les prochains jours. Pour Sol, l’entreprise annonce une accélération de la génération jusqu’à huit fois supérieure par rapport au mode standard de Codex.
Disponibilité et prix
GPT-6.1 Sol est déjà disponible pour les développeurs via OpenAI API sous le nom gpt-6.1-sol. Les utilisateurs des abonnements Plus, Pro, Business, Enterprise et Edu ont obtenu l’accès au modèle dans ChatGPT Work et Codex. Le modèle n’est pas encore disponible en mode Chat classique.
GitHub a également commencé le déploiement progressif de GPT-6.1 Sol dans Copilot pour les abonnés Pro+, Max, Business et Enterprise. Le modèle peut être utilisé dans Visual Studio Code, Visual Studio, Copilot CLI, l’agent de codage GitHub Copilot, l’application Copilot, sur github.com, dans l’application mobile GitHub, JetBrains IDE, Xcode et Eclipse.
Les tarifs standard d’OpenAI API sont les suivants :
- 1 million de jetons d’entrée – $2 ;
- 1 million de jetons d’entrée en cache – $0,10 ;
- 1 million de jetons de sortie – $10.
Ainsi, les jetons d’entrée et de sortie standard de GPT-6.1 Sol coûtent cinq fois moins cher que ceux de GPT-6 Astra, et les données d’entrée en cache sont 50 % moins chères que celles de GPT-6 Sol.











