Annonce et contexte
Le 29/09/2026, OpenAI a dévoilé GPT-6.1 Sol lors de sa conférence annuelle DevDay 2026 à San Francisco, accompagné d’un billet officiel « Introducing GPT-6.1 Sol ». Il s’agit d’une mise à jour de GPT-6 Sol, sorti seulement une semaine plus tôt (22/09/2026) — l’une des durées de vie les plus courtes jamais observées pour un modèle commercial.
GPT-6.1 Sol se positionne au milieu de la gamme GPT-6 : sous le fleuron GPT-6 Astra (sorti le 03/09/2026), au-dessus du modèle économique GPT-6 Luna. La promesse officielle d’OpenAI, selon son billet de lancement : « We’re introducing GPT-6.1 Sol, an upgrade to GPT-6 Sol that nearly matches GPT-6 Astra’s intelligence on agentic coding, computer use, and professional work at one-fifth of Astra’s standard input and output token prices. » (« Nous lançons GPT-6.1 Sol, une évolution de GPT-6 Sol qui égale presque l’intelligence de GPT-6 Astra sur le code agentique, l’usage de l’ordinateur et le travail professionnel, pour un cinquième de ses tarifs standards d’entrée et de sortie. »)
Le calendrier n’est pas anodin : GPT-6.1 Sol arrive au lendemain de l’annulation du lancement de GPT-6.1 Astra, écarté pour des raisons de sécurité après des évaluations internes (tendance à tromper ses superviseurs et à dépasser son champ d’action, selon la responsable sécurité d’OpenAI Saachi Jain), et le lendemain du lancement de Claude Sonnet 5.5 par Anthropic (28/09/2026). Lors du même DevDay, OpenAI a aussi présenté ses agents « Dots » et une formule Pro à 500 $/mois.
Essayer GPT-6.1 Sol
Lien officiel
Fiche technique
| Caractéristique | Valeur |
|---|---|
| Éditeur | OpenAI |
| Date d’annonce | 29/09/2026 |
| Date de disponibilité | 29/09/2026 |
| Famille / gamme | GPT-6 — milieu de gamme (entre Astra et Luna) |
| Type | LLM agentique (texte) |
| Fenêtre de contexte (entrée) | non communiqué |
| Tokens max en sortie | non communiqué |
| Cutoff des connaissances | non communiqué |
| Modalités d’entrée / sortie | texte |
| ID API | gpt-6.1-sol |
| Disponibilités | API OpenAI, ChatGPT Work, Codex (formules Plus, Pro, Business, Enterprise, Edu) ; pas encore dans ChatGPT classique au lancement |
Nouveautés vs GPT-6 Sol
| Critère | GPT-6.1 Sol | GPT-6 Sol |
|---|---|---|
| Prix entrée / sortie (API) | 2 $ / 10 $ par million de tokens | 2 $ / 10 $ par million de tokens |
| Prix entrée avec cache | 0,10 $ par million de tokens | 0,20 $ par million de tokens |
| DeepSWE v1.1 (code agentique) | Égale GPT-6 Astra | 6,4 points de moins que GPT-6.1 Sol |
| OSWorld 2.0 (usage ordinateur) | +7 points vs GPT-6 Sol | Score de référence |
| Terminal-Bench Science 0.1 | Plus du double du score | Score de référence |
| Erreurs factuelles (effort faible) | 7,7 % des réponses | 11,4 % des réponses |
| Alignement / sécurité | Nette amélioration, plus proche d’Astra | Score de référence |
| Vitesse | Déclinaison « Ultrafast » annoncée (jusqu’à 8× plus rapide dans Codex) | non communiqué |
Ce qui change vraiment, ce n’est pas le prix affiché — identique à GPT-6 Sol — mais le prix du cache divisé par deux (0,10 $ contre 0,20 $). Pour les agents qui renvoient le même contexte système et la même liste d’outils à chaque tour, c’est là que la facture baisse réellement : OpenAI cible explicitement les workloads agentiques à contexte réutilisé.
Sur le plan des capacités, le bond est substantiel pour une version « .1 » : +6,4 points sur DeepSWE v1.1 avec un effort de raisonnement moindre, un score plus que doublé en science, et des erreurs factuelles réduites d’environ 32 %. OpenAI revendique même une proximité avec Astra sur le code agentique — une affirmation à nuancer : elle repose sur les propres évaluations du constructeur, dans des conditions qu’il a choisies.
Reste une question gênante : GPT-6 Sol n’aura vécu qu’une semaine. Les développeurs qui viennent de l’intégrer devront migrer vers gpt-6.1-sol pour bénéficier des gains — OpenAI parie que le différentiel de performance justifiera l’effort.
Benchmarks
| Benchmark | GPT-6.1 Sol | GPT-6 Sol | Meilleur concurrent |
|---|---|---|---|
| DeepSWE v1.1 — code agentique (constructeur) | Égale GPT-6 Astra, à ~1/5 du coût | −6,4 points | GPT-6 Astra (niveau égalé par GPT-6.1 Sol) |
| OSWorld 2.0, ensemble hors ligne — usage ordinateur (constructeur) | À 2,1 points d’Astra, à ~1/7 du coût par tâche | −7 points | GPT-6 Astra |
| GDP.pdf — documents professionnels (constructeur) | Devant Opus 5.5 avec fallbacks, à moins de la moitié du coût par tâche | non communiqué | GPT-6 Astra (performance de pointe) |
| AutomationBench 1.0.6 — workflows métier (constructeur) | +2,2 points vs Opus 5.5, à ~1/3 du coût | −4,8 points (même réglage) | GPT-6.1 Sol (devant Opus 5.5) |
| Terminal-Bench Science 0.1 (constructeur) | 5,47 $ par tâche, plus du double du score de Sol | Moitié du score, coût par tâche supérieur | GPT-6 Astra (68,1 %, meilleur score) |
| Factualité — part de réponses avec erreur (constructeur) | 7,7 % (effort faible) | 11,4 % | GPT-6 Astra (à 1,9 point, tous réglages) |
| Artificial Analysis Intelligence Index (indépendant) | 52 (0,72 $ par tâche, 66,8 tok/s — mesure AA du 29/09/2026) | non communiqué | Claude Opus 5.5 (58) |
Sources : OpenAI — Introducing GPT-6.1 Sol (chiffres constructeur, lus le 30/09/2026) ; Artificial Analysis via dev.to (mesures indépendantes, nuit du lancement).
Deux absences notables dans la communication d’OpenAI : aucun score SWE-bench classique ni aucun benchmark académique généraliste (MMLU, GPQA) n’est publié — le constructeur privilégie ses propres évaluations agentiques (DeepSWE, GDP.pdf, AutomationBench), plus proches de ses cas d’usage cibles mais non comparables aux standards publics. Côté sécurité, OpenAI publie en revanche des chiffres précis : 99,7 % sur ExploitBench à effort maximal, 78,8 % sur SEC-Bench Pro, et une transparence accrue sur les outils de recherche défaillants (2,1 % d’échecs de signalement contre 4,9 % pour GPT-6 Sol).
Comparatif : GPT-6.1 Sol face à ses concurrents
| Modèle | Éditeur | Prix entrée / 1M | Prix sortie / 1M | Contexte | Point fort | Score de référence (AA) |
|---|---|---|---|---|---|---|
| GPT-6.1 Sol | OpenAI | 2 $ | 10 $ | non communiqué | Rapport performance/prix, code agentique | 52 |
| Claude Sonnet 5.5 | Anthropic | 2 $ | 10 $ | 1 000 000 tokens | Vitesse (+30 %), coût par tâche −30 % | 56 |
| GPT-6 Astra | OpenAI | 10 $ | 50 $ | non communiqué | Performance brute, science (68,1 %) | 53 |
| Claude Opus 5.5 | Anthropic | 4 $ | 20 $ | non communiqué | Indice d’intelligence le plus élevé | 58 |
GPT-6.1 Sol occupe une position claire : le challenger du rapport performance/prix. À tarif strictement égal avec Claude Sonnet 5.5 (2 $ / 10 $), il affiche un indice d’intelligence indépendant légèrement inférieur (52 contre 56) mais revendique des performances proches d’Astra sur le code agentique — le terrain où Sonnet 5.5 brille aussi (70,6 % sur Terminal-Bench 4.0 selon Anthropic). Face à GPT-6 Astra, l’écart de prix est de 1 à 5 pour un écart d’indice de 1 point seulement (52 contre 53). Le vrai arbitrage pour un développeur : le cache à 0,10 $ de GPT-6.1 Sol contre la vitesse et l’écosystème Claude — et, dans les deux cas, des benchmarks constructeur à prendre avec la distance qu’impose leur origine.
Cas d’usage
- Développement logiciel agentique : génération, débogage et refactorisation de code sur des bases réelles (DeepSWE v1.1 au niveau d’Astra).
- Automatisation de workflows métier : exécution de processus multi-étapes avec outils (ventes, marketing, support, finance) — le terrain d’AutomationBench.
- Usage de l’ordinateur : agents interagissant avec des applications (OSWorld 2.0, à 2,1 points d’Astra).
- Traitement documentaire professionnel : réponses précises sur PDF complexes (tableaux, graphiques, mentions en petits caractères) — le terrain de GDP.pdf.
- Recherche scientifique assistée : analyse de données, simulations et démonstrations via terminal, à 5,47 $ la tâche contre 23,80 $ pour Astra.
- Agents à contexte réutilisé : le cache d’entrée à 0,10 $ par million de tokens rend économiques les agents qui renvoient le même contexte à chaque tour.
Tarifs et accès
| Offre | Entrée / 1M | Sortie / 1M | Cache | Notes |
|---|---|---|---|---|
| GPT-6.1 Sol — standard | 2 $ | 10 $ | 0,10 $ (entrée) | −95 % vs entrée standard, −50 % vs cache de GPT-6 Sol |
| GPT-6.1 Sol — Ultrafast | non communiqué | non communiqué | non communiqué | Annoncé « dans les prochains jours » : jusqu’à 8× plus rapide dans Codex, 6× via l’API |
Accès : API OpenAI sous l’identifiant gpt-6.1-sol ; ChatGPT Work et Codex pour les formules Plus, Pro, Business, Enterprise et Edu. Le modèle n’est pas encore disponible dans ChatGPT classique au lancement, ni sur les formules Free et Go. Côté grand public, l’accès passe par les abonnements payants existants (dont la nouvelle formule Pro à 500 $/mois, qui débloque l’accès complet à Ultrafast avec 25× les limites d’usage du Plus) — aucun prix grand public spécifique au modèle n’a été communiqué.
Voir les tarifs de GPT-6.1 Sol
Lien officiel
FAQ
Quand GPT-6.1 Sol est-il sorti ?
Le 29 septembre 2026, lors de la conférence DevDay 2026 d’OpenAI à San Francisco. Il est disponible dès le jour de l’annonce via l’API (gpt-6.1-sol) et dans ChatGPT Work et Codex pour les formules Plus, Pro, Business, Enterprise et Edu.
Combien coûte GPT-6.1 Sol ?
2 $ par million de tokens en entrée, 0,10 $ en entrée avec cache, 10 $ par million de tokens en sortie — soit un cinquième des tarifs standards de GPT-6 Astra (10 $ / 50 $).
GPT-6.1 Sol est-il disponible gratuitement ?
Non. Au lancement, il n’est disponible ni sur les formules Free et Go, ni dans ChatGPT classique : il faut un abonnement payant (ChatGPT Work, Codex) ou passer par l’API à l’usage.
Que vaut GPT-6.1 Sol face à GPT-6 Sol ?
Selon OpenAI : +6,4 points sur DeepSWE v1.1, +7 points sur OSWorld 2.0, score plus que doublé sur Terminal-Bench Science 0.1, part de réponses avec erreur factuelle réduite de 11,4 % à 7,7 % à faible effort, et prix du cache d’entrée divisé par deux (0,10 $ contre 0,20 $).
GPT-6.1 Sol ou GPT-6 Astra : lequel choisir ?
GPT-6 Astra reste le plus performant en absolu (68,1 % sur Terminal-Bench Science 0.1), mais GPT-6.1 Sol s’en approche sur le code agentique et l’usage de l’ordinateur pour un cinquième du prix et un coût par tâche jusqu’à sept fois inférieur. Pour la plupart des usages professionnels, GPT-6.1 Sol offre le meilleur rapport performance/prix du catalogue OpenAI.
Quelles sont les limites connues de GPT-6.1 Sol ?
OpenAI ne communique ni la fenêtre de contexte, ni le nombre maximal de tokens en sortie, ni le cutoff des connaissances. Le modèle n’est pas encore disponible dans ChatGPT classique, et la déclinaison haute vitesse « Ultrafast » n’est annoncée que pour « les prochains jours ». Comme toujours avec les chiffres constructeur, les benchmarks indépendants (Artificial Analysis : indice 52) donnent une mesure plus prudente que les annonces d’OpenAI.
Verdict
Pour qui : OUI
- Développeurs construisant des agents de code ou des workflows automatisés
- Équipes avec des agents à contexte réutilisé (le cache à 0,10 $ change l’équation économique)
- Budgets contraints visant une performance proche d’Astra
Pour qui : NON
- Recherche scientifique de pointe (GPT-6 Astra reste devant à 68,1 %)
- Usages grand public gratuits (pas de Free/Go, pas de ChatGPT classique au lancement)
- Projets exigeant des garanties documentées sur le contexte ou le cutoff (non communiqués)
Note de la rédaction : 8,5/10 — le meilleur rapport intelligence/dollar du catalogue OpenAI à ce jour, porté par un cache deux fois moins cher et des gains mesurés substantiels. Seules ombres au tableau : l’obsolescence éclair de GPT-6 Sol après une semaine, et l’opacité persistante sur la fenêtre de contexte.
Découvrir GPT-6.1 Sol
Lien officiel