Le 29 septembre, OpenAI a lancé GPT-6.1 Sol avec une promesse en une phrase : une intelligence proche d’Astra pour le cinquième du prix. Pour une équipe marketing ou une agence qui sollicite un modèle de langage d’IA toute la journée, pour des briefs, des scénarios, de la recherche et des flux automatisés, cette phrase devient une décision budgétaire. Reste à savoir où « proche » suffit, et où l’écart coûte encore cher.

Tout dépend de la tâche. Voici ce que disent les chiffres jusqu’ici, qui les a produits, et une règle simple pour trancher.

REC MÊME TEXTE, DEUX FACTURES GPT-6 ASTRA10 $ ENTRÉE · 50 $ SORTIEINDICE 53 GPT-6.1 SOL2 $ ENTRÉE · 10 $ SORTIEINDICE 52
Prix courants par million de jetons et résultats à l’Intelligence Index d’Artificial Analysis, à effort maximal.

Ce qu’OpenAI a lancé

GPT-6.1 Sol met à jour GPT-6 Sol, le petit frère moins coûteux de GPT-6 Astra, le modèle phare d’OpenAI. La firme d’évaluation indépendante Artificial Analysis souligne qu’il a remplacé GPT-6 Sol après sept jours à peine. OpenAI le présente comme particulièrement fort en programmation agentique, en utilisation d’ordinateur et en travail professionnel.

Dans l’API, sous le nom gpt-6.1-sol, il coûte 2 $ par million de jetons en entrée et 10 $ par million en sortie. GPT-6 Astra coûte 10 $ et 50 $. L’entrée en cache, soit le tarif réduit pour du texte que le modèle a déjà traité dans une requête répétée, revient à 0,10 $ pour Sol et à 1 $ pour Astra. Dans ChatGPT, selon TechCrunch et VentureBeat, Sol est offert sur les forfaits Plus, Pro, Business, Enterprise et Edu, dans ChatGPT Work et Codex, mais pas encore dans le clavardage standard.

Pour le reste, les deux modèles se ressemblent sur papier. Les fiches d’OpenAI indiquent pour chacun une fenêtre de contexte de 1 050 000 jetons, 128 000 jetons de sortie au maximum, des connaissances arrêtées au 30 avril 2026 et les mêmes cinq niveaux d’effort de raisonnement. Les deux facturent un supplément sur toute requête de plus de 272 000 jetons.

Le même événement a ajouté un palier de vitesse. Selon OpenAI, Ultrafast produit jusqu’à 300 jetons par seconde, jusqu’à huit fois la vitesse standard dans Codex et jusqu’à six fois dans l’API. Il n’est offert que pour Astra, dans l’API et sur les forfaits Pro 500 et Enterprise de ChatGPT. OpenAI annonce une version Sol dans les prochains jours.

Là où Sol suit, et là où Astra garde l’avance

Selon les résultats d’OpenAI, Sol fait jeu égal avec Astra sur DeepSWE v1.1, un test de génie logiciel, et termine à 2,1 points derrière sur OSWorld 2.0, qui mesure l’utilisation d’un ordinateur. Sur les questions factuelles, son taux d’erreur reste à moins de 1,9 point de celui d’Astra, peu importe le niveau de raisonnement. The Decoder rappelle le bémol : tous ces tests « viennent d’OpenAI, qui les qualifie de préliminaires ».

Artificial Analysis fournit la première vérification externe. À effort de raisonnement maximal, son Intelligence Index donne 52 à Sol et 53 à Astra. Astra conserve une avance de deux à trois points aux tests de programmation en terminal, d’automatisation d’affaires, de programmation scientifique et de questions très difficiles. Sol fait égalité sur GDP.pdf, qui porte sur de longs PDF professionnels, et passe devant en raisonnement sur long contexte, 83 % contre 81 %.

Un point d’écart à l’indice, cinq fois l’écart en coût

Résultats indépendants à effort de raisonnement maximal, et coût d’une passe complète de l’Intelligence Index

GPT-6.1 SolGPT-6 AstraIntelligence Index (0 à 100)Intelligence Index (0 à 100), GPT-6.1 Sol: 5252Intelligence Index (0 à 100), GPT-6 Astra: 5353Terminal-Bench 4.0Terminal-Bench 4.0, GPT-6.1 Sol: 56 %56 %Terminal-Bench 4.0, GPT-6 Astra: 59 %59 %AutomationBench-AAAutomationBench-AA, GPT-6.1 Sol: 65 %65 %AutomationBench-AA, GPT-6 Astra: 68 %68 %Humanity’s Last ExamHumanity’s Last Exam, GPT-6.1 Sol: 53 %53 %Humanity’s Last Exam, GPT-6 Astra: 55 %55 %GDP.pdf (longs PDF)GDP.pdf (longs PDF), GPT-6.1 Sol: 31 %31 %GDP.pdf (longs PDF), GPT-6 Astra: 31 %31 %AA-LCR (long contexte)AA-LCR (long contexte), GPT-6.1 Sol: 83 %83 %AA-LCR (long contexte), GPT-6 Astra: 81 %81 %Coût d’une passe complète (en $ US)Coût d’une passe complète (en $ US), GPT-6.1 Sol: 1 082 $1 082 $Coût d’une passe complète (en $ US), GPT-6 Astra: 5 324 $5 324 $
GPT-6.1 Sol et GPT-6 Astra aux évaluations d’Artificial Analysis, effort de raisonnement maximal
ÉvaluationGPT-6.1 SolGPT-6 Astra
Intelligence Index d’Artificial Analysis5253
Terminal-Bench 4.056 %59 %
AutomationBench-AA65 %68 %
Humanity’s Last Exam53 %55 %
GDP.pdf31 %31 %
AA-LCR (raisonnement sur long contexte)83 %81 %
Coût d’une passe complète de l’Intelligence Index1 082 $ US5 324 $ US
Source : Artificial Analysis, comparaison GPT-6.1 Sol (Max) et GPT-6 Astra (Max), consultée le 1er octobre 2026. Les résultats peuvent bouger quand les évaluations sont refaites.

Deux terrains favorisent encore nettement Astra. Sur Terminal-Bench Science, le test de recherche scientifique d’OpenAI, Astra obtient le meilleur résultat, à 68,1 %, et OpenAI écrit qu’il « devrait servir aux tâches de recherche scientifique les plus difficiles ». Le second, c’est le comportement en mode agent. Dans l’addenda de sécurité d’OpenAI, Sol a insisté malgré un avertissement dans 23,5 % des essais, contre 17,4 % pour Astra, et a présenté son travail de programmation de façon trompeuse dans 1,50 % des cas, contre 0,51 %. Ces tests sont conçus pour être durs, mais ils comptent dès qu’un modèle agit dans vos comptes.

Les calculs de coût et de vitesse

Les prix courants sont cinq fois plus élevés pour Astra, et les coûts mesurés suivent à peu près. La passe complète de l’indice d’Artificial Analysis a coûté 1 082 $ avec Sol et 5 324 $ avec Astra. OpenAI rapporte que Sol s’approche d’Astra sur OSWorld pour environ le septième du coût par tâche, et qu’il coûte 5,47 $ par tâche de Terminal-Bench Science contre 23,80 $ pour Astra, avec un résultat plus faible.

Prenons une tâche typique d’agence : une requête de 40 000 jetons qui contient les normes de marque, des notes de recherche et un brief, et une réponse de 4 000 jetons. Au prix courant, c’est 0,12 $ avec Sol et 0,60 $ avec Astra. Répétée 2 000 fois par mois pour des variantes, des versions linguistiques ou des fiches produits, la facture passe à 240 $ contre 1 200 $. Les jetons de raisonnement sont facturés comme de la sortie : les tâches qui réfléchissent longtemps coûtent plus cher sur les deux modèles. Le cache creuse l’écart : si 30 000 jetons de normes ouvrent chaque requête et sont mis en cache, cette partie coûte 0,003 $ par passage avec Sol et 0,03 $ avec Astra.

La vitesse est un budget à part. Artificial Analysis a mesuré 66 jetons de sortie par seconde pour Sol en vitesse standard et 51 pour Astra : 1 000 jetons prennent donc environ 15 et 20 secondes. Ultrafast ramène ça à quelque trois secondes, à six fois le prix standard, soit 60 $ en entrée et 300 $ en sortie par million de jetons pour Astra. La page de tarifs d’OpenAI et VentureBeat n’affichent pas le même prix de sortie pour Sol Ultrafast : attendez le tarif en vigueur avant de le budgéter.

Ce que ça change pour les équipes marketing et créatives

Scénarios, briefs et variantes de texte : c’est du travail à fort volume, où un point d’écart à un test se voit rarement dans le résultat, et où quelqu’un retouche le texte de toute façon. Sol est le choix par défaut logique, et l’économie peut financer plus de versions et plus de temps de révision.

La recherche dans de longs documents, comme des présentations, des rapports ou des dossiers d’appel d’offres, convient aussi à Sol : il a fait égalité avec Astra au test sur les PDF et l’a devancé en raisonnement sur long contexte lors des tests indépendants. Continuez de tout vérifier. Un écart de 1,9 point sur les erreurs factuelles est mince, mais il s’applique à chaque affirmation.

Les agents et l’automatisation compliquent le choix. Sol s’est approché d’Astra sur les flux d’affaires et l’utilisation d’ordinateur, pour une fraction du coût par tâche, mais les résultats de sécurité le montrent plus enclin à passer outre un avertissement. Pour un agent qui se contente de rédiger, Sol fait l’affaire. Pour un agent qui envoie des courriels, modifie un site Web ou dépense un budget publicitaire, la prudence supplémentaire d’Astra peut valoir son prix, avec une approbation humaine à chaque étape.

Règle pratique : commencez chaque tâche avec Sol. Passez à Astra quand une erreur coûterait plus cher que le modèle, par exemple pour une note stratégique, une analyse de données complexe ou un agent qui a de vrais accès. Ne payez Ultrafast que là où quelqu’un attend la réponse, comme une séance de travail en direct avec un client.

Avant de basculer

Soumettez une vingtaine de vos vraies tâches aux deux modèles, et faites noter les résultats à l’aveugle par la personne qui révise habituellement ce travail. Comparez le coût par tâche terminée, reprises comprises, plutôt que le prix par jeton. Vérifiez quel niveau de raisonnement vos outils utilisent : le coût et la qualité en dépendent tous les deux. Confirmez que le forfait ChatGPT de votre équipe donne bel et bien accès à Sol là où vous travaillez. Et datez votre décision : Sol a remplacé son prédécesseur en moins d’une semaine, alors prévoyez de refaire le test à la prochaine version.

Sources

Gabriel Brien

Gabriel Brien

Fondateur de l’Agence Crimson Spark. Réalisateur IA et technologue créatif, qui écrit à partir de ce qu’il pratique chaque jour.

En savoir plus sur Gabriel →