GPT-6 Sol et Claude Opus 5.5 disponiblesGPT-6 Sol à moitié prix par rapport à 5.6 Sol
Blogue
Guide

GPT-6.1 Sol : avis

Décidez selon le résultat et le coût total.

10 minutes de lectureOmniaKey
GPT-6.1 SolGPT-6 AstraProgrammationPrix APIAnalyse de modèles

Si vous utilisez GPT-6 Sol pour du développement complexe et des révisions fréquentes, GPT-6.1 Sol mérite un essai comparatif en priorité. Les tarifs standard d'entrée et de sortie restent identiques, la lecture du cache coûte deux fois moins cher et plusieurs évaluations publiées par OpenAI progressent. Gardez Astra dans la comparaison lorsque l'investigation est difficile ou qu'une correction coûte cher.

Le prix du token ne dit pas combien coûte un travail terminé. Le graphique de programmation d'OpenAI montre même un cas où le nouveau Sol obtient un bien meilleur score tout en coûtant un peu plus par tâche que l'ancien. Cette nuance est plus utile qu'une promesse générale de remplacer Astra pour un cinquième du coût.

Sources vérifiées le 30 septembre 2026, UTC. Cette analyse repose sur la documentation officielle et des résultats attribués à leur auteur. Nous n'avons pas mené de comparaison indépendante des modèles. Les calculs utilisent des quantités hypothétiques de tokens. OmniaKey publie cet article et fournit une passerelle API ; ses tarifs sont distincts de ceux de l'API directe d'OpenAI.

Ce qui change avec GPT-6.1 Sol

Le journal de l'API situe la sortie au 29 septembre 2026. L'identifiant exact est gpt-6.1-sol. Le modèle vise la programmation complexe, l'utilisation de l'ordinateur et le travail professionnel à un coût inférieur à celui d'Astra.

CaractéristiqueGPT-6.1 Sol
Fenêtre de contexte1 050 000 tokens
Sortie maximale128 000 tokens
Entrée / sortie nativesTexte et images / texte
Effort de raisonnement APIlow, medium (par défaut), high, xhigh, max
API pour les outilsResponses

Les fiches de Sol 6.1, de l'ancien Sol et d'Astra indiquent les mêmes capacités de contexte et de sortie. La fenêtre ne s'agrandit pas. Sortie et raisonnement occupent aussi du contexte ; une capacité égale ne garantit pas une récupération d'information aussi précise. Le modèle ne prend pas en charge l'audio ou la vidéo en natif.

Programmation : comparer le même effort

Le graphique interactif DeepSWE v1.1 de l'annonce OpenAI évalue des tâches complexes sur de vraies bases de code. Les trois lignes ci-dessous utilisent medium. Le coût est celui mesuré par l'éditeur du benchmark, et non une facture OmniaKey ou l'un de nos exemples théoriques.

Modèle en mediumScore DeepSWE v1.1Coût moyen par tâche
GPT-6.1 Sol73,0 %0,42 USD
GPT-6 Sol56,6 %0,38 USD
GPT-6 Astra72,8 %3,08 USD

Dans cette évaluation, Sol 6.1 approche le score d'Astra pour beaucoup moins cher. L'écart de 0,2 point ne prouve aucune supériorité générale ni différence statistiquement significative. Par rapport à l'ancien Sol, le coût par tâche monte de 0,38 à 0,42 USD malgré des tarifs standard inchangés. La consommation compte autant que la grille tarifaire.

Augmenter le raisonnement n'améliore pas systématiquement le résultat : Sol 6.1 atteint 75,2 % en high, pour 0,65 USD, contre 71,9 % en max, pour 1,57 USD. Les 6,4 points de progression annoncés comparent le nouveau Sol en high au meilleur score de l'ancien, 68,8 % en max. Il ne s'agit pas de l'écart entre les deux modèles en medium.

Sur AutomationBench 1.0.6, le résultat en medium progresse de 4,8 points par rapport à l'ancien Sol. Sur l'ensemble hors ligne v2026.08.08 d'OSWorld 2.0, la récompense partielle en max gagne 7 points et reste 2,1 points derrière Astra au même effort. Une récompense partielle n'est pas un taux universel d'achèvement des tâches sur ordinateur.

L'annonce anglaise indique aussi que, sur des conversations difficiles choisies à dessein, la part des réponses comportant au moins une erreur factuelle passe de 11,4 % à 7,7 % en low. Ce n'est pas le taux d'erreur de l'usage courant. Dans le comparatif Terminal-Bench Science 0.1 du même éditeur, Astra conserve le meilleur score : 68,1 % en max. Cela justifie de tester Sol 6.1, sans supprimer Astra de tous les usages.

Prix API : où se trouve l'économie ?

Voici les tarifs officiels de l'API directe OpenAI, mode Standard, en USD par million de tokens, jusqu'à 272K tokens d'entrée. Abonnements, passerelles, outils et taxes se comptent séparément.

CatégorieGPT-6.1 SolGPT-6 SolGPT-6 Astra
Entrée hors cache2,00 USD2,00 USD10,00 USD
Lecture du cache0,10 USD0,20 USD1,00 USD
Écriture du cache2,50 USD2,50 USD12,50 USD
Sortie10,00 USD10,00 USD50,00 USD

Par rapport à l'ancien Sol, seule la lecture baisse parmi ces quatre postes. Face à Astra, les entrées et sorties standard coûtent un cinquième, les lectures un dixième. Ces rapports ne donnent pas directement le coût d'une tâche complète.

Quatre calculs reproductibles

K représente 1 000 tokens. La sortie comprend le raisonnement facturé. Les quantités sont identiques pour les trois modèles, ce qui n'est pas garanti en situation réelle. Seule la ligne de lecture suppose un cache valide ; son écriture antérieure est facturée à part. Outils, infrastructure, taxes et frais de passerelle sont exclus.

Charge hypothétiqueGPT-6.1 SolGPT-6 SolGPT-6 Astra
100K d'entrée hors cache + 10K de sortie0,30 USD0,30 USD1,50 USD
Écriture initiale de 200K + entrée hors cache de 20K + sortie de 10K0,64 USD0,64 USD3,20 USD
Lecture de 200K + entrée hors cache de 20K + sortie de 10K0,16 USD0,18 USD0,90 USD
Entrée hors cache de 300K + sortie de 10K, tarif contexte long1,35 USD1,35 USD6,75 USD

La lecture avec Sol 6.1 donne, en notation de code : 0.20 × $0.10 + 0.02 × $2 + 0.01 × $10 = $0.16. L'ancien Sol coûte 0,18 USD. Une lecture 50 % moins chère ne réduit ici la requête complète que de 11,1 %. Une écriture initiale suivie de dix lectures identiques valides coûte 2,24 contre 2,44 USD, soit environ 8,2 % d'économie. Le préfixe doit rester disponible et chaque lecture doit toucher le cache.

Le guide du cache précise que l'écriture n'est pas un supplément à ajouter au tarif d'entrée normal. Répartissez les tokens entre entrée hors cache, lecture et écriture sans les compter deux fois.

Au-delà de 272K, toute la requête change de tarif

Lorsque l'entrée dépasse 272K tokens, les tarifs d'entrée et de cache doublent et celui de sortie est multiplié par 1,5 pour l'ensemble de la requête. Les tokens lus en cache comptent dans cette longueur. D'où le calcul de Sol 6.1 pour 300K : 0.30 × $4 + 0.01 × $15 = $1.35.

Les tokens de raisonnement sont facturés en sortie. Fast coûte deux fois Standard ; Batch et Flex en coûtent la moitié. Le multiplicateur de prix ne mesure pas la vitesse de réalisation. Consignez les tentatives supplémentaires et l'attente des outils.

Trois vérifications avant la migration

Le guide GPT-6 décrit les différences susceptibles de casser une requête existante.

  1. Raisonnement : l'ancien Sol accepte none, mais Sol 6.1 n'accepte ni none ni minimal. Choisissez un réglage pris en charge, puis mesurez à nouveau consommation et latence. Le réglage par défaut de l'API est medium ; celui du client peut différer.
  2. Outils : l'ancien Sol accepte les appels de fonctions via Chat Completions uniquement avec reasoning_effort: "none". Le nouveau Sol exige Responses pour les outils. Chat Completions reste disponible sans outils.
  3. Échantillonnage : retirez les paramètres incompatibles comme temperature et top_p avec le raisonnement activé. Vérifiez ceux que le SDK ou la passerelle ajoute automatiquement.

La commande documentée pour Codex CLI est :

bash
codex --model gpt-6.1-sol

Dans une session interactive, utilisez /model. Il s'agit d'une procédure documentée, pas d'un appel avec un compte que nous aurions testé pour cet article.

Où peut-on l'utiliser ?

Le guide des modèles Codex inclut au lancement les environnements Work et Codex concernés des offres Plus, Pro, Business, Enterprise et Edu. Enterprise et Edu exigent l'activation par un administrateur ; Free et Go sont exclus du lancement. Dans ChatGPT, le modèle arrive dans Work et Codex, pas dans le Chat ordinaire à cette date. Vérifiez les modes de vitesse dans votre compte, client et espace de travail.

L'usage des abonnements et crédits est distinct de la facturation API. Les crédits Codex n'ont pas de frais séparés d'écriture du cache. Nos calculs API ne donnent donc pas un nombre garanti de tâches incluses dans un abonnement.

Faut-il en faire son modèle par défaut ?

Pour les utilisateurs de l'ancien Sol, les tarifs standard inchangés et les meilleurs résultats publiés justifient un essai contrôlé. Depuis Astra, commencez par les tâches fréquentes dont la qualité se vérifie facilement. Gardez une alternative si les échecs et les corrections humaines pèsent davantage que les tokens.

Un pilote raisonnable comprend six tâches : deux bugs reproductibles, deux modifications sur plusieurs fichiers et deux questions documentaires exigeant des preuves. Répétez chaque tâche trois fois par modèle avec un environnement neuf et les mêmes entrées, outils, permissions et limites de nouvelle tentative. Commencez à medium explicite ; les réglages optimisés feront l'objet d'un autre compte rendu. Ce protocole est proposé, pas exécuté ici.

Consignez acceptation, omissions, durée totale, tokens facturés, échecs et corrections humaines. Divisez le coût de toutes les tentatives par les résultats acceptés ; s'il n'y en a aucun, indiquez-le. Un si petit pilote ne permet pas de conclure à un taux de réussite universel.

Pour le contexte historique, consultez l'analyse de l'ancien GPT-6 Sol et le comparatif précédent avec Astra. Le catalogue des modèles affiche les routes et prix actuels d'OmniaKey. Une sortie officielle ne prouve pas l'accès via une passerelle particulière. Les documents OpenAI cités sont en anglais.