Trois semaines après avoir placé GPT-6 Astra au sommet de sa gamme, le 3 septembre, OpenAI a sorti le 22 septembre 2026 les deux modèles qui lui servent d'étage intermédiaire et d'entrée de gamme, GPT-6 Sol et GPT-6 Luna, à des tarifs divisés par deux par rapport aux prix promotionnels de GPT-5.6. Le même jour, Anthropic a remplacé Claude Opus 5, sorti le 24 juillet, par Claude Opus 5.5, présenté comme 40 % moins cher sur des charges typiques, aux réglages par défaut. Deux baisses annoncées le même jour, sur les modèles qui font tourner la majorité des agents en production.

L'enjeu dépasse le prix affiché du million de jetons. Un agent qui lit du code, appelle des outils et relit son propre contexte consomme des jetons d'entrée, des jetons relus en cache, des écritures de cache et des jetons de sortie, à quatre tarifs différents. Le « 50 % » d'OpenAI et le « 40 % » d'Anthropic ne mesurent pas la même chose.

Pour les départager, ActuIA a appliqué les grilles publiées à une session d'agent type et refait le calcul avant et après, à l'intérieur de chaque gamme. Ce que la simulation mesure, et ce qu'elle ne mesure pas Le scénario retenu est identique pour les six modèles comparés : un million de jetons d'entrée cumulés sur plusieurs requêtes, dont 70 % relus en cache, et 100 000 jetons de sortie facturés. Chaque requête reste sous le seuil de contexte long.

Le calcul utilise le tarif standard et exclut les écritures de cache ainsi que les frais d'outils et d'hébergement. Il isole l'effet des prix sur un volume donné. Cette lecture vaut entre deux générations d'un même éditeur, où le volume de jetons est une hypothèse raisonnable.

Elle ne vaut pas entre éditeurs. GPT-6 Sol et Claude Opus 5.5 ne consomment pas le même nombre de jetons pour accomplir la même tâche, ne la réussissent pas au même taux et n'appellent pas les mêmes outils. Anthropic revendique d'ailleurs qu'Opus 5.5 consomme moins de jetons par tâche que son prédécesseur ; une grille tarifaire ne permet pas de vérifier ce gain.

Les montants de 1,74 et 3,34 dollars qui suivent sont donc des points de comparaison reproductibles, pas le coût d'une tâche réussie. Les tarifs de l'API, revérifiés le 25 septembre Sur la grille d'OpenAI, GPT-6 Sol est facturé 2 dollars le million de jetons d'entrée et 10 dollars en sortie, GPT-6 Luna 0,10 et 0,50 dollar. Les lectures de cache tombent à 0,20 dollar pour Sol et 0,01 pour Luna, la remise de 90 % mise en avant par l'éditeur.

Ces prix s'appliquent jusqu'à 272 000 jetons d'entrée par requête ; au-delà, Sol passe à 4 dollars en entrée, 0,40 dollar en lecture de cache et 15 dollars en sortie, sur l'ensemble de la requête. GPT-6 Astra, qu'OpenAI présente toujours comme son meilleur modèle, reste affiché 10 et 50 dollars ; ActuIA revenait sur ses quinze premiers jours. Chez Anthropic, la page de tarifs affiche Claude Opus 5.5 à 4 et 20 dollars, avec des lectures de cache à 0,20 dollar et des écritures à 5 dollars pour une durée de conservation de cinq minutes.

Un mode rapide, annoncé jusqu'à 2,5 fois plus véloce, coûte le double : 8 et 40 dollars. Claude Opus 5 figure désormais dans la rubrique « legacy », à 5 et 25 dollars. La documentation d'OpenAI liste encore gpt-5.6-sol à 4 et 20 dollars, en précisant que ce tarif promotionnel reste garanti jusqu'au 21 novembre 2026 au minimum.

Le « 50 % » et le « 40 % » ne se calculent pas de la même façon OpenAI précise sur quoi porte sa baisse : les prix d'API de Sol et Luna reculent de 50 % par rapport au tarif promotionnel de GPT-5.6, toujours proposé au moment de la vérification. Sur Sol, entrée, entrée en cache, écritures de cache et sortie baissent exactement de moitié, y compris au-delà du seuil de contexte. À volumes et mode de traitement identiques, le coût des jetons est divisé par deux.

Sur Luna, la sortie fait même mieux, de 1,20 à 0,50 dollar, soit 58 % de moins. Le « 40 % » d'Anthropic mesure autre chose. Anthropic chiffre à 20 % l'écart de prix de liste entre Opus 5.5 et Opus 5, et à 60 % celui des lectures de cache, qui représentent, selon l'éditeur, la majorité du coût des usages agentiques et de programmation.

L'effet tarifaire dépend donc du profil de la charge : 20 % d'économie sans cache, jusqu'à 60 % sur une charge presque entièrement servie par le cache. Le reste du « 40 % » repose sur la réduction du nombre de jetons consommés par tâche, revendiquée par l'éditeur. Une session d'agent, avant et après, dans chaque gamme ModèleCoût des jetons du scénarioÉcart avec la génération précédenteGPT-5.6 Sol3,48 $RéférenceGPT-6 Sol1,74 $−50 %GPT-5.6 Luna0,194 $RéférenceGPT-6 Luna0,087 $−55 %Claude Opus 54,35 $RéférenceClaude Opus 5.53,34 $−23 % La formule additionne trois postes : 0,3 million de jetons d'entrée au tarif normal, 0,7 million au tarif de lecture du cache et 0,1 million en sortie.

Chez Anthropic, le gain monte à 37 % avec un profil plus dépendant du cache : cinq millions de jetons relus, 200 000 jetons neufs et 100 000 en sortie. Atteindre les 40 % annoncés demanderait environ 22 % de jetons en moins sur le premier scénario, à répartition égale, et environ 5 % sur le second. La constitution du cache a aussi un coût.

Si les 300 000 jetons d'entrée neufs du premier scénario sont tous facturés au tarif d'écriture affiché (cache de cinq minutes chez Anthropic), la simulation monte à 1,89 dollar sur Sol et à 3,64 dollars sur Opus 5.5. Le taux de réutilisation doit donc être lu avec les écritures et renouvellements qui l'ont rendu possible. Le contexte pèse davantage : si toutes les requêtes du scénario relèvent du tarif long, Sol atteint 2,98 dollars, soit 71 % de plus.

La sortie représente à elle seule 57 % de la facture de référence sur Sol et 60 % sur Opus 5.5. Passer de zéro à 70 % d'entrée relue en cache réduit néanmoins le coût simulé de Sol de 42 %, hors écritures. OpenAI indique avoir amélioré le taux de réutilisation du cache de GPT-6 et cite GitHub, qui rapporte une baisse de plus de moitié de la part de jetons de prompt à retraiter sur plusieurs mois.

Entre éditeurs, les seuls repères sont les coûts par tâche, et ils ne sont pas comparables Pour comparer Sol et Opus 5.5 entre eux, il faut des mesures de réussite, de latence et de reprises sur les tâches visées, pas des grilles. Les deux éditeurs en publient, chacun sur son terrain. OpenAI donne GPT-6 Sol à 33,2 % sur AutomationBench 1.0.6, à effort xhigh, pour 0,27 dollar par tâche, contre 26,9 % pour Claude Opus 5 à effort maximal et un coût 11,1 fois plus élevé.

Anthropic crédite Opus 5.5 de 54,6 % sur FrontierCode v1.1 à son effort par défaut, contre 53,3 % pour le meilleur score de GPT-6 Astra, pour environ un cinquième du coût par tâche. Ces deux comparaisons ne se recoupent pas : OpenAI compare Sol à Opus 5, pas à Opus 5.5 ; Anthropic compare Opus 5.5 à Astra, pas à Sol. Chacune dépend du protocole, des outils et des réglages retenus par l'éditeur qui la publie.

Aucune ne mesure l'écart entre Sol et Opus 5.5 sur une même application. Le supplément européen La résidence des données en Europe modifie le calcul. La documentation d'OpenAI majore de 10 % les points d'accès de traitement régional, dans les conditions d'éligibilité prévues, pour les modèles éligibles sortis à partir du 5 mars 2026 : la session type passe de 1,74 à 1,91 dollar sur Sol.

Plus lourd, pour Sol et Luna la résidence européenne n'est disponible qu'en traitement Standard, ce qui ferme l'accès aux 50 % de remise du mode Batch, au mode Flex et au mode rapide. Sur Bedrock, Claude Opus 5.5 est accessible dès le 22 septembre par les profils d'inférence inter-régions États-Unis, Union européenne, Australie, Japon et Global, avec, selon AWS, une absence de rétention des données par défaut. Pour GPT-6 Sol et Luna, en disponibilité générale le même jour, le régime diffère : le trafic signalé par les classificateurs anti-abus est conservé jusqu'à trente jours par AWS, et le client doit demander le zéro-rétention à son équipe de compte AWS.

AWS ne précise dans son billet ni tarif ni régions pour ces deux modèles ; c'est la documentation d'OpenAI qui indique que, dans les régions commerciales, la facturation Bedrock s'aligne sur ses propres prix. Deux mouvements de nature différente GPT-6 Astra et Claude Fable 5.1 restent affichés à 10 et 50 dollars le million de jetons en entrée et en sortie. La comparaison s'arrête là.

OpenAI garde Astra au sommet de sa gamme et baisse l'étage en dessous ; Anthropic met à 4 et 20 dollars celui qu'il présente comme le meilleur de la sienne. En contexte court, GPT-6 Sol et Claude Sonnet 5 partagent désormais les quatre mêmes prix : 2 dollars en entrée, 0,20 en cache, 2,50 en écriture de cache et 10 en sortie. Un éditeur qui refacture l'usage à prix fixe améliore sa marge si la migration réduit son coût total à qualité égale, tentatives supplémentaires, outils, écritures de cache et contraintes de résidence compris.

La seule mesure qui tranche entre Sol et Opus 5.5 est celle que les éditeurs ne publient pas : les traces de consommation d'une même application sur les deux modèles. ST Stephane Nachez Rédaction ActuIA — actualités, données et analyses sur l'intelligence artificielle pour les décideurs.