elginux.Décrire mon besoin

Article · 28 septembre 2026 · 6 min de lecture

Arrêtez de payer le modèle le plus cher pour trier vos courriels

OpenAI divise par deux les tarifs Sol et Luna, et Claude Opus 5.5 baisse son prix d'usage. La bonne question pour une entreprise : quelle tâche mérite encore le modèle le plus cher ?

Laurent Jachimiakfondateur d'Elginux

Réponse courte : les prix d'usage baissent, mais la bonne décision reste la même : ne pas envoyer toutes les tâches au modèle le plus cher. Un tri de courriels peut passer sur un modèle économique ; une analyse juridique, financière ou un chantier de code complexe peut justifier le modèle haut de gamme.

Ce qui est annoncé

Le 22 septembre 2026, OpenAI a annoncé une baisse de 50 % des tarifs d'accès par programme, l'API, pour les modèles GPT-6 Sol et GPT-6 Luna, par rapport aux tarifs promotionnels de GPT-5.6. Une API est le moyen technique par lequel un logiciel utilise un modèle à la consommation.

Les prix publiés par OpenAI sont les suivants, pour un million de jetons :

ModèleEntrée avantEntrée aprèsSortie avantSortie après
GPT-6 Sol4,00 $2,00 $20,00 $10,00 $
GPT-6 Luna0,20 $0,10 $1,20 $0,50 $

Un jeton est une petite unité de texte. Ce vocabulaire compte pour une entreprise : c'est l'unité utilisée pour facturer les automatisations.

Le même jour, OpenAI a aussi détaillé l'amélioration du cache : lorsque le même contexte est réutilisé dans la fenêtre de 30 minutes, la lecture des données déjà envoyées peut coûter jusqu'à 90 % moins cher. Cela concerne surtout des agents qui travaillent sur un même dossier en plusieurs étapes.

Chez Anthropic, Claude Opus 5.5 est annoncé à 4,00 $ l'entrée et 20,00 $ la sortie par million de jetons, soit 20 % de moins qu'Opus 5. La lecture en cache passe à 0,20 $, soit 60 % de moins. Anthropic indique aussi un coût total inférieur de 40 % sur ses cas d'usage types, parce que le modèle produit moins de jetons pour arriver au résultat. Les modèles Sonnet 5.5 et Haiku 5.5 sont annoncés pour les semaines suivantes, sans date ferme.

Pour qui c'est disponible

Ces tarifs concernent d'abord des usages intégrés : un logiciel interne, un outil métier, un agent ou une automatisation qui appelle le modèle. Ils ne changent pas automatiquement le prix d'un abonnement ChatGPT ou Claude.

Pour une TPE, la distinction est donc simple : si vos équipes utilisent une interface incluse dans un abonnement, la facture ne bouge pas parce que le tarif API baisse. Si un outil consomme le modèle à l'usage, l'effet peut être immédiat.

Ce que cela change pour une TPE ou une PME

La baisse des prix ne supprime pas la question du bon choix. Elle la rend même plus importante, parce qu'un flux mal conçu peut consommer beaucoup plus de volume. Une répartition simple aide à éviter de payer le haut de gamme pour une tâche simple :

TâcheModèle à privilégierPourquoi
Trier, classer, extraire des champsVersion économiqueVolume élevé, résultat facile à vérifier
Rédiger un courriel ou une relanceVersion économique ou intermédiaireTravail répétitif avec modèle de départ
Analyser un contrat ou un litigeVersion haut de gammeErreur coûteuse, contexte long, arbitrages
Audit ou migration de codeVersion haut de gammeChantier complexe, forte valeur du résultat

Le cache utile concerne surtout les agents : si les mêmes instructions, documents ou définitions d'outils sont renvoyés plusieurs fois, leur réutilisation peut coûter moins cher à condition de rester dans la fenêtre annoncée.

Ce qu'Elginux a vérifié

Elginux a relu les trois pages officielles le 28 septembre 2026 : l'annonce OpenAI Sol et Luna, la page OpenAI sur le cache GPT-6 et la page Anthropic Claude Opus 5.5. Les tarifs, la fenêtre de 30 minutes, la réduction maximale de cache et le retard de Sonnet et Haiku viennent de ces pages primaires.

Elginux n'a pas réalisé de banc d'essai entre ces modèles sur des données clients, ni mesuré l'effet des baisses sur une facture réelle. Les comparaisons de performance publiées par les fournisseurs ne remplacent pas un test sur vos propres tâches.

Ce qui reste à tester

Restent à comparer sur des cas français : la qualité des réponses en langue française, la stabilité des extractions de documents, le coût réel après cache et la différence entre un modèle économique et un modèle haut de gamme sur des dossiers délicats.

Suite utile

Si vous avez déjà un outil ou un agent qui consomme des modèles IA, listez d'abord trois tâches : une répétitive, une à risque moyen et une à erreur coûteuse. Pour examiner cette répartition et le coût réel, vous pouvez échanger avec notre équipe via notre offre Automation IA.

Sources et méthode

Sources primaires relues le 28 septembre 2026 : OpenAI, Introducing GPT-6 Sol and Luna, publiée le 22 septembre 2026 ; OpenAI, Better prompt caching for GPT-6, publiée le 22 septembre 2026 ; Anthropic, Introducing Claude Opus 5.5, publiée le 22 septembre 2026. Qualification : tarifs et disponibilité vérifiés à la source ; aucun test de performance réalisé par Elginux.

Questions fréquentes

Une baisse de tarif API change-t-elle le prix de mon abonnement ChatGPT ou Claude ?

Non. Un tarif API concerne un logiciel qui appelle le modèle à la consommation. Le prix d'un abonnement grand public ou professionnel peut rester identique.

Qu'est-ce qu'un jeton ?

Un jeton est une petite unité de texte : un mot peut en contenir un ou plusieurs. Les tarifs affichés concernent un million de jetons, soit un volume de texte bien plus important qu'un simple document.

Faut-il tout passer sur le modèle le moins cher ?

Non. Le modèle adapté dépend de la tâche : un tri simple peut utiliser un modèle économique, tandis qu'une analyse complexe ou un travail de code exigeant peut justifier un modèle plus cher.

Sources et méthode

  1. Introducing GPT-6 Sol and Luna — OpenAI · publié le 2026-09-22 · vérifié le 2026-09-28 · source primaire
    https://openai.com/index/introducing-gpt-6-sol-and-luna
  2. Better prompt caching for GPT-6 — OpenAI · publié le 2026-09-22 · vérifié le 2026-09-28 · source primaire
    https://openai.com/index/better-prompt-caching-for-gpt-6
  3. Introducing Claude Opus 5.5 — Anthropic · publié le 2026-09-22 · vérifié le 2026-09-28 · source primaire
    https://anthropic.com/claude-opus-5-5