OpenAI divise par cinq le coût de son IA la plus abordable tout en multipliant par neuf sa vitesse. Une révolution pour les entreprises qui veulent automatiser sans se ruiner.
OPEN AI RÉINVENTE SES MODÈLES POUR LES ENTREPRISES
En améliorant chaque couche de ses modèles d'intelligence artificielle, OpenAI permet désormais aux entreprises d’obtenir des performances bien supérieures pour chaque dollar investi. Hier, l’entreprise expliquait comment le GPT-5.6 avait optimisé son propre fonctionnement pour gagner en efficacité. Aujourd’hui, ces économies sont répercutées sur les clients avec des tarifs réduits pour les versions Luna et Terra, ainsi qu’un mode Fast plus rapide pour le GPT-5.6 Sol dans l’API. Ces mises à jour permettent aux entreprises d’en faire plus avec leur budget IA et d’agir plus vite quand chaque seconde compte.
DES BAISSES DE PRIX RECORD POUR LES ENTREPRISES
LE MODÈLE LUNa : L’INTELLIGENCE À PORTÉE DE TOUS
Rendre l’intelligence avancée plus accessible et abordable fait partie de la mission d’OpenAI pour que l’AGI (Intelligence Générale Artificielle) profite à toute l’humanité. Ces changements traduisent cette promesse en actes concrets. Ils reflètent des années d’améliorations dans la façon dont les modèles sont conçus, déployés et utilisés.
Le GPT-5.6 Terra, lui, est parfait pour les tâches quotidiennes comme les questions sur un espace de travail ou les missions où la rapidité compte. Dans les évaluations internes, il a montré une qualité comparable au GPT-5.5, mais à moitié prix par tâche et en 60 % de temps en moins.
UNE NOUVELLE ÈRE POUR LES AGENTS IA
« Nous cherchons à maximiser le résultat par dollar dans tout ce que nous faisons, et la série GPT-5.6 représente une avancée majeure dans ce sens. Terra et Luna sont les modèles les plus efficaces en coût sur nos benchmarks internes de codage, et Luna est désormais notre modèle par défaut pour les automatisations d’agents en arrière-plan. »
« Le GPT-5.6 Luna marque le plus grand changement dans le comportement des agents depuis le déploiement du GPT-4o mini. Luna est passé d’un simple appel structuré à une boucle complète d’Outils et d’agents, augmentant la réutilisation du cache des requêtes de 24 % à 90 %. Sur des milliers d’appels en production, Luna gère 2,2 fois plus de contexte avec 8,5 fois moins de tokens de sortie, tout en coûtant 87 % moins cher que le GPT-5.4 mini. »
« Le GPT-5.6 Luna est un excellent partenaire pour les modèles plus grands : il prend en charge la majeure partie du travail routinier tout en trouvant le juste équilibre entre coût et intelligence. Nous l’avons intégré à Devin Fusion pour offrir des économies significatives aux utilisateurs sans compromettre la qualité. »
« Depuis que nous avons adopté le GPT-5.6 Luna, nous avons vu des améliorations opérationnelles notables. Pour les mêmes tâches d’agents, le GPT-5.6 Luna est 40 % plus rapide et 40 % moins cher que notre modèle par défaut précédent, ce qui donne une expérience plus fluide aux utilisateurs. Il offre un excellent équilibre entre qualité, vitesse et efficacité. »
DES MODÈLES QUI S’ADAPTENT À TOUS LES BESOINS
Pour Replit, Notion, Ramp, Blitzy, Cognition et Dust, l’objectif est clair : faire correspondre l’intelligence au résultat attendu. Utiliser l’IA efficacement commence par définir le bon équilibre entre intelligence, vitesse, fiabilité et coût. Cet équilibre peut varier d’une étape à l’autre d’un même processus.
Le GPT-5.6 donne aux entreprises beaucoup plus de liberté pour optimiser cette équation. Le Luna offre des performances comparables à celles des modèles de pointe d’il y a un an, pour environ 6 centimes par tâche, et presque neuf fois plus vite. Pour les travaux professionnels, comme le montre le test Agents’ Last Exam, Luna dépasse Fable 5 avec un coût par tâche inférieur de près de 99 %.
En pratique, les entreprises peuvent définir le résultat et la qualité qu’elles attendent, puis utiliser des évaluations pour déterminer où une intelligence supplémentaire améliore réellement le résultat, et où un traitement plus rapide et moins coûteux peut donner la même qualité. Un flux de travail de codage pourrait, par exemple, utiliser le Sol pour résoudre les incertitudes et définir le plan, puis le Luna pour implémenter les changements bien spécifiés, écrire et exécuter des tests, et évaluer les résultats. Un autre flux pourrait nécessiter un équilibre différent.
La famille GPT-5.6 élargit donc la gamme de ces choix. Les entreprises peuvent appliquer l’intelligence maximale utile à chaque étape tout en payant le juste prix pour la valeur créée.
L’EFFICACITÉ, CLÉ DE LA RÉVOLUTION
Pour y parvenir, OpenAI a optimisé chaque couche derrière les modèles : les modèles eux-mêmes, les systèmes d’inférence qui les exécutent, et l’infrastructure agentique qui les connecte aux outils et au contexte. Les modèles GPT-5.6 empruntent un chemin plus direct pour accomplir leur travail. Une meilleure gestion des ressources maintient le matériel productif, un logiciel de production optimisé génère des tokens plus efficacement, et une gestion plus intelligente du contexte aide les agents à éviter de répéter un travail déjà fait. Ensemble, ces améliorations permettent d’accomplir plus de travail utile avec les mêmes ressources, réduisant ainsi le temps, les tokens et les coûts nécessaires pour chaque résultat.
Le GPT-5.6 Sol aide de plus en plus à trouver et à appliquer les prochains gains. Dans un processus mené par des humains, Sol a réécrit et optimisé de manière autonome les noyaux de production, conçu et exécuté des centaines d’expériences pour améliorer la génération de tokens, et surveillé l’entraînement en intervenant quand des problèmes survenaient. Les travaux sur les noyaux ont permis de réduire le coût global de service du modèle de 20 %, tandis que ses expériences ont augmenté l’efficacité de la génération de tokens de plus de 15 %. Ces améliorations créent une boucle de rétroaction plus serrée : plus les modèles deviennent autonomes et performants, plus notre capacité à améliorer leur efficacité s’accélère.
L’IA ABONDANTE : PLUS DE CALCUL, MAIS PLUS PRODUCTIF
Répondre à la demande croissante en intelligence artificielle abordable nécessite à la fois plus de calcul et un calcul plus productif. OpenAI construit un portefeuille d’infrastructures résilientes et associe chaque charge de travail aux systèmes les mieux adaptés pour l’exécuter. Cette approche soutient les deux extrémités de la courbe prix-performance. À l’extrémité économique, les nouveaux prix du Luna et du Terra rendent les travaux à haut volume économiques à une échelle bien plus grande. À l’extrémité de pointe, le mode Fast donne aux clients de l’API un accès plus rapide au Sol quand le temps de réponse est crucial.
Les entreprises peuvent ainsi intégrer davantage d’IA dans leurs opérations quotidiennes sans sacrifier la rapidité sur leurs travaux les plus importants. L’analyse de documents à grande échelle, la classification des interactions clients et la mise en œuvre de routines deviennent économiques à grande échelle, tandis que les charges de travail complexes du Sol peuvent être exécutées plus rapidement quand le surcoût est justifié.
Les gains peuvent s’accumuler. Dans un processus mené par des humains, des modèles plus performants aident nos équipes techniques à trouver la prochaine génération d’améliorations, raccourcissant le chemin vers de meilleures performances et des coûts réduits. La stratégie d’OpenAI reste axée sur l’avancement des capacités et de l’efficacité, afin que chaque génération d’intelligence puisse accomplir plus de travail à moindre coût.
TARIFS ET DISPONIBILITÉ : CE QUI CHANGE POUR LES UTILISATEURS
Les modèles GPT-5.6 Terra et Luna restent disponibles dans ChatGPT Work, Codex et l’API OpenAI. Dans ChatGPT Work et Codex, les utilisateurs Free et Go peuvent accéder au Terra, tandis que les abonnés Plus, Pro, Business et Enterprise peuvent choisir entre le Terra et le Luna.
À partir du 30 juillet, les tarifs de l’API seront de 2 dollars par million de tokens en entrée et 12 dollars par million de tokens en sortie pour le Terra, et de 0,20 dollar par million de tokens en entrée et 1,20 dollar par million de tokens en sortie pour le Luna. Les tarifs du Sol restent inchangés. Les prix des abonnements ChatGPT et Codex ainsi que les budgets de quota ne changent pas, mais l’utilisation du Terra et du Luna consomme désormais moins de crédits. Les changements de tarifs commenceront à être déployés sur AWS aujourd’hui même.
Le mode Fast pour le GPT-5.6 Sol remplace le traitement prioritaire dans l’API et s’aligne avec la commande /fast dans Codex. Les requêtes API existantes marquées comme prioritaires continueront de fonctionner. Consultez les détails complets des tarifs de l’API.
UNE RÉVOLUTION QUI BÉNÉFICIE À TOUS
Ces avancées montrent comment l’optimisation technique peut transformer l’accès à l’IA. En rendant les modèles plus efficaces, OpenAI permet aux entreprises de toutes tailles de profiter de technologies autrefois réservées aux géants du numérique. Que ce soit pour automatiser des tâches répétitives, analyser des montagnes de données ou développer des agents intelligents, le GPT-5.6 ouvre des possibilités inédites.
Pour les développeurs, ces baisses de prix signifient la possibilité de tester davantage de solutions sans se soucier du budget. Pour les entreprises, c’est l’opportunité de déployer l’IA à plus grande échelle, en réduisant les coûts tout en maintenant un niveau de performance élevé. Et pour les utilisateurs finaux, c’est une expérience plus fluide et réactive, où l’IA répond plus vite et plus précisément à leurs besoins.
ET DEMAIN ?
OpenAI ne compte pas s’arrêter là. Les améliorations continues des modèles et des infrastructures promettent des gains encore plus importants à l’avenir. Chaque nouvelle version pourrait offrir des performances supérieures à un coût encore plus bas, rendant l’IA encore plus indispensable dans notre quotidien et nos processus professionnels.
Une chose est sûre : avec des modèles comme le GPT-5.6, l’intelligence artificielle n’a jamais été aussi accessible. Et cette tendance ne fera que s’accélérer.
EN BREF : CE QU’IL FAUT RETENIR
Le GPT-5.6 marque un tournant avec des baisses de prix historiques pour les entreprises :
- Le Luna coûte 80 % moins cher, tout en offrant des performances comparables aux modèles de pointe d’il y a un an.
- Le Terra voit son prix baisser de 20 %, idéal pour les tâches quotidiennes.
- Le mode Fast accélère le Sol de 2,5 fois par rapport au traitement standard, sans perte d’intelligence.
- Ces changements permettent aux entreprises d’automatiser à grande échelle sans exploser leur budget.
- Les gains d’efficacité se renforcent grâce à une boucle de rétroaction entre modèles plus performants et infrastructures optimisées.
- OpenAI News
L'indépendance de CLODCO est votre garantie.
Pour que l'actualité de l'IA reste sans filtre et sans concession, votre soutien est indispensable. Votre contribution est le seul moteur de notre liberté éditoriale.
Soutenir CLODCO


