GPT-5.6 est disponible depuis le 9 juillet 2026 dans ChatGPT, Codex et l’API OpenAI. Rupture avec les générations précédentes : au lieu d’un modèle unique, OpenAI lance une famille de trois modèles distincts. Sol, le vaisseau amiral pour les tâches complexes, Terra, le modèle équilibré du quotidien, et Luna, le plus rapide et le moins cher. Tarifs, benchmarks, comparaison avec Claude : voici ce que les professionnels doivent retenir.
L’essentiel en bref
- GPT-5.6 est la nouvelle génération de modèles d’OpenAI, lancée en disponibilité générale le 9 juillet 2026 après une préversion limitée le 26 juin.
- La gamme comprend trois modèles : Sol (flagship, 5 $ / 30 $ par million de tokens), Terra (équilibré, 2,50 $ / 15 $) et Luna (rapide et économique, 1 $ / 6 $).
- Les trois modèles partagent une fenêtre de contexte d’environ 1 million de tokens (1 050 000), une sortie maximale de 128 000 tokens et des connaissances arrêtées au 16 février 2026.
- Sol établit un nouveau record sur les benchmarks agentiques (Terminal-Bench 2.1 à 88,8 %, indice Coding Agent à 80), mais Claude Fable 5 conserve l’avantage sur le codage de production (SWE-Bench Pro : 80 % contre 64,6 %).
- Depuis le 14 juillet 2026, GPT-5.6 est le modèle par défaut de Microsoft 365 Copilot dans Word, Excel, PowerPoint et Chat.
GPT-5.6 : trois modèles au lieu d’un seul
Avec GPT-5.6, OpenAI abandonne le principe du modèle unique avec réglages d’effort. La génération est identifiée par le numéro (5.6), tandis que les noms Sol, Terra et Luna désignent des niveaux de capacité durables, pensés pour évoluer chacun à leur propre rythme. OpenAI résume le changement ainsi : on passe d’« un modèle avec un curseur » à « trois modèles, choisissez votre niveau ».
Sol : le flagship pour les tâches critiques
Sol (identifiant API gpt-5.6-sol) est le modèle le plus puissant de la gamme. Il vise le raisonnement complexe, le travail agentique de longue durée, le code, la biologie et la cybersécurité. C’est le modèle à privilégier quand le coût d’une erreur dépasse le coût du calcul. Un mode Ultra, qui coordonne quatre agents en parallèle, est disponible dans ChatGPT Work et Codex pour les tâches les plus lourdes.
Terra : le modèle du quotidien
Terra (gpt-5.6-terra) offre selon OpenAI des performances comparables à GPT-5.5 pour environ la moitié du prix. C’est le candidat naturel pour remplacer GPT-5.5 en production : assistants, boucles d’agents, aide au code. Terra est aussi devenu le modèle par défaut des utilisateurs gratuits de ChatGPT, une montée en gamme silencieuse mais significative.
Luna : le champion du volume
Luna (gpt-5.6-luna) est le modèle le plus rapide et le moins cher. Il cible les traitements à fort volume et faible latence : classification, extraction, routage, résumés en masse. Attention toutefois : son rappel sur les textes très longs chute nettement (41,3 % sur le benchmark MRCR v2 en 8 aiguilles), ce qui le disqualifie pour l’analyse de documents volumineux.
Les tarifs de GPT-5.6 par million de tokens
La grille tarifaire est simple et l’écart entre le haut et le bas de gamme est de 5x en entrée comme en sortie :
- Sol : 5 $ en entrée / 30 $ en sortie, soit exactement le tarif de GPT-5.5 pour un modèle plus capable.
- Terra : 2,50 $ en entrée / 15 $ en sortie, la moitié du prix de Sol.
- Luna : 1 $ en entrée / 6 $ en sortie.
Le cache de prompts a également été revu : les lectures en cache bénéficient d’une remise de 90 %, les écritures sont facturées 1,25x le tarif d’entrée, avec une durée de vie minimale de 30 minutes et des points de rupture explicites. Pour les charges de travail à préfixes répétés, l’économie peut être considérable.
Benchmarks : où GPT-5.6 domine, où Claude résiste
Sur les benchmarks agentiques, Sol établit plusieurs records. Il atteint 88,8 % sur Terminal-Bench 2.1 (91,9 % en mode Ultra), 92,2 % sur BrowseComp et 80 sur l’indice Coding Agent d’Artificial Analysis, soit 2,8 points devant Claude Fable 5. Sur Agents’ Last Exam, qui évalue des workflows professionnels de longue durée dans 55 domaines, Sol en raisonnement maximal atteint 53,6 et devance Fable 5 de 13,1 points.
Le tableau n’est pas uniforme pour autant. Sur SWE-Bench Pro, le benchmark de codage en conditions réelles de production, Sol plafonne à 64,6 % quand Claude Fable 5 atteint 80 % et Claude Mythos 5 80,3 %. Fable 5 conserve aussi une courte avance sur l’indice d’intelligence générale d’Artificial Analysis (59,9 contre 58,9). Pour la correction de bugs et les pull requests dans des dépôts de production, Claude reste la référence, comme nous l’analysions dans notre article sur la course aux modèles IA en 2026.
L’argument massue d’OpenAI est ailleurs : le rapport performance/prix. Selon les chiffres publiés par OpenAI, Terra et Luna dépassent Claude Fable 5 sur Agents’ Last Exam pour environ un quart du coût estimé. Sur DeepSWE, Luna délivre environ 24 points de benchmark par dollar d’API estimé, contre 4,5 pour Claude Opus 4.8.
Les nouveautés techniques pour les développeurs
Au-delà des trois modèles, GPT-5.6 introduit plusieurs évolutions dans l’API :
- Programmatic Tool Calling : le modèle peut générer du JavaScript exécuté dans un environnement V8 isolé (sans accès réseau) pour orchestrer ses appels d’outils.
- Multi-agents en bêta : disponible avec les trois modèles dans la Responses API.
- Six niveaux d’effort de raisonnement : none, low, medium, high, xhigh et max.
- Migration simple : l’API reste compatible, il suffit de changer l’identifiant du modèle. L’alias
gpt-5.6pointe vers Sol.
Disponibilité : ChatGPT, Codex et Microsoft 365 Copilot
Dans ChatGPT, les abonnés Plus, Pro, Business et Enterprise accèdent à Sol, les offres Pro et Enterprise disposant en plus d’une option Sol Pro. Les utilisateurs gratuits et Go reçoivent Terra par défaut. Les trois modèles sont accessibles dans l’API et dans Codex, ainsi que dans ChatGPT Work, le nouvel agent de productivité lancé le 9 juillet et propulsé par GPT-5.6.
Le 14 juillet 2026, OpenAI et Microsoft ont annoncé que GPT-5.6 devenait le modèle préféré de Microsoft 365 Copilot, dans Word, Excel, PowerPoint, Chat et Cowork. Une intégration qui touche directement les professionnels au quotidien et que nous détaillerons dans notre dossier consacré à Microsoft 365 Copilot. L’annonce officielle est disponible sur le site d’OpenAI.
Quel modèle GPT-5.6 choisir selon vos usages ?
La logique de routage qui se dégage des benchmarks et des tarifs est la suivante : Luna par défaut pour les volumes importants et les tâches simples, Terra comme socle de production quotidien et comme remplaçant naturel de GPT-5.5, Sol réservé aux tâches agentiques les plus difficiles où les derniers points de performance justifient le double du prix. Le mode Ultra, environ trois fois plus cher que Sol seul pour un gain d’environ 3 points, ne se justifie que lorsqu’une tâche peut être parallélisée et que le temps gagné a une vraie valeur.
Pour les professionnels qui utilisent ChatGPT sans passer par l’API, le passage à GPT-5.6 est automatique. C’est le bon moment pour revoir votre organisation avec les Projets et les GPT personnalisés, comme expliqué dans notre guide ChatGPT pour les pros.
FAQ : vos questions sur GPT-5.6
Qu’est-ce que GPT-5.6 ?
GPT-5.6 est la famille de modèles d’IA lancée par OpenAI le 9 juillet 2026. Elle comprend trois modèles : Sol (flagship), Terra (équilibré) et Luna (rapide et économique). Tous disposent d’une fenêtre de contexte d’environ 1 million de tokens et sont accessibles via ChatGPT, Codex et l’API OpenAI.
Combien coûte GPT-5.6 ?
Par million de tokens (entrée/sortie) : Sol coûte 5 $ / 30 $, Terra 2,50 $ / 15 $ et Luna 1 $ / 6 $. Les lectures en cache bénéficient d’une remise de 90 %. Dans ChatGPT, Terra est inclus dans l’offre gratuite et Sol est réservé aux abonnements payants.
GPT-5.6 est-il meilleur que Claude ?
Cela dépend des usages. GPT-5.6 Sol domine les benchmarks agentiques (Terminal-Bench 2.1, BrowseComp, Agents’ Last Exam) avec un net avantage de coût. Claude Fable 5 reste devant sur le codage de production (SWE-Bench Pro : 80 % contre 64,6 % pour Sol) et sur l’indice d’intelligence générale d’Artificial Analysis.
GPT-5.6 est-il disponible dans Microsoft 365 Copilot ?
Oui. Depuis le 14 juillet 2026, GPT-5.6 est le modèle préféré de Microsoft 365 Copilot dans Word, Excel, PowerPoint, Chat et Cowork, apportant la dernière génération d’OpenAI dans les outils bureautiques du quotidien.
Quelle est la différence entre Sol, Terra et Luna ?
Sol est le modèle le plus puissant, destiné aux tâches complexes et au travail agentique de longue durée. Terra offre des performances proches de GPT-5.5 pour moitié prix et convient à la production quotidienne. Luna est le plus rapide et le moins cher, idéal pour la classification et les traitements en masse, mais moins fiable sur les très longs documents.