OpenAI a lancé jeudi le déploiement mondial de GPT-5.6 , son nouveau modèle phare d'intelligence artificielle. Ce modèle se décline en trois variantes, chacune portant un nom spécifique : Sol, Terra et Luna. L'entreprise, dirigée par Sam Altman, a confirmé que ce lancement fait suite à une phase d'accès restreint de 13 jours pour un petit groupe de partenaires américains. La décision d'étendre l'accès a été prise après avoir reçu l'approbation de l'administration Trump, qui exigeait un examen de sécurité préalable en raison des capacités avancées du modèle en matière de cybersécurité et dans d'autres domaines sensibles.
Le nouveau modèle est présenté comme le plus puissant jamais créé par OpenAI , grâce à des améliorations significatives en programmation, en biologie computationnelle et en cybersécurité. L'entreprise a divisé la famille GPT-5.6 en trois niveaux : Sol, le modèle phare ; Terra, une option équilibrée pour les tâches quotidiennes ; et Luna, la version la plus rapide et la plus abordable. Les prix varient selon le modèle : Sol est proposé à 5 $ par million de jetons à l'entrée et à 30 $ à la sortie, Terra à 2,50 $ et 15 $ respectivement, et Luna à 1 $ et 6 $.
Performances et benchmarks
Dans les tests publiés par OpenAI, Sol a obtenu 88,8 % au Terminal-Bench 2.1 , une évaluation mesurant les flux de travail en ligne de commande réels. En mode Ultra, qui coordonne quatre sous-agents en parallèle, le score atteint 91,9 %. Ces résultats surpassent ceux des modèles Anthropic, tels que Claude Opus 4.8 (78,9 %) et Fable 5 (entre 83,4 % et 84,3 %). Dans les tâches de programmation multi-agents, Sol surpasse également ses concurrents, bien que dans SWE-Bench Pro, qui mesure la résolution de problèmes GitHub réels, Claude Fable 5 conserve un avantage avec 80,3 % contre 58,6 % pour GPT-5.5.
Dans le domaine de la cybersécurité, Sol s'est montré compétitif en utilisant seulement un tiers des jetons de sortie employés par des modèles similaires, selon les données d'ExploitBench. OpenAI affirme que le modèle a pu identifier des vulnérabilités dans des navigateurs tels que Chromium et Firefox, bien qu'il n'ait pas encore produit d'exploit pleinement fonctionnel. L'entreprise soutient que GPT-5.6 Sol ne dépasse pas son seuil de « Cyber-critique » dans le cadre de son référentiel de préparation, justifiant ainsi les mesures de sécurité supplémentaires.
Sécurité et contrôle gouvernemental
OpenAI a dévoilé GPT-5.6, doté de son système de sécurité le plus robuste à ce jour , comprenant des classificateurs en temps réel, une vérification au niveau des comptes et un système automatisé de mise en réseau qui a nécessité l'équivalent de plus de 700 000 heures de calcul sur GPU A100. L'entreprise a collaboré avec des représentants de l'administration Trump, notamment Howard Lutnick et Scott Bessent, afin de valider les affirmations relatives à la sécurité avant la publication, à l'instar de la proposition faite à OpenAI de céder une participation au gouvernement américain dans la gestion des bénéfices de l'IA. Altman a déclaré que ce type d'examen préalable ne devrait pas devenir la norme, car il donne l'impression que la technologie n'est pas fiable.
Le contexte géopolitique a également influencé ce lancement. L'Union européenne et d'autres régions avaient exprimé des inquiétudes quant à l'accès restreint aux modèles les plus avancés, initialement réservés aux partenaires américains. Anthropic, concurrent d'OpenAI, avait également rencontré des restrictions similaires avec sa série Mythos. Désormais, avec l'accord de Washington, GPT-5.6 est déployé progressivement à l'échelle mondiale : les utilisateurs de ChatGPT Plus, Pro, Business et Enterprise peuvent déjà accéder à Sol, tandis que les comptes gratuits et Go utilisent Terra.
Autres nouveautés d'OpenAI
En plus de GPT-5.6, OpenAI a annoncé GPT-Live, son modèle vocal de nouvelle génération qui permet des conversations naturelles et fluides grâce à la possibilité d'écouter et de parler simultanément. Ce modèle s'appuie sur GPT-5.5 en arrière-plan pour les tâches complexes et sera déployé dès ce mercredi dans ChatGPT pour Android, iOS et le Web. ChatGPT Work, une nouvelle application de bureau basée sur Codex et GPT-5.6, est également disponible pour les abonnements Pro, Enterprise et Edu ; les abonnements Plus et Business seront bientôt disponibles.
En résumé, le lancement de GPT-5.6 marque une étape importante dans la course à l'intelligence artificielle de pointe . OpenAI mise sur une famille de modèles capables de gérer aussi bien les tâches quotidiennes que les applications les plus exigeantes, le tout sous un contrôle de sécurité sans précédent. L'entreprise prévoit que cette nouvelle génération consolidera sa position face à Anthropic et à ses concurrents, à mesure que le prix des jetons continue de baisser et que les capacités des modèles augmentent.
