Le géant de l'IA a également publié sa « superapplication » très attendue sous la forme de ChatGPT Work.

L'efficacité des jetons occupe une place centrale avec la dernière famille de modèles d'IA d'OpenAI qui est censée surpasser son rival Anthropic Claude Fable 5 sur certaines tâches.

Les modèles ont fait l'objet d'un lancement échelonné à la demande du gouvernement américain, qui a adopté une approche de plus en plus restrictive en matière de partage de modèles d'IA avancés développés en interne en raison de préoccupations liées à la cybersécurité et à la domination technologique.

Le PDG Sam Altman a déclaré à CNBC que la version phare du modèle – GPT-5.6 Sol – est 54 % plus efficace en termes de jetons sur les tâches de codage agent, fonctionnant « aussi bien ou mieux » par rapport aux modèles concurrents sur le marché.

Selon la société, GPT-5.6 Sol a obtenu un score de 53,6 lors d'une évaluation du raisonnement adaptatif, battant Fable 5 d'environ 13 points. Avec un raisonnement moyen, il a battu Fable d'environ 11 points, soit environ un quart du coût estimé, a déclaré OpenAI.

Pendant ce temps, GPT-5.6 Terra, une version plus équilibrée du modèle, et GPT-5.6 Luna, la version la plus rentable de la famille, surpassent Fable 5 à environ un seizième du coût, selon OpenAI.

Selon l'indice d'intelligence analytique artificielle, Sol, à sa capacité de raisonnement maximale, se rapproche de la capacité de Fable 5 tout en prenant 61 % de temps en moins pour environ la moitié du coût estimé, a déclaré OpenAI.

La montée en flèche des coûts des jetons est devenue le nouveau défi à l’adoption de l’IA. Uber a fait la une des journaux plus tôt cette année pour avoir dépensé l'intégralité de son budget de codage d'IA pour 2026 en seulement quatre mois, tandis que Microsoft a commencé à annuler les licences Claude Code de ses développeurs quelques mois après les avoir activées.

Les améliorations apportées à l'efficacité des jetons sont tout simplement incapables de suivre le rythme de l'adoption massive de l'IA par le secteur, ce qui, à son tour, a permis à davantage d'entreprises de niche telles que SambaNova d'intervenir pour remédier aux pièges de l'inférence.

OpenAI, qui envisagerait de céder à l'administration gouvernementale américaine une participation de 5 % dans la société de 852 milliards de dollars, n'est cependant pas satisfaite de donner au gouvernement un accès prioritaire à ses derniers modèles.

« Nous ne pensons pas que ce type de processus d'accès gouvernemental devrait devenir la norme à long terme. Il permet de conserver les meilleurs outils des utilisateurs, des développeurs, des entreprises, des cyberdéfenseurs et des partenaires mondiaux qui en ont besoin », a déclaré la société dans un article de blog.

« Nous prenons cette mesure à court terme car nous pensons qu'il s'agit du chemin le plus solide vers une plus grande disponibilité dans les semaines à venir ».

Altman a déclaré à CNBC que la société avait travaillé avec des responsables américains, notamment le secrétaire au Commerce Howard Lutnick, le secrétaire au Trésor Scott Bessent et le directeur national de la cybersécurité Sean Cairncross, pour obtenir l'approbation de ses nouveaux modèles. Il espère que l'approche réglementaire sera globale.

« Tout le monde y aura accès », a-t-il déclaré à la publication. « Ce n’est pas comme si les États-Unis allaient en bénéficier de manière disproportionnée. »

GPT-5.6 Sol ne franchit pas le « seuil cybercritique » dans le cadre de préparation d'OpenAI, a indiqué la société. Bien qu'il soit capable d'identifier les éléments constitutifs d'un exploit, le modèle n'a pas produit de manière autonome un exploit fonctionnel complet dans des conditions de test, selon son créateur.

« GPT-5.6 est formé pour refuser la cyberassistance interdite, y compris lorsque les utilisateurs tentent de dissimuler leur intention ou de jailbreaker le modèle », a déclaré la société.

« Superapp » fait ses débuts

Le géant de l'IA a également publié sa « superapplication » très attendue sous la forme de ChatGPT Work, un agent d'IA qui collecte des informations sur les applications et les flux de travail d'un utilisateur.

Le nouvel agent, alimenté par GPT-5.6, représente le pivot d'OpenAI vers le marché des entreprises plus rentable où Anthropic a acquis une base solide.

L'outil de codage d'OpenAI Codex – avec plus de 5 millions d'utilisateurs hebdomadaires – est en train d'être fusionné avec ChatGPT Work, offrant des avantages supplémentaires à plus d'un million d'utilisateurs qui utilisent l'outil pour travailler en dehors du développement de logiciels, selon la société.

L'agent peut raisonner à travers des tâches en plusieurs étapes et créer des documents qui suivent des modèles et des fichiers de référence. Presque toutes les équipes d'OpenAI, y compris les fonctions non codées telles que la finance et les ventes, utilisent ChatGPT Work et Codex, a indiqué la société.

Le nouveau lancement intervient après qu'OpenAI ait supprimé un certain nombre de produits de son portefeuille, notamment son modèle de génération d'images et son application Sora, et ait abandonné les projets d'une version de ChatGPT qui permettrait aux utilisateurs d'avoir des discussions sexuelles avec l'IA.

Le navigateur autonome Atlas AI de la société est la dernière offre à être fermée. Atlas devait initialement être intégré à la nouvelle superapplication.

OpenAI a également lancé une nouvelle génération de modèles vocaux appelés GPT-Live, qui, selon la société, « donnent l'impression que parler avec l'IA ressemble beaucoup plus à une vraie conversation ».

Le modèle est conçu pour écouter et parler en même temps, et peut insérer des phrases telles que « mhmm » ou « ouais » pour montrer qu'il écoute, selon OpenAI.

A lire également