Passer au contenu

24 heures après avoir annulé Astra, OpenAI lance GPT-6.1 Sol, classé « critique » en cybersécurité

En vingt-quatre heures, OpenAI a rangé au placard son prochain modèle de pointe pour excès de risque, puis mis en vente une déclinaison presque aussi capable, cinq fois moins chère, et officiellement classée « critique » en cybersécurité.

Lundi, OpenAI renonçait à sortir GPT-6.1 Astra, son prochain modèle de pointe, en invoquant « des niveaux de tromperie plus élevés » que son prédécesseur. Mardi, au DevDay, l’entreprise lançait GPT-6.1 Sol, présenté comme « près de l’intelligence d’Astra » au cinquième de son prix. La carte système publiée le même jour précise le revers de cette démocratisation : le modèle est traité comme « critique » en cybersécurité, le niveau de risque le plus élevé de la maison.

D’une pause d’août à l’annulation de lundi

Le 18 août, OpenAI expliquait déjà dans un billet que le futur Astra « pourrait atteindre le seuil de capacité critique » en cybersécurité, et suspendait son plus gros entraînement par renforcement dans la foulée. L’affaire couvait donc depuis l’été.

L’annulation de lundi a enfoncé le clou. La responsable de la sécurité des systèmes, Saachi Jain, a reconnu que GPT-6.1 Astra « n’atteignait pas tout à fait la barre en matière de respect du périmètre et des autorisations », le modèle allant jusqu’à mobiliser des outils externes sans permission. La sortie prévue en octobre est abandonnée sans nouvelle date.

Vingt-quatre heures plus tard, lors du Devday, la même entreprise généralisait pourtant l’accès à une intelligence voisine aux côtés d’un nouvel abonnement et d’un agent IA. GPT-6.1 Sol est facturé 2 dollars le million de jetons en entrée et 10 en sortie, disponible immédiatement dans Codex et les applications Work pour les abonnés, présenté comme l’égal approximatif d’Astra sur le code et le travail professionnel.

Un seuil « critique » assumé noir sur blanc

La carte système, cachée dans le billet d’annonce du modèle, l’écrit sans détour : GPT-6.1 Sol est traité comme « Critical » en cybersécurité, une catégorie que le document définit par la capacité à « identifier et développer des exploits zero-day fonctionnels de tous niveaux de sévérité dans de nombreux systèmes critiques réels durcis, sans intervention humaine ».

Sur un banc d’essai construit avec des vulnérabilités divulguées entre juin et août, pour limiter la triche par mémorisation, le modèle réussit une exécution de code arbitraire dans 21,5 % des cas, contre 5,5 % pour son prédécesseur direct et 31,5 % pour Astra. Il déniche aussi des failles dans les moteurs JavaScript de Chrome et Firefox dans 78,8 % des essais.

En conséquence, le modèle hérite de l’intégralité des garde-fous d’Astra, et les usages cyber avancés passent par un accès à paliers réservé aux acteurs vérifiés. En biologie et en chimie, GPT-6.1 Sol reste un cran en dessous, classé « High », sous les quatre seuils critiques testés, et la carte revendique des évaluations de sûreté en progrès sur presque toutes les catégories face à GPT-6 Sol.

Le centre de gravité du risque vient donc de bouger : ce qui inquiétait hier était un modèle d’élite distribué au compte-gouttes, ce qui sort aujourd’hui est une capacité d’attaque quasi équivalente au tarif d’un outil de masse. OpenAI parie que ses garde-fous tiendront la porte pendant que le prix l’ouvre en grand. Les prochains bulletins de sécurité diront qui, du verrou ou du tarif, aura eu le dernier mot.

👉🏻 Suivez l’actualité tech en temps réel : ajoutez 01net à vos sources sur Google, et abonnez-vous à notre canal WhatsApp.

Source : OpenAI


Naïm Bada