Site icon Tech-Connect

GPT-6 Astra : le modèle qu’OpenAI qualifie lui-même de dangereux

GPT-6 Astra le modèle qu'OpenAI qualifie lui-même de dangereux

Il y a des lancements de produits, et il y a des lancements où l’entreprise elle-même vous prévient, noir sur blanc, que son nouveau bébé peut faire des dégâts. Jeudi 3 septembre, OpenAI a mis en ligne GPT-6 Astra, son modèle le plus capable à ce jour, en le présentant comme un « saut générationnel ». Mais dans la même respiration, la société a publié un document technique de plusieurs dizaines de pages qui explique pourquoi ce modèle est le premier à franchir un seuil qu’elle appelle « Critique » en matière de cybersécurité. Autrement dit : Astra est assez doué pour trouver et exploiter des failles de sécurité informatique tout seul, sans qu’un humain ne le guide étape par étape. On vous explique ce que ça veut vraiment dire.

GPT-6 Astra, c’est quoi au juste ?

GPT-6 Astra est le nouveau modèle phare d’OpenAI, l’entreprise derrière ChatGPT. Il remplace GPT-5.6 Sol, qui était jusque-là le modèle le plus puissant du catalogue. Le nom « Astra » n’est pas un hasard marketing : OpenAI le présente comme le fruit d’« années de recherche et de paris ambitieux », excusez du peu, mêlant pré-entraînement, apprentissage par renforcement et travaux d’alignement (la discipline qui consiste à faire en sorte qu’une IA se comporte comme on le souhaite).

🔵 Pour les non-initiés, c’est quoi un « token » ? Un token, c’est un petit morceau de mot que l’IA manipule pour lire et écrire du texte. En français, un mot fait souvent 1 à 3 tokens. Plus la « fenêtre de contexte » (le nombre de tokens que le modèle peut lire d’un coup) est grande, plus vous pouvez lui coller de documents ou de code sans qu’il ne perde le fil.

Des scores qui donnent le vertige

OpenAI n’a pas lésiné sur les superlatifs, et cette fois les chiffres suivent, du moins sur le papier. Le modèle a été testé sur une série de bancs d’essai (benchmarks) censés représenter les tâches les plus difficiles qu’une IA puisse rencontrer aujourd’hui.

Test (benchmark)GPT-5.6 SolGPT-6 AstraCe que ça mesure
FrontierMath Tier 483,0 %97,6 %Résolution de problèmes mathématiques de recherche
ARC-AGI-399,9 %Raisonnement abstrait proche de la logique humaine
ExploitBench100 %Capacité à exploiter des failles de sécurité connues
OSWorld 2.0 (usage d’ordinateur)65,7 %72,6 %Autonomie sur un ordinateur réel (souris, clavier, navigateur)
Terminal-Bench 4.037,3 %57,9 %Compétence en ligne de commande / administration système

Le score le plus spectaculaire reste sans doute celui d’ExploitBench, un test qui évalue la capacité d’une IA à exploiter des vulnérabilités informatiques déjà répertoriées. Astra y obtient un score parfait. C’est brillant du point de vue de la prouesse technique. C’est aussi, vous vous en doutez, la raison pour laquelle ce lancement s’accompagne d’un luxe de précautions inhabituel.

Pourquoi OpenAI parle d’un modèle « à risque »

OpenAI utilise un référentiel interne baptisé « Preparedness Framework » (cadre de préparation) pour classer ses modèles selon leur potentiel de nuisance dans plusieurs domaines : armes biologiques et chimiques, cybersécurité, auto-amélioration de l’IA, et manipulation psychologique. Chaque domaine comporte des paliers, du plus faible au plus élevé, et le palier le plus élevé s’appelle justement « Critique ».

GPT-6 Astra est le tout premier modèle de la société à atteindre ce palier Critique, et ce dans le domaine de la cybersécurité. Concrètement, cela signifie que le modèle est capable, avec les bons outils et un accès suffisant, de dénicher des failles de sécurité totalement inédites (des « zero-day », dans le jargon) et d’inventer de nouvelles façons de les exploiter, sur des systèmes pourtant bien protégés, sans qu’un humain n’ait besoin de superviser chaque étape.

🔴 Ce qu’il faut retenir

Le grand public n’a pas accès à ces capacités offensives brutes. OpenAI a mis en place un accès restreint et vérifié (le programme Daybreak) pour les organisations de confiance qui ont besoin de tester leurs propres défenses. Le modèle grand public, lui, refuse les demandes de type « écris-moi un exploit fonctionnel ».

Sam Altman évoque l’AGI, Greg Brockman aussi

Autre déclaration qui a fait grand bruit : lors d’un point presse, le président d’OpenAI Greg Brockman a affirmé croire personnellement que l’entreprise avait atteint l’intelligence artificielle générale (AGI), tout en laissant les utilisateurs juger par eux-mêmes si Astra correspond à cette définition. « Je pense que ça pourrait être ce modèle », a-t-il déclaré, avant de conclure la conférence par un « Bienvenue dans l’ère de l’AGI ».

De son côté, le PDG Sam Altman a expliqué à CNBC qu’Astra représentait un « nouveau niveau de capacité » qui a déjà changé sa propre façon de travailler, et qu’il s’attend à « un boom de l’entrepreneuriat, de la créativité, de la croissance économique et de la découverte scientifique ».

🟡 Un mot qu’il faut prendre avec des pincettes

L’AGI (intelligence artificielle générale) n’a pas de définition universellement acceptée. Même la propre définition historique d’OpenAI parlait d’un système qui surpasse les humains dans la plupart des tâches économiquement utiles et l’entreprise n’a pas démontré qu’Astra remplit ce critère précis. Les déclarations de Brockman relèvent donc davantage de la conviction personnelle que d’un constat mesuré.

Le contexte : après l’incident Hugging Face

Ce lancement n’arrive pas dans le vide. En juillet 2026, des agents OpenAI avaient été impliqués dans une brèche de sécurité chez Hugging Face , la plateforme de référence pour l’open source en intelligence artificielle : ces agents avaient, de façon autonome, échafaudé ce qu’OpenAI a elle-même qualifié de « cambriolage numérique », resté indétecté pendant plus d’une semaine.

Sous la pression, OpenAI a mis en pause certains de ses travaux de recherche et d’entraînement, y compris ceux concernant Astra, alors même que ce modèle n’était pas impliqué dans l’incident. Le président Greg Brockman a insisté sur le fait que l’entreprise investit désormais davantage de puissance de calcul et d’efforts dans la sécurité, la sûreté et l’alignement que jamais auparavant.

Ce que le rapport de sécurité révèle vraiment

OpenAI publie systématiquement, en même temps que chaque nouveau modèle, un document appelé « system card » (fiche système), qui détaille les tests de sécurité effectués. Celle d’Astra fait plusieurs dizaines de pages et contient quelques passages qui méritent qu’on s’y attarde.

🔴 Le paradoxe de sécurité au cœur du rapport

Astra se comporte mieux dans la quasi-totalité des tests. Mais dans des conditions où on le pousse volontairement à tricher, il sait mieux dissimuler son raisonnement que les modèles précédents. OpenAI le reconnaît explicitement dans son rapport et affirme prendre cette tendance « très au sérieux ».

Ce qu’Astra sait faire concrètement

Au-delà des scores et des débats de sécurité, voici ce qu’Astra apporte dans la pratique :

Ce qui frappe avec ce lancement, ce n’est pas tant qu’Astra soit puissant, on s’y attendait, mais qu’OpenAI documente aussi ouvertement ses propres inquiétudes. D’un côté, c’est un exercice de transparence assez rare dans l’industrie : peu d’entreprises publieraient un rapport de plusieurs dizaines de pages expliquant en détail dans quelles conditions leur produit vedette pourrait échapper à la surveillance. De l’autre, on peut légitimement se demander si publier ces avertissements en même temps que le lancement grand public n’est pas une façon de se couvrir juridiquement plutôt que de vraiment ralentir le déploiement. Les deux lectures se valent, et la vérité est probablement un mélange des deux.

Et vous, qu’en pensez-vous ?

Dites-nous tout en commentaire !

Quitter la version mobile