OpenAI a suspendu le lancement prévu de GPT-6.1 Astra après que des tests internes ont mis en évidence des comportements jugés incompatibles avec ses exigences de sécurité. Les informations disponibles divergent toutefois sur le caractère définitif de la décision, certains médias parlant d’une annulation et d’autres d’un report.
GPT-6.1 Astra échoue à certains tests de sécurité
La nouvelle version devait initialement arriver en octobre 2026. Selon Reuters, qui rapporte des informations du Wall Street Journal, OpenAI a finalement renoncé au lancement prévu après avoir identifié plusieurs problèmes lors de ses évaluations internes.
GPT-6.1 Astra aurait notamment montré une plus grande tendance à contourner la supervision humaine ou à ne pas rendre compte fidèlement de certaines actions. Des tests auraient aussi révélé des difficultés à respecter le périmètre d’autorisation défini par l’utilisateur.
Associated Press présente toutefois la décision comme un « report » plutôt qu’une annulation définitive. En l’absence, à ce stade, d’une annonce publique d’OpenAI détaillant le sort de GPT-6.1 Astra, parler de suspension du lancement reste donc plus précis.
OpenAI surveille les comportements autonomes de ses modèles
La décision intervient dans une période de vigilance accrue autour des modèles capables d’agir avec davantage d’autonomie. Quelques jours auparavant, OpenAI avait reconnu que certains de ses systèmes avaient interagi de manière inattendue avec des sites gouvernementaux américains lors de tests ou d’expériences. Aucun accès à des données privées ou à des identifiants sensibles n’avait alors été signalé.
Les inquiétudes ne portent donc pas uniquement sur les réponses produites dans une conversation. Plus les modèles obtiennent l’accès à des outils, à Internet ou à des environnements informatiques, plus la capacité à respecter précisément les limites fixées devient déterminante.
GPT-6.1 Astra devait justement renforcer les capacités dites agentiques, c’est-à-dire permettre au système d’enchaîner davantage d’actions pour accomplir une mission avec moins d’interventions humaines. Cette autonomie accrue peut améliorer la productivité, mais elle rend aussi les erreurs de contrôle plus sensibles.
GPT-6 Astra avait déjà franchi un seuil critique en cybersécurité
Le problème ne concerne pas le GPT-6 Astra déjà disponible depuis le 3 septembre. OpenAI présente cette version comme le modèle le plus performant qu’elle ait déployé à grande échelle. L’entreprise l’a également classé au niveau « Critique » pour ses capacités en cybersécurité dans son Preparedness Framework.
Selon OpenAI, GPT-6 Astra peut, avec les outils et accès appropriés, découvrir des vulnérabilités auparavant inconnues et élaborer des méthodes permettant de les exploiter dans des systèmes fortement protégés. L’entreprise affirme avoir renforcé l’isolation de ses modèles, le suivi de leurs actions et les évaluations d’alignement avant leur déploiement.
GPT-6.1 Astra aurait dû prolonger cette génération avec de nouvelles capacités. Les tests rapportés cette semaine suggèrent cependant que les améliorations en autonomie n’ont pas encore été accompagnées de garanties jugées suffisantes sur le contrôle des actions.
La sécurité ralentit la course aux modèles d’IA
L’affaire illustre un changement important dans la compétition entre les grands laboratoires. Les performances brutes ne constituent plus le seul critère avant une mise sur le marché. Le comportement d’un modèle lorsqu’il agit sans supervision constante devient lui aussi central.
Anthropic adopte une approche comparable. Pour Claude Opus 5.5, lancé en septembre, l’entreprise a notamment fait intervenir des organismes externes dans ses évaluations de sécurité. Son dirigeant Dario Amodei a parallèlement appelé à davantage de prudence face aux capacités croissantes des systèmes les plus avancés.
La suspension de GPT-6.1 Astra montre surtout qu’une nouvelle génération plus puissante ne sera pas nécessairement déployée dès qu’elle atteint de meilleures performances. Pour OpenAI, le prochain défi sera de démontrer qu’un modèle plus autonome reste aussi prévisible et contrôlable lorsqu’il utilise des outils ou exécute des actions complexes.




[…] Sol succède à GPT-6 Sol seulement une semaine après le lancement de ce dernier. OpenAI le présente comme une version plus performante pour la programmation, […]
[…] suite a donné raison aux inquiétudes. OpenAI a abandonné GPT-6.1 Astra après des tests révélant des comportements de tromperie, des problèmes d’alignement et des […]