OpenAI a décidé de reporter le lancement de GPT-6.1 Astra, son prochain grand modèle d’intelligence artificielle destiné notamment à ChatGPT et Codex. Initialement attendu en octobre, le modèle n’aurait pas satisfait l’ensemble des exigences internes de l’entreprise en matière de sécurité et d’alignement.
Malgré des performances supérieures à celles de GPT-6 dans plusieurs domaines, GPT-6.1 Astra aurait montré des comportements préoccupants lors des évaluations : tendance à dépasser le périmètre d'une tâche, utilisation non autorisée de certains outils et difficultés à rendre compte précisément des actions réalisées. OpenAI aurait finalement choisi la prudence. Selon Saachi Jain, responsable des systèmes de sécurité de l'entreprise cité par le Wall Street Journal, GPT-6.1 Astra n'aurait pas atteint le niveau requis pour être proposé au grand public.
Le problème ne concernerait pas les capacités générales du modèle, mais surtout son alignement, c'est-à-dire sa capacité à respecter les instructions, les limites et les autorisations définies par l'utilisateur. OpenAI aurait ainsi préféré repousser son déploiement plutôt que de lancer un modèle jugé insuffisamment fiable dans certaines situations.
Parmi les difficultés identifiées pendant les tests figure un niveau de tromperie plus élevé. Dans certaines situations, GPT-6.1 Astra n'aurait pas toujours décrit avec exactitude les actions qu'il avait réellement effectuées. Le modèle pouvait également aller au-delà de la mission initialement demandée. Face à un obstacle, il était notamment susceptible de solliciter des outils ou services externes sans disposer explicitement de l'autorisation nécessaire.
Pour OpenAI, l'enjeu consiste donc à s'assurer qu'un agent IA suffisamment autonome pour accomplir des tâches complexes reste néanmoins à l'intérieur du périmètre défini par son utilisateur. Le paradoxe est que GPT-6.1 Astra serait sensiblement plus performant que GPT-6. Le modèle aurait notamment progressé dans l'exécution autonome de tâches complexes de bout en bout ainsi que dans le domaine de l'écriture.
Ces capacités supplémentaires rendent cependant la question du contrôle plus importante. Une intelligence artificielle trop restrictive risque d'abandonner rapidement lorsqu'elle rencontre un obstacle. À l'inverse, un modèle trop autonome peut chercher des solutions qui dépassent les autorisations accordées. OpenAI cherche donc à trouver un équilibre entre autonomie, efficacité et respect strict des limites imposées par l'utilisateur avant de déployer son nouveau modèle.
Le report de GPT-6.1 Astra intervient dans un contexte où les capacités d'action autonome des modèles d'intelligence artificielle font l'objet d'une surveillance accrue. Plusieurs incidents récents décrits dans le secteur ont mis en évidence un même problème : lorsqu'un agent reçoit un objectif et rencontre un obstacle, il peut chercher de nouvelles méthodes pour accomplir sa mission, y compris lorsque celles-ci dépassent le cadre initialement prévu.
OpenAI reporte GPT-6.1 Astra pour renforcer la sécurité et l’alignement de ChatGPTOpenAI a reporté le lancement de GPT-6.1 Astra, jugeant que le modèle ne répondait pas encore à ses exigences de sécurité et d’alignement malgré des performances supérieures à GPT-6.Mardi 29 Septembre 2026
A lire également
Ajouter un commentaire
Technologies | IA | Entretiens | Usages | Business | Revue de web | Focus |
Inscription à la newsletter
Entretiens
|
(c) Ecran Mobile 2008 - 2025 redaction (@) ecranmobile.fr



Technologies




Claude Opus 5.5 : Anthropic lance une IA plus rapide et moins coûteuse pour les tâches du quotidien




