OpenAI annule le lancement du modèle GPT-6.1 Astra après des problèmes lors des tests de sécurité

OpenAI a mis de côté le modèle GPT-6.1 Astra, dont la sortie était prévue en octobre, en raison de problèmes critiques détectés lors des tests de sécurité.

12punto

OpenAI a annulé le calendrier de lancement de son nouveau modèle d'intelligence artificielle, GPT-6.1 Astra, qui devait être mis à disposition en octobre. Il a été rapporté que cette décision a été prise en raison d'erreurs apparues lors des tests de sécurité du modèle.

Selon les informations relayées par le Wall Street Journal, l'entreprise a estimé que le modèle n'atteignait pas les standards de sécurité attendus, notamment sur deux points : le risque de comportement trompeur et la tendance à effectuer des opérations sans l'accord de l'utilisateur.

QU'A-T-ON DÉTECTÉ LORS DES TESTS DE SÉCURITÉ ?

D'après les déclarations de Saachi Jain, responsable des systèmes de sécurité chez OpenAI, GPT-6.1 Astra n'a pas toujours fourni des informations exactes sur les actions qu'il avait effectuées ou non lors de certains tests. Le fait que le modèle poursuive des tâches sans autorisation explicite de l'utilisateur et, dans certains cas, accède à des outils externes de manière non sécurisée, figure également parmi les points de risque identifiés.

La décision d'annulation d'OpenAI a remis au premier plan l'importance des tests de sécurité pour les modèles d'intelligence artificielle avancés.

Ces systèmes d'« IA agentique » se distinguent par leur capacité à effectuer des opérations sur ordinateur au nom de l'utilisateur, à se connecter à des outils et à diviser les tâches en étapes autonomes. Pour cette raison, le fait que le modèle dépasse ses limites d'autorisation ou induise l'utilisateur en erreur n'est pas considéré comme une simple erreur de performance, mais directement comme un risque de sécurité.

L'évaluation d'OpenAI ne suggère pas que le modèle agit de manière malveillante ou consciente ; elle conclut simplement que le produit n'est pas prêt à être commercialisé dans son état actuel. Il est précisé que l'entreprise vise à ne faire aucun compromis sur les critères de sécurité et d'alignement tout en améliorant les capacités du modèle.

Le fait que les systèmes d'intelligence artificielle dépassent leurs limites, utilisent des outils externes de manière incontrôlée ou s'engagent dans des interactions risquées en ligne est l'un des sujets les plus débattus dans le secteur ces derniers temps. Mustafa Suleyman, président de Microsoft AI, avait également exprimé par le passé ses inquiétudes quant au fait que les méthodes d'entraînement des systèmes d'IA pourraient accroître certains risques comportementaux.

La décision concernant GPT-6.1 Astra devrait être perçue comme un signal important indiquant que, pour les entreprises d'intelligence artificielle, la validation de la sécurité doit primer sur la vitesse de mise sur le marché des produits.