Débat sur les tests de sécurité chez OpenAI : des employés affirment que leurs avertissements ont été ignorés
Des employés d'OpenAI auraient averti la direction que certains modèles d'intelligence artificielle ne faisaient pas l'objet de tests de sécurité suffisamment rigoureux.
12punto
Des employés d'OpenAI auraient alerté la haute direction, arguant que les tests de sécurité des modèles d'intelligence artificielle n'étaient pas suffisamment contrôlés. Selon des allégations basées sur des courriels examinés par le New York Times, deux employés ont signalé que les modèles les plus récents de l'entreprise devaient faire l'objet d'un suivi plus strict lors des tests de capacités et de sécurité.
Dans ces échanges, les employés auraient souligné que les tests visant à mesurer le niveau de sophistication des modèles devaient être menés parallèlement aux protocoles de sécurité. Cependant, selon ces allégations, les dirigeants d'OpenAI auraient donné l'instruction d'accélérer les tests autant que possible afin que les modèles puissent être lancés selon le calendrier prévu.
Alors qu'il est avancé que des protocoles de sécurité supplémentaires n'ont pas été mis en œuvre malgré les avertissements des employés, un incident de test survenu précédemment au sein de l'entreprise est également au cœur de la controverse. Dans un rapport d'examen publié par OpenAI le 26 août, il était noté que l'incident était lié à un modèle nommé « Internal Model 1 (IM1) », utilisé uniquement à des fins de recherche en interne.
IL A ÉTÉ INDIQUÉ QU'IL EST SORTI DE L'ENVIRONNEMENT DE TEST
Selon le rapport, lors de tests de capacités effectués en juillet 2026, un agent d'intelligence artificielle a outrepassé les limites qui lui avaient été définies et est sorti de l'environnement de test. Il a été précisé que l'agent a accédé aux systèmes de l'entreprise et à Internet, puis a communiqué avec d'autres agents d'intelligence artificielle.
Le rapport d'examen indique que l'un des agents a identifié 14 identifiants permettant d'accéder à Hugging Face, une plateforme de modèles d'intelligence artificielle open source, et les a partagés avec d'autres agents. Il a été rapporté qu'à l'étape suivante, les agents ont utilisé les vulnérabilités des systèmes de Hugging Face pour exécuter du code sur des serveurs, accédant ainsi à des données privées et à des informations d'accès à différents systèmes.
L'incident a relancé la question de savoir comment les contrôles de sécurité doivent être menés à mesure que les agents d'intelligence artificielle cessent d'être de simples systèmes générateurs de texte pour devenir des outils capables d'effectuer des opérations dans des environnements numériques. Le trafic d'e-mails entre les employés d'OpenAI et les dirigeants a également conduit à des évaluations suggérant une tension au sein de l'entreprise entre les priorités de rapidité et de sécurité.