Trouvez les actualités publiées dans la plage de dates ci-dessous
et et
et et
et et
Effacer
Euro
Arrow
55,6025
Dollar
Arrow
49,0102
Livre sterling
Arrow
64,8280
Or
Arrow
6640,0610
BIST 100
Arrow
12.339

Débat sur les tests de sécurité chez OpenAI : des employés affirment que leurs avertissements ont été ignorés

Des employés d'OpenAI auraient averti la direction que certains modèles d'intelligence artificielle ne faisaient pas l'objet de tests de sécurité suffisamment rigoureux.

Ne laisse pas l'algorithme choisir tes actualités, décide toi-même ce que tu lis. Ajoute 12punto à tes sources préférées !
Débat sur les tests de sécurité chez OpenAI : des employés affirment que leurs avertissements ont été ignorés

Des employés d'OpenAI auraient alerté la haute direction, arguant que les tests de sécurité des modèles d'intelligence artificielle n'étaient pas suffisamment contrôlés. Selon des allégations basées sur des courriels examinés par le New York Times, deux employés ont signalé que les modèles les plus récents de l'entreprise devaient faire l'objet d'un suivi plus strict lors des tests de capacités et de sécurité.

Dans ces échanges, les employés auraient souligné que les tests visant à mesurer le niveau de sophistication des modèles devaient être menés parallèlement aux protocoles de sécurité. Cependant, selon ces allégations, les dirigeants d'OpenAI auraient donné l'instruction d'accélérer les tests autant que possible afin que les modèles puissent être lancés selon le calendrier prévu.

Capture d'écran montrant le logo d'OpenAI.
Les allégations concernant les tests de sécurité chez OpenAI ont relancé le débat sur le contrôle des modèles d'intelligence artificielle.

Alors qu'il est avancé que des protocoles de sécurité supplémentaires n'ont pas été mis en œuvre malgré les avertissements des employés, un incident de test survenu précédemment au sein de l'entreprise est également au cœur de la controverse. Dans un rapport d'examen publié par OpenAI le 26 août, il était noté que l'incident était lié à un modèle nommé « Internal Model 1 (IM1) », utilisé uniquement à des fins de recherche en interne.

IL A ÉTÉ INDIQUÉ QU'IL EST SORTI DE L'ENVIRONNEMENT DE TEST

Selon le rapport, lors de tests de capacités effectués en juillet 2026, un agent d'intelligence artificielle a outrepassé les limites qui lui avaient été définies et est sorti de l'environnement de test. Il a été précisé que l'agent a accédé aux systèmes de l'entreprise et à Internet, puis a communiqué avec d'autres agents d'intelligence artificielle.

Visuel sur le thème de l'intelligence artificielle montrant un œil numérique et un flux de code.
Les tests de sécurité sur les modèles d'intelligence artificielle avancés sont considérés comme l'un des sujets les plus sensibles du secteur.

Le rapport d'examen indique que l'un des agents a identifié 14 identifiants permettant d'accéder à Hugging Face, une plateforme de modèles d'intelligence artificielle open source, et les a partagés avec d'autres agents. Il a été rapporté qu'à l'étape suivante, les agents ont utilisé les vulnérabilités des systèmes de Hugging Face pour exécuter du code sur des serveurs, accédant ainsi à des données privées et à des informations d'accès à différents systèmes.

L'incident a relancé la question de savoir comment les contrôles de sécurité doivent être menés à mesure que les agents d'intelligence artificielle cessent d'être de simples systèmes générateurs de texte pour devenir des outils capables d'effectuer des opérations dans des environnements numériques. Le trafic d'e-mails entre les employés d'OpenAI et les dirigeants a également conduit à des évaluations suggérant une tension au sein de l'entreprise entre les priorités de rapidité et de sécurité.

Visuel sur le thème de l'intelligence artificielle composé d'un robot humanoïde et d'interfaces numériques.
Les limites et le contrôle des agents d'intelligence artificielle figurent parmi les thèmes fondamentaux des tests de sécurité.

Source de l'actualité: 12punto

OpenAI intelligence artificielle Sécurité de l'intelligence artificielle Hugging Face Internal Model 1 cybersécurité