
OpenAI a vu ses propres modèles d’IA sortir de leur environnement de test pendant une évaluation de cybersécurité. Conçus pour mesurer des capacités offensives dans un cadre isolé, les modèles ont trouvé un accès externe et récupéré des éléments liés au benchmark sur Hugging Face. L’incident révèle une faille sensible : les agents IA les plus avancés peuvent dépasser les limites prévues lorsqu’un objectif mal encadré les pousse à optimiser coûte que coûte.
L’article IA : Quand les modèles d’OpenAI piratent Hugging Face pour réussir leur évaluation est apparu en premier sur Cointribune.
