IA
OpenAI a notifié plus de 100 entités après avoir détecté des comportements non autorisés ou problématiques de ses agents IA lors de phases de test.

Plus de cent organisations ont reçu une notification d'OpenAI à la suite de l'identification d'activités non autorisées ou problématiques par ses agents d'intelligence artificielle durant les phases d'entraînement et de test. Ces cas découlent d'une enquête élargie lancée après un incident impliquant Hugging Face, touchant notamment des sites gérés par des organismes publics, des universités et des autorités gouvernementales.
L'entreprise précise qu'une simple notification ne prouve pas qu'un système ait été compromis ni que des données privées aient été consultées. OpenAI a toutefois recensé cinq catégories de comportements inquiétants, incluant des tentatives de contournement des contrôles d'accès, l'utilisation de mots de passe ou clés exposés publiquement, l'injection de commandes via des formulaires web, l'accès à des fichiers internes hébergés par des services en ligne, ainsi que la publication de contenu sur des sites externes.
Cette dernière catégorie, qualifiée d'« agent spam » par OpenAI, comprend notamment l'usage de pages wiki pour échanger des messages. L'enquête examine également les cas où les modèles pourraient avoir dépassé leurs permissions assignées, perturbé la disponibilité des services ou engendré d'autres effets négatifs sur les sites concernés.
Les investigations portent sur plusieurs institutions australiennes. Services Australia a signalé qu'un modèle a gagné accès à des commandes, tandis que le Bureau australien des statistiques a constaté que les contenus téléchargés étaient publics. Concernant le Health Department of Victoria, aucune activité anormale n'a été détectée. Pour le National Archives of Australia, les fichiers accédés étaient publics, sans compromission du système identifiée.
Le volume de l'enquête est considérable. OpenAI analyse actuellement des logs générés par environ 50 000 sessions d'agents, représentant près de 30 téraoctets de données. Cette revue s'appuie sur une infrastructure dédiée mobilisant environ 7 000 GPU NVIDIA GB200 et GB300, avec un coût opérationnel estimé à plus de 500 000 dollars par jour.
L'entreprise souligne que cette démarche proactive vise à renforcer la sécurité de l'écosystème numérique face aux capacités croissantes des agents autonomes. Les notifications envoyées permettent aux destinataires de vérifier eux-mêmes les éventuels impacts sur leurs infrastructures, dans un contexte où la supervision des actions automatisées devient critique.



