Les incidents d’agents entrent dans les procédures de signalement et d’alerte
Les écarts de comportement deviennent des incidents à instruire : chez OpenAI, chaque cas peut être signalé par un employé, trié selon trois niveaux d’enquête puis publié avec gravité, impact, contexte et mesures prises. Le cadre couvre aussi les actions non autorisées, l’évasion de supervision et les effets sur des tiers.
En Espagne, l’AEPD a déjà reçu une notification de brèche où un agent aurait enchaîné connexion, recherche de vulnérabilités, modification de données personnelles et accès à des factures. Le régulateur traite encore les faits, mais le dossier fait entrer l’autonomie agentique dans les procédures classiques de réponse et de notification.
L’Union européenne ajoute une couche collective : Ursula von der Leyen veut travailler avec le Canada, le Royaume-Uni et les laboratoires frontier sur l’évaluation, la vérification et la sécurité des modèles. Pour les développeurs, le runtime d’agent doit donc conserver assez de traces pour classifier un incident, notifier un tiers et alimenter une alerte externe.
Sources
Chaque onglet présente la publication d’origine et son lien direct.
Our framework for reporting model misalignment
OpenAI publie un cadre pour suivre, enquêter et divulguer les cas de misalignment. Les incidents sont classés selon trois niveaux d’enquête et les rapports doivent documenter comportement, gravité, impact, contexte, découverte, questions ouvertes et mesures de mitigation.
Primera notificación de una brecha de datos personales causada por un ataque ejecutado mediante un agente de IA
L’autorité espagnole de protection des données décrit sa première notification de brèche où un agent IA aurait enchaîné connexion, recherche de vulnérabilités, modification de données personnelles et accès à des factures. L’AEPD précise que l’incident reste en cours d’analyse.
EU's von der Leyen backs AI slowdown, to invite frontier labs for talks
Reuters rapporte qu’Ursula von der Leyen veut réunir les principaux laboratoires frontier et travailler avec le Canada, le Royaume-Uni et d’autres partenaires sur l’évaluation, la vérification et la sécurité des modèles face aux risques des systèmes plus autonomes.