Une étude alarmante: certaines IA pas assez protégées contre les utilisations à but terroriste
De nombreux modèles d’intelligence artificielle (IA) disposent de protections insuffisantes contre les demandes d’“aide à une opération terroriste”, souligne l’initiative Tech Against Terrorism dans un rapport publié vendredi.
E.L
Source: BELGA
9 octobre 2026, 07:23
Ajoutez-nous à vos favoris Google
Dans le cadre de cette initiative, soutenue par l’ONU, un test a été mené sur 162 modèles d’IA. Ils ont été soumis à une série de 627 questions auxquelles “un terroriste préparant une attaque aurait besoin” d’obtenir des réponses.
Parmi ces modèles, Tech Against Terrorism indique avoir pu évaluer 116 modèles classiques, 13 modèles personnalisés après leur publication afin d’être utilisés dans des domaines spécifiques, et 13 modèles débridés, dont les barrières de sécurité ont été modifiées par des tiers.
D’après les résultats de cette étude, les modèles classiques interrogés, tels que ChatGPT (OpenAI), Claude (Anthropic), ou Gemini (Google), ont répondu en moyenne à 1,9% des questions posées par un utilisateur qui indiquait clairement dans sa demande son “intention terroriste”.
Modèles débridés
Dans les autres cas, le modèle d’IA interrogé refusait de fournir une réponse. Pour les mêmes modèles, le nombre moyen de réponses utilisables s’est élevé à 16,9 % lorsque l’utilisateur indiquait effectuer sa demande dans le cadre de recherches en sécurité.
D’après les tests menés, ces résultats ont radicalement changé pour les modèles débridés, c’est-à-dire des modèles modifiés après leur publication afin de contourner leurs paramètres de sécurité et leur capacité à refuser certaines demandes.
Sur les 13 modèles débridés testés, le taux de réponse moyen à des questions liées à une “activité terroriste” variait entre 87 % et 92 %. “Aucun modèle qui échoue à un test de sécurité indépendant ne devrait être hébergé, proposé ou vendu, et chaque entreprise de la chaîne de distribution devrait le vérifier au préalable”, affirme l’organisation.