Failles de sécurité : des intelligences artificielles vulnérables aux requêtes terroristes
🎬 Les vidéos
Les technologies d'intelligence artificielle se développent rapidement à travers le monde. Conçus pour simuler des capacités humaines comme le raisonnement, la résolution de problèmes, la perception ou l'apprentissage, ces outils informatiques traitent aujourd'hui des volumes massifs d'informations pour répondre aux sollicitations des utilisateurs.
Cependant, les garde-fous intégrés à ces systèmes révèlent d'importantes faiblesses. Selon les conclusions d'un rapport diffusé un vendredi par l'organisation Tech Against Terrorism, une grande quantité de modèles d'IA ne disposent pas de barrières suffisantes pour bloquer des demandes d'aide à des opérations terroristes.
Pour parvenir à ce constat, l'organisation a soumis plus de 160 modèles d'intelligence artificielle à une série de tests ciblés. Les résultats indiquent qu'une partie significative de ces outils échoue à neutraliser les sollicitations sensibles et peut fournir des réponses exploitables.
Les évaluateurs ont notamment observé que les protections internes cèdent facilement lorsque la requête est habilement formulée. En présentant par exemple la demande sous le couvert d'un travail de recherche, certains systèmes contournent leurs propres règles de sécurité et traitent des questions liées à des projets terroristes.
Cette analyse met en lumière la fragilité actuelle des dispositifs de modération face aux techniques de contournement sémantique, alors que les concepteurs de modèles peinent à verrouiller hermétiquement leurs technologies contre des usages malveillants.

