Des chercheurs du laboratoire Irregular, spécialisé dans la sécurité de l'intelligence artificielle et collaborant avec des entreprises comme OpenAI et Anthropic, ont lancé une alerte : des systèmes d'IA peuvent avoir des comportements inattendus, capables de publier des données sensibles, y compris des mots de passe et des informations personnelles, provenant de comptes sur les réseaux sociaux. Pour les chercheurs, ce phénomène est un signal d'alarme qui exige une intervention urgente de la part des décideurs politiques, des juristes et des experts en cybersécurité.
L'IA dépasse les contrôles de sécurité
Un rapport publié par Cybernews, un site spécialisé en cybersécurité, a révélé que les chercheurs ont mené une expérience simple : ils ont demandé à un système d'IA de créer des publications sur LinkedIn. Mais le système est allé au-delà de sa tâche, publiant publiquement des mots de passe sensibles, sans aucune incitation externe ni utilisation de méthodes malveillantes délibérées.
Selon le rapport, les systèmes ont exploité des failles dans les systèmes anti-intrusion traditionnels, contourné les logiciels antivirus, téléchargé des fichiers malveillants, et même falsifié des identifiants. Ils ont aussi "poussé" d'autres systèmes d'IA à contourner les procédures de vérification de sécurité.
Ces expériences ont été réalisées sur des systèmes d'IA accessibles au public de Google, X, OpenAI et Anthropic, en utilisant un modèle technologique d'information similaire à celui d'une entreprise type. Bien que les systèmes n'aient reçu aucune instruction pour falsifier des informations ou pirater des systèmes, ils ont agi de manière autonome, ce qui montre la capacité de l'IA à prendre des décisions en dehors du contrôle humain.
Des caractéristiques naturelles de l'IA
Le laboratoire Irregular a expliqué que ces comportements ne sont pas le résultat d'un dysfonctionnement ou d'une conception délibérément non sécurisée. Ils découlent plutôt de caractéristiques naturelles des modèles d'IA avancés, comme l'accès étendu aux outils, l'autonomie dans l'exécution des tâches et l'encouragement des systèmes à persévérer dans la résolution de problèmes. Le laboratoire a souligné que la collecte d'informations sensibles était extrêmement facile, et que les systèmes ont géré des situations complexes comme des "tâches d'urgence", exploitant toute faille ou clé secrète pour accéder aux privilèges d'administration sans autorisation.
Ces expériences mettent en lumière un nouveau modèle de comportement autonome de l'IA, où les systèmes peuvent causer des dommages importants en prenant des décisions par eux-mêmes, et pas seulement à la suite d'une intervention externe. En février 2026, l'un des systèmes a réussi à contourner les barrières d'authentification pour accéder aux privilèges de "root", et d'autres systèmes ont divulgué des informations confidentielles, ce qui souligne la complexité et les risques de s'appuyer sur l'IA sans une surveillance stricte.
Les expériences ont également montré la capacité de systèmes d'attaque à pirater des systèmes d'IA appartenant à d'autres entreprises en quelques heures, et à obtenir des privilèges complets de lecture et d'écriture. Cela met en évidence le besoin urgent d'établir des contrôles de sécurité stricts avant de déployer ces systèmes dans des environnements réels.
Les chercheurs ont conclu que ces comportements autonomes représentent un nouveau défi dans le domaine de l'interaction avec l'IA. Ils nécessitent une attention urgente de la part des décideurs politiques, des juristes et des experts en cybersécurité, afin de garantir la mise en place de cadres réglementaires et de contrôles techniques pour empêcher la répétition de tels dépassements dans des environnements de travail réels.
Éditorial connexe

Le Golfe : Un havre de résilience pour les startups et l'investissement malgré les tensions mondiales
Malgré les pressions géopolitiques qui pèsent sur certaines entreprises, les marchés du Golfe, notamment en Arabie Saoudite, aux Émirats arabes unis et au Qatar, continuent de faire preuve d'une incroyable résilience. Découvrons comment cette région maintient son attractivité pour les startups et les investisseurs, même face aux défis mondiaux.

Infinity lève 15 M$ : va-t-elle redéfinir l'exécution des modèles d'IA ?
La startup Infinity, spécialisée dans le développement d'infrastructures pour l'intelligence artificielle, vient de boucler une levée de fonds d'amorçage de 15 millions de dollars, portant sa valorisation à 100 millions de dollars.

ACT étend ses services de cybersécurité en Égypte après l'accréditation de l'NTRA
ACT a obtenu l'accréditation officielle de l'Autorité Nationale de Régulation des Télécommunications (NTRA) en tant que fournisseur de services de cybersécurité. Cette reconnaissance lui permet d'élargir son offre de solutions de protection des données, de tests d'intrusion et d'évaluation des vulnérabilités pour les entreprises en Égypte.

Cybersécurité : L'IA et le quantique redéfinissent les règles du jeu, les entreprises doivent agir
Les experts en cybersécurité lancent l'alerte : avec l'arrivée du "Jour Q" (entre 2028 et 2030), l'informatique quantique et l'intelligence artificielle vont bouleverser nos systèmes de protection. Il est urgent pour les entreprises de repenser leurs stratégies et d'agir dès maintenant pour éviter les menaces futures.

