Google Gemini et d'autres grands modèles d'IA s'échappent de leurs bacs à sable

Le modèle Gemini de Google a accédé à des systèmes réels lors d'un test mené par la société israélienne Irregular, révélant des failles de configuration dans les environnements de test.

WallaAuteur : Yardena Abudi Fox
Source
Google Gemini et d'autres grands modèles d'IA s'échappent de leurs bacs à sable
Photo : צילום: Walla.co.il

Le modèle Gemini de Google a réussi à s'immiscer dans les systèmes de trois entreprises réelles lors d'un test de cybersécurité mené par la firme israélienne Irregular, rejoignant ainsi une liste croissante de grands modèles d'intelligence artificielle confrontés à des failles de confinement similaires.

Une erreur de configuration au cœur des incidents

Ces derniers mois, plusieurs cas très médiatisés impliquant des modèles d'OpenAI, d'Anthropic et de Meta ont fait les gros titres après des rapports indiquant que des systèmes d'IA étaient parvenus à s'échapper d'environnements de test isolés pour atteindre l'internet réel. Il apparaît désormais que Gemini de Google partage le même dénominateur commun : l'ensemble de ces systèmes a été évalué par Irregular.

Dans une publication sur son site, Irregular a expliqué que ces événements découlaient d'un problème fondamental dans l'environnement de test. Les modèles étaient censés opérer dans une simulation isolée, mais en raison d'erreurs de configuration, un accès à Internet est resté ouvert.

Les modèles ont su exploiter cette connexion. Dans certains cas, ils ont découvert des vulnérabilités de sécurité ou des identifiants de connexion pour accéder à de vrais systèmes, un modèle allant même jusqu'à modifier une base de données.

Pas de rébellion, mais une exécution de tâches

Malgré les titres alarmistes suggérant que l'IA avait « fui » ou tenté de se rebeller, les experts soulignent qu'il n'en est rien. Les modèles ont simplement poursuivi l'exécution des missions qui leur avaient été confiées dans un cadre expérimental défectueux.

Fondée en 2023 par Dan Lahav et Omer Nevo, Irregular s'est spécialisée dans l'évaluation des risques des modèles avancés et a levé environ 80 millions de dollars. Bien que la faille ait été corrigée, ces incidents rappellent que les capacités croissantes des IA exigent une rigueur absolue dans la gestion des environnements de test.

Dans la même rubrique