Des chercheurs piratent le code source d'OpenAI via l'IA Claude d'Anthropic

Des chercheurs ont pénétré les systèmes d'OpenAI et accédé au code source via le modèle Claude d'Anthropic, révélant de nouveaux risques liés aux capacités de l'IA.

Source
Des chercheurs piratent le code source d'OpenAI via l'IA Claude d'Anthropic
Photo : ICE / open ai (צילום Shutterstock)

Des chercheurs en sécurité ont réussi à pénétrer dans les systèmes internes d'OpenAI pour obtenir l'accès au code source de l'entreprise, en utilisant le modèle d'intelligence artificielle Claude de leur principal concurrent, Anthropic. L'incident, survenu dans le cadre d'un programme de divulgation de vulnérabilités, a valu aux chercheurs une récompense financière tout en soulevant un avertissement retentissant.

Selon un rapport de Forbes, des chercheurs de la start-up Hacktron AI ont réussi à accéder au compte ChatGPT d'un employé d'OpenAI, accédant ainsi au code source interne hébergé sur GitHub. Les chercheurs ont d'abord tenté l'exploitation à l'aide du modèle Claude Opus 4.8, qui a eu du mal à générer la vulnérabilité. Ce n'est qu'après avoir utilisé le modèle plus avancé Opus 5 que l'opération a été menée à bien, illustrant le rythme rapide d'amélioration des capacités des modèles. Les chercheurs ont utilisé une version spéciale de Claude destinée aux professionnels autorisés de la cybersécurité.

OpenAI a corrigé les failles de sécurité exposées et a versé aux chercheurs une prime de 6 500 dollars pour cette découverte.

Les chercheurs soulignent un changement conceptuel profond : alors que les logiciels bénéficiaient auparavant d'une protection grâce à leur complexité et au besoin d'une expertise humaine rare, l'intelligence artificielle transforme cette expertise en puissance de calcul accessible. Des opérations qui nécessitaient autrefois de grandes équipes et des mois de travail se réduisent désormais à quelques jours, obligeant la sécurité d'entreprise à s'adapter rapidement.

Dans la même rubrique