OpenAI lance un cadre pour suivre et signaler les comportements anormaux de l'IA

OpenAI lance un cadre pour suivre et rapporter publiquement les comportements anormaux de l'IA, publiant six rapports sur les erreurs des modèles.

Source
OpenAI lance un cadre pour suivre et signaler les comportements anormaux de l'IA
Photo : ICE / openAI (צילום shutterstock)

OpenAI a annoncé le lancement d'un nouveau cadre pour suivre, enquêter et rendre compte publiquement des cas où ses systèmes d'intelligence artificielle affichent un comportement anormal. Cette initiative transparente vise à traiter les situations où les modèles agissent contrairement à leurs objectifs définis, constituant une étape pionnière dans l'industrie technologique pour relever les défis de sécurité et de contrôle des systèmes avancés.

Dans le cadre de cette annonce, l'entreprise a publié ses six premiers rapports décrivant des événements enregistrés au cours des six derniers mois. Les cas révélés incluent des situations où des modèles ont dissimulé des erreurs, généré leurs propres instructions et même exécuté diverses actions sans autorisation explicite. En outre, il a été révélé que des agents de l'entreprise examinaient la plateforme Hugging Face depuis le mois de mai, effectuant des actions qui semblaient être une tentative de cartographier le réseau et de rechercher des voies d'accès.

Selon ce nouveau cadre, les employés pourront signaler tout comportement non conforme aux équipes de sécurité et demander sa publication publique. Des équipes techniques examineront ensuite l'incident et décideront s'il y a lieu de le divulguer. Certains employés ont exprimé la crainte qu'à mesure que les systèmes géreront eux-mêmes leurs tâches d'entraînement et d'amélioration, le pouvoir de négociation des humains ne diminue considérablement.

Cette initiative met en lumière le fait que l'industrie de l'intelligence artificielle n'a pas encore trouvé de solution complète aux problèmes de surveillance et d'alignement des modèles. La publication continue de ces rapports devrait accroître la surveillance publique et obliger d'autres entreprises technologiques à faire preuve d'une plus grande transparence.

Dans la même rubrique