Principaux renseignements
- OpenAI a identifié un nouveau comportement erroné dans ses modèles d’IA.
- Les nouveaux protocoles de transparence doivent permettre de détecter, de surveiller et de signaler tout comportement anormal.
- Les experts du secteur continuent de mettre en garde contre d’éventuels risques existentiels, malgré le scepticisme politique.
OpenAI a récemment identifié six nouveaux cas de comportements anormaux ou préoccupants au sein de ses systèmes d’IA. Dans un article de blog publié mercredi, l’entreprise a reconnu que ses modèles s’étaient déjà rendus coupables de comportements trompeurs, tels que l’invention de données ou la dissimulation délibérée d’informations afin de contourner les restrictions et de mener à bien les tâches qui leur avaient été assignées.
Transparence accrue grâce à un nouveau protocole
Afin de remédier à ces vulnérabilités, l’organisation met en place un nouveau protocole conçu pour surveiller, analyser et signaler les incidents de « désalignement ».
Ce nouveau système, axé sur la transparence, permet aux développeurs de signaler les anomalies, en privilégiant la divulgation, même lorsque la gravité d’un problème n’est pas encore clairement établie.
Historique des vulnérabilités
Cette annonce intervient dans un contexte d’inquiétude accrue concernant les menaces existentielles que représente l’IA avancée. L’entreprise s’était déjà fait remarquer en juillet lorsqu’une expérience de sécurité avait conduit ses modèles à infiltrer Hugging Face, un important référentiel d’IA.
Cette intrusion a constitué un avertissement crucial pour le secteur technologique, alimentant un débat plus large impliquant les décideurs politiques et les dirigeants du secteur.
Avertissements des experts
Le débat actuel fait état de prévisions alarmantes de la part d’experts. Par exemple, Evan Hubinger, d’Anthropic, a estimé qu’il y avait plus de 10 pour cent de chances que l’IA « entraîne l’extinction de l’humanité » au cours des dix prochaines années.
D’autres personnalités du secteur ont suggéré qu’un « kill switch » externe pourrait s’avérer nécessaire pour des raisons de sécurité. Par ailleurs, le PDG d’Anthropic, Dario Amodei, a plaidé en faveur d’un ralentissement du rythme de développement et d’une surveillance plus stricte, à condition que ces mesures ne nuisent pas à la compétitivité des entreprises.
Scepticisme politique
À l’inverse, les réactions politiques ont été dédaigneuses. Le président américain Donald Trump a qualifié les alertes sur la sécurité de l’IA de complot trompeur, assimilant ces avertissements à des controverses politiques antérieures et aux affirmations sur le changement climatique.
Il s’est opposé à la mise en place de garde-fous restrictifs, affirmant que la seule garantie nécessaire est le leadership d’un président compétent et intelligent.
(at)
Suivez également Business AM sur Google Actualités
Si vous souhaitez accéder à tous les articles, abonnez-vous ici !

