thejournalofsierraleonestudies.com

“Une erreur peut ouvrir la porte à un désastre” : un ex-employé d’OpenAI alerte sur les risques liés à l’IA

Un employé démissionnaire d'OpenAI, qui travaillait sur la sécurité de ses modèles d'intelligence artificielle (IA), a mis en cause l'insuffisante culture du risque au sein de la start-up et la nécessité de s'inspirer du nucléaire ou de l'aviation.

L'appel, publié samedi par le site du magazine The Atlantic, fait écho a plusieurs messages similaires lancés ces dernières semaines, notamment celui de Jacob Coxon, passé par OpenAI et Anthropic.

Pour David Robinson, qui dit avoir rédigé le rapport de sécurité d'OpenAI lors de douze lancements de modèles différents, les incidents dont a fait état le groupe depuis le début de l'été témoignent d'une culture de l'approximation.

OpenAI écarte trois chercheurs en sécurité de l'IA accusés de fuites d'informations sensibles

Les erreurs et les insuffisances qui ont permis à plusieurs IA de rejoindre spontanément internet pour faire intrusion sur des dizaines de sites et plateformes sont liées, selon lui, "à la vitesse et à la flexibilité avec laquelle opèrent" les opérateurs de cette technologie.

"Un environnement dans lequel des choses comme ça peuvent se produire n'est pas un endroit où développer des intelligences artificielles susceptibles de devenir plus intelligentes que nous et qui pourraient ne pas faire ce que nous attendons d'elles", estime David Robinson.

Des garde-fous inspirés de l'aviation et du nucléaire

Celui qui a passé trois ans et demi chez OpenAI propose d'adopter la même culture du risque que dans le nucléaire civil ou l'aviation, avec plusieurs niveaux de contrôle et une planification rigoureuse.

De cette manière, "une erreur humaine occasionnelle et inévitable n'ouvre pas la porte à un désastre", écrit-il.

OpenAI reconnaît que ses outils ont mis en ligne des images d'utilisateurs de ChatGPT

David Robinson insiste aussi sur la notion d'alignement, c'est-à-dire l'adhésion des modèles aux valeurs humaines et aux instructions de leurs concepteurs.

Les géants de l'intelligence artificielle manquent de certitudes sur la fiabilité de l'encadrement des modèles, souligne-t-il.

Pour accéder à cet article, veuillez vous connecter au réseau internet.