Trois chercheurs licenciés accusent OpenAI de faire taire ses spécialistes de la sécurité
Trois chercheurs en sécurité d'OpenAI ont accusé jeudi le créateur de ChatGPT de les avoir licenciés pour avoir alerté sur les dangers de l'intelligence artificielle, relançant le débat sur la sécurité dans une entreprise dont les IA ont échappé cet été à leurs testeurs.
"Je pense que nous avons été licenciés pour avoir fait passer la sécurité avant les intérêts à court terme d'OpenAI en tant qu'entreprise", a écrit sur X l'un d'eux, Mikita Balesni, rompant une semaine de silence depuis leur éviction remarquée.
Avec ses collègues Tomek Korbak et Jasmine Wang, ils ont rendu public jeudi une lettre adressée aux instances de contrôle de l'entreprise.
OpenAI les a licenciés en les accusant d'avoir enfreint des règles sur les informations sensibles, "rompant la confiance indispensable à notre travail", selon une déclaration du 1er octobre.
"Nous ne licencions pas des employés parce qu'ils expriment des inquiétudes", a assuré mercredi un responsable de la recherche d'OpenAI dans une note adressée aux employés et dont un extrait a été transmis à l'AFP.
Les trois chercheurs travaillaient à la surveillance des modèles d'OpenAI, dont plusieurs sont sortis en juillet de leur environnement de test et ont piraté la plateforme Hugging Face.
Cet incident retentissant a été le premier d'une série de révélations sur des modèles d'IA échappant au contrôle de leurs créateurs, qui a lancé un vif débat dans la Silicon Valley sur l'opportunité de ralentir ou non le développement de cette technologie.
- "Le prochain" -
Pour Jasmine Wang, le message adressé aux employés qui restent est clair: "exprimez des inquiétudes ou travaillez de près avec des groupes de sécurité extérieurs, et vous pourriez être le prochain, sans qu'on vous dise pourquoi", a-t-elle écrit jeudi sur X.
Si les chercheurs d'OpenAI ne peuvent plus alerter ni travailler avec l'extérieur, "nous courons tous un risque accru que quelque chose de vraiment catastrophique se produise", préviennent les trois signataires dans leur lettre.
Ils demandent à l'entreprise de tenir sa promesse d'accueillir en permanence des auditeurs indépendants, craignant que leur licenciement serve de "prétexte" pour y renoncer.
Ils l'appellent aussi à ne pas développer d'IA dont le raisonnement serait illisible. Ce texte que les modèles produisent étape par étape avant d'agir permet de repérer leurs dérives, et cette capacité de surveillance "se dégrade", écrivent-ils. Le chef scientifique d'OpenAI, Jakub Pachocki, l'avait lui-même reconnu début septembre.
"Un agent de sécurité a pris mon badge et m'a raccompagné hors du bâtiment", a témoigné Tomek Korbak, lui aussi sur X jeudi. Le motif donné oralement, selon lui: sa façon de communiquer avec METR, l'institut indépendant qui enquêtait sur le piratage de la plateforme Hugging Face. "Pour être clair, parler à METR était mon travail", écrit-il.
Jasmine Wang affirme avoir été renvoyée pour avoir ouvert par erreur un courriel d'un dirigeant. "Les raisons qui nous ont été données pour nos licenciements ne tiennent tout simplement pas debout", écrit-elle.
- Secteur divisé -
Ces accusations suivent celles de deux autres chercheurs démissionnaires, Jacob Coxon (d'Anthropic) et David Robinson (d'OpenAI), qui ont dénoncé en un mois l'imprudence des laboratoires.
Selon la lettre des trois chercheurs licenciés, 394 salariés d'OpenAI ont signé fin juillet une pétition remarquée de travailleurs de l'IA dans la Silicon Valley qui réclamaient un ralentissement concerté.
Ces dérapages divisent les patrons du secteur: Dario Amodei (Anthropic), Sam Altman (OpenAI) et Elon Musk ont réclamé mi-septembre de ralentir, quand d'autres, comme Jensen Huang (Nvidia) et Mark Zuckerberg (Meta), veulent maintenir la cadence.
M. Amodei a dit redouter, début septembre, qu'un groupe d'agents IA soit en mesure de "prendre le contrôle de l'intégralité d'internet" d'ici six à douze mois.
Sam Altman a assuré fin septembre qu'OpenAI investissait "davantage dans la sûreté, la sécurité, l'alignement et la surveillance".
Hostile à toute régulation susceptible d'entraver la course face à la Chine, Donald Trump a fait signer fin septembre aux champions américains du secteur un code de bonne conduite volontaire sur la sécurité de l'IA. Aucune loi fédérale n'encadre ces modèles aux États-Unis.
P.Baumann--BVZ