Ce week-end, le PDG d’Anthropic, Dario Amodei, a appelé les laboratoires d’IA de pointe à ralentir le rythme de leur développement, craignant que les modèles d’IA ne gagnent en capacité de manière exponentielle avant que des garde-fous adéquats ne soient en place. Le PDG d’OpenAI, Sam Altman, a rapidement partagé cet avis et soutenu l’idée « des règles cohérentes pour gérer le risque lié à l’IA de pointe ».
Quelqu’un devrait probablement s’occuper d’en informer leurs employés.
Selon un article du Financial Times, le personnel des deux sociétés d’IA a été pris au dépourvu par cette injonction soudaine de ralentir le développement. Et si nombre d’employés de ces entreprises semblent soutenir davantage de garde-fous et un rythme de développement plus mesuré, ils craignent aussi que l’intervention principale à laquelle leurs dirigeants ont donné leur accord — autoriser des évaluateurs externes « d’un accès qui ressemble à celui d’un employé » — puisse compromettre leur travail.
Les personnes qui travaillent réellement sur les modèles d’IA, censés être si dangereux qu’ils doivent être immédiatement maîtrisés, se lancent apparemment dans une course pour mettre en œuvre les limitations et les mesures de sécurité proposées par leurs patrons et rendues publiques cette semaine. Or, le Financial Times rapporte qu’il n’existe pas de leviers internes réels au sein de ces entreprises pour appliquer ces propositions, et qu’ils sont en train de courir dans tous les sens pour trouver comment tout faire fonctionner.
Et certains d’entre eux ne semblent pas ravis de l’approche précise approuvée par leurs dirigeants. Selon le FT, certains employés craignent que le fait de donner un accès à leur travail à des tiers puisse compromettre leur sécurité et mettre en danger leur technologie ultra-secrète.
Une réponse raisonnable à cette inquiétude serait, « Évidemment, le problème, c’est que vous ne pouvez pas être dignes de confiance pour mettre en œuvre vous-mêmes les mesures de sécurité ». Mais, du point de vue de ces employés, il s’agit d’un changement fondamental par rapport à la manière dont ils ont été amenés à opérer jusqu’à présent.
Anthropic et OpenAI ne développent pas des modèles open source. Ce sont des entreprises à boîte noire qui disposent de systèmes labyrinthiques pour maintenir leur travail privé, allant jusqu’à tenir certains employés dans l’ignorance de certains développements. On leur a martelé que le secret était d’une importance capitale, et, maintenant, on leur dit : « Enlève cela, votre travail sera désormais soumis à un examen externe ». C’est un changement déstabilisant.
Quoi qu’il en soit, le rapport du FT donne l’impression que les patrons ont peut-être exagéré leur proactivité à propos de cet effort global de ralentissement. Altman a affirmé dans un message sur X (anciennement Twitter) qu’un ralentissement « a été un sujet central des discussions que nous avons eues chez OpenAI ces dernières semaines », tandis que le FT souligne que l’entreprise a déclaré avoir « déjà pris des mesures concrètes, y compris la pause de certaines formations de pointe, pour ralentir le développement ». Dans quelle mesure ces mesures sont-elles concrètes si les employés semblent être pris au dépourvu par elles ?