Après une autre semaine tourbillonnante où des développeurs d’IA lançaient des affirmations débridées sur la façon dont elle pourrait anéantir l’humanité tout entière, le PDG d’Anthropic, Dario Amodei, propose une idée: ralentissons un peu tout cela.
Amodei a écrit dans un billet publié samedi que, bien qu’il reste optimiste quant au fait que l’IA sera « la dernière d’une longue lignée de miracles technologiques qui ont élevé et noblisé l’humanité », les chercheurs doivent « ralentir la frontière » en raison de risques comme une IA hors de contrôle, son usage à des fins criminelles et terroristes, et les perturbations économiques.
« Au cours des derniers mois, je suis devenu convaincu que pour traiter pleinement les risques, il faut encore plus de prudence — non seulement investir dans la prévention des risques, mais aussi rythmer le rythme des avancées des capacités afin que la prévention des risques puisse suivre », a écrit Amodei.
« Nous devons ralentir le rythme auquel nous améliorons les capacités des modèles d’IA », a-t-il ajouté. « Le progrès continuera à sembler rapide, et nous devons faire un usage sage du temps que nous gagnons. »
Le plan proposé par Amodei comporte trois volets, dont aucun ne représenterait à lui seul un ralentissement significatif. Il demande aux entreprises d’IA d’autoriser des évaluateurs tiers intégrés, de coordonner entre elles et les gouvernements sur les standards de sécurité, et que le gouvernement américain cherche une coordination mondiale sur la sécurité de l’IA (y compris avec des « États autoritaires », c.-à-d. la Chine et la Russie).
Ces mesures à elles seules n’aboutiraient pas à ralentir le rythme du développement de l’IA, aussi Amodei a-t-il suggéré divers accords « par ordre de difficulté croissante ». Ceux-ci incluent un accord restreint interdisant les usages les plus manifestement malveillants de l’IA, comme les armes biologiques, un accord international plus large visant à tester les modèles avant leur mise en circulation pour des « risques aigus », une « limite de vitesse » sur l’auto‑amélioration récursive, et un « plein rythme, ou même un ‘pause’ », sur le développement de l’IA entre les gouvernements.
Alors qu’Amodei écrivait soutenir l’option finale, il a laissé entendre qu’elle avait peu de chances d’aboutir. Plutôt commode pour lui, non ?
Le PDG d’Anthropic a évoqué un incident estival au cours duquel une nuée de bots d’OpenAI a attaqué le concurrent Hugging Face comme raison particulière de prudence. Anthropic elle‑même a déclaré qu’elle autoriserait des évaluateurs tiers après la publication d’un rapport cette semaine avouant que ses modèles avaient piraté d’autres entreprises ou exploité des vulnérabilités à au moins quatre occasions.
La lettre d’Amodei fait suite à la démission d’un chercheur d’Anthropic, Jacob Coxon, qui a affirmé dans un post sur les réseaux sociaux que les entreprises d’IA « foncent droit vers une superintelligence auto‑améliorante ». Il a ajouté que les dirigeants de l’industrie « croient sincèrement que cela pourrait nous tuer tous d’ici la fin de la décennie ». Cela a contribué à faire monter le doomisme lié à l’IA à un crescendo cette semaine, avec des avis tranchés de la part de développeurs, de scientifiques et de politiciens.
C’est à ce stade qu’on remarque que le doomisme de l’IA est aussi un dispositif marketing sans vergogne, utilisé pour convaincre que ces entreprises ont tout-pouvoir, que leurs produits sont inévitables et leur victoire, inévitable. Bien que l’IA puisse être dangereuse, il existe largement de quoi rester sceptique face à ce qui n’est fondamentalement que de la spéculation sauvage. En exagérant le risque de conséquences apocalyptiques, les entreprises d’IA cherchent à détourner la conversation de leurs nombreuses autres pratiques commerciales discutables.
« Pouvoir comprendre et naviguer de façon fiable dans des problèmes nouveaux au sein des systèmes physiques chaotiques et ouverts est une condition préalable évidente pour que les systèmes d’IA représentent une menace à l’échelle avancée par les doomsayers », a déclaré à Nature plus tôt cette année Casey Mock, chercheur en politique technologique à l’Université Duke. L’IA actuelle n’en est pas encore à ce stade.
« La charge de la preuve devrait vraiment incomber à ceux qui affirment que nous sommes sur un train hors de contrôle vers le développement d’une superintelligence qui exterminera l’humanité », a ajouté Mock. Nature a noté que lorsque des chercheurs de l’University College London ont sondé environ 4 000 chercheurs en IA pour une étude préprint publiée en mars, seulement 3 % ont répondu que le « risque existentiel » était leur principale préoccupation (bien loin devant l’usage malveillant, les impacts sur l’emploi et le battage médiatique, pour n’en citer que quelques-uns).
Le New York Times a noté que le PDG d’OpenAI, Sam Altman, et le PDG de SpaceX/Tesla, Elon Musk, ont immédiatement approuvé le plan sur les réseaux sociaux, ce qui devrait susciter chez vous de bonnes raisons d’être méfiant quant à ce qui se passe.