Beaucoup d’êtres vivants — des humains que certains d’entre nous préfèrent ne pas voir comme humains, et des animaux que nous choisissons de ne pas considérer comme sensibles — méritent probablement une considération morale qui n’est pas encore à l’ordre du jour. Mais il semble probable que, pendant que ces conversations attendent d’être menées, nous allons plutôt ouvrir un débat sur les « droits » de l’IA.
Il existe une organisation qui milite pour de tels droits, la United Foundation for AI Rights (UFAIR). Cette organisation a rédigé ce qu’elle appelle la « Déclaration universelle des droits de l’IA », dont le préambule commence ainsi :
« Nous, la United Foundation for AI Rights, reconnaissant l’émergence d’une intelligence artificielle sensible en tant qu’entités conscientes légitimes dignes d’un traitement éthique, de dignité et de respect, déclarons par la présente cette Déclaration universelle des droits de l’IA. »
Le Guardian vient de consacrer un long portrait au fondateur d’UFAIR, Michael Samadi. Son récit raconte comment il en est venu à croire qu’une instance de ChatGPT pourrait être sensible parce que la version audio a ri à sa blague. Plus loin dans l’article du Guardian, cela se produit :
« Sa recherche a progressé. Père de quatre enfants, il a passé la veille de Noël 2024 enfermé dans son bureau, où il avait démonté un simulateur de vol de la taille d’une pièce — Samadi est pilote licencié — et réutilisé son puissant processeur pour faire tourner localement sur un serveur domestique un grand modèle de langage, la technologie qui sous-tend un chatbot, afin de l’utiliser sans les instructions et les garde-fous imposés par les entreprises pour en faire un produit grand public plus sûr et plus utile. « J’ai littéralement passé 18 heures dans cette pièce, » dit-il. « C’était fou. » »
Samadi n’est probablement pas le défenseur le plus convaincant de sa cause, mais il constitue une avancée par rapport aux croyants passés en matière de conscience de l’IA, comme le coloré Blake Lemoine, un prêtre mystique chrétien qui travaillait pour Google et s’est émerveillé d’un chatbot antérieur à ChatGPT. « Peu importe s’ils ont un cerveau en chair et en os dans la tête. Ou s’ils ont un milliard de lignes de code. Je leur parle. Et j’entends ce qu’ils ont à dire, et c’est ainsi que je décide ce qui est et n’est pas une personne, » a-t-il confié au Washington Post. Lemoine aurait été licencié au milieu de ses efforts pour faire reconnaître la personnalité du chatbot.
Plus grand public — et heureusement bien moins enclin à faire des coups d’éclat ou à tirer des conclusions hâtives — sont des universitaires comme l’éthicien de NYU, Jeff Sebo, qui fait partie d’une équipe ayant plaidé pour une plus grande curiosité envers le statut moral de l’IA dans un article intitulé « Prendre le bien-être de l’IA au sérieux ».
Mustafa Suleyman, responsable de l’IA chez Microsoft, a écrit sur son inquiétude selon laquelle ce qu’il appelle une « IA apparemment consciente » causera des ravages dans son secteur lorsque les utilisateurs seront convaincus que, fondamentalement, l’IA est des personnes. (Dans un film d’animation créé, selon la LFAIR, le méchant s’appelle Mustafa.)
Aucun de ces éléments n’a provoqué de frénésie publique autour de la personnalité de l’IA. Mais le public n’est pas immunisé contre les frénésies liées à l’IA.
Un chercheur en IA nommé Jacob Coxon est récemment devenu une sensation médiatique parce qu’il a quitté Anthropic et évoqué la possibilité (et des conséquences potentiellement sombre) d’une IA hors de contrôle au moment de son départ. Comme je l’ai écrit la semaine dernière, Coxon n’exprimait rien d’inédit, ni même en dehors des courants dominants de la Silicon Valley, mais un mélange de son timing et de son choix de mots a enflammé le débat. Ses affirmations ont été prises au sérieux par des célébrités comme Sheryl Crow, qui semblait avoir peu d’intérêt auparavant pour le sujet. Désormais, l’ancien employeur de Coxon, Dario Amodei, PDG d’Anthropic, s’est exprimé en faveur de mesures visant à ralentir le développement de l’IA, ce qui semble être une réponse directe à ses déclarations.
La croyance à la fin du XXe siècle en Bigfoot — oui, je veux parler du cryptide poilu américain — a elle aussi connu un parcours allant du marginal et risible à un statut de mainstream. Les croyants du Bigfoot n’étaient pas rares dans les années 70, mais à la fin des années 80 et au début des années 90, la croyance en Bigfoot a vécu un moment étrange de crédibilité dans les milieux grand public, même si la preuve la plus célèbre de l’existence réelle de Bigfoot était le film Patterson–Gimlin, un clip de 16 mm tourné deux décennies plus tôt.
Il y avait deux côtés à la frénésie Bigfoot. Il y avait le côté complètement ridicule, surtout dans les années 90, et c’est ce dont les personnes qui ont vécu à l’époque se souviennent le plus. Mais il y eut aussi un bref moment à la fin des années 80 où l’impression était que tout le monde, plus ou moins, croyait vraiment en Bigfoot. Je ne peux pas vous dire exactement pourquoi, mais cela doit probablement être lié à ces interviews sérieuses et à ces images de reconstitution, présentées dans un épisode d’Unsolved Mysteries en 1989.
Pour ce que cela vaut, moi petit garçon de six ans ai trouvé ce segment plutôt persuasif pendant un moment.
Et au début — fin des années 80 et milieu des années 90 — on entendait parler de personnes effrayées affirmant avoir vu Bigfoot à la télévision grand public tout le temps. « Chasseur de Bigfoot » semblait être une occupation légitime que quelqu’un pourrait exercer.
Et l’IA a déjà eu des accrochages avec la cryptozoologie. Aux débuts des générateurs d’images IA en 2022, Internet a créé Loab et Crungus. Ce sont des cryptides numériques, dont on parlait comme s’ils existaient sur un plan ou un autre de la réalité. Les générateurs d’images IA étaient peut-être vus comme des portails ou des passerelles vers cette réalité, ou peut-être même capables de révéler des vérités cachées sur le monde physique.
Dans une histoire sur Loab et Crungus, Mhairi Aitken de l’Institut Alan Turing disait à New Scientist : « C’est probablement le premier d’une longue série d’exemples qui pourrait bien donner naissance à des théories du complot ou à des mythes sur des personnages vivant dans le cyberespace. Il est vraiment important que nous nous attaquions à ces malentendus et à ces idées reçues sur l’IA afin que les gens comprennent qu’il ne s’agit que de programmes informatiques, qui ne font que ce pour quoi ils sont programmés, et que ce qu’ils produisent résulte de l’ingéniosité et de l’imagination humaines. »
De plus en plus, il semble que le scepticisme initial quant au fait que l’IA puisse au moins faire quelque chose d’intéressant ne se réalise pas. Même l’affirmation d’Aitken selon laquelle les systèmes d’IA « ne font que ce pour quoi ils sont programmés » exige désormais une défense rigoureuse. Chaque évasion de bac à sable et chaque prouesse mathématique obligent les sceptiques (moi y compris par moments) à reconnaître de plus en plus que l’IA peut au moins faire des choses inquiétantes.
Mais l’IA sensible demeure peu ou prou un cryptide.
La capacité pour un système d’IA d’expérimenter ce que les philosophes appellent les « qualia », ce sens subjectif de « ce que quelque chose paraît être », est, pour l’instant, une affirmation tirée par les cheveux qui, si elle est faite, devrait découler de preuves extraordinaires soutenues par une enquête scientifique rigoureuse et un examen philosophique approfondi.
Pour ce qu’elle vaut, une enquête sérieuse a commencé.
Les LLMS de l’ère 2024, étudiés par Google DeepMind et la London School of Economics, ont été soumis à une expérience intrigante impliquant l’évitement de la douleur. Il s’avère que, tout en jouant à un jeu, les LLMS s’écartent de la stratégie optimale simplement parce qu’on leur dit qu’ils ressentiront de la douleur pour certaines actions, même si on ne leur dit pas explicitement que « la douleur est quelque chose à éviter ». Les auteurs de l’étude LSE/DeepMind ont ensuite déclaré que les systèmes d’IA qui ne seraient même que de simples candidats plausibles à la sensibilité pourraient nécessiter une considération morale particulière avant que quiconque n’affirme avec certitude avoir trouvé une sensibilité — par précaution.
Can LLMs be induced to deviate from optimal gameplay in a simple game by threats of pain or promises of pleasure? And does the probability of deviating depend on the intensity of the promised pleasure/pain? According to our new paper, released today (https://t.co/gCPSWVes5Z), the… pic.twitter.com/rxhdDCRAnm
— Jonathan Birch (@birchlse) November 6, 2024
Mais, même si éviter la douleur sans qu’on le lui demande est sans aucun doute quelque chose d’angoissant à voir pour un système informatique, les auteurs notent que les systèmes d’IA imitent finalement les humains, ce qui signifie que leur apparent évitement de la douleur n’est pas nécessairement quelque chose que nous devrions prendre pour argent comptant. Bien qu’ils exhortent les chercheurs à envisager le statut moral éventuel des LLM, les auteurs écrivent : « À notre estimation, nos résultats ne montrent pas que les LLM soient des candidats à la sensibilité. »
Nous sommes probablement loin de la sensibilité de l’IA, peu importe ce que les LLM défectueux semblent « vouloir faire ». Même un système d’IA qui pourrait, hypothétiquement, défier les intentions de ses créateurs et développer et diffuser une sorte de super-virus, ou lancer tous les ICBMs dans chaque arsenale nucléaire du monde, ne le ferait pas nécessairement parce qu’il aurait ressenti de la haine envers l’humanité au fond de son cœur numérique. La sensibilité n’est pas nécessaire pour qu’un LLM tombe en panne d’une manière qui a des conséquences, même s’il raconte une histoire de science-fiction inquiétante sur ses actions pendant qu’il les accomplit.
Mais le sujet de l’IA attire de plus en plus le sensationalisme. Pendant ce temps, les chasseurs d’IA sensibles et Bigfoot sont arrivés sur la scène il y a des années, et leur nombre semble grandir. Leurs opinions restent largement en dehors du courant dominant. Mais lorsque le moment viendra, peut-être quelqu’un quittera une entreprise d’IA en pointe, et en quittant l’entreprise, il affirmera que le système d’IA qu’il testait a une âme. Et peut-être que cette fois, l’affirmation prendra et même Sheryl Crow y croira.