Je travaille sur les LLM depuis un certain temps, et avec divers think tanks de haut niveau, pour essayer de comprendre les implications philosophiques, morales et éthiques des LLM.

Souvent, on sent un vrai décalage entre la communauté technique et la communauté éthique. Expliquer le fonctionnement interne des LLM à une personne non technique est vraiment difficile, et j’essaie de trouver des façons de le rendre plus accessible.

J’ai récemment donné une conférence devant un panel de 10 éthiciens de haut niveau, avec des formations en philosophie, en bioéthique et en théologie ; voici quelques points clés de notre discussion.

L’IA n’est pas « intelligente »

Utiliser le mot « intelligence » pour décrire l’IA est une erreur. En anglais, intelligence désigne aussi le renseignement, l’information, et non l’intelligence au sens courant du mot français. C’est une mauvaise traduction qui crée beaucoup de confusion. « Information artificielle » serait donc moins trompeur.

Science-fiction

Beaucoup de films de science-fiction dépeignent l’IA comme une force surnaturelle engendrée par des gobelins geeks dans une cave obscure. Ce n’est pas le cas. L’IA n’est qu’un tas de mathématiques et de statistiques. C’est commode pour des scénaristes paresseux qui veulent un méchant qui ne fâche personne.

Mauvais journalisme

La plupart des journalistes ont une compréhension très superficielle de l’IA et écrivent souvent des articles inexacts. Ils ont tendance à réutiliser le matériel marketing des entreprises qui vendent de l’IA, souvent trompeur, et qui gonfle les possibilités réelles de l’IA. C’est un vrai problème, parce que cela crée beaucoup de peur et d’incompréhension dans la population.

Les LLM ne font que prédire le mot suivant

Le texte est une structure séquentielle où la position des mots a un sens, exactement comme en musique. Les LLM sont des modèles séquentiels qui tentent de prédire le mot suivant à partir des mots précédents. C’est un processus déterministe qui sélectionne le prochain token d’une séquence, donc à mille lieues de l’intelligence humaine.

Quel est le statut d’une parole produite par une machine ?

Sur le plan philosophique, la prédiction du prochain token ne peut pas vraiment être mise sur le même plan que la pensée humaine, même si elle est très efficace pour faire semblant.

Quelle est l’ampleur du biais culturel anglophone dans les LLM ?

L’essentiel des données d’entraînement vient d’Internet, et Internet est surtout en anglais. Les LLM sont donc très bons en anglais, et cela semble pousser dans le texte généré un certain biais culturel anglophone, présenté comme neutre.

Un LLM pourrait-il servir à générer une nouvelle religion sur mesure ?

En politique, on a vu un ciblage individuel avancé à partir des données des réseaux sociaux. Les religions ont une approche de « tapis de bombes » : elles essaient de convaincre le plus de gens possible avec un message universel. Des LLM pourraient servir à générer une religion nouvelle pour chaque individu, à partir de ses propres croyances et de ses propres biais. Par exemple, si vous croyez au karma et souhaitez un paradis pour les chats, le LLM pourrait rapidement vous générer une religion sur mesure qui correspond parfaitement à ce que vous voulez entendre et exploite votre sentiment religieux.