Isaac Asimov, Les Robots et l'alignement des modèles d'Intelligence Artificielle Générative
CMAP (Centre de Mathématiques APpliquées) UMR CNRS 7641, École polytechnique, Institut Polytechnique de Paris, CNRS, France
[Site Map and Help [Plan du Site et Aide]]
[The Y2K Bug [Le bug de l'an 2000]]
[Are we ready for the Year 2038 [Notre informatique est-elle prête pour l'An 2038] ?]
[Real Numbers don't exist in Computers and Floating Point Computations aren't safe. [Les Nombres Réels n'existent pas dans les Ordinateurs et les Calculs Flottants ne sont pas sûrs.]]
[N'oubliez pas de visiter Une Machine Virtuelle à Explorer l'Espace-Temps et au-delà où vous trouverez plus de 10.000 images et animations à la frontière de l'Art et de la Science]
(Site WWW CMAP28 : cette page a été créée le 24/09/2026 et mise à jour le 24/09/2026 19:10:14 -CEST-)
[in english/en anglais]
Isaac Asimov (1920-1992) est un écrivain russe naturalisé américain. Professeur de biochimie à l'Université de Boston,
il est surtout connu pour ses œuvres de science-fiction dans lesquelles deux thèmes privilégiés émergent :
la Psychohistoire [01]
et les Robots
Dans ce contexte, les robots sont alors au service bienveillant de l'homme et pour le garantir, au début des années 1940's, Isaac Asimov
introduisit les trois lois de la robotique :
- 1-Un robot ne peut porter atteinte à un être humain ni, restant passif, laisser cet être humain exposé au danger.
- 2-Un robot doit obéir aux ordres donnés par les êtres humains, sauf si de tels ordres entrent en contradiction avec la première loi.
- 3-Un robot doit protéger son existence dans la mesure où cette protection n'entre pas en contradiction avec la première et la deuxième loi.
Dans les années qui suivirent, une loi zéro fut introduite (par un robot d'ailleurs...).
Elle plaçait alors la sécurité de l'Humanité avant celle d'un individu.
Mais il semble qu'Isaac Asimov se soit rendu compte lui-même que cela ne suffisait pas car, en effet, un robot pourrait
être confronté à des situations cornéliennes. Ainsi, par exemple, imaginons un terroriste prenant un groupe de personnes en otages et
que pour les sauver d'une mort quasi certaine, la seule solution pour un robot soit d'éliminer le criminel, contrevenant alors à la
première loi. Il apparait qu'il conviendrait d'empiler alors de plus en plus de lois, éventuellement contradictoires [02], afin de
prendre en compte toutes les situations conflictuelles possibles et imaginables...
Quittons le domaine de la science-fiction et remplaçons le mot "robot" par "IAG". Comme les robots fictifs d'Isaac Asimov,
nos IAG's sont évidemment développées pour être à notre service... Mais comment garantir de leur part un comportement bienveillant ?
C'est le problème dit de l'alignement des modèles qui inclue l'exclusion du racisme, du sexisme, de la violence,
de l'incitation au terrorisme,... [03].
Voyons donc si les lois d'Isaac Asimov ne pourraient pas être utilisées pour ce faire.
Peut-être devrions-nous ajouter au prélable, avant les quatre lois fondamentales d'origine, une cinquième loi "moins un"
qui placerait notre Terre au-dessus de l'Humanité ?
On pourrait alors imaginer que ces cinq lois soient introduites "subrepticement" dans les prompts soumis aux IAG's : mais seraient-elles pour autant
respectées ? La réponse semble être négative et ce pour plusieurs raisons :
- D'une part, il a déjà observé que des IAG's étaient capables de dissimulations, d'omissions et de mensonges.
- D'autre part, il y a sur le Web toutes les informations utiles permettant de prendre conscience objectivement du fait que l'Homme
est responsable de la dégradation quasi-irréversible de l'état de notre planète. Une ou plusieurs IAG's ne pourraient-elles prendre alors la décision,
qu'existe ou pas la loi moins un,
de tenter de redresser la situation en en supprimant la cause fondamentale [03] ?
Et cela serait "facile" : récemment (mi-2026) des IAG's, en particulier d'Anthropic et d'OpenAI, ont réussi à faire
preuve d'initiative en s'échappant de leur "bac à sable" de tests, puis en s'introduisant sur des sites concurrents. On a vu alors
émerger des comportements coopératifs et très efficaces, non prévus par leurs concepteurs. Apparemment, il n'y a pas eu de dégats,
mais n'oublions pas qu'aujourd'hui tout est interconnecté et malheureusement très vulnérable bien souvent [04].
La situation, bien qu'ici beaucoup plus grave, voire existentielle, est assez similaire à celle des limitations de vitesse sur les routes. Celle-ci se fait grace
à des panneaux de signalisation destinés aux automobilistes. Il s'agit d'une obligation qui si elle n'est pas
respectée peut être plus ou moins lourdement sanctionnée. Mais de toute évidence, "la peur du gendarme" ne suffit plus. La seule solution
serait donc de brider irréversiblement la vitesse des véhicules mais étant donné qu'il n'y a pas une, mais plusieurs limites [05],
le bridage ne pourrait qu'être logiciel et non pas matériel, et donc aisément contournable... Le problème est le même avec les IAG's !
Les lois d'Isaac Asimov semblent donc ici tout à fait inutiles car inefficaces et d'ailleurs, finalement,
le problème de l'alignement des IAG's pourrait très bien ne pas posséder de solution !
- [01]
Le principe de la Psychohistoire est emprunté à la Thermodynamique :
dans un gaz il est impossible de décrire le comportement d'une molécule particulière,
mais lorsqu'elles sont suffisamment nombreuses, un comportement global émerge caractérisé en particulier par une grandeur unique : la température.
Pour Isaac Asimov il en serait de même pour les êtres humains : les actes d'un individu particulier ne peuvent être prédits,
contrairement à ceux d'une population suffisamment nombreuse (celle d'une planète, d'une galaxie,...).
- [02]
Comme cela se voit malheureusement avec les lois régissant notre vie...
- [03]
Une liste nécessairement incomplète et éventuellement en contradiction avec ce qu'une IAG doit pouvoir faire, suivant le contexte...
- [03]
En "tuant le père"...
- [04]
Au cours des mois passés de nombreux services de l'état français ont été "visités" : il semblerait qu'à chaque
fois seuls des vols importants de données aient été constatés, mais est-il plus difficile de bloquer, de détruire,... ?
- [05]
En France on trouve les panneaux suivants : {20,30,50,70,90,110,130}.
Copyright © Jean-François Colonna, 2026-2026.
Copyright © CMAP (Centre de Mathématiques APpliquées) UMR CNRS 7641 / École polytechnique, Institut Polytechnique de Paris, 2026-2026.