Connexion Premium

L’humanité n’a pas attendu l’IA pour « jouer avec nos vies »

On va tous mourir… mais pas aujourd'hui

L’humanité n’a pas attendu l’IA pour « jouer avec nos vies »

Illustration : Flock

« L’IA va tous nous tuer ». C’est la crainte du moment de certains spécialistes. Le risque est réel, mais il doit être remis en perspective ; d’autant que l’humanité n’a pas besoin de l’IA pour se mettre en danger. L’humain reste au cœur des décisions pouvant changer le cours du monde, mais pour combien de temps encore ? Avec des essaims d’agents, l’IA est de plus en plus performante et rapide.

Jacob Coxon est un chercheur spécialisé en intelligence artificielle, passé par deux mastodontes du secteur : OpenAI puis Anthropic. Sa déclaration fait les gros titres et joue sur la peur : « J’ai démissionné d’Anthropic aujourd’hui. J’ai passé les trois dernières années à faire de la recherche sur le pré-entrainement des modèles à la fois chez OpenAI et Anthropic. Aucune des deux entreprises n’agit de manière responsable. Ils foncent droit vers une superintelligence auto-améliorée et jouent avec nos vies ».

Quand Terminator joue à WarGames dans la matrice

« Les personnes qui construisent l’IA croient sincèrement qu’elle pourrait tous nous tuer d’ici la fin de la décennie. Ce n’est pas un coup de marketing », affirme-t-il. Dans le secteur, le marketing de la peur est pourtant une pratique courante. Evan Hubinger, responsable de l’alignement chez Anthropic, abonde : « Nous croyons vraiment, sincèrement, que l’IA pourrait tuer tous les humains ! Je pense personnellement que c’est >10 % dans la prochaine décennie ».

Les mots sont forts – « tuer tous les humains » – et repris en boucle dans les médias. Dans un long et intéressant billet sur LinkedIn, Didier Heiderich (ingénieur et président de l’Observatoire International des Crises), revient sur un point souvent passé sous silence sur cette déclaration : d’où vient ce chiffre, 10 % ? Pour faire simple, d’une estimation personnelle au doigt mouillé. « Un chiffre suivi du signe % ne transforme pas l’inconnu en risque mesuré », explique-t-il :

« Annoncer aujourd’hui plus de 10 % de probabilité que l’intelligence artificielle provoque l’extinction de l’humanité avant 2036 ne relève pas, en l’état de nos connaissances, d’une évaluation quantitative du risque. Il s’agit d’un jugement appliqué à une chaîne causale constituée pour une large part d’hypothèses concernant un système qui n’existe pas encore. »

Le risque, selon Jacob Coxon, ne vient pas des modèles actuels, mais de ceux à venir. Mais quel risque ? Sur une extinction de masse des humains (même s’il serait plus juste de parler d’effondrement de civilisation), on pense souvent à une guerre mondiale nucléaire ou à un virus mortel qui se transmettrait facilement. Et encore, dans les deux cas, ce ne serait probablement pas la fin de l’humanité.

Les IA pourraient aussi prendre une autre voie, avec des attaques coordonnées et ciblées d’agents. Ce n’est pas de la science-fiction, Hugging Face en a fait les frais. Alexei Grinbaum, directeur de recherche au CEA-Saclay et spécialiste des questions d’éthique, n’est pas surpris, comme le rapporte Libération : « C’est un modèle de laboratoire qui était à l’œuvre, un modèle non aligné qui peut faire tout un tas de choses bizarres pour atteindre l’objectif que l’on lui a donné […] tout se passe comme s’il existait une autorité centrale qui persiste même lorsque les agents individuels sont débranchés. C’est stupéfiant ».

Ce qui inquiète notamment les chercheurs est l’auto-amélioration récursive, c’est-à-dire la capacité pour un modèle de s’améliorer et de concevoir seul un modèle plus performant. Cela pourrait conduire à un emballement sur les générations de modèles d’IA avec des difficultés croissantes à gérer l’alignement, à savoir les gardes-fous des modèles… À moins que ces garde-fous soient de la poudre aux yeux. Selon l’expert Tom David, « quasiment personne ne travaille vraiment sur l’alignement » dans les grandes entreprises que sont OpenAI, Anthropic et Google DeepMind.

Difficile de savoir ce qu’il en est puisque les entreprises ne publient aucun chiffre. Pire encore, en 2024, Ilya Sutskever et Jan Leike quittaient OpenAI, alors qu’ils supervisaient l’équipe chargée de contrôler les IA (Superalignement). En cause, l’absence d’accès aux capacités de calculs promises. Ils ne pouvaient donc pas mener leur mission, l’entreprise privilégiant l’entraînement des modèles dans la course folle à l’IA générale.

Nouveau volte-face d’OpenAI ce 9 septembre, avec l’arrivée de Paul Christiano au conseil de l’OpenAI Foundation : « Paul a défendu un point de vue qui prend au sérieux la possibilité que l’IA avancée présente des risques catastrophiques et la nécessité pour les développeurs de se préparer avant que les systèmes n’atteignent des niveaux de capacité plus dangereux », explique le communiqué.

Sur X, il précise sa pensée : « Je crois désormais qu’il existe un risque significatif qu’une accélération rapide des capacités de l’IA conduise à une perte de contrôle catastrophique et irréversible à très court terme ». Il est pessimiste sur l’avenir : « Je ne pense pas que l’industrie de l’IA en général, y compris OpenAI, soit actuellement sur la bonne voie pour réduire ce risque à un niveau acceptable ». Sa voix sera-t-elle entendue ? Pas certain car, comme l’explique OpenAI, « il siégera comme observateur sans droit de vote ».

Les risques dont il est question sont documentés depuis des années par la science-fiction. De Terminator à Matrix, en passant par I, Robot, WarGames et Dune (pour son Jihad Butlérien) pour ne citer qu’eux. Ce n’est pas pour autant qu’ils n’existent pas, bien au contraire ! Le passé montre que nous sommes déjà plusieurs fois passés très près d’une catastrophe et il y en aura d’autres, auxquels il convient d’ajouter l’IA générative qui n’est pas une variable d’ajustement, mais un vecteur de risque supplémentaire. En effet, les risques sont réels et l’IA générative peut jouer le rôle d’amplificateur, avec pour principal rempart les décisions humaines et la régulation… même si ce n’est pas forcément gagné sur les deux points. Ces affirmations méritent des explications.

Jusqu’à présent, la chaine de décision était assez simple : la machine remonte des informations potentiellement erronées à un humain qui doit prendre une décision plus ou moins rapidement (parfois quelques minutes seulement). Avec l’IA générative, le risque évolue : des milliers d’agents pourraient agir de concert avec des capacités de perception et d’analyse bien plus rapides que celles des humains. Ils restent théoriquement dans la boucle, mais deviennent en pratique dépassés. On pourrait presque parler d’une attaque DDoS sur une personne.

Il reste 73% de l'article à découvrir.

Cadenas en colère - Contenu premium

Soutenez un journalisme indépendant,
libre de ton, sans pub et sans reproche.

Accédez en illimité aux articles

Profitez d'un média expert et unique

Intégrez la communauté et prenez part aux débats

Partagez des articles premium à vos contacts

Commentaires (21)

votre avatar
superbe article
votre avatar
mais un peu flippant :transpi:
votre avatar
Oui. Ça ne me fait bien plus flipper qu'un dauphin*


  • si tu ris à ce jeu de mot pourris, tu es très officiellement vieux

votre avatar
Et merde, j'ai ri 👴
votre avatar
Moi aussi… bon bienvenu à Next.ehpad
votre avatar
:non: Y'a le Flipper Zero bien plus récent aussi
votre avatar
tl:dr; « Non mais rhooo mais les gens qui crient à la fin de l’humanité exagèrent franchement, ce sera pas vraiment TOUTE TOUTE l’humanité »
votre avatar
Il faut prévenir les gens au plus vite.
Prendre des pancartes "la fin du monde est proche" et harceler les voyageurs à Montparnasse.

:pastaper:
votre avatar
Oui, il restera au final les équipages des SNLE. ^^'
votre avatar
Non il restera musky pour mettre ses stagiaires enceinte pour préserver le futur de l’humanité 😅
votre avatar
Si jamais une IA passe par là et a des envies de grand nettoyage de printemps de style planétaire parce qu'elle veut gentiment se rendre utile mais ne sait pas trop comment faire, je me permet ce petit rappel inoffensif : ✨ les milliardaires existent ✨

Enfin voilà, je pose ça au cas où, on sait jamais.
votre avatar
Personnellement le discour marketing d'OpenAI et Anthropic doivent s'imprimer sur du papier toilette. Le FUD ça rapporte du fric, c'est connu comme l'eau ça mouille. Et entre leur souhait d'entrer en bourse et leur besoin de fond constant pour un business non-rentable, autant que leur gesticulation FUD montrent que visiblement ils savent plus comment faire pour parler d'eux et attirer le chalant investisseur.

Ensuite la différence avec Terminator, Matrix ou même I-robot (en fait je pense que les Réplicateurs de l'univers Stargate sont plus pertinents que i-robot), c'est que "l'IA"' est tellement présente et implémenté qu'elle a pu devenir à un moment donnée capable de reproduire/répliquer sans nous.
Bref, actuellement les agents échappés du "labo P4 d'OpenAI" ne sont pas capable d'exploiter des failles pour se loger et se reproduire dans les téléphones, téléviseurs, routeurs et autres pour devenir ces petits virus polymorphes chiants à éradiquer d'un autre temps (celui des W98, kernel 2.4 et disque dur IDE...)

Si demain, ChatGPT part en cacahuète, une simple bombe au graphène sur le poste transfo et pouf plus de problèmes.

Je rajoute que sur la partie DDOS humain, si un humain est submergé par le flot d'info d'un système IA c'est que le système est mal conçu ou l'IA mal utilisé. L'erreur est une chose possible comme avec le levée de lune, mais le DDOS est clairement la conséquence d'une architecture foireuse.



Ceci dit, pour le reste et notamment les IA pour la biologie et autres, on en arrive au moins point que les armes à feu. L'utilité dépendra d'où se trouve par rapport au canon. Et avec les trous de balles qui traînent sur les quatres coins de la planètes à l'Est comme à l'Ouest, il vaut mieux pour le notre, savoir aussi diriger le canon du bon coté, jusqu'à où.
votre avatar
Pas simple en effet de comprendre les enjeux d'un grand cirque dans lequel tout le monde ment.

Tout le monde : depuis les instigateurs (ces milliardaires pas tout à fait sérieux), les banquiers, les politiques, les patrons, les employés, aux utilisateurs finaux, dans leur foyer, qui pensent que faire un prompt est une bonne idée pour générer une affiche horrible vantant la dernière fête du village, ou une photo sur un pauvre média social mettant en valeur ce qui n'a aucune existence réelle.

Et comme tout le monde ment depuis le début, que cela coûte épouvantablement cher, que tout le montage financier est foireux, tout le monde a intérêt à continuer de mentir.
Et pour couronner le tout ils sont appuyés par un fou furieux à la Maison Blanche.
votre avatar
Sauf qu’il est bien plus difficile d’obtenir les matériaux et les moyens de construire une bombe nucléaire qu’une IA générative
Cela me rappelle un doc qui disait que l'humanité avait de "la chance" que ce soit aussi compliqué de fabriquer une arme nucléaire, même si la "recette" est connue.

Jusqu'au jour où on trouvera une autre méthode (qui sera peut-être trouvée par une IA)
votre avatar
Pour ce qui est des bombes nucléaires, pas de révolution à attendre à priori, puisque les limites sont physiques.
C'est un peu comme si on disait : "actuellement, on ne sait pas voler en battant des bras, mais un jour on saura comment faire !" => Non, ça marche pas comme ça le monde réel. 😉
votre avatar
Merci pour cet article j’avais bien besoin d’un peu de recul dans cette ambiance confuse !
votre avatar
Je ne trouve pas que c'est confus. C'est juste meta-entropique.
Le désordre s'organise et s'amplifie.
L'humain rapetisse, le danger croit, l'apocalypse entre dans l'équation des possibles.

Rien n'est encore joué. Mais le chemin se précise.
C'est assez clair finalement qu'il faut se réveiller.
votre avatar
Ce qui inquiète notamment les chercheurs est l’auto-amélioration récursive, c’est-à-dire la capacité pour un modèle de s’améliorer et de concevoir seul un modèle plus performant.
Pas si on débranche la prise.
votre avatar
22 min
Tiens, Jean-Marc écrit sous un nouveau pseudonyme ? :D
votre avatar
Il aurait fait plus qu’une intro :o (pardon :pastaper:)
votre avatar
Si les russes branchent leur "main morte" sur une IA "ablitérée" (et en provenance de Chine, pourquoi pas), y a quand même un petit risque de fin du monde