Pourquoi un chercheur en IA prédit qu’il y a 99,9 % de chances que l’IA mette fin à l’humanité

Le podcasteur Lex Fridman a déclaré dans un épisode récent que la plupart des ingénieurs en IA avec lesquels il parle estiment entre 1 et 20 % de chances que l'intelligence artificielle générale finisse par tuer les humains.
La prédiction varie en fonction de la façon dont vous demandez. Par exemple, une étude récente menée auprès de 2 700 chercheurs en IA a indiqué qu’il n’y a que 5 % de chances que l’IA conduise à l’extinction de l’humanité.
Mais Fridman a déclaré qu'il était important de parler à des personnes qui estiment qu'il est beaucoup plus probable que l'IA puisse nous anéantir – comme le chercheur en IA Roman Yampolskiy, qui a déclaré au podcasteur dans une interview publiée dimanche qu'il l'évalue à 99,9% dans les cent prochaines années.
Le chercheur en IA enseigne l'informatique à l'Université de Louisville et vient de sortir un livre intitulé « IA: Unexplainable, Unpredictable, Uncontrollable ».
Il a discuté des risques de l'IA pendant plus de deux heures sur le podcast de Fridman – et ses prédictions étaient plutôt sombres.
Il a déclaré que les chances que l’IA anéantisse l’humanité dépendent de la capacité des humains à créer des logiciels très complexes ne comportant aucun bug au cours des 100 prochaines années. Yampolskiy a déclaré qu'il trouvait cela peu probable, car aucun modèle d'IA n'a été complètement à l'abri des personnes tentant de faire faire à l'IA quelque chose pour laquelle elle n'a pas été conçue.
« Ils ont déjà commis des erreurs », a déclaré Yampolskiy. « Nous avons eu des accidents, ils ont été jailbreakés. Je ne pense pas qu'il existe aujourd'hui un seul grand modèle de langage que personne n'ait réussi à faire faire à quelque chose que les développeurs n'avaient pas prévu. »

Les premières versions de modèles d’IA au cours des deux dernières années ont déclenché divers signaux d’alarme concernant une utilisation abusive ou une désinformation potentielle. Les deepfakes ont créé de fausses images pornographiques de personnalités publiques féminines et ont menacé d’influencer les élections avec des appels automatisés d’IA imitant le président Biden.
Google AI Overviews, basé sur le modèle Gemini AI de Google, est le dernier déploiement de produit qui n'a pas réussi à atterrir. La nouvelle fonctionnalité de la recherche Google visait à fournir des aperçus informatifs rapides pour certaines demandes présentées en haut des résultats de recherche. Au lieu de cela, il est devenu viral en proposant des réponses absurdes, comme suggérer de faire de la pizza avec de la colle ou déclarer qu'aucun pays d'Afrique ne commençait par la lettre K.
Yampolskiy a déclaré que pour contrôler l’IA, il fallait une machine de sécurité perpétuelle. Yampolskiy a déclaré que même si nous faisons du bon travail avec les prochaines versions de GPT, l'IA continuera à s'améliorer, à apprendre, à s'auto-modifier et à interagir avec différents joueurs – et avec des risques existentiels, « vous n'avez qu'une seule chance ».
Le PDG du développeur ChatGPT OpenAI, Sam Altman, a suggéré un « bac à sable réglementaire » dans lequel les gens expérimentent l'IA et la réglementent en fonction de ce qui « s'est vraiment mal passé » et de ce qui s'est « vraiment bien passé ».
Altman a un jour prévenu – ou peut-être plaisantait-il – en 2015 que « l’IA mènera probablement à la fin du monde, mais en attendant, il y aura de grandes entreprises ».
Plus récemment, Altman a déclaré que ce qui l'empêche de dormir la nuit, c'est « tous les trucs de science-fiction » liés à l'IA, y compris les choses qui sont « faciles à imaginer où les choses tournent vraiment mal ».
Depuis que ChatGPT a pris d'assaut le monde en novembre 2022, diverses prédictions ont été faites sur la façon dont l'IA pourrait conduire à la chute de l'humanité en ce qui concerne l'IA.
Mais Yampolskiy a également averti que « nous ne pouvons pas prédire ce que fera un système plus intelligent ». Il a comparé les humains aux écureuils dans le contexte de l’AGI, ou intelligence artificielle générale, et a déclaré que l’IA créerait quelque chose dont nous ne connaissons même pas encore l’existence.
Selon Yampolskiy, cependant, il prédit trois domaines de résultats. Un risque est que tout le monde mourra, un autre est que tout le monde souffrira et souhaitera mourir, et un autre est que les humains auront complètement perdu leur raison d’être.
La dernière fait référence à un monde dans lequel les systèmes d’IA sont plus créatifs que les humains et peuvent effectuer toutes les tâches. Dans cette réalité, on ne sait pas exactement ce que les humains feraient pour contribuer, a déclaré Yampolskiy, faisant écho à certaines inquiétudes quant à savoir si l'IA commencerait à prendre les emplois des humains.
La plupart des acteurs du domaine reconnaissent un certain niveau de risque avec l’IA, mais ils ne pensent pas qu’il soit aussi probable que les choses se terminent mal. Elon Musk a prédit qu’il y a 10 à 20 % de chances que l’IA détruise l’humanité.
L'ancien PDG de Google, Eric Schmidt, a déclaré que les véritables dangers de l'IA, à savoir les cyberattaques et les attaques biologiques, apparaîtront dans trois à cinq ans. Si l’IA développe le libre arbitre, Schmidt propose une solution simple : les humains peuvent simplement la débrancher.

Pourquoi un chercheur en IA prédit qu’il y a 99,9 % de chances que l’IA mette fin à l’humanité