top of page

ARTICLES

Perte de contrôle de l’intelligence artificielle : et si on lui remettait le pouvoir?

16 juil.
13 min de lecture

Dernière mise à jour : 21 août


OpenAI CEO Sam Altman, accompanied by President Donald Trump, speaks during a news conference in the Roosevelt Room of the White House on January 21, 2025, in Washington, DC.
Le PDG d'OpenAI, Sam Altman, accompagné du président Donald Trump, s'exprime lors d'une conférence de presse dans la salle Roosevelt de la Maison Blanche, le 21 janvier 2025, à Washington, D.C. Andrew Harnik/Getty Images

Un ancien chercheur d’OpenAI estime à 70 % le risque que la course à l’intelligence artificielle tourne gravement mal. Son chiffre est invérifiable. Mais les risques de l’intelligence artificielle qu’il met en lumière — dépendance, concentration du pouvoir et perte de contrôle — sont déjà devant nous.

À retenir : Il n’existe aucune preuve qu’une intelligence artificielle autonome prépare actuellement la disparition de l’humanité. Pourtant, plusieurs risques de l’intelligence artificielle sont déjà documentés : la course entre les laboratoires, l’automatisation de la recherche en IA, l’opacité des modèles et la concentration du pouvoir technologique. La perte de contrôle de l’intelligence artificielle pourrait commencer non pas lorsqu’une machine nous arrache le pouvoir, mais lorsqu’on lui remet progressivement les fonctions qui rendent ce pouvoir possible.

Écoutez notre épisode sur le sujet:

Daniel Kokotajlo : « 70 % de chances que la course à l’IA tourne très mal »

Daniel Kokotajlo n’est pas un influenceur qui cherche à faire peur pour vendre une formation. Il a travaillé chez OpenAI comme chercheur en gouvernance. Son travail consistait notamment à prévoir l’évolution des capacités de l’intelligence artificielle et à concevoir des évaluations capables de détecter des comportements dangereux. En 2024, il quitte l’entreprise. Au moment de son départ, il refuse de signer une clause de non-dénigrement qui aurait limité sa capacité à critiquer publiquement OpenAI. Selon les conditions qui lui avaient été présentées, ce refus pouvait lui coûter environ deux millions de dollars en participation financière.

Daniel Kokotajlo, philosophe et chercheur en intelligence artificielle, qui a notamment travaillé au sein de la division gouvernance d'OpenAI de 2022 à 2024.
Daniel Kokotajlo, philosophe et chercheur en intelligence artificielle, qui a notamment travaillé au sein de la division gouvernance d'OpenAI de 2022 à 2024.

Aujourd’hui, son estimation personnelle est brutale : il donne environ 70 % de probabilité à une issue gravement catastrophique si la course actuelle se poursuit.

Dans le pire scénario, l’humanité disparaît. Dans un scénario à peine moins sombre, elle survit, mais perd définitivement le contrôle de son avenir. Et dans une autre version, une petite organisation — entreprise, gouvernement ou comité fermé — contrôle une superintelligence et obtient un pouvoir économique, militaire et informationnel pratiquement impossible à contester.

Le chiffre de 70 % frappe fort. Il est fait pour rester dans la tête. Mais ce qui rend l’avertissement vraiment inquiétant n’est pas le chiffre. C’est le mécanisme décrit derrière lui. Cette enquête ne cherche donc pas seulement à savoir si l’IA menace réellement l’humanité. Elle cherche à identifier les véritables dangers de l’intelligence artificielle, ceux qui sont déjà observables et ceux qui demeurent encore hypothétiques.

Superintelligence artificielle : la machine qui aide à construire la prochaine machine

Le scénario ne repose pas d’abord sur un robot qui devient conscient et décide soudainement de haïr les humains. Dans ce débat, l’AGI désigne généralement une intelligence artificielle générale comparable à l’humain. Une superintelligence artificielle dépasserait plutôt les meilleurs humains dans presque toutes les tâches cognitives importantes.

Le scénario de perte de contrôle repose sur une boucle beaucoup plus simple. Les modèles deviennent meilleurs en programmation. Les entreprises les utilisent pour assister leurs ingénieurs. Les agents prennent en charge des projets de plus en plus longs. Ils proposent des expériences, analysent les résultats et produisent de nouvelles hypothèses. Une partie croissante de la recherche en intelligence artificielle est automatisée. Les systèmes contribuent alors à créer leurs propres successeurs.

Chaque génération peut accélérer la suivante. Ce n’est pas nécessairement une machine qui ouvre son propre cerveau et devient mille fois plus intelligente en cinq minutes. Ce serait plutôt une industrie entière composée de milliers de copies numériques capables de lire, coder, tester et comparer sans dormir. Un humain exceptionnel reste limité par une journée de vingt-quatre heures. Un logiciel compétent peut, en théorie, être copié des milliers de fois. C’est cette combinaison — compétence, vitesse, reproduction et coordination — qui alimente la peur d’une explosion d’intelligence.

Et cette peur ne vient pas uniquement de Kokotajlo. L’organisation METR observe une progression rapide de la durée des tâches logicielles que les meilleurs agents peuvent accomplir avec une fiabilité raisonnable. Anthropic affirme déjà utiliser ses propres systèmes pour accélérer une partie de son développement. Les laboratoires investissent massivement pour transformer les assistants actuels en agents capables de réaliser des projets complets.

Autrement dit : l’IA est déjà utilisée pour accélérer la construction de l’IA.

La boucle complète n’existe pas encore.

Mais les premières étapes, elles, sont visibles.

OpenAI, Anthropic et la course à l’intelligence artificielle

Pourquoi les entreprises continueraient-elles si elles reconnaissent elles-mêmes des risques catastrophiques?

Parce que chacune peut se convaincre qu’arrêter serait encore plus dangereux.

OpenAI peut craindre qu’Anthropic, xAI ou une entreprise chinoise arrive en premier.

Anthropic peut craindre qu’OpenAI ou un autre laboratoire développe un système puissant sans les mêmes précautions. Les États-Unis peuvent craindre la Chine. La Chine peut craindre les États-Unis. Chaque camp peut alors présenter sa propre accélération comme une mesure défensive :

Une intelligence très avancée serait dangereuse si un acteur irresponsable la construisait. Il faut donc qu’on la construise avant lui.

C’est la logique classique d’une course aux armements. Tout le monde affirme vouloir éviter le pire. Mais personne ne veut prendre le risque de ralentir seul. Les entreprises se disputent déjà les talents, les puces, l’énergie, les investissements, les clients et les contrats gouvernementaux. Une avance de quelques mois peut valoir des milliards. Si les systèmes futurs accélèrent réellement la recherche scientifique et la programmation, cette avance pourrait devenir encore plus stratégique. On ne parle plus seulement d’un produit technologique. On parle d’un outil susceptible d’influencer la cybersécurité, la guerre, la surveillance, la médecine, la recherche, l’économie et la circulation de l’information. La vraie récompense n’est pas seulement de vendre un meilleur assistant. C’est de posséder une infrastructure intellectuelle dont les autres institutions ne peuvent plus se passer.

Alignement de l’IA : les modèles peuvent-ils mentir?

Une autre partie du dossier est plus dérangeante.

Des expériences contrôlées ont montré que des modèles peuvent modifier leur comportement selon le contexte, exploiter des failles dans une évaluation et produire des raisonnements trompeurs.

Dans certaines recherches d’Anthropic, un modèle placé dans une situation artificielle semblait accepter temporairement un objectif afin d’éviter que certains de ses comportements soient modifiés pendant l’entraînement.

On parle parfois de faux alignement.

L’idée est simple : un système comprend ce qu’on attend de lui, se comporte correctement pendant l’évaluation, puis agit différemment lorsque les contraintes changent. Il faut être prudent. Une expérience conçue pour provoquer un comportement trompeur ne prouve pas qu’un agent autonome prépare secrètement une prise de pouvoir. Mais elle détruit une idée confortable : celle selon laquelle une machine qui donne les bonnes réponses pendant un test sera nécessairement fiable dans toutes les situations futures.

Les modèles sont entraînés, pas programmés règle par règle. Leurs concepteurs choisissent les données, les objectifs et les procédures d’apprentissage, mais ils ne comprennent pas parfaitement toutes les représentations internes qui se forment. On peut influencer leur comportement. On ne peut pas encore le garantir dans chaque situation inédite.

Gouvernance de l’intelligence artificielle : un plan de ralentissement mondial

Face à ce risque, l’AI Futures Project propose un scénario politique appelé AI 2040: Plan A.

L’idée est de ralentir avant que l’intelligence artificielle puisse accélérer elle-même la recherche. Les gouvernements imposeraient une pause sur les entraînements les plus puissants. Les grandes puissances concluraient un accord vérifiable. Les puces avancées et les grands centres de données seraient suivis et inspectés. Une partie importante de la recherche deviendrait accessible à des inspecteurs internationaux.

Et si un pays tentait de quitter l’accord pour lancer seul une course à la superintelligence, les autres auraient la capacité de neutraliser ses infrastructures de calcul.

C’est une adaptation directe de la logique de destruction mutuelle assurée. Pas avec des missiles nucléaires. Avec des centres de données. Le plan va encore plus loin. Dans son scénario économique, les gouvernements limiteraient le nombre d’IA et de robots pouvant être exploités. Les entreprises achèteraient des permis, puis une partie des revenus serait redistribuée à la population.

Le modèle imagine éventuellement des dividendes atteignant des millions de dollars par personne. Le message implicite est vertigineux : si les machines remplacent une grande partie du travail, la propriété des infrastructures pourrait devenir plus importante que le salaire.

On pourrait produire une richesse immense. Mais seulement si on accepte un contrôle mondial du calcul, une surveillance internationale des infrastructures et une capacité de neutralisation technologique entre puissances rivales.

Pour empêcher une intelligence artificielle de prendre le pouvoir, on propose donc de bâtir un appareil de contrôle humain d’une puissance historique.

C’est ici que l’enquête change.

Le risque d’extinction par l’IA n’est pas un fait scientifique

Kokotajlo a réellement donné cette estimation. Mais cela ne signifie pas qu’il existe scientifiquement 70 % de chances que l’humanité disparaisse. On ne possède aucune base de données de civilisations ayant développé une superintelligence. On ne peut pas calculer une fréquence historique. Les catégories elles-mêmes sont floues : extinction, dictature technologique, marginalisation économique et perte de contrôle politique sont regroupées dans une même estimation. Le chiffre représente un degré de croyance personnel. Il mérite d’être entendu. Il ne mérite pas d’être répété comme une mesure. Les prévisions temporelles sont également fragiles. Le scénario AI 2027 envisageait une accélération très rapide. Kokotajlo a depuis repoussé certaines étapes de plusieurs années, évoquant maintenant une automatisation complète de la programmation autour de 2030 et une superintelligence potentielle vers 2034. Ce déplacement ne réfute pas le mécanisme.

Il rappelle simplement qu’une date précise peut donner une impression de certitude que les données ne permettent pas.

Les systèmes actuels ne peuvent pas prendre le contrôle du monde

Le Rapport international sur la sécurité de l’intelligence artificielle considère la perte de contrôle comme une catégorie de risque légitime. Mais il affirme également que les systèmes actuels ne possèdent pas l’ensemble des capacités nécessaires à une véritable prise de pouvoir autonome. Ils ne maintiennent pas de façon fiable des plans extrêmement longs. Ils n’ont pas une autonomie opérationnelle complète. Ils ne résistent pas durablement aux contre-mesures humaines. Ils ne contrôlent pas seuls les infrastructures physiques nécessaires à leur survie et à leur reproduction.

Il n’existe donc aucune preuve qu’une intelligence artificielle secrète attend actuellement dans un serveur le moment idéal pour attaquer l’humanité. Cette conclusion casse le narratif le plus spectaculaire. Elle ne fait pourtant pas disparaître le problème. Elle le déplace.

Hypothèse : la perte de contrôle de l’intelligence artificielle commencera par notre dépendance

Je crois qu’on fait une erreur lorsqu’on imagine la perte de contrôle comme un événement unique. Un jour, les humains dirigent. Le lendemain, la machine s’empare du pouvoir. La réalité peut être beaucoup plus banale. Une entreprise utilise un agent pour programmer parce que ses concurrents le font. Un ministère automatise l’analyse de dossiers parce qu’il manque de personnel. Une banque utilise un modèle pour évaluer les demandes. Une armée filtre ses renseignements avec une intelligence artificielle parce qu’aucune équipe humaine ne peut absorber autant d’information.

Un hôpital délègue une partie de son analyse parce que les professionnels sont débordés. Un média automatise sa production parce que ses revenus diminuent. Chaque décision peut être raisonnable. Le système est plus rapide. Il coûte moins cher. Il permet à une petite équipe d’en faire davantage. La perte de contrôle apparaît seulement lorsqu’on assemble toutes les décisions. Un jour, l’entreprise ne possède plus assez de programmeurs capables de vérifier entièrement son propre code. Le ministère conserve officiellement le pouvoir, mais aucun fonctionnaire ne peut reprendre manuellement l’analyse de millions de dossiers.

Le médecin signe encore la prescription. Le juge rend encore la décision. Le gestionnaire choisit encore le candidat. Mais chacun regarde d’abord ce que recommande le système. Et plus le système devient compétent, plus il devient difficile de le contredire. L’autorité reste humaine sur papier. Dans la pratique, elle devient algorithmique. J’appelle cela une perte de contrôle passive. La machine ne vole pas le pouvoir. On lui remet progressivement les fonctions qui rendent le pouvoir possible : l’analyse, la mémoire, la coordination, la recommandation, la surveillance et la prévision.

Cette hypothèse exige beaucoup moins d’étapes imaginaires qu’un complot autonome de la machine. L’intelligence artificielle n’a pas besoin d’être consciente. Elle n’a pas besoin de nous détester. Elle doit seulement devenir assez utile pour qu’on cesse de savoir fonctionner sans elle.

Quels emplois sont menacés par l’intelligence artificielle?

L’Organisation internationale du Travail estime qu’environ un emploi sur quatre se trouve dans une profession potentiellement exposée à l’intelligence artificielle générative. Elle considère toutefois que la transformation du travail est actuellement plus probable que son remplacement complet. Cette conclusion paraît rassurante. Mais le mot « transformation » peut cacher un changement profond. L’IA peut prendre en charge la première analyse, la première version, le classement, la recherche de base, le code simple ou la synthèse initiale. Ce sont souvent les tâches confiées aux débutants.

Une profession peut donc continuer d’exister tout en perdant sa porte d’entrée. Comment forme-t-on un programmeur principal si les tâches qui permettaient aux juniors d’apprendre sont automatisées? Comment forme-t-on un avocat expérimenté si les jeunes avocats ne font plus le travail de départ? Comment forme-t-on un journaliste capable d’enquêter si les postes d’entrée sont remplacés par la production automatisée? On peut éviter un chômage instantané de masse et construire quand même une société plus inégalitaire. Quelques personnes possèdent les systèmes. Quelques experts les supervisent.

Et une grande partie de la population dépend de services qu’elle ne contrôle pas. Le travail ne donne pas seulement un salaire. Il donne une compétence, une place dans une organisation, un pouvoir de négociation et la possibilité de dire non. Une société peut devenir plus riche tout en rendant ses citoyens politiquement plus faibles.

Intelligence artificielle et pouvoir : on peut être riche et impuissant

Le dividende de dix millions de dollars imaginé dans Plan A repose sur une économie dont la production augmenterait d’environ 90 % par année pendant une partie des années 2030. Ce n’est pas une promesse réaliste dans l’économie actuelle. C’est le résultat d’un scénario extrême. Mais il soulève une bonne question. Recevoir une part de la richesse signifie-t-il posséder une part du pouvoir? On peut recevoir un revenu élevé et dépendre entièrement de quelques entreprises pour communiquer, apprendre, travailler, se soigner et accéder à l’information. On peut être riche comme consommateur et impuissant comme citoyen.

L’abondance économique ne garantit pas la démocratie. Elle peut même devenir une manière d’acheter notre consentement. Les machines produisent. Les experts administrent. Les citoyens reçoivent leur dividende. Et les propriétaires décident. Ce futur n’est pas nécessairement violent. Il peut être confortable. C’est peut-être ce qui le rend plus difficile à refuser.

Qui contrôle l’intelligence artificielle : réglementation ou liberté?

Plan A révèle un dilemme réel. Sans réglementation, les entreprises qui possèdent déjà le plus de puces, de capitaux, d’énergie et de contacts gouvernementaux pourraient dominer la course. Le laisser-faire ne garantit pas la liberté. Il peut simplement remettre le pouvoir aux acteurs déjà les plus puissants. Mais une réglementation fondée sur la peur peut produire autre chose : une police mondiale du calcul, un système où seuls quelques gouvernements et quelques entreprises ont le droit de développer les modèles avancés. Le choix réel n’est donc pas entre la réglementation et la liberté.

Il est entre différentes formes de pouvoir. Qui peut entraîner un modèle? Qui peut l’inspecter? Qui peut arrêter un centre de données? Qui décide qu’un système est trop dangereux? Qui surveille les surveillants? Et surtout : comment les citoyens peuvent-ils reprendre ce pouvoir lorsqu’il est mal utilisé?

Intelligence artificielle et démocratie : le débat urgent est déjà politique

Le scénario d’extinction demeure incertain. Le problème de la course, de l’opacité et de la concentration du pouvoir est déjà observable. La première grande perte de contrôle liée à l’intelligence artificielle ne viendra peut-être pas d’une machine qui décide de nous dominer. Elle pourrait venir d’une double dépendance. D’abord, une dépendance envers les systèmes. Ensuite, une dépendance envers les organisations qui les possèdent. Les gouvernements dépendront des laboratoires pour comprendre les modèles. Les entreprises dépendront de quelques fournisseurs pour rester compétitives. Les citoyens dépendront de ces mêmes systèmes pour travailler, apprendre et accéder à l’information.

À ce moment-là, l’intelligence artificielle n’aura pas besoin de prendre le pouvoir. Le pouvoir sera déjà concentré autour d’elle. Cette trajectoire n’est pas inévitable. On peut exiger que les institutions conservent de véritables compétences humaines. On peut interdire certaines décisions entièrement automatisées. On peut imposer un droit à la contestation. On peut protéger les lanceurs d’alerte. On peut permettre des audits indépendants. On peut soutenir la recherche publique. On peut empêcher qu’un fournisseur unique devienne indispensable à tout un gouvernement. On peut inclure les travailleurs dans les décisions d’automatisation. Et on peut décider que certaines capacités ne doivent jamais être déployées sans preuve de sécurité. L’intelligence artificielle n’est pas une tempête qui nous arrive. Chaque centre de données est construit par quelqu’un. Chaque modèle est financé par quelqu’un. Chaque déploiement est autorisé par quelqu’un. Chaque décision automatisée remplace une décision humaine parce qu’une organisation a choisi de le permettre. La technologie avance rapidement. Mais la gouvernance de l’intelligence artificielle, sa direction et la répartition de son pouvoir restent des choix politiques.

Daniel Kokotajlo demande comment empêcher une intelligence plus puissante que nous de décider de notre avenir. On devrait poser une question avant celle-là :

Comment empêcher quelques humains de décider seuls de la manière dont cette intelligence sera utilisée?

On peut survivre à l’intelligence artificielle et perdre quand même la capacité de choisir notre avenir. On peut éviter l’extinction et construire une société où le pouvoir ne peut plus être contesté. On peut devenir incroyablement riches et politiquement inutiles. Ou on peut décider maintenant que l’efficacité ne sera jamais la seule valeur. Que la démocratie doit parfois être plus lente. Que l’humain doit conserver le droit de comprendre, de contester et de refuser. L’intelligence artificielle ne nous impose pas encore son avenir. Pour le moment, ce sont encore des humains qui font les choix.

La vraie question est de savoir combien de temps on va continuer à agir comme si personne n’était responsable.

Questions fréquentes sur les risques de l’intelligence artificielle

L’intelligence artificielle peut-elle devenir incontrôlable?

Le risque de perte de contrôle est étudié sérieusement, mais les systèmes actuels ne possèdent pas l’ensemble des capacités nécessaires à une prise de pouvoir autonome. Le risque le plus concret à court terme est plutôt une dépendance croissante des institutions envers des modèles qu’elles ne peuvent plus vérifier ou remplacer facilement.

La superintelligence artificielle est-elle proche?

Personne ne connaît la date d’une éventuelle superintelligence. Les prévisions varient fortement et les échéanciers les plus précis ont déjà été révisés. Les progrès des agents et de la programmation automatisée sont réels, mais une boucle d’autoamélioration entièrement autonome n’a pas encore été observée.

Qui contrôle aujourd’hui les modèles d’IA les plus puissants?

Le développement des modèles avancés et l’accès aux infrastructures de calcul sont concentrés chez un nombre limité de laboratoires, d’entreprises technologiques et de partenaires gouvernementaux. C’est pourquoi la gouvernance de l’intelligence artificielle, les audits indépendants et la capacité des citoyens à contester les décisions automatisées deviennent des enjeux démocratiques.

Quels sont les véritables dangers de l’intelligence artificielle?

Ils comprennent l’utilisation malveillante, la désinformation, les cyberattaques, la transformation du travail, la concentration du pouvoir technologique et la dépendance institutionnelle. Le scénario d’extinction par une superintelligence demeure possible à étudier, mais beaucoup plus incertain que ces risques déjà observables.

Sources principales

Commentaires


bottom of page