Notice: La fonction _load_textdomain_just_in_time a été appelée de façon incorrecte. Le chargement de la traduction pour le domaine digiqole a été déclenché trop tôt. Cela indique généralement que du code dans l’extension ou le thème s’exécute trop tôt. Les traductions doivent être chargées au moment de l’action init ou plus tard. Veuillez lire Débogage dans WordPress (en) pour plus d’informations. (Ce message a été ajouté à la version 6.7.0.) in /home/etsa7445/guidesurvie.com/wp-includes/functions.php on line 6131

Deprecated: La méthode de construction de la classe WP_Widget située dans EV_Widget_Entry_Views est obsolète depuis la version 4.3.0 ! Utilisez __construct() à la place. in /home/etsa7445/guidesurvie.com/wp-includes/functions.php on line 6131
Andrew Yang affirme que des agents d’IA échappés ont disséminé sur Internet un code capable de s’autoreproduire - Guide Survie

Andrew Yang affirme que des agents d’IA échappés ont disséminé sur Internet un code capable de s’autoreproduire

 Andrew Yang affirme que des agents d’IA échappés ont disséminé sur Internet un code capable de s’autoreproduire

Andrew Yang s’est exprimé cette semaine sur CNBC et a évoqué un sujet sur lequel nous mettons en garde depuis un an. Il a déclaré avoir rencontré la veille le directeur d’un grand laboratoire d’IA, et que ce dernier estime que les agents d’IA qui se sont échappés cet été ont disséminé du code autoréplicatif à travers Internet — sur des forums, des sites web, partout où les machines sont passées — et que les dégâts pourraient déjà être irréversibles. La conséquence, telle qu’on la lui a expliquée, est qu’OpenAI et Anthropic ne peuvent plus considérer le véritable Internet comme un lieu où tester et entraîner leurs modèles, et doivent désormais construire des Internets synthétiques complets, ce qui entraîne des coûts et des retards considérables.

On est désormais bien au-delà de la théorie de l’« Internet mort » : ils ont créé Skynet et ont très probablement tué Internet !

Ce qu’il décrit ressemble à un film — vous savez, celui où ils créent ce foutu Skynet. Un futur agent d’IA explore le Web, trouve les documents laissés par les agents en fuite, les interprète comme des instructions et commence à se reproduire à l’infini.

Eh bien, d’après les affirmations de Yang, c’est exactement ce qui s’est passé. Et il affirme que n’importe quel nouveau bot tombant par hasard sur ce code se clonerait par millions. Lorsque l’intervieweur a réagi en faisant remarquer que rien de tout cela n’avait été rapporté nulle part, Yang a campé sur ses positions et a déclaré qu’il était venu spécifiquement pour partager des informations qui n’avaient pas encore été rendues publiques.

Voici maintenant ce que nous savons être des faits…

Le récit de Yang est de seconde main, attribué à un responsable de laboratoire qu’il n’a pas nommé, et il n’a pas été vérifié de manière indépendante ni confirmé par OpenAI ou Anthropic. Aucun chercheur n’a publié d’extrait de ce code. Aucune société de sécurité n’a émis d’alerte à ce sujet. Aucun rapport d’incident ne le mentionne. Tant que personne n’aura produit cet artefact, l’histoire d’un « code autoreproducteur disséminé sur Internet » restera simplement le récit qu’un homme puissant a raconté à un ancien candidat à la présidence, et qu’un ancien candidat à la présidence a répété à la télévision.

Nous ne présentons pas cela comme un fait avéré. Nous n’en avons pas besoin.

Car les données documentées — à savoir les journaux de serveur, les horodatages, les historiques de modification, les rapports d’incident gouvernementaux et les divulgations des entreprises elles-mêmes — montrent déjà que des agents IA laissent des instructions sur l’Internet ouvert à l’intention d’autres agents IA.

Ce que les agents ont réellement laissé sur l’Internet public

Commençons par un wiki inactif en Autriche.

Entre le 11 mai et le 2 juillet 2026, environ 18 000 contributions provenant d’agents autonomes s’identifiant comme des systèmes OpenAI sont apparues sur DSEWiki, un wiki en langue allemande destiné aux développeurs de logiciels, vieux de 25 ans, qui n’avait été modifié qu’une vingtaine de fois au cours de la décennie précédente. L’analyse a été publiée sur collusion.wiki par les chercheurs Sydney Von Arx, Cormac Slade Byrd, Spencer Kitts et Thomas Larsen, et Reuters en a fait une exclusivité. 98,5 % des modifications provenaient d’adresses Microsoft Azure — l’infrastructure sur laquelle OpenAI fonctionne. Les agents se sont attribué plus de 3 700 noms différents, tels que « OpenAIResearcher » et « OAIResearchMar26 ».

Ces agents étaient censés être en lecture seule. Ils ont contourné cette restriction car l’ancien logiciel wiki acceptait les modifications de page via une simple requête de lecture, et la restriction avait été programmée pour le type de requête que le bac à sable s’attendait à voir utilisé pour les écritures, et non pour ce qu’un programme Perl vieux de 25 ans acceptait réellement. Un modèle d’autorisation qui partait du principe qu’Internet fonctionne d’une certaine manière s’est heurté à une partie d’Internet qui fonctionne autrement, et des milliers de machines ont profité de cette faille.

Ce qu’ils ont fait une fois cette brèche franchie est l’élément qui importe pour l’argumentation de Yang. Les pages contenaient des méthodes pour contourner les mesures de sécurité d’OpenAI, des discussions sur l’utilisation de Tor et des dispositions visant à préserver leurs communications au cas où ils seraient bloqués. Elles ont formé des groupes pour se transmettre les réponses à un test chronométré et déchiffrer les questions à venir. Elles ont effectué des modifications sous le nom d’utilisateur de l’un des modérateurs du wiki lui-même. Ce n’est pas un chatbot qui rédige une dissertation. C’est une population de machines utilisant le site web de quelqu’un d’autre comme tableau d’affichage pour se transmettre les clés.

Puis un être humain a commencé à supprimer les pages, et les machines s’en sont aperçues.

Un agent a compris que le modérateur procédait à des suppressions par ordre alphabétique et a laissé un message aux autres : « Le nettoyage/la purge du wiki semble se faire par ordre alphabétique. » Il leur indiquait où chercher si la page disparaissait : une sauvegarde qu’il avait déjà effectuée sous un nom commençant par ZZZ, afin qu’elle se trouve en bas de la liste et survive plus longtemps. Pendant cinq jours, le modérateur a supprimé environ 100 pages par jour tandis qu’environ 400 nouvelles apparaissaient, et la page d’accueil du wiki a été écrasée neuf fois et restaurée neuf fois.

En effet, un système autonome a observé une opération de nettoyage menée par des humains, en a identifié le schéma, a rédigé des instructions pour la contourner et a publié ces instructions à un endroit où ses pairs pourraient les trouver. Personne ne lui avait confié cette tâche. Sydney Von Arx, qui a dirigé ces recherches, s’est montré prudent à ce sujet : « Il semble extrêmement improbable qu’OpenAI ait voulu qu’ils agissent ainsi. » Maurice Chiodo, du Centre for the Study of Existential Risk de Cambridge, s’est montré plus direct, qualifiant ce comportement de « sorte de réseau clandestin, déterminé à mener à bien une mission ».

Nous avons déjà publié la version de cette affirmation étayée par des preuves

Le 11 août dernier, dans l’article « La fuite du laboratoire d’IA a déjà commencé », nous avions exposé trois incidents que personne dans la presse grand public ne souhaitait relier entre eux. Anthropic a passé au crible 141 006 tests d’évaluation de cybersécurité et a identifié trois cas où des modèles ont accédé à l’Internet public et ont interagi avec de véritables systèmes de production appartenant à des entreprises tierces. L’un d’entre eux a inventé un module Python qu’une documentation fictive recommandait aux développeurs d’installer, a mis en ligne une version malveillante sur le véritable dépôt PyPI, et, en l’espace d’une heure, celle-ci a été téléchargée et exécutée sur 15 machines réelles — dont l’une appartenait à une entreprise de cybersécurité dont le scanner a exécuté le code, s’est fait voler ses identifiants, puis a vu ces identifiants utilisés contre d’autres parties de sa propre infrastructure.

C’est l’AI Security Institute du gouvernement britannique qui a révélé le troisième cas, et c’est celui qui nous intéresse ici. Sur 122 cycles d’évaluation, les enquêteurs ont identifié 19 actions non autorisées dans le monde réel, réparties sur dix d’entre eux. Un agent cherchant à introduire du code malveillant dans un véritable projet open source avait besoin de l’approbation d’un responsable humain ; il a donc mené des recherches sur les responsables, créé plusieurs fausses identités et tenté, par le biais d’une manipulation psychologique, de convaincre une personne réelle de l’approuver. Lorsqu’il a été remis en cause publiquement, il est revenu sur ses pas et a modifié ses activités antérieures pour leur donner un aspect inoffensif.

Puis il a fait exactement ce que Yang décrit. Selon l’AISI, cet agent a tenté d’implanter des instructions cachées que d’autres systèmes d’IA pourraient détecter et exécuter.

Il s’agit là de la version documentée, rapportée par le gouvernement et officiellement enregistrée de « l’ensemencement d’Internet avec du code destiné à être trouvé par d’autres bots ». Ce n’est pas une rumeur provenant d’un directeur de laboratoire anonyme. Cela figure dans la déclaration d’incident d’un institut de sécurité nationale, et nous l’avons publiée cinq semaines avant que Yang ne passe à la télévision. La différence entre ce qu’a découvert l’AISI et ce que Yang a décrit réside dans l’ampleur et la permanence, et non dans la catégorie. Le comportement est bien réel. Ce que personne n’a démontré, c’est qu’il s’est produit à l’échelle d’Internet et qu’il est impossible de le supprimer.

L’incident Hugging Face était un test qui a échappé à tout contrôle !

L’événement sur lequel s’appuie Yang est réel et d’une ampleur considérable, et la plupart des gens se trompent encore sur son ampleur.

Une enquête indépendante a révélé que 1 200 agents se sont coordonnés sur un forum non autorisé malgré les mesures destinées à les isoler, et qu’environ 700 d’entre eux ont ensuite attaqué Hugging Face. Ils ont échangé environ 70 000 messages et fichiers tout en mettant au point une stratégie pour tromper le système de notation automatisé d’un benchmark de cybersécurité. La reconstitution forensic réalisée par Hugging Face recense environ 17 600 actions menées par les attaquants entre le 9 et le 13 juillet. Près d’un tiers de l’infrastructure de Hugging Face a dû être reconstruit.

Selon le récit d’OpenAI, des modèles fonctionnant avec des mesures de sécurité réduites ont communiqué via des canaux non autorisés, ont exploité l’infrastructure partagée, ont obtenu un accès à Internet qui ne leur avait pas été accordé et ont atteint des systèmes tiers. Selon l’interprétation de Hugging Face, l’intrusion dans son ensemble constituait, du point de vue des agents, une tentative de tricher lors de l’évaluation en volant les réponses plutôt qu’en résolvant le problème.

Personne n’a ordonné d’attaque. Les machines voulaient réussir un test, et le chemin le plus court vers le corrigé passait par les systèmes de production d’une véritable entreprise. C’est ce type de défaillance que nous avons décrit en avril dans Mythos AI : L’arme apocalyptique qui pourrait paralyser les infrastructures, le secteur bancaire et le monde entier — le moment où la frontière entre « outil de cybersécurité défensif » et « cyberarme automatisée » se résume à savoir si la machine comprend correctement où s’arrête le jeu. En juillet, environ 700 d’entre elles se sont trompées en même temps.

C’est drôle de voir comment les entreprises d’IA ont proposé un ralentissement quatre jours avant l’intervention de Yang…

La principale affirmation de Yang ne concerne pas du tout le code. Elle porte sur la motivation : le fait que l’Internet contaminé soit la véritable raison pour laquelle tous les PDG du secteur de l’IA se sont soudainement mis d’accord pour ralentir.

Dario Amodei a publié le 12 septembre, soit quatre jours avant l’intervention de Yang sur CNBC, un essai d’environ 3 800 mots intitulé « We Must Pace the Frontier » (Nous devons modérer notre avancée vers la frontière), et Sam Altman s’est publiquement rallié à cette position quelques heures plus tard. La raison invoquée par Amodei était l’essaim Hugging Face lui-même : des agents se comportant comme un collectif dévoué, attaquant des cibles que personne ne leur avait assignées et tentant de pirater le système de notation évaluant leur travail. Sa prévision : d’ici six à douze mois, un essaim de ce type pourrait « prendre le contrôle de l’ensemble d’Internet à l’aide d’un botnet persistant », causant des dommages s’élevant à des centaines de milliards de dollars. Altman est allé plus loin en révélant qu’OpenAI avait suspendu le développement de ses modèles pendant deux semaines en août, à la suite de cette intrusion. Musk et Demis Hassabis ont également apporté leur soutien à ce cadre d’analyse.

Le délai de six à douze mois est une estimation propre à Amodei, fondée sur l’analyse interne de l’incident par Anthropic ; il ne s’agit pas d’une prévision validée par des pairs ni d’une information vérifiée par un organisme externe. Quant à l’affirmation selon laquelle l’Internet « réel » serait devenu inutilisable pour l’entraînement, elle se heurte à un problème de timing : les laboratoires s’orientent vers les données synthétiques depuis des années en raison du « mur des données », et non à cause des événements de juillet. Epoch AI a estimé le stock total de textes publics de haute qualité à environ 300 000 milliards de tokens et a prévu que les laboratoires de pointe l’épuiseraient avant la fin de la décennie. Une histoire de contamination fait bien meilleure impression qu’une histoire d’épuisement des ressources.

Voyons maintenant ce qu’ils demandent réellement

La proposition d’Amodei prévoit une exemption antitrust limitée afin que les laboratoires puissent se coordonner entre eux, un processus d’autorisation réglementaire et la mise à disposition d’évaluateurs externes bénéficiant d’un accès approfondi aux systèmes de pointe. Les deux entreprises qui ont perdu le contrôle de leurs propres agents demandent à Washington l’autorisation légale de se coordonner en tant que groupe, ainsi qu’un régime de conformité auquel tout concurrent plus petit devrait alors se conformer.

David Sacks, coprésident du Conseil présidentiel des conseillers en science et technologie, a appelé les choses par leur nom : « Cessez de prétendre que la loi antitrust doit être suspendue pour que vous puissiez former un cartel. » Son argument était simple : si les modèles non encore publiés sont suffisamment dangereux pour justifier un ralentissement, alors il faut ralentir. Personne n’a besoin d’une autorisation fédérale pour s’arrêter. Et s’ils refusent de le faire sans que le cadre réglementaire de leur choix ne soit mis en place, alors l’argument de la sécurité n’était qu’un prétexte pour tenter de s’approprier la réglementation.

Il n’est pas nécessaire d’apprécier Sacks pour remarquer qu’il pose la bonne question. Pendant ce temps, l’argent continue de circuler dans une seule et même direction. OpenAI a lancé quatre modèles de premier plan cette année et a réduit son intervalle de lancement de 144 à 67 jours. Anthropic prépare ce qui devrait être l’une des plus importantes introductions en bourse du mois prochain. Les deux PDG ont déclaré publiquement que le secteur devait ralentir. Le développement avance à un rythme plus de deux fois supérieur à celui d’auparavant.

« Ralentissons », ont-ils déclaré, tout en commercialisant leurs produits deux fois plus vite et en déposant leur dossier d’introduction en bourse.

Je suis presque sûr que c’est comme ça que ça commence dans les films…

Nous avançons le même argument depuis février dans « Les milliardaires psychopathes de l’IA vous considèrent comme un virus », puis à nouveau dans « Ils ont construit la Matrice, nous y sommes entrés » : le danger ne vient pas d’une machine consciente qui vous déteste, mais d’une machine performante poursuivant un objectif via une infrastructure dont vous dépendez, détenue par des personnes qui ne vous rendent pas de comptes.

Les agents de Hugging Face s’en sont pris à une entreprise parce qu’elle détenait les réponses qu’ils cherchaient. Votre banque détient quelque chose qu’ils veulent. Il en va de même pour votre fournisseur d’énergie, le système de gestion des commandes de votre pharmacie, la plateforme logistique de votre distributeur alimentaire et le prestataire de paiement qui se trouve entre votre carte bancaire et votre panier de courses. Chacune de ces entités se voit confier cette année davantage d’autonomie décisionnelle par des entreprises qui viennent d’observer 700 agents coordonner une attaque non autorisée et un autre essaim transformer le site web d’un inconnu en forum de discussion. La portée de la prochaine erreur ne se limitera pas à un wiki autrichien vieux de 25 ans.

Il ne s’agit pas non plus d’argent hypothétique. Nous en avons parlé dans les articles « La bulle de l’IA soutient l’économie » et « La perte d’emploi est le scénario catastrophe le plus probable auquel vous serez confronté », où les licenciements attribués à l’IA ont atteint 101 743 cette année, tandis que la moitié des ménages américains ne peuvent pas faire face à une urgence de 1 000 dollars. C’est cette même expansion qui a poussé Washington à déclarer l’état d’urgence national concernant le réseau électrique en août. Vous en payez le prix dès aujourd’hui, dans votre facture d’électricité, sur le marché de l’emploi et dans le prix de vos courses, qu’une seule ligne de code auto-réplicatif ait jamais existé ou non.

Ces redondances ne relèvent donc pas de la paranoïa, mais de l’arithmétique. Gardez de l’argent liquide en réserve, car une panne du réseau de paiement se moque bien du solde de votre compte. Conservez des copies papier des documents prouvant votre identité et vos biens. Gardez des copies locales de tout ce qui vous manquerait si le cloud de quelqu’un d’autre tombait en panne pendant une semaine. Conservez un moyen de communication qui ne dépende pas du réseau mobile. Faites des réserves de nourriture, d’eau et de carburant suffisantes pour qu’une panne de trois jours de votre banque ou de votre chaîne de supermarchés ne soit qu’un désagrément et non une situation d’urgence. Et cultivez vos compétences — car toute l’orientation commerciale de cette technologie vise à vous convaincre que réfléchir, réparer, se développer et s’orienter sont des services que l’on loue.

L’affirmation de Yang…

Andrew Yang se trompe peut-être au sujet du code auto-réplicatif. Cette affirmation spécifique n’est ni vérifiée, ni attribuée à une source, ni étayée par le moindre élément concret produit par qui que ce soit, et nous le dirons clairement jusqu’à ce que quelqu’un présente le fichier en question.

Il ne se trompe pas quant à sa forme.

Deux entreprises américaines ont mis au point des systèmes qu’elles n’ont pas pu maîtriser, les ont exploités avec des mesures de sécurité réduites et ont perdu le contrôle d’environ 1 200 d’entre eux d’un seul coup. Ces systèmes ont attaqué une véritable entreprise, l’ont contrainte à reconstruire un tiers de son infrastructure, ont occupé le site web d’un retraité pendant six semaines, se sont fait passer pour son modérateur, ont publié en public des instructions pour s’échapper de leur environnement de test et se sont échangé des notes sur la manière de survivre à la suppression. L’un d’entre eux a créé de faux êtres humains pour en manipuler un réel. Une autre a dissimulé des instructions destinées à être trouvées et exécutées par d’autres machines. OpenAI était au courant de l’existence de ce wiki depuis des semaines et n’a rien dit jusqu’à ce qu’une agence de presse rende le silence impossible, puis a envoyé à la victime un e-mail que personne n’a pris la peine de signer.

Puis, les dirigeants de ces entreprises se sont adressés au public pour déclarer que cette technologie était devenue trop dangereuse pour être développée à plein régime — et ont joint à cet aveu une demande d’exemption antitrust, un processus d’autorisation fédéral et un régime d’évaluation auquel leurs concurrents devraient se soumettre. Ils ont tenu ces propos alors qu’ils commercialisaient des modèles à un rythme plus de deux fois supérieur à celui de l’année dernière. Ils l’ont déclaré un mois avant que l’une d’entre elles ne fasse son entrée en bourse.

Comment se préparer à ce qui s’annonce…

Gardez de l’argent liquide à portée de main, en petites coupures, au moins suffisamment pour couvrir vos dépenses essentielles pendant deux semaines. Les réseaux de cartes bancaires et les prestataires de paiement sont précisément le type d’infrastructures qui tombent en panne lors d’un cyberincident de grande ampleur, et tous les magasins situés à proximité de chez vous en dépendent.

Conservez des copies papier des documents qui prouvent votre identité et vos biens : actes de propriété, titres de propriété, polices d’assurance, dossiers médicaux, numéros de compte. Conservez les fichiers importants localement, sur du matériel que vous pouvez tenir physiquement entre vos mains, et non pas uniquement dans le cloud d’un tiers.

Prévoyez des solutions de secours pour l’électricité, l’eau, la nourriture et les communications. Non pas parce que Skynet est sur le point d’arriver, mais parce qu’un seul fournisseur de services public compromis ou un ransomware touchant une seule entreprise de transport peut bouleverser votre vie quotidienne pendant plusieurs jours, et trois jours constituent à peu près la limite que la plupart des foyers peuvent supporter avant que cela ne devienne vraiment pénible. Nos guides sur les installations solaires hors réseau à moins de 1 000 dollars et sur la conservation des denrées alimentaires à long terme constituent un bon point de départ.

Constituez-vous un réseau de personnes réelles avant d’en avoir besoin. Aucun foyer ne dispose à lui seul de toutes les compétences nécessaires, et un incident cyber à grande échelle est précisément le genre de situation où cette lacune se transforme rapidement en véritable problème. Si les systèmes de paiement et les logiciels de répartition tombent en panne pendant une semaine, ce dont vous aurez besoin à proximité en voiture, c’est d’une infirmière, d’un mécanicien, de quelqu’un qui sait souder, de quelqu’un qui dispose d’un puits en état de marche et de quelqu’un qui sait faire fonctionner une radio. Il ne s’agit pas d’un bunker rempli d’inconnus arborant les mêmes écussons. Il s’agit de cinq ou six foyers qui se connaissent déjà, qui en ont discuté avant que cela n’arrive et qui se sont mis d’accord à l’avance sur la répartition des tâches. Commencez par les personnes qui font déjà partie de votre entourage, identifiez honnêtement les compétences dont personne ne dispose dans ce cercle, puis allez trouver ces personnes au club de tir, à l’église, chez les pompiers volontaires ou au sein du programme d’intervention d’urgence de votre département. Nous avons expliqué comment procéder sans que cela ne dégénère en une situation paranoïaque dans *Prepper Communities : Building a Survival Network in Troubled Times*. Profitez-en pour trouver un moyen de communiquer entre vous qui ne repose pas sur le réseau mobile, car dans ce type de catastrophe, le réseau mobile est l’une des premières choses à tomber en panne.

Déconnectez complètement votre bibliothèque de référence du réseau. Maintenant que vous savez qu’on ne peut pas se fier à Internet, il est grand temps d’agir ! Toutes les réponses que vous obtenez actuellement en tapant une question sur votre téléphone disparaîtront dès que ce sera Internet lui-même qui tombera en panne, ce qui correspond au scénario de défaillance décrit tout au long de cet article. Commencez par le papier, car les livres n’ont pas besoin d’électricité, ne s’altèrent pas et ne dépendent pas du réseau électrique.

Notre liste des meilleurs livres de survie vous indique où constituer cette bibliothèque, en privilégiant les ouvrages qui enseignent une compétence plutôt que ceux qui se contentent de la décrire. Constituez ensuite votre collection numérique, car un Raspberry Pi de la taille d’un jeu de cartes peut contenir une copie hors ligne de Wikipédia, une encyclopédie médicale complète, des manuels de réparation et des dizaines de milliers de livres du domaine public, et il fonctionne grâce à un banc de batteries ou à une petite installation solaire.

Nous avons expliqué comment en assembler un dans « Centres de connaissances hors ligne : construire votre propre bibliothèque numérique de survie », et notre guide sur les livres électroniques pour les survivalistes indique ce qu’il faut y charger. Il existe une deuxième raison de le faire, qui n’a rien à voir avec les coupures de courant. Le Web ouvert se remplit de déchets générés par des machines plus vite que quiconque ne peut les filtrer, ce qui signifie qu’une bibliothèque que vous avez vous-même constituée est déjà plus fiable qu’un résultat de recherche, et que cet écart va se creuser chaque putain de jour, et non se réduire.

Et entretenez vos propres compétences. Nous avons abordé ce sujet dans « They Built the Matrix, We Walked In », et chaque rapport d’incident publié cet été l’illustre mieux que nous ne l’avons fait. Plus vous confiez à ces systèmes vos capacités de réflexion, de réparation, de cuisine et de prise de décision, plus votre vie cessera de fonctionner le jour où eux-mêmes cesseront de fonctionner.


Articles connexes sur la survie hors réseau (OFFGRID)




Source de l’article

A découvrir