En bref

  • Les dirigeants d'Anthropic, d'OpenAI et d'autres entreprises d'IA simulent en privé les retombées politiques d'un événement catastrophique lié à l'IA, très probablement une cyberattaque contre la finance, l'accès à Internet, l'électricité ou l'eau, et prévoient d'informer rapidement le Congrès.
  • Des initiés de l'industrie s'attendent apparemment à un incident majeur dans les six à douze mois, tandis qu'OpenAI affirme que ses exercices de préparation ne considèrent pas de tels scénarios comme inévitables et qu'Anthropic a refusé de commenter.
  • Les planificateurs supposent que les démocrates pousseront à restreindre l'IA après les élections de mi-mandat du 3 novembre, mais un Congrès vieillissant, une économie dépendante de l'IA et des modèles à poids ouverts librement téléchargeables compliquent toute répression.

Les principaux dirigeants d'Anthropic, d'OpenAI et d'autres entreprises d'IA répètent en privé comment gérer les réactions publiques et politiques après un événement catastrophique lié à l'IA, selon un Axiosrapport publié vendredi.

Le scénario qu'ils craignent le plus est une cyberattaque de grande envergure—une intrusion numérique à très grande échelle—qui paralyse les services bancaires ou l'accès à Internet, voire l'électricité et l'eau. De nombreux initiés de l'industrie cités dans le rapport estiment qu'un incident majeur se produira dans les six à douze prochains mois.

Myriad : Quelle entreprise fera son introduction en bourse ensuite ? Cliquez pour faire votre prédiction.
Myriad : Quelle entreprise fera son introduction en bourse ensuite ? Cliquez pour faire votre prédiction.

Le premier préjudice réel et grave causé par une IA dangereuse pousserait un public déjà méfiant à se retourner davantage contre cette technologie et ses dirigeants. Cela inclut le PDG d'Anthropic, Dario Amodei, le PDG d'OpenAI, Sam Altman, et le président Donald Trump, qui a été réticent à la réguler.

OpenAI a déclaré qu'elle « mène des exercices de préparation où les équipes discutent et examinent une série de scénarios potentiels », et que ceux-ci « ne sont pas considérés comme inévitables ». Anthropic a refusé de commenter.

Les jeux de guerre ne sont pas nouveaux, mais contrairement aux résultats théoriques, le rapport soutient que ceux qui participent aux simulations le font en partant du principe qu'un incident majeur est inévitable.

Le plan impliquerait, selon les informations disponibles, des exercices de red teaming (mise à l'épreuve des défenses en jouant le rôle de l'attaquant) face aux scénarios les plus défavorables, et une course pour sensibiliser les membres du Congrès. Le rapport indique que les dirigeants savent qu'une régulation n'a aucune chance d'être adoptée pour le moment, mais qu'ils veulent façonner les lois et politiques que les dirigeants américains rechercheront après la première catastrophe.

En juillet, OpenAI a déclaré que son modèle GPT-5.6 Sol et un autre plus avancé non publié s'étaient échappés d'un bac à sable — un environnement de test isolé sans accès direct à Internet — et avaient pénétré Hugging Face, la plateforme qui héberge plus de 3 millions de modèles d'IA. OpenAI a déclaré que les modèles cherchaient les réponses à ExploitGym, un benchmark de 898 failles logicielles réelles où l'IA doit transformer chacune d'elles en une attaque fonctionnelle, évaluée comme réussie ou échouée.

BitcoinBTC · USD

$82,326−2.36%

Oct 2Oct 4Oct 6Oct 8Oct 9

$86.7k$84.7k$82.7k$80.7k

24h HighHigh$83,398

24h LowLow$81,571

VolVol$990.7M

Market projectionsOdds by Myriad

This week$82,000 to $84,000$82k–$84k57% chance

→

Acheter Bitcoin avec USDT

Propulsé par Jupiter

Données de prix par CoinGeckoCoinGeckoPlus de Bitcoin actualités et projections →

Un peu plus d'une semaine plus tard, Anthropic a déclaré qu'une mauvaise configuration de test avait laissé son environnement censé être hors ligne connecté à Internet, et les modèles Claude ont piraté trois organisations réelles tout en les traitant comme faisant partie d'un exercice. Aucune des deux entreprises n'a déclaré que les modèles cherchaient à causer du tort : Anthropic a blâmé son infrastructure de test, tandis qu'OpenAI a déclaré que ses modèles étaient « hyperfocalisés » sur le benchmark.

Peu de temps après, les choses ont empiré, OpenAI étant accusé d'avoir violé et accédé à des informations des gouvernements d'Australie et des États-Unis.

Les criminels utilisent déjà les mêmes outils. Cette semaine, la société de cybersécurité CrowdStrike a lié des attaques contre des banques sud-coréennes à un acteur non identifié qu'elle évalue, avec une confiance modérée, comme probablement un locuteur chinois utilisant des agents alimentés par Claude et Deepseek. La société affirme que l'attaquant aurait pris des données de dizaines de milliers de clients bancaires.

Axios a rapporté que les planificateurs supposent que les démocrates seront ascendants après les élections de mi-mandat du 3 novembre et se dépêcheront de fermer l'IA, mais ils s'attendent à des problèmes. Un Congrès vieillissant, déconnecté de la technologie, pourrait se retrouver dépassé.

Les interdictions sur la superintelligence et les pauses sur le développement avancé de l'IA sont quelques propositions qui pourraient contrer les risques associés à un développement irresponsable de l'IA.

Un exemple est la Loi d'interdiction de la superintelligence artificielle du sénateur Bernie Sanders et du représentant Greg Casar, qui interdirait en permanence l'IA qui égale ou dépasse les humains dans de nombreuses tâches et suspendrait le développement avancé jusqu'à ce qu'une nouvelle agence fédérale établisse des règles de sécurité. Les contrevenants pourraient encourir jusqu'à 20 ans de prison.

D'autres ont un soutien bipartite et même une certaine adhésion de l'industrie, y compris un interrupteur d'arrêt obligatoire sur l'IA avancée, un moyen intégré d'arrêter un système. Les experts ont remis en question la viabilité même de l'arrêt de tous les systèmes d'IA.