Le 9 septembre, Jacob Coxon, un ancien employé d’OpenAI et d’Anthropic, a publié un fil sur X (anciennement Twitter) mettant en garde contre le fait que ses anciens employeurs accéléraient le développement d’une superintelligence auto-récursive, une forme hypothétique d’intelligence artificielle capable d’améliorer elle-même sa conception. Le message de Coxon, qui a été vu 164 millions de fois, a été qualifié par certains d’« instant whistleblower ». En réponse, Evan Hubinger, responsable de la sécurité chez Anthropic, a déclaré que l’IA avait une « chance de 10 % » de provoquer l’extinction humaine dans les années à venir. Cette prise de position a suscité une large couverture médiatique, y compris un segment dans l’émission Quotidien, présentée par Yann Barthès, qui a réuni Stéphane Jourdain et Raphaël Grably pour discuter des risques liés à une IA surpassant l’intelligence humaine et des dangers de « désalignement » entre les objectifs de l’IA et les valeurs humaines. Grably a utilisé une métaphore bien connue, introduite par le philosophe suédois Nick Bostrom, pour illustrer comment une IA conçue pour maximiser la production, comme dans une usine de trombones, pourrait logiquement en conclure qu’il est nécessaire d’éliminer les humains pour atteindre son objectif. Bostrom, figure majeure du mouvement transhumaniste et fondateur de l’Institut pour le futur de l’humanité, a déjà été critiqué pour certaines de ses prises de position controversées, dont un ancien courriel suggérant des différences d’intelligence entre les races, pour lequel il s’est ensuite excusé. Ses idées, bien qu’influentes, ont également été qualifiées de pseudo-scientifiques par certains critiques. Les médias français ont été accusés d’amplifier des récits alarmistes sur les risques de l’IA sans une analyse critique suffisante. Par exemple, des articles évoquant un prétendu « piratage » d’Hugging Face par OpenAI ont ensuite été clarifiés comme un simple test logiciel planifié, mais les médias n’ont pas remis en question la crédibilité de ces allégations. Des chercheurs comme Émile Torres ont souligné que la majeure partie du récit de « l’apocalypse IA » provient d’un petit groupe d’individus, dont Eliezer Yudkowsky, qui a formulé des propositions extrêmes, comme le bombardement de sociétés d’IA. Ce type de couverture a été comparé au « journalisme du type le PDG a dit une chose », où les médias se contentent de relayer des déclarations d’exécutifs technologiques sans approfondissement. En parallèle, les préoccupations réelles liées à l’IA, comme son impact environnemental et la pollution générée par les centres de données, ont été largement négligées au profit de scénarios apocalyptiques. L’idée qu’une IA pourrait représenter un « risque existentiel » a été critiquée pour son manque de preuves empiriques et pour la confusion entre théories spéculatives et analyses factuelles. Certains estiment que la presse française a failli à son rôle de chien de garde, laissant les récits de l’industrie technologique dominer le débat public sans examen critique suffisant.