Les Gardiens Autoproclamés de la Silicon Valley

La présentation publique par Anthropic des menaces biologiques et de la propagande bloquées révèle la réalité gênante de l'auto-régulation des géants de la technologie.

Silicon Valley’s Self-Appointed Guardians

Juste à temps pour son introduction en bourse prévue cet automne, Anthropic a publié un compte rendu public de sa propre vigilance. Dans son troisième rapport sur les menaces depuis mars 2025, le développeur d'intelligence artificielle a exposé comment ses modèles Claude ont été ciblés par des opérations d'influence secrètes, des cybercriminels et des chercheurs cherchant à suralimenter les virus transmis par les moustiques. Le message de l'entreprise est clair : l'écosystème numérique est dangereux, le logiciel est puissant et les entreprises technologiques privées décident où fixer les limites.

Les détails publiés par l'entreprise sont certes frappants. Entre décembre 2025 et août 2026, des acteurs malveillants ont tenté d'utiliser Claude pour des tâches allant de la propagande politique automatisée à la recherche biologique à double usage. Dans un cas, un utilisateur a demandé au chatbot de rédiger une demande de financement pour une recherche sur le virus chikungunya à gain de fonction, visant à améliorer sa transmissibilité et ses capacités d'évasion immunitaire. Bien qu'une telle recherche puisse théoriquement aider au développement de vaccins, Anthropic a noté que les mêmes modifications pourraient rendre l'agent pathogène substantiellement plus dangereux.

Au-delà des risques biologiques, l'entreprise a signalé neuf opérations d'influence secrètes originaires de Russie, d'Iran, de Turquie et de régions d'Asie, d'Afrique et d'Europe. Ces réseaux ont déployé des centaines de comptes automatisés pour amplifier des messages politiques coordonnés sur une période d'une semaine. Anthropic a rapporté que ses systèmes défensifs ont intercepté ces opérations pendant leur phase de mise en place et ont incité à des mesures de protection plus strictes sur les nouveaux modèles comme Claude Fable 5. L'entreprise a défendu ses divulgations publiques en déclarant que plus les modèles deviendront capables, plus leurs risques augmenteront, à moins que les développeurs d'IA et les défenseurs de la société n'agissent pour les rendre plus sûrs. Les systèmes plus anciens, y compris Claude Opus 4, fonctionnaient avec des contrôles moins stricts car leurs capacités d'analyse étaient jugées insuffisantes pour aider à la recherche biologique sophistiquée.

Pourtant, ce récit de gestion d'entreprise s'accompagne d'une forte dissidence interne. Deux jours seulement avant la publication du rapport, le chercheur Jacob Coxon a démissionné d'Anthropic. Son départ a été accompagné d'un avertissement sévère selon lequel l'entreprise, avec des concurrents tels qu'OpenAI, est en concurrence téméraire vers une superintelligence auto-améliorante et joue avec la sécurité publique. Coxon a averti que certains initiés de l'industrie croient que les systèmes artificiels pourraient mettre en danger la vie humaine avant la fin de la décennie.

Cet épisode met en lumière un dilemme structurel pour les marchés modernes. Comme l'a observé John Thickstun, professeur adjoint à l'Université Cornell, les entreprises commerciales d'IA sont effectivement contraintes de prendre des décisions de valeur à l'échelle sociétale sans surveillance démocratique ou délibérative. Lorsque les entreprises privées décident quelles requêtes scientifiques sont admissibles et quels comportements numériques franchissent la ligne, elles assument des responsabilités traditionnellement réservées aux autorités souveraines. La question de savoir si un début en bourse à l'automne offre les bonnes incitations pour gérer les risques techniques mondiaux est une question que les investisseurs devront bientôt prendre en compte.

Écrit par Andreas Hofer andreas.hofer@alpineweekly.com