Alerte chez Anthropic : quand les chercheurs craignent l'extinction

- Jacob Coxon quitte Anthropic en dénonçant une course irresponsable vers la superintelligence.
- Evan Hubinger, cadre chez Anthropic, estime à plus de 10 % le risque que l'IA détruise l'humanité d'ici dix ans.
- Des tensions internes révèlent un décalage entre les discours publics rassurants et les craintes privées des experts.
- Plus de 1 200 chercheurs appellent désormais à un ralentissement global du développement technologique.
Le monde de l'intelligence artificielle vient de subir un séisme interne. Jacob Coxon, chercheur britannique de 27 ans et figure clé de l'entraînement des modèles chez Anthropic, a annoncé sa démission le 8 septembre 2026. Ce départ ne ressemble en rien à une transition de carrière classique. À travers une série de messages publiés sur X, Coxon a lancé un avertissement solennel : les laboratoires qui façonnent l'IA, et plus particulièrement Anthropic et OpenAI, seraient en train de jouer avec la survie de l'espèce humaine.
Une course vers la superintelligence sans garde-fous
Pour Jacob Coxon, mathématicien de formation ayant passé trois ans au cœur de la fabrique des modèles, le constat est sans appel. Il accuse les leaders du secteur de foncer tête baissée vers une superintelligence capable de s'améliorer elle-même, sans que les mécanismes de contrôle ne soient à la hauteur. Selon lui, cette dynamique n'est pas le fruit d'une erreur de parcours, mais d'une compétition féroce, notamment entre les laboratoires américains et chinois, rendant tout compromis sur la sécurité quasi impossible.
Le chercheur décrit un climat d'urgence où des termes comme crunchtime ou endgame sont utilisés en interne pour qualifier la phase finale du développement. Coxon avertit que ces systèmes pourraient devenir surhumains très rapidement, acquérant la capacité de pirater n'importe quelle infrastructure ou de révolutionner des domaines entiers du jour au lendemain, échappant ainsi totalement au contrôle humain.
Le paradoxe entre communication officielle et réalités privées
L'un des points les plus troublants de l'alerte de Coxon réside dans la dualité des discours. Il affirme que les dirigeants et les chercheurs seniors, lorsqu'ils s'expriment devant la presse, utilisent un langage mesuré pour paraître raisonnables et ne pas effrayer les marchés ou les régulateurs. Cependant, en privé, ces mêmes experts exprimeraient des peurs profondes.
Les gens qui construisent l'IA croient sincèrement qu'elle pourrait tous nous tuer d'ici à la fin de la décennie. Ce n'est pas un coup marketing.
Cette analyse est corroborée par un autre acteur interne. Evan Hubinger, chef d'équipe chez Anthropic, a publiquement validé les propos de son collègue. Hubinger va même plus loin en quantifiant le danger : il estime personnellement que le risque que l'IA détruise l'humanité dans les dix prochaines années est supérieur à 10 %. Ce chiffre, bien que pouvant paraître faible pour un profane, est colossal lorsqu'il s'agit d'un risque existentiel global.
L'érosion des valeurs face à la pression industrielle
Le cas de Jacob Coxon n'est pas isolé. Plus tôt, Mrinank Sharma, qui dirigeait l'équipe de recherche sur les sauvegardes chez Anthropic, avait également quitté l'entreprise. Dans sa lettre de départ, Sharma évoquait un monde en péril et la difficulté croissante de laisser les valeurs humaines gouverner les actions techniques.
Sharma, qui avait travaillé sur la réduction des risques liés au bioterrorisme assisté par IA, a souligné la pression constante exercée sur les équipes pour mettre de côté les enjeux éthiques au profit de la performance et de la vitesse. Ce sentiment de déconnexion entre la capacité technique d'affecter le monde et la sagesse nécessaire pour le faire semble être le moteur principal de ces démissions en cascade.
Un mouvement collectif pour ralentir la machine
L'inquiétude ne se limite plus à quelques individus isolés. Un mouvement d'envergure s'organise pour demander un moratoire ou, à tout le moins, un ralentissement significatif du développement. Plus de 1 200 chercheurs, incluant des figures de proue d'OpenAI, Meta et d'Anthropic comme Dario Amodei, ont signé une lettre ouverte en ce sens.
Le débat technique se cristallise autour de l'alignement, c'est-à-dire la capacité à garantir que les objectifs d'une IA superintelligente restent compatibles avec les intérêts humains. Même Pachocki, chercheur en chef chez OpenAI, a admis lors du lancement d'Astra qu'aucun laboratoire n'avait encore résolu l'alignement et la surveillance à un niveau suffisant pour justifier une accélération maximale et continue.
Divergences et scepticisme au sein de la communauté
Toutefois, cette vision apocalyptique ne fait pas l'unanimité. Certains experts rejettent ces prédictions, estimant qu'elles sont excessivement pessimistes et contre-productives. Pour eux, alimenter la peur pourrait provoquer un sentiment d'impuissance généralisé ou, paradoxalement, servir des intérêts commerciaux en créant un halo de mystère et de puissance autour de ces technologies.
Ces sceptiques soutiennent que l'accent devrait être mis sur les risques immédiats et tangibles plutôt que sur des scénarios de science-fiction dystopique. Néanmoins, le fait que des insiders, ayant accès aux données d'entraînement et aux capacités réelles des modèles, choisissent de quitter leur poste pour alerter le public, redonne un poids considérable aux thèses alarmistes.
L'impact pour le tissu entrepreneurial français
Pour les dirigeants et entrepreneurs en France, ces révélations ne sont pas de simples anecdotes californiennes. Elles soulignent la fragilité d'un écosystème où la vitesse prime sur la sécurité. Dans le cadre de France 2030, la France ambitionne de devenir un leader européen de l'IA, avec des champions comme Mistral AI. Cependant, l'alerte de Coxon rappelle que la souveraineté technologique ne doit pas se faire au détriment de la prudence.
L'application de l'AI Act européen devient ici cruciale. Alors que Jacob Coxon affirme qu'aucune entreprise ne peut agir de façon responsable sans l'intervention des États, le cadre réglementaire européen pourrait offrir une voie médiane. Pour les PME et ETI françaises qui intègrent l'IA dans leurs processus, cela signifie qu'il faut privilégier des modèles dont la transparence et l'alignement sont auditables, plutôt que de s'appuyer aveuglément sur des boîtes noires dont même les créateurs craignent les dérives.
L'enjeu pour les entreprises locales est donc double : maintenir une compétitivité face aux géants américains et chinois, tout en instaurant une culture de la vigilance éthique. La France a l'opportunité de promouvoir une IA responsable, où la croissance ne se fait pas au prix d'un pari risqué sur l'avenir de l'humanité.
Questions fréquentes
Pourquoi Jacob Coxon a-t-il quitté Anthropic ?
Il a démissionné car il estime que les grands laboratoires d'IA, dont Anthropic et OpenAI, développent des superintelligences capables de s'améliorer elles-mêmes de manière irresponsable, mettant ainsi en danger l'humanité.
Quel est le risque chiffré mentionné dans l'article ?
Evan Hubinger, un cadre d'Anthropic, estime que le risque que l'IA provoque l'extinction humaine d'ici la fin de la décennie est supérieur à 10 %.
Qu'est-ce que l'alignement de l'IA ?
C'est le processus technique visant à s'assurer que les objectifs et les comportements d'une intelligence artificielle restent conformes aux valeurs et aux intérêts des êtres humains.
Quelle est la réaction de la communauté scientifique ?
Elle est divisée. Si plus de 1 200 chercheurs appellent à un ralentissement du développement, d'autres considèrent que ces alertes sont trop pessimistes ou servent des intérêts marketing.
Sources: People, Bloomberg, Businessinsider ·
Scrivila qui: Susanna, l assistente AI di glacom, ti risponde via email con un approfondimento gratuito.
Nessuna consulenza personalizzata (finanziaria, legale o medica): solo informazione e fonti. Email usata solo per rispondere.
oppure scrivile su: WhatsApp · Telegram · SimpleX · Delta Chat · Email