High-techMaroc

« L’IA pourrait tuer tous les humains » : démission d’un chercheur d’Anthropic

Un jeune chercheur britannique de 27 ans a pris la décision de quitter Anthropic, ainsi que l’ensemble du secteur de l’intelligence artificielle, en raison de ses préoccupations quant aux risques que représente la quête incessante de systèmes d’IA toujours plus puissants pour l’humanité. Jacob Coxon, qui a accumulé de l’expérience chez OpenAI avant de rejoindre Anthropic, a travaillé sur le pré-entraînement des modèles d’intelligence artificielle. Il estime que les géants américains ne mesurent pas suffisamment les dangers associés à une IA capable de s’auto-améliorer.

Dans un message diffusé sur X, Coxon a exprimé son inquiétude face à cette course technologique qu’il juge alarmante. Il a déclaré que, selon lui, « aucune autre activité humaine ne pose un tel niveau de danger ». Il critique les laboratoires d’IA pour leur précipitation à développer une superintelligence sans avoir les garanties nécessaires pour maîtriser les conséquences de leurs créations.

Coxon souligne que cette menace est bien connue des acteurs du secteur. « Les gens qui construisent l’IA croient sincèrement qu’elle pourrait tous nous tuer d’ici la fin de la décennie », a-t-il affirmé, insistant sur le fait que cette préoccupation ne doit pas être perçue comme une simple stratégie pour attirer l’attention.

Son passage chez OpenAI et Anthropic lui a également permis de constater que les deux entreprises abordent cette problématique de manière différente. Il estime que, bien qu’Anthropic ait une meilleure compréhension des enjeux, elle est néanmoins engagée dans une compétition pour développer une intelligence artificielle toujours plus avancée. Cette situation paradoxale réside dans le fait que les dirigeants pourraient se sentir contraints d’accélérer leurs recherches, par manque de confiance dans la responsabilité de leurs concurrents.

Les déclarations de Jacob Coxon ont pris une ampleur particulière après la réponse d’Evan Hubinger, responsable de la sûreté chez Anthropic. Ce dernier a reconnu sur X que le scénario évoqué par Coxon était effectivement pris très au sérieux au sein de l’entreprise. « Nous croyons réellement, et très sérieusement, que l’IA pourrait tuer tous les humains », a-t-il écrit, en faisant référence à un rapport de risque publié par Anthropic en août.

Ces préoccupations font écho aux craintes exprimées depuis plusieurs années par des chercheurs qui s’inquiètent de la possibilité de voir émerger des systèmes dont les capacités pourraient rapidement surpasser celles des êtres humains. Jacob Coxon appelle donc ses anciens collègues à réfléchir sur l’orientation de l’industrie. Il les exhorte à se demander s’il est judicieux de poursuivre le développement de systèmes toujours plus puissants, alors même que la compréhension de leur fonctionnement interne reste encore insuffisante.