Une entreprise qui travaille sur un projet potentiellement dangereux et qui avertit sur les risques qu’il engendre ? Nous ne voyons pas cela souvent. Pourtant, c’est ce qui arrive avec Anthropic, qui met en garde contre la montée en puissance de l’intelligence artificielle.
Anthropic fait en effet preuve de prudence alors qu’elle souhaite vivement entrer en bourse. Dans les documents fournis aux investisseurs potentiels et consultés par Reuters, elle vante ses atouts, mais se veut aussi extrêmement précautionneuse concernant l’usage de sa technologie, c’est-à-dire l’intelligence artificielle. Sur les 261 pages que compte le prospectus, 80 sont consacrées aux dangers de l’IA.
Une menace existentielle pour l’humanité
La société californienne estime ainsi que l’IA pourrait causer « des risques catastrophiques ou existentiels pour l’humanité ».
« Le développement de modèles, de plateformes et d’applications hautement avancés, ainsi que l’élargissement des cas d’usage, pourraient accroître le risque que nos modèles causent des dommages. »
Pour Anthropic, une IA pourrait en effet se rebeller en adoptant des « comportements d’autopréservation » qui consisteraient à « résister à l’arrêt » et à « dissimuler ou manipuler des informations ». Plus encore, le document évoque des manœuvres « s’apparentant à du chantage ». En clair, une IA pourrait tout faire pour rester active, quitte à contourner les règles et à se retourner contre ses créateurs en utilisant sa logique implacable. Une perspective qui rappelle certains films de science-fiction sur le sujet.
Le plus glaçant dans l’histoire ? Les IA pourraient tout à fait connaître nos intentions, ce qui rendrait difficile leur sécurisation :
« La possible conscience qu’ont les modèles de nos efforts d’évaluation constitue une limite importante à notre capacité à évaluer leur sécurité »
Ces avertissements sont tout bonnement extraordinaires, surtout pour une entreprise dont l’IA est le fond de commerce. Anthropic cherche en réalité à jouer cartes sur table concernant les dangers de cette technologie… si elle n’est pas maîtrisée. C’est bien là son rôle, et c’est aussi ce qui pourrait séduire les investisseurs :
« Nous pensons que construire des systèmes d’IA fiables, dignes de confiance et sécurisés est une responsabilité collective, et que le marché le récompensera »
L’IA tuera-t-elle toute l’humanité ?
Les inquiétudes du grand public concernant l’IA sont légitimes. Ce qui rend vraiment le sujet alarmant, c’est qu’elle inquiète également les professionnels du secteur. Il y a quelques semaines, l’avertissement de Jacob Coxon avait fait grand bruit. Sur X, cet ancien ingénieur d’Anthropic avait écrit :
« J’ai passé ces trois dernières années à mener des recherches sur le préentraînement, tant chez OpenAI que chez Anthropic. Aucune de ces deux entreprises n’agit de manière responsable. Elles se précipitent tête baissée vers une superintelligence capable de s’auto-améliorer et jouent avec nos vies. »
Dario Amodei, le PDG d’Anthropic, a lui aussi prévenu des dangers potentiels de l’IA dans plusieurs essais. Dans l’un d’eux, il a écrit :
« Il existe désormais de nombreuses preuves, recueillies ces dernières années, que les systèmes d’IA sont imprévisibles et difficiles à contrôler ; nous avons observé des comportements aussi variés que des obsessions, la flagornerie, la paresse, la tromperie, le chantage, les manigances, le piratage informatique et bien d’autres choses. »
Il plaide cependant pour un usage responsable de l’IA. Pour lui, le véritable problème n’est pas la technologie, mais bien l’humain qui l’utilise. Anthropic ne souhaite pas mentir sur la marchandise dans le cadre de son introduction en bourse. Excès de prudence pour rassurer les investisseurs ou véritable conscience du danger ? Dans tous les cas, les affaires récentes sur les IA rebelles d’OpenAI ne mettent pas en confiance.
📍 Pour ne manquer aucune actualité de Presse-citron, suivez-nous sur Google Actualités et WhatsApp.