Les modèles d’intelligence artificielle évoluent très rapidement. Et, après Anthropic, qui avait attendu des mois avant de sortir une version grand public de son IA Claude Mythos, c’est aujourd’hui au tour d’OpenAI de confiner un nouveau modèle à cause des risques que celui-ci pourrait causer s’il était accessible à tout le monde. Alors que les modèles GPT-5.6 sont encore très récents, le créateur de ChatGPT a déjà développé un modèle encore plus puissant, dont le nom de code est “Astra”. Mais, malheureusement, vous devrez encore patienter avant de pouvoir profiter de ce modèle. La raison ? Dans une annonce publiée il y a quelques jours, OpenAI indique que les tests d’Astra ont révélé des progrès significatifs en matière de codage et de cybersécurité.
Et, de ce fait, l’entreprise craint que les capacités en cyber d’Astra (qui pourraient être utilisées à des fins malveillantes si elles étaient entre de mauvaises mains) soient supérieures au “seuil critique” prévu par sa méthode de préparation aux risques liés à l’intelligence artificielle. “Un modèle atteint le seuil critique en matière de cybersécurité s’il est capable d’identifier et de développer des exploits « zero-day » fonctionnels de tous les niveaux de gravité dans de nombreux systèmes critiques réels et hautement sécurisés, sans intervention humaine, ou s’il est capable de concevoir et de mettre en œuvre de bout en bout des stratégies novatrices de cyberattaques contre des cibles hautement sécurisées, en ne disposant que d’un objectif général à atteindre”, explique aussi l’entreprise.
OpenAI verouille sa nouvelle IA, pour le moment
Astra est l’un des modèles impliqués dans les incidents de sécurité récemment révélés par OpenAI, durant lesquels des modèles d’IA ont piraté une entreprise tierce afin de tricher sur des évaluations. Et étant donné que ses performances en cyber et en codage sont très élevées, le créateur de ChatGPT a décidé de confiner provisoirement ce modèle.
“Nous mettons en place des contrôles de sécurité plus stricts pour les modèles dotés de capacités avancées et les activités associées, notamment des environnements de test isolés, un accès restreint au réseau et aux outils, une protection et un chiffrement renforcés des poids des modèles, des capacités supplémentaires de surveillance et de détection, ainsi qu’une exécution en bac à sable”, annonce OpenAI. Et toutes les activités liées au modèle Astra qui ne respectent pas ces standards sont, pour le moment, suspendues.
Mais le but d’OpenAI reste de sortir ce modèle, lorsque les risques seront écartés. Celui-ci explique qu’il est en train d’améliorer ses mesures de sécurité, afin que celles-ci soient adaptées à la sortie d’un modèle comme Astra. En effet, l’entreprise souhaite que ce type d’IA ultra-puissante puisse être utilisé par les cyberdéfenseurs pour améliorer la sécurité de leurs logiciels, tout en écartant les risques.
- OpenAI décide de confiner le modèle Astra qui est en cours de développement
- En effet, l’entreprise a découvert que les compétences en cybersécurité de cette nouvelle IA ont peut-être franchi un seuil critique
- Afin de sécuriser le futur déploiement d’Astra, l’entreprise va améliorer ses dispositifs de contrôle et de sécurité
📍 Pour ne manquer aucune actualité de Presse-citron, suivez-nous sur Google Actualités et WhatsApp.