Anthropic développe avec la NNSA et le DOE un classificateur pour la sûreté nucléaire de l’IA
Anthropic indique avoir co-développé avec la NNSA et les laboratoires nationaux du DOE un classificateur, c’est-à-dire un système d’IA capable de catégoriser automatiquement des contenus. Lors de tests préliminaires, cet outil a distingué des conversations liées au nucléaire jugées préoccupantes de conversations considérées comme bénignes, avec une précision de 96 %. Cette démarche s’inscrit dans un partenariat public-privé consacré au développement de dispositifs de sûreté nucléaire appliqués à l’intelligence artificielle.
