Anthropic estime que les progrès de l’intelligence artificielle pourraient conduire à des systèmes transformateurs au cours de la prochaine décennie. L’entreprise reconnaît toutefois que les méthodes permettant de rendre ces systèmes sûrs et alignés sur les valeurs humaines restent encore mal comprises. Elle indique donc mener plusieurs axes de recherche consacrés à une meilleure compréhension des systèmes d’IA, à leur évaluation et à leur alignement. Cette démarche vise à approfondir les connaissances nécessaires pour traiter les enjeux de sécurité associés aux futurs développements de l’IA.
Pourquoi cette annonce compte
Ces orientations intéressent les professionnels du numérique qui doivent suivre l’évolution des travaux sur la fiabilité et l’alignement des systèmes d’IA. Elles donnent aussi un aperçu des priorités de recherche d’Anthropic.