Les sauvegardes du chat de l’IA ne parviennent pas à empêcher la propagation de la désinformation de la santé, l’étude révèle
Une étude a évalué l’efficacité des garanties dans les modèles fondamentaux de grand langage (LLM) pour se protéger contre les instructions malveillantes qui pourraient les transformer en outils pour répandre la désinformation, ou la création délibérée et la diffusion de fausses informations dans l’intention de nuire. L’étude a révélé des vulnérabilités dans les garanties du […]