Une faille fondamentale rend les grands modèles de langage (LLM) extrêmement vulnérables aux attaques, les LLM ne voyant qu'un flux continu de texte dans lequel les instructions se mélangent aux réponses
Selon une nouvelle étude, en raison de ce que les chercheurs qualifient de faille de sécurité « fondamentale » dans leur fonctionnement, même les meilleurs modèles d'IA peuvent, dans certains cas, enfreindre leurs propres règles de sécurité et finir par obéir aux ordres d'un utilisateur malveillant....
Une faille fondamentale rend les grands modèles de langage (LLM) extrêmement vulnérables aux attaques, les LLM ne voyant qu’un flux continu de texte dans lequel les instructions se mélangent aux réponses
Une faille fondamentale rend les grands modèles de langage (LLM) extrêmement vulnérables aux attaques, les LLM ne voyant qu'un flux continu de texte dans lequel les instructions se mélangent aux réponsesSelon une nouvelle étude, en raison de ce que les...