מחקר
3 דקות
מ־arXiv cs.AI
HarmTransform: הסוואת שאילתות מזיקות בדיון רב-סוכנים
בעידן שבו דגמי שפה גדולים (LLM) שולטים בשיחות דיגיטליות, מנגנוני הבטיחות שלהם חסומים בפני תכנים מסוכנים גלויים – אך נכשלים מול הסוואות מתוחכמות. HarmTransform מציעה פתרון חדשני. קראו עכשיו על המסגרת שמשפרת אימון בטיחות.
קרא עוד