מחקר
4 דקות
מ־arXiv cs.AI
GT-HarmBench: בנצ'מרק חדש לבדיקת בטיחות AI בסביבות רב-סוכנים
GT-HarmBench חושף כשלים בבטיחות AI רב-סוכנים: רק 62% פעולות מועילות. כלי חדש מבוסס תורת המשחקים לשיפור יישור. גלו כיצד להגן על העסק שלכם.
קרא עודGT-HarmBench חושף כשלים בבטיחות AI רב-סוכנים: רק 62% פעולות מועילות. כלי חדש מבוסס תורת המשחקים לשיפור יישור. גלו כיצד להגן על העסק שלכם.
קרא עודסוכני LLM חכמים זקוקים להסברים על תרומת הכלים. AgentSHAP – שיטה ראשונה מבוססת Shapley values – חושפת חשיבות מדויקת. קראו על התרומות והניסויים.
קרא עוד