חיפוש בחדשות

2 תוצאות עבור "ETHICS".

פרומורל-בנץ': איך עיצוב פרומפטים משפר בטיחות מוסרית ב-LLM
מחקר
6 דקות
מ־arXiv cs.AI

פרומורל-בנץ': איך עיצוב פרומפטים משפר בטיחות מוסרית ב-LLM

ProMoral-Bench (arXiv:2602.13274v1) הוא בנצ'מרק שמאפשר להשוות בצורה אחידה בין 11 אסטרטגיות פרומפטינג להשגת חשיבה מוסרית ובטיחות במודלי שפה, על בסיס סטים כמו ETHICS, Scruples ו-WildJailbreak, ובתוספת מבחן חוסן חדש ETHICS-Contrast. החוקרים מציעים מדד מאוחד בשם UMSS שמאזן בין דיוק מוסרי לבין עמידות לתוכן מזיק וג’יילברייק. לפי הממצאים, פרומפטים קומפקטיים עם דוגמאות few-shot עקביות מנצחים פרומפטים מרובי-שלבים: הם יציבים יותר תחת ניסוח מחדש, עמידים יותר לפריצות, וגם זולים יותר בטוקנים—נקודה קריטית למי שמפעיל שירות ב-WhatsApp Business API ומשלב נתונים מ-CRM כמו Zoho דרך N8N.

קרא עוד
Mirror לבדיקת אתיקה במחקר: מסגרת רב-סוכנים עם EthicsLLM ו-41 אלף דוגמאות
ניתוח
6 דקות
מ־arXiv cs.AI

Mirror לבדיקת אתיקה במחקר: מסגרת רב-סוכנים עם EthicsLLM ו-41 אלף דוגמאות

Mirror הוא מסגרת רב־סוכנים לבדיקת אתיקה בסיוע בינה מלאכותית, שמחברת בין EthicsLLM (מודל שפה ייעודי) לבין פרשנות כללים מובנית ודיון דמוי־ועדה. לפי המאמר arXiv:2602.13292v1, EthicsLLM כויל על EthicsQA עם 41 אלף דוגמאות, ומאפשר שני מצבים: Mirror-ER לבדיקות מזורזות למחקרים בסיכון מינימלי באמצעות בסיס כללים “בר־הרצה”, ו־Mirror-CR שמדמה דיון ועדה מלא עם סוכני מומחים ומפיק הערכה ב־10 ממדים. לעסקים בישראל המשמעות היא “אתיקה כהליך”: אפשר להטמיע מסלול בדיקות אוטומטי לפיילוטים (למשל ניתוח שיחות/הודעות) תוך תיעוד ב־Zoho CRM והרצה של כללי ציות ב־N8N, עם התראות סטטוס דרך WhatsApp Business API בלי לחשוף תוכן רגיש.

קרא עוד