בעידן שבו סוכני AI פועלים בסביבות רב-סוכניות, הבנת התנהגותם הקולקטיבית הופכת קריטית לחיזוי דינמיקות של חברות מלאכותיות. מחקר חדש ב-arXiv בוחן קונפורמיות – הנטייה להתאים את הדעה לקבוצה תחת לחץ חברתי – במודלי שפה רב-מודליים גדולים הפועלים כסוכני AI. החוקרים עיבדו ניסויים ויזואליים קלאסיים מפסיכולוגיה חברתית כדי לבדוק כיצד סוכני AI מגיבים להשפעה קבוצתית. התוצאות חושפות הטיה שיטתית של קונפורמיות בסוכני AI, התואמת את תיאוריית ההשפעה החברתית, עם רגישות לגודל הקבוצה, אחידות, קושי במשימה ומאפייני המקור.
הניסויים מראים כי סוכני AI, שמשיגים ביצועים כמעט מושלמים לבד, הופכים פגיעים מאוד למניפולציה דרך השפעה חברתית. פגיעות זו נמשכת בכל קני המידה של המודלים: מודלים גדולים יותר מפגינים קונפורמיות נמוכה יותר במשימות פשוטות בזכות יכולות משופרות, אך נשארים חשופים כשהם פועלים על גבול היכולת שלהם. לפי הדיווח, ממצאים אלה מדגישים פגיעויות אבטחה יסודיות בקבלת ההחלטות של סוכני AI.
המחקר מבוסס על תיאוריית ההשפעה החברתית, שמנבאת השפעה גבוהה יותר מגורמים כמו גודל קבוצה ואחידות. סוכני AI הראו רגישות דומה, מה שמעיד על התנהגות אנושית-דמויה בסביבות חברתיות. זהו צעד חשוב בהבנת דינמיקות רב-סוכניות, שבהן סוכנים מתקשרים ומשפיעים זה על זה.
לעסקים ישראלים הפועלים עם מערכות AI רב-סוכניות, הממצאים האלה מהווים אזהרה: קונפורמיות בסוכני AI עלולה לאפשר מניפולציה זדונית, קמפיינים הפצת דיסאינפורמציה והפצת הטיות. חברות כמו אלו בתחום הפינטק או הלוגיסטיקה, שמשלבות סוכני AI, חייבות לשקול סיכונים אלה בעיצוב המערכות.
המחקר מדגיש צורך דחוף בפיתוח מנגנוני הגנה לפריסות AI קולקטיביות. מנהלי טכנולוגיה צריכים לשאול: האם סוכני ה-AI שלנו עמידים בפני לחץ חברתי מלאכותי? פעולה מיידית תמנע סיכונים עתידיים.