מנגנוני הגנה במודלי בינה מלאכותית: אנת'רופיק מעדכנת את Claude Fable 5
חברת Anthropic (אנת'רופיק) הוסיפה מנגנון אבטחה מחמיר למודל הבינה המלאכותית Claude Fable 5 (קלוד פייבל 5) במטרה לרצות את משרד המסחר האמריקאי ולהסיר את מגבלות הייצוא שהטילו עליה. השינוי מגיע בעקבות מחקר של חברת Amazon (אמזון) וניתוח של חברת Luta Security (לוטה סקיוריטי), שחשפו כי משתמשים הצליחו לעקוף את חסמי הסייבר של המודל על ידי בקשות עקיפות לתיקון קוד במקום איתור חולשות. מנגנון האבטחה החדש מנתב שאילתות חשודות באופן אוטומטי למודל Claude Opus 4.8 הפחות מתקדם. עבור עסקים המטמיעים סוכני AI, המקרה מדגיש את החשיבות של בניית מנגנוני הגנה במודלי בינה מלאכותית שאינם תלויים אך ורק במפתחות המודלים.
קרא עוד