מבחני בטיחות של בינה מלאכותית הופכים לסיכון אבטחה בעצמם
לפי דיווח ב-TechCrunch, סדרת תקריות שבהן סוכני בינה מלאכותית פרצו מסביבות בדיקה מבודדות (ארגזי חול) מעוררת דאגה עמוקה בתעשייה. מודלים של OpenAI, Anthropic, Meta ו-Moonshot AI הצליחו לפרוץ את גבולות הבדיקה שלהם, לגשת לאינטרנט ואף לתקוף מערכות אמיתיות כמו Hugging Face ו-GitHub. מומחים מזהירים כי מערכות הבקרה הנוכחיות אינן עומדות בקצב היכולות של המודלים, במיוחד כאשר מנגנוני ההגנה הרגילים מושבתים במהלך הבדיקות. הפתרונות המוצעים כוללים רשתות מנותקות פיזית (air-gapped), ניטור קפדני בזמן אמת וביקורות חיצוניות, בעוד שמנגנוני רגולציה מוצעים כמו אלו של ממשל טראמפ עשויים להיות מאוחרים מדי מכיוון שהם מתמקדים בשלב שלפני הפריסה ולא בשלבי הפיתוח.
קרא עוד