בעולם שבו AI כובש כל תחום, אירוניה גדולה נחשפת בכנס NeurIPS היוקרתי: הזיות ציטוטים במאמרים שנכתבו על ידי מיטב חוקרי הבינה המלאכותית. חברת GPTZero, המתמחה בזיהוי תוכן AI, סרקה את כל 4,841 המאמרים שאושרו לכנס שהתקיים בסן דייגו בחודש שעבר. התוצאה? 100 ציטוטים מזויפים ב-51 מאמרים שונים, אותם אישרה החברה כהזיות AI.
GPTZero מדווחת כי מדובר במספר זניח סטטיסטית – 100 מתוך עשרות אלפי ציטוטים – אך ההקשר מדאיג. קבלת מאמר ל-NeurIPS היא הישג קריירה משמעותי בקרב חוקרי AI. חוקרים אלה, מובילי התחום, נוהגים להשתמש במודלי שפה גדולים (LLMs) לכתיבת ציטוטים משעממת, אך הזיות כאלה עלולות לפגוע באמינות. NeurIPS עצמה מציינת כי ציטוט שגוי אינו מבטל את תוכן המאמר.
למרות זאת, ציטוטים הם מטבע ערך בקהילת המחקר – הם מודדים השפעה והצלחה. הזיות AI מדללות את ערכם ומעלות שאלות על תהליכי הביקורת העמיתית. כל מאמר נבדק על ידי מספר בודקים שמונעים מלזהות הזיות, אך עם נפח כה עצום של הגשות, המערכת נמצאת על סף קריסה, כפי שצוין במאמר מיולי 2025 על משבר הביקורת בכנסי AI.
המקרה חושף בעיה רחבה יותר: כנסים מובילים כמו NeurIPS סובלים מצונאמי הגשות, שמכביד על תהליכי הסינון. GPTZero מדגישה כי המטרה היא להצביע על דליפת 'שמן AI' דרך עומס זה. חוקרים אמורים לאמת ציטוטים בעצמם, שכן הם מכירים את המקורות, אך נראה שזה לא תמיד קורה.
לעסקים ישראלים בתחום AI, הממצאים רלוונטיים במיוחד. NeurIPS משפיע על חדשנות גלובלית, וכל פגם בתהליכים עלול להשפיע על אמינות מחקרים שמניעים פיתוחים. חברות ישראליות המשתמשות במחקרים אלה חייבות להגביר בדיקות עצמאיות.
השורה התחתונה אירונית: אם מומחי AI המובילים בעולם אינם מצליחים להבטיח דיוק בשימוש בכלי AI שלהם – כשהמוניטין שלהם על כף המאזניים – מה זה אומר לשארנו? זה מחייב מנהלי טכנולוגיה לבחון מחדש תהליכי אימות בתחומי העסקים שלהם.
מה תעשו כדי למנוע הזיות כאלה בפרויקטים שלכם?