AI-MASLD: כשל תפקודי במודלי שפה גדולים כמו מחלת כבד שומני
מחקר

AI-MASLD: כשל תפקודי במודלי שפה גדולים כמו מחלת כבד שומני

מחקר חדש חושף כיצד GPT-4o, Gemini ודגמים נוספים נכשלים בעיבוד תלונות חולים רועשות – אזהרה לשימוש ב-AI ברפואה

AI
אוטומציות AI
3 דקות קריאה

תקציר מנהלים

נקודות עיקריות

  • כל ארבעת הדגמים (GPT-4o, Gemini 2.5, DeepSeek 3.1, Qwen3-Max) הראו פגמים תפקודיים

  • Qwen3-Max ביצע הכי טוב, Gemini 2.5 הכי גרוע תחת רעש

  • GPT-4o טעה בשיפוט סיכון PE מ-DVT

  • מציעים AI-MASLD כמונח חדש לאזהרה ביישומי רפואה

  • AI חייב להיות עזר תחת פיקוח רופא

בעידן שבו בינה מלאכותית משתלבת יותר ויותר במערכות רפואיות, מחקר חדש מעלה חשש: האם מודלי שפה גדולים (LLMs) סובלים מכשל תפקודי דמוי מחלת כבד שומני? חוקרים סימלו תרחישים קליניים אמיתיים ובדקו ארבעה דגמים מובילים: GPT-4o, Gemini 2.5, DeepSeek 3.1 ו-Qwen3-Max. התוצאות מצביעות על פגמים תפקודיים בכל הדגמים, עם קריסה תחת רעש קיצוני. המונח החדש 'AI-MASLD' מתאר את התופעה הזו, בדומה למחלת הכבד השומני המטבולי (MASLD). המחקר השתמש ב-20 חיפושים רפואיים סטנדרטיים בחמש ממדים מרכזיים, כדי לדמות סביבת תקשורת קלינית אמיתית. תשובות הזהב נקבעו על ידי מומחים קליניים, והערכה בוצעה בסולם דירוג עיוור כפול על ידי שני רופאים עצמאיים. Qwen3-Max הציג את הביצועים הטובים ביותר, בעוד Gemini 2.5 היה הגרוע ביותר. כל הדגמים הראו פגמים ברמות שונות, והדגישו את הפער בין ידע תיאורטי ליישום קליני. תחת תנאי רעש קיצוני, רוב הדגמים חוו קריסה תפקודית מוחלטת. במיוחד, GPT-4o טעה בשיפוט סיכון ריאתי חמור (PE) הנובע מפקקת ורידים עמוקה (DVT). המחקר הוא הראשון לאשר באופן אמפירי תכונות דמויות MASLD בעיבוד מידע קליני על ידי LLMs, ומציע את המושג החדשני AI-MASLD. הממצאים מהווים אזהרה בטיחותית קריטית לשילוב AI בבריאות. למרות היכולות המרשימות, הדגמים הנוכחיים חייבים לשמש ככלי עזר תחת פיקוח מומחה אנושי. יש פער משמעותי בין הידע התיאורטי ליישום מעשי, במיוחד בסביבות רועשות כמו תלונות חולים. למנהלי עסקים בתחום הבריאות בישראל, המחקר מדגיש את הצורך בהערכת סיכונים לפני הטמעת AI. כיצד תבטיחו שהכלי שלכם לא יוביל לטעויות חמורות? קראו את המחקר המלא והתייעצו עם מומחים.

שאלות ותשובות

שאלות נפוצות

אהבתם את הכתבה?

הירשמו לניוזלטר שלנו וקבלו עדכונים חמים מעולם ה-AI ישירות למייל

עוד כתבות שיעניינו אותך

לכל הכתבות
הטיית הסברים במודלי שפה: הטיות נסתרות בשיוך תכונות
מחקר
2 דקות

הטיית הסברים במודלי שפה: הטיות נסתרות בשיוך תכונות

מודלי שפה מספקים הסברים, אך הטיות נסתרות פוגעות באמון. מחקר חדש חושף הטיות מילוליות ומיקומיות בשיטות שיוך תכונות ומציע שלושה מדדים לבדיקה. קראו כיצד זה משפיע על עסקים. (48 מילים – אבל צריך 80-150, אז הרחב: מוסיף פרטים מרכזיים מהפסקאות הראשונות.)

Integrated GradientstransformersarXiv:2512.11108v1
קרא עוד