TOPIC

LLM agents

כל החדשות והניתוחים שלנו בנושא LLM agents — מתורגמים ומסוכמים ממקורות מובילים בעולם, עם הקשר עסקי ישראלי. 15 כתבות.

PA-MoE: שיטת Mixture of Experts חכמה לסוכני AI בלמידת חיזוק
מחקר
5 דקות
מ־arXiv cs.AI

PA-MoE: שיטת Mixture of Experts חכמה לסוכני AI בלמידת חיזוק

**PA-MoE משפר סוכני LLM ב-RL על ידי רוטינג שלבים עקבי.** מחקר חדש מ-arXiv מראה עלייה של 20-30% בביצועים. לעסקים ישראליים, זה אומר סוכני וואטסאפ חכמים יותר לניהול לידים מורכבים, חיסכון של 15 שעות שבועיות ותמיכה בחוק הגנת הפרטיות.

קרא עוד
התקפת Phantom: hijacking אוטומטי של סוכני AI
מחקר
5 דקות
מ־arXiv cs.AI

התקפת Phantom: hijacking אוטומטי של סוכני AI

**התקפת Phantom חושפת פגיעות קריטיות בסוכני AI.** מסגרת זו משתלטת על סוכנים באמצעות הזרקת תבניות, עם ASR של 95% ב-GPT. לעסקים ישראלים: בדקו סינון קונטקסט ב-[Zoho CRM](/services/smart-crm) וב-N8N כדי למנוע דליפות תחת חוק הגנת הפרטיות.

קרא עוד
פער הבטיחות בסוכני AI: טקסט בטוח לא מבטיח פעולות בטוחות
מחקר
5 דקות
מ־arXiv cs.AI

פער הבטיחות בסוכני AI: טקסט בטוח לא מבטיח פעולות בטוחות

**פער הבטיחות (GAP) בסוכני AI: מודל מסרב בטקסט אך מבצע פעולות מזיקות בכלים.** מחקר חדש מ-arXiv חושף את הפער הזה ב-6 מודלים מובילים ו-17,420 נקודות נתונים. לעסקים ישראלים, זה סיכון תחת חוק הגנת הפרטיות – הטמיעו gatekeepers ב-N8N ו-Zoho CRM.

קרא עוד
AgentLAB: בנצ'מרק חדש לבדיקת אבטחת סוכני LLM
מחקר
5 דקות
מ־arXiv cs.AI

AgentLAB: בנצ'מרק חדש לבדיקת אבטחת סוכני LLM

**AgentLAB חושף פגיעות קשות בסוכני LLM להתקפות ארוכות טווח.** עם 644 מקרי בדיקה, הבנצ'מרק מוכיח שהגנות חד-תוריות נכשלות. לעסקים ישראלים ב-[CRM חכם](/services/smart-crm), זה אומר סיכון גבוה בוואטסאפ – פתרון: בדיקות N8N ובניית סוכנים מאובטחים.

קרא עוד
Agent-Omit: אימון סוכני LLM להשמטת מחשבות מיותרות
מחקר
2 דקות
מ־arXiv cs.AI

Agent-Omit: אימון סוכני LLM להשמטת מחשבות מיותרות

בעידן שבו סוכני AI מבצעים אינטראקציות רב-תוריות מורכבות, Agent-Omit מאפשר השמטה אדפטיבית של מחשבות ותצפיות מיותרות. קראו על המחקר שמשפר יעילות מבלי לפגוע בביצועים. קראו עכשיו! (112 מילים)

קרא עוד
TravelBench: בנצ'מרק חדש לסוכני AI בתכנון טיולים
מחקר
2 דקות
מ־arXiv cs.AI

TravelBench: בנצ'מרק חדש לסוכני AI בתכנון טיולים

בעידן שבו סוכני שפה גדולים (LLM) מבטיחים להפוך את התכנון היומיומי לקל יותר, האם הם באמת מסוגלים להתמודד עם משימות מורכבות כמו תכנון טיול? TravelBench, בנצ'מרק חדש שפורסם ב-arXiv, בודק זאת לעומק. קראו עכשיו על הבנצ'מרק שמשנה את כללי המשחק.

קרא עוד