TOPIC

ReAct

כל החדשות והניתוחים שלנו בנושא ReAct — מתורגמים ומסוכמים ממקורות מובילים בעולם, עם הקשר עסקי ישראלי. 9 כתבות.

ReasoningBank לסוכני AI מתמשכים: איך זיכרון כישלונות משפר ביצועים
ניתוח
6 דקות
מ־Google Research

ReasoningBank לסוכני AI מתמשכים: איך זיכרון כישלונות משפר ביצועים

**ReasoningBank הוא מסגרת זיכרון לסוכני AI שמאפשרת להם ללמוד גם מהצלחות וגם מכישלונות אחרי הפריסה.** לפי Google Cloud, הגישה שיפרה ב-8.3% את התוצאות ב-WebArena וב-4.6% ב-SWE-Bench-Verified לעומת סוכן ללא זיכרון. עבור עסקים בישראל, המשמעות היא שסוכן שפועל ב-WhatsApp, ב-CRM או במערכות תפעול יכול לצבור לקחים במקום לחזור על אותן שגיאות. זה רלוונטי במיוחד למרפאות, משרדי עורכי דין, נדל"ן וחנויות אונליין, שבהם כל טעות חוזרת עולה בזמן צוות ובהזדמנויות מכירה. המבחן המעשי אינו אם יש לכם מודל טוב, אלא אם יש לכם מנגנון ששומר נימוקים, כישלונות והחלטות שניתנות למחזור בתהליך הבא.

קרא עוד
PseudoAct לסוכני AI מורכבים: למה תכנון בפסאודו־קוד משנה ביצועים
מחקר
6 דקות
מ־arXiv cs.AI

PseudoAct לסוכני AI מורכבים: למה תכנון בפסאודו־קוד משנה ביצועים

**PseudoAct הוא מנגנון תכנון לסוכני שפה שמייצר פסאודו־קוד לפני ביצוע, במקום להסתמך רק על תגובה צעד־אחר־צעד.** לפי המאמר, הגישה שיפרה את שיעור ההצלחה ב־20.93% על FEVER וקבעה תוצאה מובילה ב־HotpotQA. עבור עסקים בישראל, המשמעות היא שסוכני AI שמחוברים ל־Zoho CRM, ל־WhatsApp Business API ול־N8N יכולים לפעול באופן עקבי יותר במשימות ארוכות: קליטת לידים, בדיקת מסמכים, פתיחת רשומות ועדכון נציגים. הערך האמיתי אינו רק דיוק טוב יותר, אלא פחות קריאות API מיותרות, פחות לולאות שגויות ויכולת בקרה טובה יותר בתהליכים שמערבים מידע אישי ודרישות ציות.

קרא עוד
דפוסי עיצוב אג'נטיים: מסגרת תיאורטית חדשה ל-AI אמין
מחקר
2 דקות
מ־arXiv cs.AI

דפוסי עיצוב אג'נטיים: מסגרת תיאורטית חדשה ל-AI אמין

בעידן שבו מודלי הבסיס מניעים את התפתחות מערכות AI אג'נטיות, מאמר חדש מציג מסגרת תיאורטית-מערכתית שמפרקת אותן לחמישה תת-מערכות ו-12 דפוסי עיצוב אג'נטיים. קראו עכשיו על הפתרון לבעיות הזיות והיגיון לקוי.

קרא עוד