TOPIC

KV cache

כל החדשות והניתוחים שלנו בנושא KV cache — מתורגמים ומסוכמים ממקורות מובילים בעולם, עם הקשר עסקי ישראלי. 3 כתבות.

SideQuest לניהול זיכרון בסוכני AI: פחות טוקנים, יותר מחקר
מחקר
5 דקות
מ־arXiv cs.AI

SideQuest לניהול זיכרון בסוכני AI: פחות טוקנים, יותר מחקר

**SideQuest היא גישה חדשה לניהול זיכרון במודלי שפה במשימות agentic ארוכות, שבה המודל עצמו קובע אילו טוקנים כדאי לשמור.** לפי המחקר ב-arXiv, השיטה הפחיתה את שיא השימוש בטוקנים בעד 65% עם פגיעה מינימלית בדיוק, למרות שאומנה על 215 דגימות בלבד. עבור עסקים בישראל, המשמעות מעשית מאוד: סוכני AI שמחוברים ל-WhatsApp Business API, ל-Zoho CRM, למסמכים ול-N8N יכולים להפוך מיקרים ואיטיים יותר למערכות יציבות יותר. אם אתם בונים תהליך רב-שלבי — שירות, מכירות, ביטוח, נדל"ן או מרפאה — ניהול זיכרון הופך עכשיו לשכבת תשתית עסקית, לא לפרט הנדסי שולי.

קרא עוד
CHESS לניהול KV Cache: איך להאיץ מודלי שפה ארוכי־הקשר
מחקר
6 דקות
מ־arXiv cs.AI

CHESS לניהול KV Cache: איך להאיץ מודלי שפה ארוכי־הקשר

**CHESS היא שיטה לניהול KV cache במודלי שפה ארוכי־הקשר, שמטרתה לשפר מהירות אינפרנס בלי לפגוע באיכות.** לפי המאמר ב-arXiv, המערכת מגיעה לתוצאות חזקות גם עם 1% בלבד מה-cache ומציגה עד פי 4.56 תפוקה. עבור עסקים בישראל, המשמעות היא פוטנציאל להריץ סוכני שירות, ניתוח מסמכים ושיחות WhatsApp על הקשר ארוך יותר, בזמן תגובה נמוך יותר ובעלות תשתית סבירה יותר. זה חשוב במיוחד למשרדי עורכי דין, ביטוח, מרפאות ונדל"ן, שבהם כל תשובה נשענת על היסטוריה ארוכה של מסמכים, טפסים ושיחות.

קרא עוד