חיפוש בחדשות

15 תוצאות עבור "אימון סוכני".

תשתית Orchard: פלטפורמת קוד פתוח לאימון סוכני AI
חדשות
4 דקות
מ־Microsoft Research

תשתית Orchard: פלטפורמת קוד פתוח לאימון סוכני AI

חוקרים מ-Microsoft Research הציגו את Orchard, תשתית קוד פתוח חדשנית לאימון והערכה של סוכני בינה מלאכותית (Agentic AI) בקנה מידה רחב ובעלות נמוכה. המערכת מבוססת על Orchard Env, שירות סביבה קל-משקל המבוסס על Kubernetes, המאפשר לאמן סוכנים ישירות בתוך מעטפות פריסה אמיתיות כמו Codex ו-OpenClaw. הפרויקט כולל שלושה מודלים ייעודיים: Orchard-SWE המיועד להנדסת תוכנה ומגיע ל-73% ב-SWE-bench Verified עם מודל של כ-3 מיליארד פרמטרים פעילים בלבד; Orchard-GUI, סוכן דפדפן קל-משקל המשיג ממוצע של 68.4% במשימות ניווט ברשת; ו-Orchard-Claw, עוזר אישי למשימות פרודוקטיביות. הפלטפורמה מציעה גישה חדשה של למידה מצטברת המאפשרת לדורות הבאים של הסוכנים לרשת את ניסיון קודמיהם.

קרא עוד
Encore AI מגייסת 30 מיליון דולר עבור סוכני בינה מלאכותית
חדשות
4 דקות
מ־TechCrunch

Encore AI מגייסת 30 מיליון דולר עבור סוכני בינה מלאכותית

חברת הסטארט-אפ Encore AI, המפתחת סוכני בינה מלאכותית קוליים הלומדים משיחות של לקוחות, גייסה 30 מיליון דולר בסבב A בהובלת קרן Team8. החברה, שהוקמה ב-2022 כ-Insait IO על ידי דביר גינזבורג, מספקת פלטפורמה לניתוח שיחות, הודעות ואימיילים כדי לזהות מהלכים מוצלחים של נציגים אנושיים ולאמן לפיהם סוכני AI. המערכת מנתחת את שלבי השיחה ומאפשרת לסוכנים לתפקד כנציגים עצמאיים או כעוזרים בזמן אמת לנציגי השירות והמכירות. עם למעלה מ-40 לקוחות ארגוניים, בעיקר מוסדות פיננסיים, וגידול של פי 5 בהכנסות ה-ARR מאז סבב הסיד, החברה מתכננת להרחיב את המכירות בארה"ב.

קרא עוד
אימון סוכני בינה מלאכותית באמצעות משחקי מחשב: הגיוס של General Intuition
חדשות
4 דקות
מ־TechCrunch

אימון סוכני בינה מלאכותית באמצעות משחקי מחשב: הגיוס של General Intuition

חברת הסטארט-אפ General Intuition גייסה 320 מיליון דולר לפי שווי של 2.3 מיליארד דולר כדי לפתח מודלי עולם המסוגלים לאמן סוכני AI ורובוטים פיזיים באמצעות נתוני משחקי מחשב. החברה משתמשת במיליוני שעות גיימינג מפלטפורמת Medal, הכוללות תיוג פעולות (Action Labels) מדויק של לחצני השחקנים, כדי להקנות למודל הבנה של סיבתיות ומרחב-זמן. בניסויים שערכה החברה, נדרשו רק 8 דקות של נתונים מהעולם האמיתי כדי להתאים את המודל לרובוט פיזי בעל ארבע רגליים, דבר המציג פריצת דרך משמעותית במהירות ובחיסכון בעלויות האימון המרחביות של רובוטים.

קרא עוד
InfoPO לאימון סוכני שיחה: כך מודדים ערך של כל שאלה
מחקר
6 דקות
מ־arXiv cs.AI

InfoPO לאימון סוכני שיחה: כך מודדים ערך של כל שאלה

**InfoPO הוא מנגנון אימון שמתגמל סוכן LLM על שאלות הבהרה שמשנות בפועל את ההחלטה הבאה שלו.** לפי תקציר המחקר ב-arXiv, השיטה מודדת information gain בכל תור שיחה ומשלבת אותו עם תוצאת המשימה, במקום להסתפק בתגמול כולל על כל המסלול. עבור עסקים בישראל, המשמעות ברורה: בערוצים כמו WhatsApp, לידים מגיעים לעיתים קרובות בלי 2-3 פרטים קריטיים. סוכן שיודע לשאול בדיוק את שאלת ההבהרה הנכונה יכול לשפר סיווג לידים, לעדכן Zoho CRM נכון יותר, ולהפעיל אוטומציות N8N רק כשיש מספיק מידע. זהו כיוון חשוב במיוחד למרפאות, ביטוח, נדל"ן ושירות מקצועי.

קרא עוד
SWE-Hub: מפעל נתונים חדש לאימון סוכני פיתוח תוכנה
מחקר
5 דקות
מ־arXiv cs.AI

SWE-Hub: מפעל נתונים חדש לאימון סוכני פיתוח תוכנה

**SWE-Hub הוא צינור ייצור מאוחד ליצירת משימות הנדסת תוכנה ניתנות להרצה בקנה מידה גדול.** לפי התקציר שפורסם ב-arXiv, המערכת מטפלת ב-3 בעיות שמגבילות היום סוכני קוד: סביבות לא יציבות, עלות גבוהה של יצירת באגים ריאליסטיים, ומחסור במשימות ארוכות-טווח. עבור עסקים בישראל, המשמעות אינה רק מחקרית: מי שבונה תהליכי פיתוח, QA ו-DevOps עם AI צריך מדידה עקבית של קוד בתוך סביבה אמיתית. זה נכון במיוחד בחיבורים בין Zoho CRM, WhatsApp Business API ו-N8N, שבהם תקלה אחת יכולה להשפיע על תהליך מכירה או שירות שלם.

קרא עוד
אימון יציב לסוכני LLM: מה מחקר ARLArena משנה
מחקר
5 דקות
מ־arXiv cs.AI

אימון יציב לסוכני LLM: מה מחקר ARLArena משנה

**אימון יציב לסוכני LLM הוא תנאי בסיסי להפיכת סוכן מבוסס AI ממדגים מרשימים לכלי עסקי שאפשר לסמוך עליו.** מחקר ARLArena מציג מסגרת בדיקה שיטתית ל-Agentic Reinforcement Learning ומציע את SAMPO, שיטה שמטרתה לצמצם קריסות באימון ולשפר עקביות במשימות מרובות שלבים. עבור עסקים בישראל, המשמעות מעשית: אם סוכן אמור לעדכן Zoho CRM, להפעיל תהליך ב-N8N ולשלוח הודעה ב-WhatsApp Business API, היציבות חשובה לא פחות מהדיוק. ההמלצה היא להתחיל בפיילוט מדיד, לבנות שכבת בקרה, ולבחון הצלחה לפי שיעור השלמת תהליך ולא רק לפי איכות התשובה.

קרא עוד
תזמון אצווה חזוי PBS: האצת אימון מודלי שפה ב-13%
מחקר
5 דקות
מ־arXiv cs.AI

תזמון אצווה חזוי PBS: האצת אימון מודלי שפה ב-13%

**תזמון אצווה חזוי PBS מאיץ אימון מודלי שפה ב-6-13% באמצעות מנבא טוקנים.** מחקר חדש מ-arXiv מוכיח יעילות ללא overhead. לעסקים ישראלים: חיסכון בזמן אימון סוכני AI עבריים ל-WhatsApp ו-CRM, רלוונטי לקליניקות ומשרדים.

קרא עוד
אימון סוכני AI בסימולציות עסקיות: Corecraft משפר ביצועים ב-45%
מחקר
5 דקות
מ־arXiv cs.AI

אימון סוכני AI בסימולציות עסקיות: Corecraft משפר ביצועים ב-45%

**אימון סוכני AI בסביבות RL כמו Corecraft משפר ביצועים ב-45% יחסי ומאפשר הכללה.** מחקר Surge AI מראה שסימולציה של 2,500 ישויות תמיכה לקוחות מעלה שיעור הצלחה מ-25% ל-37%. לעסקים ישראלים: אינטגרציה עם וואטסאפ ו-Zoho CRM דרך N8N תחסוך שעות עבודה.

קרא עוד
Agent-Omit: אימון סוכני LLM להשמטת מחשבות מיותרות
מחקר
2 דקות
מ־arXiv cs.AI

Agent-Omit: אימון סוכני LLM להשמטת מחשבות מיותרות

בעידן שבו סוכני AI מבצעים אינטראקציות רב-תוריות מורכבות, Agent-Omit מאפשר השמטה אדפטיבית של מחשבות ותצפיות מיותרות. קראו על המחקר שמשפר יעילות מבלי לפגוע בביצועים. קראו עכשיו! (112 מילים)

קרא עוד
מסנתטיקה מתפתחת עצמית ל-RL: אימון סוכני כלים אינטראקטיביים
מחקר
2 דקות
מ־arXiv cs.AI

מסנתטיקה מתפתחת עצמית ל-RL: אימון סוכני כלים אינטראקטיביים

בעידן שבו סוכני AI צריכים להתמודד עם משימות עולם אמיתי דרך אינטראקציות רב-תוריות... קראו את המאמר המלא עכשיו כדי להבין איך EigenData משנה את חוקי המשחק באימון סוכנים משתמשים בכלים.

קרא עוד