חיפוש בחדשות

30 תוצאות עבור "מודלים גדולים".

אימון מיומנויות של סוכני AI: הכירו את SkillOpt של מיקרוסופט
מחקר
4 דקות
מ־Microsoft Research

אימון מיומנויות של סוכני AI: הכירו את SkillOpt של מיקרוסופט

מחקר חדש של Microsoft Research (זרוע המחקר של מיקרוסופט) מציג את SkillOpt (מערכת אופטימיזציה למיומנויות סוכני AI), גישה חדשנית ההופכת את תהליך כתיבת הפרומפטים לאימון פרמטרי מבוקר. המערכת שומרת על משקלי מודל השפה קפואים, ומאמנת שכבת מיומנויות טקסטואלית חיצונית באמצעות לולאת משוב המנתחת הצלחות וכישלונות. במבחני ביצועים מול מודלים מובילים כמו GPT-5.5, המערכת הציגה שיפור ממוצע של 23.5 נקודות במשימות מורכבות, ואיפשרה למודלים קטנים וזולים כמו Qwen3.5-4B לעקוף את ביצועי הבסיס של מודלים גדולים בהרבה ללא מיומנויות מותאמות.

קרא עוד
שבבי AI לסוכנים: למה מטא קונה מיליוני Graviton מאמזון
ניתוח
6 דקות
מ־TechCrunch

שבבי AI לסוכנים: למה מטא קונה מיליוני Graviton מאמזון

**שבבי AI מבוססי CPU הופכים לרכיב קריטי בהרצת סוכנים, לא רק באימון מודלים.** עסקת Meta לשימוש במיליוני שבבי AWS Graviton מצביעה על שינוי חשוב בשוק: יותר עומסי inference, חיפוש, כתיבת קוד וניהול משימות רב-שלביות עוברים לחומרה שמציעה יחס עלות-ביצועים טוב יותר. לפי הדיווח, Graviton הוא CPU מבוסס ARM, בעוד GPU נשאר מרכזי בעיקר לאימון מודלים גדולים. עבור עסקים בישראל, המשמעות פרקטית: בניית מערכות AI צריכה להישען על סטאק נכון של מודל שפה, WhatsApp Business API, Zoho CRM ו-N8N, ולא על "עוד מודל" בלבד. מי שיבדיל בין עיבוד שפה לבין לוגיקה עסקית יוכל להוריד עלויות ולשפר זמני תגובה.

קרא עוד
רגולציית AI ברמת מדינה: למה עמק הסיליקון נלחם בה
ניתוח
6 דקות
מ־Wired

רגולציית AI ברמת מדינה: למה עמק הסיליקון נלחם בה

**רגולציית AI ברמת מדינה היא מסגרת שמחייבת מפתחי מודלים גדולים לפרסם נהלי בטיחות, לדווח על אירועי סיכון ולעמוד בבקרות פומביות.** זה בדיוק לב הוויכוח סביב Alex Bores, מחוקק מניו יורק שקידם את חוק RAISE, בעוד גורמים מעמק הסיליקון, בהם Greg Brockman מ-OpenAI ו-Joe Lonsdale מ-Palantir, תומכים בקמפיין נגדו. עבור עסקים בישראל, הלקח ברור: הדיון על AI כבר אינו רק טכנולוגי אלא גם תפעולי ורגולטורי. מי שמחבר מודלי שפה ל-WhatsApp Business API, ל-Zoho CRM ול-N8N צריך לבנות לוגים, אישורי אדם ומסלולי חריגים — אחרת הוא לוקח סיכון עסקי, משפטי ותדמיתי.

קרא עוד
הסכם חשמל לפיוז'ן ל-AI: מה שיחות Helion ו-OpenAI מסמנות
ניתוח
6 דקות
מ־TechCrunch

הסכם חשמל לפיוז'ן ל-AI: מה שיחות Helion ו-OpenAI מסמנות

**השיחות בין Helion ל-OpenAI מסמנות שינוי עמוק בשוק ה-AI: הבעיה המרכזית כבר אינה רק שבבים, אלא גם חשמל.** לפי הדיווח, OpenAI עשויה לקבל 5 ג'יגה-ואט עד 2030 ו-50 ג'יגה-ואט עד 2035 — היקף שמדגיש עד כמה מודלים גדולים תלויים בתשתיות אנרגיה. עבור עסקים בישראל, המשמעות מעשית: עלויות API, זמינות מודלים וביצועים בשעות עומס עלולים להיות מושפעים מעלות אנרגיה. לכן נכון כבר עכשיו לצמצם קריאות מיותרות ל-AI, לשלב N8N ו-Zoho CRM בתהליכים, ולהפעיל AI רק בנקודות שבהן הוא באמת מוסיף ערך.

קרא עוד
Dementia-R1 לחיזוי דמנציה מתיק רפואי: מה זה אומר לעסקים
מחקר
5 דקות
מ־arXiv cs.AI

Dementia-R1 לחיזוי דמנציה מתיק רפואי: מה זה אומר לעסקים

**Dementia-R1 הוא מחקר שמראה איך אפשר לחזות התקדמות דמנציה מתוך רשומות קליניות חופשיות לאורך זמן, ולא רק לסווג מסמך בודד.** לפי המאמר, המודל הגיע ל-AUROC של 84.02% בקוהורט אמיתי, עקף מודלים גדולים ממנו עד פי 10, והשיג 83.17% גם על ADNI. המשמעות לעסקים בישראל רחבה יותר מרפואה: זהו מקרה בולט שבו AI מצליח להבין רצף של אירועים, שיחות או ביקורים. עבור ארגונים שעובדים עם CRM, WhatsApp ותיעוד טקסטואלי, הלקח המעשי הוא לבנות תחילה מדדי ביניים ניתנים למדידה, ורק אחר כך אוטומציה של החלטות.

קרא עוד
מודלי AI דחוסים לעסקים: מהלך Multiverse משנה את המשחק
ניתוח
6 דקות
מ־TechCrunch

מודלי AI דחוסים לעסקים: מהלך Multiverse משנה את המשחק

**מודלי AI דחוסים הם חלופה מעשית למודלים גדולים כאשר העסק צריך פרטיות, עלות נמוכה יותר וזמן תגובה יציב.** לפי הדיווח, Multiverse Computing השיקה אפליקציית CompactifAI ופורטל API חדש שמרחיבים את הגישה למודלים דחוסים שיכולים לרוץ מקומית או בענן לפי יכולות המכשיר. עבור עסקים בישראל, המשמעות היא שאפשר לתכנן תהליכי AI היברידיים: משימות פשוטות כמו סיווג פניות, סיכום שיחות וניתוח טפסים ירוצו קרוב למידע, ורק משימות מורכבות יעברו למודל חיצוני. זו גישה רלוונטית במיוחד לענפים עם מידע רגיש כמו מרפאות, ביטוח, נדל"ן ומשרדי עורכי דין, ובעיקר כאשר משלבים WhatsApp Business API, Zoho CRM ו-N8N.

קרא עוד
שבבי AI לאימון מודלים: MatX מגייסת 500 מיליון דולר
ניתוח
6 דקות
מ־TechCrunch

שבבי AI לאימון מודלים: MatX מגייסת 500 מיליון דולר

**שבבי AI לאימון מודלים גדולים הם שכבת התשתית שקובעת את מחיר הבינה המלאכותית לעסקים.** גיוס של 500 מיליון דולר ל-MatX, לפי TechCrunch, מראה שהשוק מחפש חלופה ל-Nvidia בדיוק כשעלויות אימון והסקה נשארות גבוהות. החברה, שהוקמה בידי שני יוצאי Google TPU, טוענת ליעד של שיפור פי 10 באימון LLMs ומתכננת משלוחים ב-2027 דרך TSMC. עבור עסקים בישראל, המשמעות אינה קניית שבב חדש אלא סיכוי לירידת עלויות עתידית בשירותי AI, ב-API ובפרויקטים שמחברים WhatsApp Business API, Zoho CRM ו-N8N. מי שמפעיל צ'אט, סיווג מסמכים או אוטומציה למוקדי שירות צריך לעקוב עכשיו אחרי שכבת התשתית — כי היא משפיעה ישירות על תקציב, SLA ורווחיות.

קרא עוד
TPRU למודלים מולטימודליים קטנים: כך משתפרת הבנת וידאו
מחקר
6 דקות
מ־arXiv cs.AI

TPRU למודלים מולטימודליים קטנים: כך משתפרת הבנת וידאו

**TPRU הוא מחקר שמנסה לפתור בעיה קריטית במודלים מולטימודליים: הבנה של סדר פעולות לאורך זמן, ולא רק זיהוי פריים בודד.** לפי המאמר, מודל 7B שופר מ-50.33% ל-75.70% במבחן ייעודי ואף עקף מודלים גדולים יותר כמו GPT-4o. עבור עסקים בישראל, המשמעות היא יכולת טובה יותר לנתח הקלטות מסך, הדרכות, תהליכי שירות וזרימות עבודה. אם החידוש הזה יעבור ממחקר לפרודקשן, הוא עשוי לשפר בקרה תפעולית, לחבר בין וידאו לאוטומציה, ולאפשר שילוב מדויק יותר בין WhatsApp Business API, Zoho CRM, N8N וסוכני AI בתהליכים עסקיים.

קרא עוד
EduResearchBench: בנצ'מרק חדש לבדיקת LLM בכתיבה מחקרית חינוכית
מחקר
5 דקות
מ־arXiv cs.AI

EduResearchBench: בנצ'מרק חדש לבדיקת LLM בכתיבה מחקרית חינוכית

**EduResearchBench מפרק כתיבה מחקרית ל-24 משימות אטומיות ומאפשר הערכה מדויקת של LLM.** מודל EduWrite (30B) מנצח מודלים גדולים יותר. לעסקים ישראלים, זה אומר אוטומציה של דוחות שוק ב-N8N ו-Zoho CRM, חיסכון 15 שעות שבועיות.

קרא עוד
TSPO: שובר את דילמת ההומוגניזציה הכפולה בלמידה מחוזקת ל-LLM
מחקר
3 דקות
מ־arXiv cs.AI

TSPO: שובר את דילמת ההומוגניזציה הכפולה בלמידה מחוזקת ל-LLM

בעידן שבו מודלים גדולים של שפה מתמודדים עם משימות מורכבות באמצעות חיפוש איטרטיבי, TSPO פותרת את דילמת ההומוגניזציה הכפולה ומשפרת ביצועים ב-24%. קראו את המחקר המלא עכשיו! (48 מילים)

קרא עוד
LAMLAD: מתקפת LLM עוקפת גלאי וירוסי אנדרואיד
מחקר
2 דקות
מ־arXiv cs.AI

LAMLAD: מתקפת LLM עוקפת גלאי וירוסי אנדרואיד

בעידן הדיגיטלי שבו תוכנות זדוניות לאנדרואיד מתרבות בקצב מסחרר, חוקרים מציגים את LAMLAD – מסגרת התקפה אויבת חדשנית המשתמשת ביכולות היוצרות והמנתחות של מודלים גדולים של שפה (LLM) כדי לעקוף גלאי תוכנות זדוניות מבוססי למידת מכונה. קראו עכשיו על ההצלחה המדהימה של 97%.

קרא עוד