חיפוש בחדשות

4 תוצאות עבור "עיבוד שפה".

האצת מודלי בינה מלאכותית על המכשיר: החידוש של גוגל ב-MTP
מחקר
4 דקות
מ־Google Research

האצת מודלי בינה מלאכותית על המכשיר: החידוש של גוגל ב-MTP

חברת Google הציגה פריצת דרך בארכיטקטורת מחשוב הקצה של מכשירי Pixel 9 ו-Pixel 10 באמצעות שילוב טכנולוגיית Multi-Token Prediction (MTP) במודל Gemini Nano v3 המקומי. פיתוח זה מאפשר להאיץ את מהירות הרצת המודלים על גבי המכשיר ביותר מ-50% ללא צורך במודל טיוטה חיצוני המכביד על הזיכרון. הארכיטקטורה החדשה, המכונה Zero-copy, עושה שימוש ישיר ב-KV cache של מודל הבסיס הקיים, ובכך חוסכת כ-130MB מזיכרון ה-RAM הדינמי ומפחיתה את צריכת האנרגיה של הסוללה, תוך שמירה על רמת דיוק ובטיחות גבוהה במשימות עיבוד שפה וסיכומי מידע.

קרא עוד
גיוס מומחים בסיוע בינה מלאכותית קולית: Ethos משנה את כללי המשחק
חדשות
4 דקות
מ־TechCrunch

גיוס מומחים בסיוע בינה מלאכותית קולית: Ethos משנה את כללי המשחק

הסטארט-אפ הלונדוני Ethos משנה את הדרך שבה קרנות וחברות מייעצות מוצאות מומחים לפרויקטים מורכבים. בעוד שפלטפורמות מסורתיות כמו לינקדאין מסתמכות על תוארי משרה, Ethos משלבת סוכני AI שמנהלים שיחות קוליות עם מועמדים. כך היא מחלצת תובנות עמוקות יותר על כישורים וניסיון צדדי. החברה גייסה לאחרונה 22.75 מיליון דולר בהובלת קרן ההון סיכון a16z. בעידן שבו חברות שואפות לדיוק מקסימלי בגיוס, השימוש בעיבוד שפה טבעית לאיתור כישרונות מספק יתרון משמעותי על פני חיפוש מילות מפתח פשוט, ומייעל את בניית בסיסי הנתונים בארגונים מודרניים.

קרא עוד
שבבי AI לסוכנים: למה מטא קונה מיליוני Graviton מאמזון
ניתוח
6 דקות
מ־TechCrunch

שבבי AI לסוכנים: למה מטא קונה מיליוני Graviton מאמזון

**שבבי AI מבוססי CPU הופכים לרכיב קריטי בהרצת סוכנים, לא רק באימון מודלים.** עסקת Meta לשימוש במיליוני שבבי AWS Graviton מצביעה על שינוי חשוב בשוק: יותר עומסי inference, חיפוש, כתיבת קוד וניהול משימות רב-שלביות עוברים לחומרה שמציעה יחס עלות-ביצועים טוב יותר. לפי הדיווח, Graviton הוא CPU מבוסס ARM, בעוד GPU נשאר מרכזי בעיקר לאימון מודלים גדולים. עבור עסקים בישראל, המשמעות פרקטית: בניית מערכות AI צריכה להישען על סטאק נכון של מודל שפה, WhatsApp Business API, Zoho CRM ו-N8N, ולא על "עוד מודל" בלבד. מי שיבדיל בין עיבוד שפה לבין לוגיקה עסקית יוכל להוריד עלויות ולשפר זמני תגובה.

קרא עוד
dUltra: מודלי שפה דיפוזיה מהירים בעזרת למידה מחוזקת
מחקר
3 דקות
מ־arXiv cs.AI

dUltra: מודלי שפה דיפוזיה מהירים בעזרת למידה מחוזקת

בעידן שבו מהירות עיבוד שפה טבעית קובעת את קצב החדשנות בעסקים, חוקרים מפתחים את dUltra – מסגרת למידה מחוזקת חדשה שמאיצה באופן דרמטי את מודלי השפה הדיפוזיה המוסתרים (MDLMs). קראו את הפרטים המלאים עכשיו.

קרא עוד