TOPIC

Llama

כל החדשות והניתוחים שלנו בנושא Llama — מתורגמים ומסוכמים ממקורות מובילים בעולם, עם הקשר עסקי ישראלי. 21 כתבות.

צבא ארה"ב מנצל במהירות את מכסות אסימוני הבינה המלאכותית שלו
חדשות
4 דקות
מ־Wired

צבא ארה"ב מנצל במהירות את מכסות אסימוני הבינה המלאכותית שלו

פיקוד פיתוח היכולות הקרביות של צבא ארצות הברית (DEVCOM) נאלץ להגביל באופן מיידי את השימוש בכלי בינה מלאכותית יוצרת, לאחר שמאגר האסימונים של מנהל מערכות המידע הראשי של הצבא (Army CIO) אזל לחלוטין. מכתב פנימי שהגיע לידי מגזין WIRED חושף כי פחות מחודשיים לאחר שהוכרז על שימוש חופשי וללא הגבלה באסימונים, המשאבים התרוקנו כליל. הצבא, המשתמש בפלטפורמת Ask Sage להרצת מודלים דוגמת ChatGPT, Gemini ו-Llama, עודד את עובדיו להגביר את השימוש ואף שלח הודעות המרצה לעובדים לא פעילים. כעת, בעוד הפנטגון ממשיך לקדם כלי בינה מלאכותית ואף לקצץ בצוותי הגנה אנושיים, עובדים בשטח מדווחים על חוסר אמינות של המערכות, ומדינות וחברות ענק כמו מטא ואובר מתמודדות אף הן עם צריכת אסימונים חריגה ומנסות להגביל את השימוש של מהנדסיהן.

קרא עוד
ממשל טראמפ נגד Anthropic: דגמי Fable ו-Mythos הושבתו
ניתוח
4 דקות
מ־TechCrunch

ממשל טראמפ נגד Anthropic: דגמי Fable ו-Mythos הושבתו

ממשל טראמפ זעזע את תעשיית הבינה המלאכותית כאשר כפה על חברת Anthropic (אנתרופיק) להשבית מיידית את דגמי הדגל החדשים שלה, Fable 5 ו-Mythos 5. המהלך הדרמטי, שהתבצע באמצעות צו פיקוח ייצוא דחוף תחת עילה של "חששות לביטחון לאומי", הופעל לאחר שחוקרי אבטחה של חברת Amazon (אמזון) זיהו דרכים לעקוף את מנגנוני ההגנה של הדגמים, ומנכ"ל אמזון אנדי ג'אסי דיווח על כך ישירות לבית הלבן. האירוע מציב סימן שאלה גדול סביב יציבותם של מודלי שפה מסחריים ומדגיש את החשיבות של מעבר לאסטרטגיית ריבוי מודלים (Multi-LLM) עבור עסקים וסטארטאפים ברחבי העולם ובפרט בישראל.

קרא עוד
חיפוש שם במודלי בינה מלאכותית: האם ה-AI באמת מכיר אתכם?
חדשות
4 דקות
מ־TechCrunch

חיפוש שם במודלי בינה מלאכותית: האם ה-AI באמת מכיר אתכם?

הכלי הוויראלי החדש In the Weights (פלטפורמת החיפוש הוויראלית החדשה), שפותח על ידי יוצאי OpenAI (חברת הבינה המלאכותית המובילה שפיתחה את ChatGPT), מאפשר לבצע חיפוש שם במודלי בינה מלאכותית מובילים כמו GPT ו-Claude. הכלי מחשב ציון חוזק מספרי מ-0 עד 1,000 שמראה אם הפרטים שלכם מוטמעים ישירות בתוך משקולות המודל הנוירוני ללא צורך בגישה לרשת. המהפכה הזו משנה את מושג המוניטין הדיגיטלי ומעבירה את הפוקוס של מנהלי שיווק ועסקים מחיפוש מסורתי בגוגל לעבר הבנת הדרך שבה מודלי שפה גדולים מקטלגים את שמם.

קרא עוד
משקפי מציאות רבודה צבאיים: השותפות החדשה של Anduril ו-Meta
חדשות
5 דקות
מ־MIT Technology Review

משקפי מציאות רבודה צבאיים: השותפות החדשה של Anduril ו-Meta

חברת הביטחון האמריקאית Anduril נכנסת לזירת הטכנולוגיה הלבישה עם שני פרויקטים חדשים לפיתוח משקפי מציאות רבודה המיועדים לכוחות הצבא. אחד הפרויקטים, המוערך ב-159 מיליון דולר, מפותח בשיתוף פעולה עם חברת Meta. המערכות משלבות אינטגרציה עמוקה עם מודלי שפה גדולים, כגון Gemini ו-Llama, כדי לאפשר לחיילים לתת פקודות קוליות טבעיות ולשלוט בכלים בלתי מאוישים ללא צורך במסכים פיזיים. החזון המרכזי הוא לצמצם את העומס הקוגניטיבי על המשתמש ולספק ניתוח סביבתי בזמן אמת על ידי בינה מלאכותית. המגמה העולמית משפיעה במישרין גם על תעשיות בישראל, שעתידות לשלב טכנולוגיות דומות במגזרי הלוגיסטיקה, התשתיות והרפואה.

קרא עוד
מודלי שפה למק: הפתרון המקומי והעסקי של פלטפורמת Osaurus
מוצר חדש
4 דקות
מ־TechCrunch

מודלי שפה למק: הפתרון המקומי והעסקי של פלטפורמת Osaurus

פלטפורמת Osaurus מציגה פתרון פורץ דרך למשתמשי מחשבי מק, ומאפשרת למנהלים בחברות ועסקים להריץ מודלי בינה מלאכותית באופן מקומי לחלוטין וללא תלות בשרתי ענן חיצוניים. מטרת הפלטפורמה, שזכתה כבר ליותר מ-112,000 הורדות מאז עלייתה לרשת, היא לנתק את התלות בעלויות האסימונים (Tokens) של חברות הענק ולאפשר שמירה מקסימלית על פרטיות המידע העסקי, תכונה קריטית במיוחד לארגונים הכפופים לחוק הגנת הפרטיות בישראל. בעזרת טכנולוגיית "ארגז חול" המבודדת את הבינה המלאכותית מקבצי המערכת, יחד עם למעלה מ-20 תוספים מובנים לאפליקציות שולחניות כמו דוא"ל, יומן ומערכת קבצים, פלטפורמת הקוד הפתוח פותחת צוהר לעידן חדש של אבטחת מידע בארגונים בישראל.

קרא עוד
מילון מונחי בינה מלאכותית לעסקים: המדריך המלא לניהול טכנולוגי
מדריך
6 דקות
מ־TechCrunch

מילון מונחי בינה מלאכותית לעסקים: המדריך המלא לניהול טכנולוגי

הבנת השפה הטכנולוגית של עולם הבינה המלאכותית היא כבר לא נחלתם של מפתחים בלבד. לפי דיווח של TechCrunch, הכרת מונחי יסוד כמו סוכני AI, אסימונים (Tokens), נקודות קצה (API) וכוונון עדין של מודלים (Fine-tuning) מהווה תנאי סף לקבלת החלטות עסקיות מושכלות. מנהלים שיודעים לדרוש מנגנוני "שרשרת מחשבה" כדי למנוע "הזיות" נתונים, או מבינים את המשמעות הכלכלית של צריכת אסימונים במערכות סחר אלקטרוני, מסוגלים להגן על הארגון שלהם משגיאות יקרות ודליפות מידע רגיש. המדריך המלא מפרט את כל מושגי הליבה שכל מקבל החלטות בישראל חייב להכיר כדי לנהל בהצלחה פרויקטים טכנולוגיים.

קרא עוד
מילון מונחי AI לעסקים: מה זה LLM, הלוצינציות וסוכני AI
מדריך
6 דקות
מ־TechCrunch

מילון מונחי AI לעסקים: מה זה LLM, הלוצינציות וסוכני AI

מונחי AI כמו LLM, הלוצינציות, tokens ו-AI agent אינם רק שפה של מהנדסים; הם קובעים איך מערכת תעבוד בעסק, כמה היא תעלה, ומה רמת הסיכון שלה. לפי TechCrunch, אלה המושגים המרכזיים שמלווים את תעשיית הבינה המלאכותית ב-2026. עבור עסקים בישראל, ההבנה שלהם חשובה במיוחד כשמחברים כלים כמו ChatGPT, WhatsApp Business API, Zoho CRM ו-N8N לתהליכי מכירה ושירות. המשמעות המעשית: מי שמבין את הטרמינולוגיה יודע להבחין בין דמו מרשים לבין מערכת שניתנת לבקרה, למדידה ולהגנה מפני טעויות. לפני כל רכישה, כדאי לבדוק עלות טוקנים, סיכון להלוצינציות, חיבור ל-API ובקרה אנושית.

קרא עוד
המעבר של Meta למודל סגור: מה זה אומר לעסקים בישראל
ניתוח
6 דקות
מ־AI Weekly

המעבר של Meta למודל סגור: מה זה אומר לעסקים בישראל

**המעבר של Meta למודל סגור הוא איתות אסטרטגי לשוק הארגוני, לא רק שינוי מוצר.** לפי הדיווח, Anthropic עקפה את OpenAI בקצב הכנסות שנתי של 30 מיליארד דולר מול 24 מיליארד דולר, בזמן ש-Meta התרחקה מהגישה הפתוחה של Llama והשיח המשפטי סביב AI החריף. עבור עסקים בישראל, המשמעות ברורה: צריך לבנות תשתית AI גמישה שאינה תלויה בספק אחד. השילוב הנכון הוא שכבת תזמור כמו N8N, מערכת כמו Zoho CRM, ערוץ כמו WhatsApp Business API וסוכן AI שניתן להחליף מאחוריו מודלים. כך מצמצמים סיכון מסחרי, משפטי ותפעולי.

קרא עוד
מודלי שפה קריטיים: האם כך נמדוד יכולת reasoning בלי מבחנים?
מחקר
5 דקות
מ־arXiv cs.AI

מודלי שפה קריטיים: האם כך נמדוד יכולת reasoning בלי מבחנים?

**קריטיות עצמית במודלי שפה היא מצב שבו המודל מתקרב לנקודת מעבר־פאזה, ולפי מחקר חדש זה עשוי להסביר why reasoning מופיע בזמן inference.** המאמר ב-arXiv טוען כי במודלי PLDR-LLM, כאשר פרמטר הסדר מתקרב לאפס, ביצועי ההסקה משתפרים וניתן אולי להעריך יכולת reasoning גם בלי להסתמך רק על בנצ'מרקים חיצוניים. עבור עסקים בישראל זה חשוב בעיקר בבחירת מודלים לתהליכים רגישים כמו WhatsApp, CRM ואוטומציות N8N, שבהם עקביות לוגית שווה כסף, זמן וסיכון תפעולי.

קרא עוד
צ'אטבוטים לתכנון מבצעים צבאיים: מה חשף הדמו של Palantir
ניתוח
6 דקות
מ־Wired

צ'אטבוטים לתכנון מבצעים צבאיים: מה חשף הדמו של Palantir

**צ'אטבוט מבצעי מבוסס מודל שפה הוא שכבת AI שמתחברת לנתונים ארגוניים, מסכמת מצב ומציעה חלופות פעולה בתוך שניות.** לפי WIRED, הדגמות של Palantir מציגות כיצד AIP Assistant, המבוסס בין היתר על Claude, יכול לנתח מידע, להפיק 3 מהלכי פעולה ולסייע בכתיבת דוחות מבצעיים. הלקח לעסקים בישראל ברור: אותה ארכיטקטורה יכולה לשרת מכירות, שירות ותפעול. במקום לראות ב-AI עוד צ'אט, כדאי לבחון חיבור ישיר בין WhatsApp Business API, Zoho CRM ו-N8N, עם הרשאות, לוגים ואישור אנושי. הערך האמיתי אינו בטקסט, אלא בקיצור זמן החלטה ובהפיכת דאטה לפעולה מדידה.

קרא עוד
מודלים פתוחים של Nvidia: השקעה של 26 מיליארד דולר
ניתוח
6 דקות
מ־Wired

מודלים פתוחים של Nvidia: השקעה של 26 מיליארד דולר

**מודלים פתוחים של Nvidia הם ניסיון אסטרטגי לבנות חלופה אמריקאית חזקה ל-OpenAI ולמודלים הסיניים, עם השקעה של 26 מיליארד דולר בחמש שנים.** מבחינת עסקים בישראל, המשמעות אינה רק תחרות בין מעבדות AI אלא אפשרות ממשית להריץ מודלים שניתן להתאים, לחבר ל-Zoho CRM, לשלב ב-WhatsApp Business API ולהפעיל דרך N8N. לפי הדיווח, Nemotron 3 Super כולל 128 מיליארד פרמטרים וקיבל ציון 37 במדד Artificial Intelligence Index. עבור משרדי עורכי דין, מרפאות, סוכני ביטוח וחנויות אונליין, זה עשוי לאפשר יותר שליטה על פרטיות, עלויות ותהליכי שירות — במיוחד במערכות היברידיות שמשלבות מודל פתוח עם אוטומציה עסקית.

קרא עוד
Mozi לסוכני LLM בגילוי תרופות: כך בונים אמינות לאורך תהליך
מחקר
6 דקות
מ־arXiv cs.AI

Mozi לסוכני LLM בגילוי תרופות: כך בונים אמינות לאורך תהליך

**Mozi היא מסגרת לניהול סוכני LLM בתהליכים ארוכים, שבה המודל חושב בחופשיות אך פועל תחת בקרות קשיחות, הרשאות מוגבלות ונקודות עצירה אנושיות.** לפי התקציר ב-arXiv, המערכת שיפרה את דיוק התזמור ב-PharmaBench לעומת בסיסי השוואה. עבור עסקים בישראל, זו תזכורת חשובה: בתהליכים כמו קליטת לידים, WhatsApp, CRM ותיאום פגישות, הבעיה המרכזית אינה רק איכות המודל אלא שליטה בתהליך. השילוב הנכון הוא שכבת בקרה, חוזי נתונים, Human-in-the-Loop ואינטגרציה מסודרת עם Zoho CRM ו-N8N.

קרא עוד
יישור בזמן היסק בדלילות: איך SIA חוסכת עד פי 6 בעלות
מחקר
6 דקות
מ־arXiv cs.AI

יישור בזמן היסק בדלילות: איך SIA חוסכת עד פי 6 בעלות

**יישור בזמן היסק דליל הוא שיטה שמכוונת מודל שפה רק בצמתי החלטה חשובים, במקום להתערב בכל טוקן.** לפי המחקר החדש על SIA, התערבות ב-20% עד 80% מהטוקנים יכולה לשפר את היחס בין איכות יישור לעלות, ובמקרים מסוימים אף להשתוות למודלי instruct חזקים יותר, תוך חיסכון חישובי של עד פי 6. עבור עסקים בישראל שבונים תהליכי שירות, מכירות ותפעול עם Qwen, Llama או GPT, המשמעות היא אפשרות להקטין latency ועלות בלי לוותר על שליטה. החיבור המעשי הוא לשכבת האינטגרציה: WhatsApp Business API, Zoho CRM ו-N8N, שם ניתן ליישם בקרה ממוקדת דווקא בהחלטות עסקיות רגישות.

קרא עוד
CHESS לניהול KV Cache: איך להאיץ מודלי שפה ארוכי־הקשר
מחקר
6 דקות
מ־arXiv cs.AI

CHESS לניהול KV Cache: איך להאיץ מודלי שפה ארוכי־הקשר

**CHESS היא שיטה לניהול KV cache במודלי שפה ארוכי־הקשר, שמטרתה לשפר מהירות אינפרנס בלי לפגוע באיכות.** לפי המאמר ב-arXiv, המערכת מגיעה לתוצאות חזקות גם עם 1% בלבד מה-cache ומציגה עד פי 4.56 תפוקה. עבור עסקים בישראל, המשמעות היא פוטנציאל להריץ סוכני שירות, ניתוח מסמכים ושיחות WhatsApp על הקשר ארוך יותר, בזמן תגובה נמוך יותר ובעלות תשתית סבירה יותר. זה חשוב במיוחד למשרדי עורכי דין, ביטוח, מרפאות ונדל"ן, שבהם כל תשובה נשענת על היסטוריה ארוכה של מסמכים, טפסים ושיחות.

קרא עוד
צנזורה בצ'אטבוטים סיניים: מה המחקר אומר לעסקים
ניתוח
6 דקות
מ־Wired

צנזורה בצ'אטבוטים סיניים: מה המחקר אומר לעסקים

**צנזורה עצמית בצ'אטבוטים סיניים היא מצב שבו מודל מסרב לענות, מקצר תשובות או מחזיר מידע שגוי בנושאים רגישים.** לפי מחקר של Stanford ו-Princeton, DeepSeek סירב לענות על 36% מהשאלות הרגישות ו-Ernie Bot על 32%, בעוד GPT ו-Llama ירדו מתחת ל-3%. עבור עסקים בישראל, הלקח רחב יותר מהוויכוח על סין: מודל שפה שמסתיר מידע או ממציא תשובות עלול לפגוע בשירות, במכירות ובאמינות של מערכות פנימיות. לכן, לפני שמחברים AI ל-WhatsApp, ל-Zoho CRM או ל-N8N, צריך למדוד שיעור סירוב, דיוק ותיעוד — ולא להסתפק במהירות או במחיר.

קרא עוד
אי ודאות בציונים AI: בדיקת שיטות מדידה במודלי שפה גדולים
מחקר
5 דקות
מ־arXiv cs.AI

אי ודאות בציונים AI: בדיקת שיטות מדידה במודלי שפה גדולים

**אי ודאות בציונים LLM היא אתגר מרכזי, כפי שחושף מחקר arXiv חדש.** הבדיקה מראה ששיטות כמו Entropy נכשלות ב-70% מהמקרים. לעסקים ישראליים בהכשרות עובדים, זה אומר צורך באינטגרציות כמו Zoho CRM + N8N לשיפור אמינות.

קרא עוד