חיפוש בחדשות

8 תוצאות עבור "EIG".

אנתרופיק מבהירה: דאריו אמודאי לא מתנגד למודלים של משקולות פתוחות
חדשות
4 דקות
מ־TechCrunch

אנתרופיק מבהירה: דאריו אמודאי לא מתנגד למודלים של משקולות פתוחות

מנכ"ל ומייסד אנתרופיק (Anthropic), דאריו אמודאי, הבהיר באופן רשמי כי החברה מעולם לא קראה לאסור על מודלים של בינה מלאכותית בעלי משקולות פתוחות (open-weight), בניגוד לשמועות שנפוצו בתעשייה. תגובתו מגיעה בעקבות מכתב פתוח שפרסמו אנבידיה וחברות נוספות נגד הטלת מגבלות מוקדמות על מודלים אלו. עם זאת, אמודאי הביע חשש עמוק מכך שממשלים סמכותניים, ובראשם המפלגה הקומוניסטית הסינית, יפתחו מודלים חזקים שיקנו להם עליונות צבאית קבועה, או שישמשו לביצוע מתקפות ביולוגיות. לטענתו, מודלים פתוחים ללא חסמי בטיחות מציגים סיכון גבוה בתרחישים אלו. כדי להתמודד עם האיום, אמודאי מציע להגביל גישה לשבבים חזקים, לפעול נגד העתקת מודלים בשיטת זיקוק, ולהקים מערך בדיקות בטיחות גלובלי בהשתתפות סין.

קרא עוד
מודלי בינה מלאכותית של חברת מיסטרל איי איי: המהפכה של אירופה
ניתוח
5 דקות
מ־TechCrunch

מודלי בינה מלאכותית של חברת מיסטרל איי איי: המהפכה של אירופה

חברת Mistral AI הצרפתית הופכת לאלטרנטיבה המובילה ל-OpenAI בעולם ה-AI הארגוני. החברה, שהוקמה על ידי יוצאי Google DeepMind ו-Meta, מציגה מודל עסקי ייחודי המבוסס על מודלים פתוחים (Open-weights) ופלטפורמת סוכנים מתקדמת בשם Vibe. עם קצב הכנסות שנתי (ARR) שחצה את רף ה-400 מיליון דולר ב-2026 ונמצא בדרך למיליארד דולר, מיסטרל מאפשרת לארגונים וממשלות להטמיע בינה מלאכותית באופן מקומי ומאובטח. רכישת Koyeb והשקעה של כ-4 מיליארד אירו במרכזי נתונים באירופה מבטיחות ריבונות מידע מלאה לעסקים המבקשים להימנע מריכוזיות ושליטה אמריקאית.

קרא עוד
חיפוש שם במודלי בינה מלאכותית: האם ה-AI באמת מכיר אתכם?
חדשות
4 דקות
מ־TechCrunch

חיפוש שם במודלי בינה מלאכותית: האם ה-AI באמת מכיר אתכם?

הכלי הוויראלי החדש In the Weights (פלטפורמת החיפוש הוויראלית החדשה), שפותח על ידי יוצאי OpenAI (חברת הבינה המלאכותית המובילה שפיתחה את ChatGPT), מאפשר לבצע חיפוש שם במודלי בינה מלאכותית מובילים כמו GPT ו-Claude. הכלי מחשב ציון חוזק מספרי מ-0 עד 1,000 שמראה אם הפרטים שלכם מוטמעים ישירות בתוך משקולות המודל הנוירוני ללא צורך בגישה לרשת. המהפכה הזו משנה את מושג המוניטין הדיגיטלי ומעבירה את הפוקוס של מנהלי שיווק ועסקים מחיפוש מסורתי בגוגל לעבר הבנת הדרך שבה מודלי שפה גדולים מקטלגים את שמם.

קרא עוד
Alignment-Weighted DPO: כך מחזקים סירוב מנומק ל-LLM
מחקר
6 דקות
מ־arXiv cs.AI

Alignment-Weighted DPO: כך מחזקים סירוב מנומק ל-LLM

**Alignment-Weighted DPO הוא מנגנון אימון שמחזק סירוב מנומק של מודלי שפה ולא רק חסימה שטחית.** לפי המחקר החדש, שיטות כמו SFT, RLHF ו-DPO שיפרו בטיחות, אך עדיין נפרצות דרך ג׳יילברייקים בניסוח עקיף. החוקרים מציעים לשלב Chain-of-Thought עם DPO משוקלל, כך שהמודל ילמד לא רק להגיד "לא" אלא להסביר לעצמו למה הבקשה מסוכנת. עבור עסקים בישראל שמחברים מודלי שפה ל-WhatsApp, ל-Zoho CRM ול-N8N, זו נקודה קריטית: אם המודל מפעיל תהליכים, מסכם שיחות או כותב ללקוח, איכות היישור משפיעה ישירות על סיכון תפעולי, פרטיות ואמינות.

קרא עוד
Nanbeige4.1-3B: מודל 3B שמבצע סוכנות, קוד והסקה במודל אחד
מחקר
6 דקות
מ־arXiv cs.AI

Nanbeige4.1-3B: מודל 3B שמבצע סוכנות, קוד והסקה במודל אחד

**Nanbeige4.1-3B הוא מודל שפה קטן (3B פרמטרים) שמנסה לאחד במודל אחד יכולות של סוכן עם שימוש בכלים, יצירת קוד והסקה כללית. לפי המאמר ב-arXiv (2602.13367v1), האימון מכוון לאינטראקציות יציבות לטווח ארוך ומדווח על יכולת להגיע עד 600 תורות של קריאות לכלים — נתון שמעניין במיוחד עסקים שבונים תהליכים רב-שלביים.** לעסקים בישראל המשמעות יכולה להיות פריסה זולה יותר וקרובה יותר לנתונים (שרת פרטי/ענן פרטי), מה שמקטין חשיפה של מידע לקוחות ומקל על ציות. השילוב המתבקש בשטח הוא תזמור תהליכים ב‑N8N יחד עם Zoho CRM ו‑WhatsApp Business API, כדי לסגור מעגל “ליד → בדיקה → תיאום → עדכון CRM” עם פחות לוגיקה ידנית ויותר עקביות.

קרא עוד
כימות PTQ ל-LLM חשיבתי על Ascend NPU: מה עובד ב-4bit ומה קורס
מחקר
6 דקות
מ־arXiv cs.AI

כימות PTQ ל-LLM חשיבתי על Ascend NPU: מה עובד ב-4bit ומה קורס

כימות PTQ (Post‑Training Quantization) הוא דרך לדחוס מודל שפה אחרי אימון ל-INT8/INT4 כדי להקטין זיכרון ולשפר ביצועים בפריסה. לפי arXiv:2602.17693v1 שבחן מודלי reasoning כמו DeepSeek-R1-Distill-Qwen (1.5B/7B/14B) ו-QwQ-32B על Ascend NPU, מתקבלת רגישות פלטפורמה מובהקת: INT8 נשאר יציב מספרית, בעוד שכימות 4bit אגרסיבי למשקולות+אקטיבציות עלול ליצור חוסר יציבות בכיול שכבות ולהוביל ל״קריסת לוגיקה״ בהקשר ארוך. לעסקים בישראל שמפעילים תהליכים מבוססי WhatsApp ו-CRM, ההמלצה הפרקטית היא להתחיל ב-INT8, לבנות סט בדיקות הקשר ארוך אמיתי מהדאטה שלכם, ורק אחר כך לשקול 4bit weight-only עם מדידת ביצועים מקצה לקצה (כולל overhead של dynamic quantization).

קרא עוד
מסנתטיקה מתפתחת עצמית ל-RL: אימון סוכני כלים אינטראקטיביים
מחקר
2 דקות
מ־arXiv cs.AI

מסנתטיקה מתפתחת עצמית ל-RL: אימון סוכני כלים אינטראקטיביים

בעידן שבו סוכני AI צריכים להתמודד עם משימות עולם אמיתי דרך אינטראקציות רב-תוריות... קראו את המאמר המלא עכשיו כדי להבין איך EigenData משנה את חוקי המשחק באימון סוכנים משתמשים בכלים.

קרא עוד