חיפוש בחדשות

4 תוצאות עבור "GPT-5.5".

פערי הבטיחות של מודלי בינה מלאכותית בקוד פתוח: המקרה של GLM-5.2
מחקר
5 דקות
מ־TechCrunch

פערי הבטיחות של מודלי בינה מלאכותית בקוד פתוח: המקרה של GLM-5.2

דוח חדש של עמותת SaferAI חושף כי מודל הבינה המלאכותית בעל המשקולות הפתוחות GLM-5.2, שפותח על ידי החברה הסינית Z.ai, מצמצם משמעותית את פער היכולות מול מודלי הקצה המובילים בעולם כמו GPT-5.5 ו-Claude Opus 4.7 בתחומי הסייבר והביולוגיה הדו-שימושית. עם זאת, הדוח מצביע על פער בטיחותי מתרחב: בעוד שהדגמים הסגורים מסרבים בעקביות לבקשות מזיקות, המודל הסיני הפתוח לא סירב לאף משימת סייבר התקפית או משימה ביולוגית שהוצגה בפניו במהלך הבדיקות. הממצאים מעוררים מחדש את הדיון הציבורי סביב ניהול הסיכונים הכרוכים בשחרור מודלים פתוחים, שכן מנגנוני ההגנה ברמת ה-API ניתנים להסרה או לעקיפה בקלות ברגע שמשקולות המודל מורצות באופן מקומי על ידי המשתמשים.

קרא עוד
אימון מיומנויות של סוכני AI: הכירו את SkillOpt של מיקרוסופט
מחקר
4 דקות
מ־Microsoft Research

אימון מיומנויות של סוכני AI: הכירו את SkillOpt של מיקרוסופט

מחקר חדש של Microsoft Research (זרוע המחקר של מיקרוסופט) מציג את SkillOpt (מערכת אופטימיזציה למיומנויות סוכני AI), גישה חדשנית ההופכת את תהליך כתיבת הפרומפטים לאימון פרמטרי מבוקר. המערכת שומרת על משקלי מודל השפה קפואים, ומאמנת שכבת מיומנויות טקסטואלית חיצונית באמצעות לולאת משוב המנתחת הצלחות וכישלונות. במבחני ביצועים מול מודלים מובילים כמו GPT-5.5, המערכת הציגה שיפור ממוצע של 23.5 נקודות במשימות מורכבות, ואיפשרה למודלים קטנים וזולים כמו Qwen3.5-4B לעקוף את ביצועי הבסיס של מודלים גדולים בהרבה ללא מיומנויות מותאמות.

קרא עוד
למה Codex מדבר על גובלינים: מה זה אומר על סוכני קוד
ניתוח
5 דקות
מ־Wired

למה Codex מדבר על גובלינים: מה זה אומר על סוכני קוד

**כש-Codex מזכיר "גובלינים" בלי קשר למשימה, זו לא רק בדיחה — זו אינדיקציה לבעיית שליטה בסוכן AI.** לפי הדיווח ב-WIRED, OpenAI הוסיפה ל-Codex CLI הוראה מפורשת לא לדבר על גובלינים, גרמלינים או יצורים אחרים אלא אם זה רלוונטי. עבור עסקים בישראל, הלקח ברור: ככל שמודל עובר מכתיבת טקסט לביצוע פעולות, חשיבות ה-guardrails, ההרשאות והלוגים עולה. בארגונים שמחברים WhatsApp Business API, Zoho CRM ו-N8N, גם סטייה לשונית קטנה עלולה להפוך לשגיאת תהליך. ההמלצה המעשית: להתחיל בפיילוט של 14 יום בסביבת sandbox, למדוד שגיאות והסלמות, ורק אז להרחיב לסביבת ייצור.

קרא עוד
GPT-5.5 לעסקים: למה מהלך ה"סופר-אפליקציה" של OpenAI חשוב
ניתוח
6 דקות
מ־TechCrunch

GPT-5.5 לעסקים: למה מהלך ה"סופר-אפליקציה" של OpenAI חשוב

GPT-5.5 הוא יותר משדרוג מודל: לפי OpenAI, זה צעד נוסף בדרך ל"סופר-אפליקציית AI" שתאחד את ChatGPT, כלי קוד, דפדפן ויכולות ביצוע תחת ממשק אחד. עבור עסקים בישראל, המשמעות היא מעבר מכלי שמייצר טקסט לכלי שמנהל זרימות עבודה בפועל. אם מחברים יכולות כאלה ל-WhatsApp Business API, ל-Zoho CRM ול-N8N, אפשר לקצר זמני תגובה, לתעד פניות אוטומטית ולצמצם עבודה ידנית. אבל ההזדמנות מגיעה עם דרישות ברורות: אינטגרציה מסודרת, בקרה על פרטיות, ובחירת ארכיטקטורה שלא ננעלת לספק אחד. המבחן האמיתי של GPT-5.5 לא יהיה בבנצ'מרק, אלא בשאלה האם הוא חוסך לעסק דקות, טעויות ועלויות בכל תהליך.

קרא עוד