Z.ai משיקה GLM-4.6V: מודל ראייה-שפה פתוח עם שיחת פונקציות
מוצר חדש

Z.ai משיקה GLM-4.6V: מודל ראייה-שפה פתוח עם שיחת פונקציות

סדרת דגמים חדשה של Zhipu AI מציעה ביצועים מובילים, אינטגרציה עם כלים ויזואליים ורישוי MIT – אידיאלי לעסקים ישראליים

4 דקות קריאה
מבוסס על כתבה שלVentureBeatתרגום, סיכום והקשר עסקי על-ידי המערכתאיך אנחנו עובדים

תקציר מנהלים

נקודות עיקריות

  • שתי גרסאות: 106B לענן ו-9B מקומי.

  • שיחת פונקציות ויזואלית ישירה ללא אובדן מידע.

  • 128K טוקנים + SoTA ב-20+ בדיקות.

  • רישוי MIT + API זול/חינם.

  • אוטומציה של UI ודוחות מולטימדיה.

Z.ai משיקה GLM-4.6V: מודל ראייה-שפה פתוח עם שיחת פונקציות

  • שתי גרסאות: 106B לענן ו-9B מקומי.
  • שיחת פונקציות ויזואלית ישירה ללא אובדן מידע.
  • 128K טוקנים + SoTA ב-20+ בדיקות.
  • רישוי MIT + API זול/חינם.
  • אוטומציה של UI ודוחות מולטימדיה.

בעידן שבו בינה מלאכותית ויזואלית הופכת למרכזית בפיתוח עסקי, חברת Zhipu AI הסינית (Z.ai) משיקה את סדרת GLM-4.6V – דור חדש של מודלי שפה-ראייה (VLM) פתוחים שמבטיחים חשיבה רב-מודלית מתקדמת, אוטומציה של ממשקים קדמיים והפעלה יעילה. הסדרה כוללת שני דגמים: GLM-4.6V הגדול (106 מיליארד פרמטרים) המיועד להסקה בקנה מידה ענן, ו-GLM-4.6V-Flash הקטן (9 מיליארד פרמטרים) לאפליקציות מקומיות בזמן אמת נמוך.

החדשנות המרכזית היא שילוב קריאת פונקציות טבעית במודל ויזואלי, המאפשר שימוש ישיר בכלים כמו חיפוש, חיתוך תמונות או זיהוי גרפים מתוך קלט ויזואלי. הדגמים תומכים בהקשר של 128,000 טוקנים – שווה ערך לרומן של 300 עמודים – ומשיגים תוצאות ברמה העולמית (SoTA) ביותר מ-20 בדיקות סטנדרטיות. הם זמינים דרך ממשק API תואם OpenAI, דמו באתר Zhipu, הורדה מ-Hugging Face ואפליקציית שולחן עבודה.

ביצועי GLM-4.6V (106B) מובילים בין מודלים פתוחים בגודל דומה בבדיקות כמו MMBench, MathVista (88.2 נקודות), ChartQAPro ו-WebVoyager (81.0). הדגם הקטן, GLM-4.6V-Flash (9B), עולה על מתחרים כמו Qwen3-VL-8B ו-GLM-4.1V-9B. אפילו מול דגמים גדולים יותר כמו Step-3 (321B), GLM-4.6V מצטיין במשימות הקשר ארוך, סיכום וידאו וחשיבה מובנית.

הארכיטקטורה מבוססת מקודד ViT (AIMv2-Huge) ומקדם MLP להתאמת תכונות ויזואליות למודל שפה גדול. הדגמים תומכים ברזולוציות שרירותיות, יחסי תמונה רחבים (עד 1:200), וידאו עם כיווצים תלת-ממדיים וקידוד זמן. שיחת הפונקציות דו-כיוונית: העברת תמונות ישירות לכלים וקליטת פלט ויזואלי לתהליך החשיבה, ללא אובדן מידע.

בפרקטיקה, GLM-4.6V מאפשר יצירת דוחות מובנים ממסמכים מעורבים, ביקורת ויזואלית על תמונות, חיתוך אוטומטי מגרפים, חיפוש אינטרנט ויזואלי ושכפול ממשקים קדמיים מדויק פיקסלית מרשומות מסך. זה רלוונטי במיוחד לעסקים ישראליים בפינטק, הייטק ופיתוח תוכנה, שם אוטומציה ויזואלית חוסכת זמן ומשאבים.

מחירי ה-API תחרותיים: 0.30 דולר לקלט ו-0.90 דולר לפלט למיליון טוקנים בדגם הגדול, חינם ל-Flash. בהשוואה ל-GPT-5.1 או Gemini, זה זול משמעותית. הרישוי MIT מאפשר שימוש מסחרי חופשי, התאמה ושילוב במערכות סגורות, כולל סביבות מבודדות – אידיאלי לציות רגולטורי.

האימון כלל שלבים מרובים עם דגימה דינמית (RLCS), תגמולים מותאמים לתחומים כמו STEM וסוכנים גרפיים, וללא אובדן KL להתייצבות. זה ממשיך את הצלחת GLM-4.5, שכללה יצירת מצגות אוטומטיות.

למנהלי עסקים: GLM-4.6V פותח דלת לבניית סוכנים רב-מודליים פנימיים. האם תשלבו מודלים פתוחים כאלה בפיתוח המוצר שלכם? הורידו עכשיו מ-Hugging Face ובדקו.

שאלות ותשובות

שאלות נפוצות

הכתבה הוכנה על-ידי המערכת בליווי בינה מלאכותית: תרגום, סיכום והוספת הקשר עסקי ישראלי מתוך פרסום מקורי של VentureBeat. קראו על תהליך העריכה שלנו. קישור למקור המקורי.

אהבתם את הכתבה?

הירשמו לניוזלטר שלנו וקבלו עדכונים חמים מעולם ה-AI ישירות למייל

עוד מ־VentureBeat

כל הכתבות מ־VentureBeat
פער ההערכה של סוכני AI: פריסה לייצור למרות כשלים מול לקוחות
מחקר
4 דקות
מ־VentureBeat

פער ההערכה של סוכני AI: פריסה לייצור למרות כשלים מול לקוחות

מחקר חדש של VentureBeat Pulse Research חושף כי קיים פער עמוק בין האוטונומיה המוענקת לסוכני AI לבין האמון במערכות הבדיקה שלהם. מחצית מהארגונים שנשאלו כבר השיקו סוכן שעבר את ההערכות הפנימיות אך כשל בפני לקוח בסביבת הייצור, ורק 5% סומכים באופן מלא על הערכות אוטומטיות כיום. למרות זאת, 66% מהארגונים מאפשרים או פועלים לאפשר פריסה אוטומטית לחלוטין ללא מעורבות אנושית. השוק מבוזר מאוד ורבים מתכננים להחליף פלטפורמות בשנה הקרובה.

קרא עוד
אורקסטרציה של סוכני בינה מלאכותית בארגונים: פער בין שאיפות למציאות
מחקר
5 דקות
מ־VentureBeat

אורקסטרציה של סוכני בינה מלאכותית בארגונים: פער בין שאיפות למציאות

סקר חדש של VentureBeat Pulse Research מיוני 2026 חושף פער עמוק בארגונים בין השאיפות לניהול סוכני בינה מלאכותית (AI) לבין המציאות בשטח. לפי הסקר, שנערך בקרב 101 ארגונים, קיים תהליך התגבשות סביב פלטפורמות של ספקי מודלים, ובראשן Claude של Anthropic (המובילה עם 40% מההטמעות), בעוד הבחירה מונעת מ'כוח המשיכה' של מודל הבסיס. עם זאת, בעוד ארגונים מגדירים הצלחה לפי ביצוע אמין של תהליכים מרובי-שלבים, 71% מהם מדווחים בכנות כי רבע או פחות מהסוכנים המוטמעים שלהם בפועל הם אכן מרובי-שלבים, ומרביתם הם רק מעטפות צ'אטבוט פשוטות. בנוסף, 27% מהארגונים חסרים בקרה פיננסית בזמן אמת על עלויות צריכת האסימונים של הסוכנים.

קרא עוד
Listen Labs גייסה 69 מיליון דולר אחרי קמפיין שילוט ויראלי
חדשות
4 דקות
מ־VentureBeat

Listen Labs גייסה 69 מיליון דולר אחרי קמפיין שילוט ויראלי

אלפרד וולפורס מ-Listen Labs השתמש בלוח מודעות ויראלי כדי לגייס כישרונות, וכעת החברה גייסה 69 מיליון דולר. הפלטפורמה מבצעת ראיונות לקוחות AI מהירים ומדויקים, פותרת בעיות הונאה ומשמשת מיקרוסופט ועוד. קראו עכשיו על השינוי במחקר שוק!

קרא עוד

עוד כתבות שיעניינו אותך

לכל הכתבות
AMD קוראת תיגר על Nvidia עם מערכת המסד Helios למחשוב AI
מוצר חדש
3 דקות
מ־TechCrunch

AMD קוראת תיגר על Nvidia עם מערכת המסד Helios למחשוב AI

לפי דיווח של TechCrunch, חברת השבבים AMD משיקה את מערכת ה-Helios, מערכת שרתים שלמה במסד (rack-scale system) המיועדת להתחרות ישירות במובילת השוק Nvidia. המערכת החדשה, שתוכננה עבור מעבדות ה-AI הגדולות בעולם כדי לאמן ולהריץ את מודלי הקצה התובעניים ביותר, כבר גייסה רשימה של לקוחות ענק הכוללת את מיקרוסופט, OpenAI, Meta, Oracle ו-Anthropic. מיקרוסופט מתכננת להרחיב את תשתית הענן Azure באמצעותה, ואילו Anthropic הכריזה על שיתוף פעולה לפריסת עד שני גיגוואט של מעבדים גרפיים. בנוסף, AMD הציגה את מעבד ה-Venice-X המיועד למרכזי נתונים שיושק ב-2027. מנכ"לית AMD, ד"ר ליסה סו, מעריכה כי העלייה בביקוש למחשוב המונעת על ידי בינה מלאכותית סוכנתית (agentic AI) תוביל את שוק מאיצי ה-AI לשווי של כ-1.4 טריליון דולר עד שנת 2030.

קרא עוד
Runway משיקה מנתב מודלים של בינה מלאכותית למדיה גנרטיבית
מוצר חדש
4 דקות
מ־TechCrunch

Runway משיקה מנתב מודלים של בינה מלאכותית למדיה גנרטיבית

חברת הסטארט-אפ Runway משיקה את Runway Media Router, כלי חדש המאפשר למפתחים לנתב באופן אוטומטי בקשות יצירת תמונה, וידאו ואודיו למודל המתאים ביותר. הכלי, שהושק באמצעות פלטפורמת המפתחים Runway Dev, מנתב את הבקשות על פי העדפות המפתח לגבי איכות, מהירות או עלות. המהלך מסמן את שאיפתה של Runway להפוך לשכבת תשתית ואורקסטרציה עבור תעשיית המדיה הגנרטיבית, בתקופה שבה השוק נעשה צפוף ותחרותי במיוחד והחברה מתמודדת עם תחרות עזה מצד ענקיות טכנולוגיה כמו גוגל, בייטדאנס ועליבאבא.

קרא עוד
גוגל מציגה את דגמי Gemini 3.6 Flash ו-3.5 Flash-Lite
מוצר חדש
5 דקות
מ־DeepMind

גוגל מציגה את דגמי Gemini 3.6 Flash ו-3.5 Flash-Lite

חברת גוגל הכריזה על השקת דגמי בינה מלאכותית חדשים בסדרת פלאש: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite ו-Gemini 3.5 Flash Cyber. הדגמים מיועדים לפיתוח סוכני AI בייצור ומציעים שיפור ביעילות הטוקנים, מהירות וחיסכון בעלויות. דגם 3.6 Flash מפחית ב-17% את צריכת טוקני הפלט בהשוואה לגרסה הקודמת, ודגם 3.5 Flash-Lite פועל במהירות של 350 טוקני פלט לשנייה. כמו כן, דגם הסייבר הייעודי 3.5 Flash Cyber ישולב במערכת CodeMender ויופץ בשלב זה במתכונת פיילוט מוגבלת לממשלות ולשותפים מהימנים בלבד לצורך זיהוי ותיקון חולשות אבטחה.

קרא עוד
OpenAI משיקה מקלדת לניהול סוכני קוד ברקע מאבק משפטי
מוצר חדש
4 דקות
מ־TechCrunch

OpenAI משיקה מקלדת לניהול סוכני קוד ברקע מאבק משפטי

לפי דיווח ב-TechCrunch, חברת OpenAI נכנסת לשוק החומרה עם השקת מקלדת ה-Codex Micro במחיר של 230 דולר, המיועדת לניהול סוכני תכנות חצי-אוטונומיים. המקלדת פותחה בשיתוף עם Work Louder וכוללת מקשים מוארים להצגת סטטוס, ג'ויסטיק וחוגה לכיוונון רמת החשיבה של הסוכן. במקביל, דיווח של Bloomberg חשף כי החברה מפתחת רמקול חכם נייד ונטול מסך בעל חלקים נעים, המעוצב על ידי מהנדסי Apple לשעבר. פיתוח זה עומד במרכז תביעה שהגישה Apple נגד OpenAI בשבוע שעבר בטענה לגניבת סודות מסחריים, טענות ש-OpenAI מכחישה לחלוטין.

קרא עוד