ג'מיני 3 פלאש: מהירות ועלויות נמוכות כמו שלא ראיתם
מוצר חדש

ג'מיני 3 פלאש: מהירות ועלויות נמוכות כמו שלא ראיתם

גוגל משיקה מודל שפה חדש שמתקרב לביצועי ג'מיני 3 פרו, אך זול ומהיר פי כמה – אידיאלי ליישומים עסקיים מהירים

4 דקות קריאה
מבוסס על כתבה שלVentureBeatתרגום, סיכום והקשר עסקי על-ידי המערכתאיך אנחנו עובדים

תקציר מנהלים

נקודות עיקריות

  • ג'מיני 3 פלאש מציע ביצועים קרובים לג'מיני 3 פרו במהירות גבוהה פי 3 ועלויות נמוכות

  • מדורג ראשון במבחן ידע, 78% בקידוד SWE-Bench וחיסכון של 90% ב-Context Caching

  • מתאים ליישומי סוכנים מהירים, ניתוח וידאו ומשימות עסקיות בקנה מידה גדול

  • משתמשים מוקדמים מדווחים על שיפורים משמעותיים בתחומי משפט וזיהוי דיפפייק

ג'מיני 3 פלאש: מהירות ועלויות נמוכות כמו שלא ראיתם

  • ג'מיני 3 פלאש מציע ביצועים קרובים לג'מיני 3 פרו במהירות גבוהה פי 3 ועלויות נמוכות
  • מדורג ראשון במבחן ידע, 78% בקידוד SWE-Bench וחיסכון של 90% ב-Context Caching
  • מתאים ליישומי סוכנים מהירים, ניתוח וידאו ומשימות עסקיות בקנה מידה גדול
  • משתמשים מוקדמים מדווחים על שיפורים משמעותיים בתחומי משפט וזיהוי דיפפייק

בעידן שבו כל שנייה בעיבוד AI עולה כסף רב, גוגל מציגה את ג'מיני 3 פלאש – מודל שפה גדול שמגיע לביצועים קרובים לאלו של ג'מיני 3 פרו המתקדם, אך במחיר נמוך בהרבה ובמהירות גבוהה פי כמה. המודל החדש זמין כעת בפלטפורמות כמו Gemini Enterprise, Google Antigravity, Gemini CLI, AI Studio ובתצוגת תצהיר ב-Vertex AI, ומאפשר בניית יישומי סוכנים מהירים ותגובתיים בזמן אמת כמעט.

ג'מיני 3 פלאש מצטרף למשפחת המודלים המובילה של גוגל, הכוללת את ג'מיני 3 פרו, ג'מיני 3 Deep Think ו-Gemini Agent, ששוחררו בחודש שעבר. לפי הודעת החברה בפוסט בבלוג, המודל מבוסס על סדרת הדגמים האהובה על מפתחים וארגונים, ומשופר במיוחד לזרימות עבודה תכופות הדורשות מהירות גבוהה מבלי לוותר על איכות. טולסי דושי, סמנכ"לית ניהול מוצרים בצוות ג'מיני, ציינה כי "ג'מיני 3 פלאש מוכיח שמהירות וקנה מידה לא חייבים לבוא על חשבון אינטליגנציה".

המודל מציע ביצועי קידוד ברמה של ג'מיני 3 פרו עם השהיה נמוכה, ומתאים במיוחד לפיתוח איטרטיבי, מערכות מוכנות לייצור ואפליקציות אינטראקטיביות תגובתיות. משתמשים מוקדמים כבר מדווחים על תוצאות מרשימות: חברת Harvey, פלטפורמת AI למשרדי עורכי דין, רשמה קפיצה של 7% בביצועי חשיבה במבחן הפנימי BigLaw Bench; חברת Resemble AI גילתה כי ג'מיני 3 פלאש מעבד נתוני פורנזיקה מורכבים לזיהוי דיפפייק פי 4 מהר יותר מג'מיני 2.5 פרו.

ג'מיני 3 פלאש מביא יתרונות כלכליים משמעותיים. דרך API של ג'מיני, העלות היא 0.50 דולר למיליון אסימונים כניסה ו-3 דולר למיליון אסימונים יציאה – זול בהרבה מג'מיני 2.5 פרו (1.25 דולר כניסה ו-10 דולר יציאה). מבחני Artificial Analysis מראים תפוקה של 218 אסימונים לשנייה, מה שהופך אותו למהיר יותר מ-GPT-5.1 של OpenAI (125 t/s) ומדורג ראשון במבחן AA-Omniscience לדיוק ידע. למרות שימוש גבוה יותר באסימונים, המחיר הנמוך הופך אותו ליעיל ביותר בקטגוריית האינטליגנציה שלו.

בהשוואה למתחרים כמו Qwen 3 Turbo (0.25 דולר סה"כ), Grok 4.1 (0.70 דולר) ו-Claude Haiku (6 דולר), ג'מיני 3 פלאש מציע תמורה מעולה, במיוחד עם יכולות מולטימודל מתקדמות כמו ניתוח וידאו מורכב והפקת נתונים. גוגל מציעה פרמטר 'רמת חשיבה' להתאמה אישית – נמוכה למשימות פשוטות והגבוהה למורכבות – מה שמפחית השהיות ועלויות. בנוסף, Context Caching חוסך עד 90% בעלויות על נתונים סטטיים גדולים, ובשילוב Batch API – הנחה של 50%.

בבנצ'מרקים, ג'מיני 3 פלאש השיג 78% ב-SWE-Bench Verified לקידוד סוכנים – טוב יותר מג'מיני 2.5 ומג'מיני 3 פרו עצמו – ו-81.2% ב-MMMU Pro, דומה לפרו. זה מאפשר העברת משימות תחזוקת תוכנה ובאגים למודל מהיר וזול יותר ללא פגיעה באיכות. המודל אידיאלי ליישומים מורכבים כמו ניתוח וידאו, שאלות-תשובות ויזואליות ועוזרים במשחקים.

לארגונים ישראלייים המחפשים להטמיע AI בקנה מידה גדול, ג'מיני 3 פלאש מציע פתרון פרקטי: מהירות פי 3 מג'מיני 2.5 פרו, עלויות נמוכות יותר וכלים להתאמה אישית. זה מאפשר בניית סוכנים אוטונומיים ליישומים עסקיים כמו ניתוח נתונים בזמן אמת או אוטומציה משפטית, מבלי להגיע למגבלות תקציב.

בקיצור, ג'מיני 3 פלאש משנה את כללי המשחק באינטליגנציה מלאכותית עסקית. האם העסק שלכם מוכן להאיץ את תהליכי ה-AI? קראו את הפרטים המלאים והתחילו לבדוק היום.

שאלות ותשובות

שאלות נפוצות

הכתבה הוכנה על-ידי המערכת בליווי בינה מלאכותית: תרגום, סיכום והוספת הקשר עסקי ישראלי מתוך פרסום מקורי של VentureBeat. קראו על תהליך העריכה שלנו. קישור למקור המקורי.

אהבתם את הכתבה?

הירשמו לניוזלטר שלנו וקבלו עדכונים חמים מעולם ה-AI ישירות למייל

עוד מ־VentureBeat

כל הכתבות מ־VentureBeat
פער ההערכה של סוכני AI: פריסה לייצור למרות כשלים מול לקוחות
מחקר
4 דקות
מ־VentureBeat

פער ההערכה של סוכני AI: פריסה לייצור למרות כשלים מול לקוחות

מחקר חדש של VentureBeat Pulse Research חושף כי קיים פער עמוק בין האוטונומיה המוענקת לסוכני AI לבין האמון במערכות הבדיקה שלהם. מחצית מהארגונים שנשאלו כבר השיקו סוכן שעבר את ההערכות הפנימיות אך כשל בפני לקוח בסביבת הייצור, ורק 5% סומכים באופן מלא על הערכות אוטומטיות כיום. למרות זאת, 66% מהארגונים מאפשרים או פועלים לאפשר פריסה אוטומטית לחלוטין ללא מעורבות אנושית. השוק מבוזר מאוד ורבים מתכננים להחליף פלטפורמות בשנה הקרובה.

קרא עוד
אורקסטרציה של סוכני בינה מלאכותית בארגונים: פער בין שאיפות למציאות
מחקר
5 דקות
מ־VentureBeat

אורקסטרציה של סוכני בינה מלאכותית בארגונים: פער בין שאיפות למציאות

סקר חדש של VentureBeat Pulse Research מיוני 2026 חושף פער עמוק בארגונים בין השאיפות לניהול סוכני בינה מלאכותית (AI) לבין המציאות בשטח. לפי הסקר, שנערך בקרב 101 ארגונים, קיים תהליך התגבשות סביב פלטפורמות של ספקי מודלים, ובראשן Claude של Anthropic (המובילה עם 40% מההטמעות), בעוד הבחירה מונעת מ'כוח המשיכה' של מודל הבסיס. עם זאת, בעוד ארגונים מגדירים הצלחה לפי ביצוע אמין של תהליכים מרובי-שלבים, 71% מהם מדווחים בכנות כי רבע או פחות מהסוכנים המוטמעים שלהם בפועל הם אכן מרובי-שלבים, ומרביתם הם רק מעטפות צ'אטבוט פשוטות. בנוסף, 27% מהארגונים חסרים בקרה פיננסית בזמן אמת על עלויות צריכת האסימונים של הסוכנים.

קרא עוד
Listen Labs גייסה 69 מיליון דולר אחרי קמפיין שילוט ויראלי
חדשות
4 דקות
מ־VentureBeat

Listen Labs גייסה 69 מיליון דולר אחרי קמפיין שילוט ויראלי

אלפרד וולפורס מ-Listen Labs השתמש בלוח מודעות ויראלי כדי לגייס כישרונות, וכעת החברה גייסה 69 מיליון דולר. הפלטפורמה מבצעת ראיונות לקוחות AI מהירים ומדויקים, פותרת בעיות הונאה ומשמשת מיקרוסופט ועוד. קראו עכשיו על השינוי במחקר שוק!

קרא עוד

עוד כתבות שיעניינו אותך

לכל הכתבות
AMD קוראת תיגר על Nvidia עם מערכת המסד Helios למחשוב AI
מוצר חדש
3 דקות
מ־TechCrunch

AMD קוראת תיגר על Nvidia עם מערכת המסד Helios למחשוב AI

לפי דיווח של TechCrunch, חברת השבבים AMD משיקה את מערכת ה-Helios, מערכת שרתים שלמה במסד (rack-scale system) המיועדת להתחרות ישירות במובילת השוק Nvidia. המערכת החדשה, שתוכננה עבור מעבדות ה-AI הגדולות בעולם כדי לאמן ולהריץ את מודלי הקצה התובעניים ביותר, כבר גייסה רשימה של לקוחות ענק הכוללת את מיקרוסופט, OpenAI, Meta, Oracle ו-Anthropic. מיקרוסופט מתכננת להרחיב את תשתית הענן Azure באמצעותה, ואילו Anthropic הכריזה על שיתוף פעולה לפריסת עד שני גיגוואט של מעבדים גרפיים. בנוסף, AMD הציגה את מעבד ה-Venice-X המיועד למרכזי נתונים שיושק ב-2027. מנכ"לית AMD, ד"ר ליסה סו, מעריכה כי העלייה בביקוש למחשוב המונעת על ידי בינה מלאכותית סוכנתית (agentic AI) תוביל את שוק מאיצי ה-AI לשווי של כ-1.4 טריליון דולר עד שנת 2030.

קרא עוד
Runway משיקה מנתב מודלים של בינה מלאכותית למדיה גנרטיבית
מוצר חדש
4 דקות
מ־TechCrunch

Runway משיקה מנתב מודלים של בינה מלאכותית למדיה גנרטיבית

חברת הסטארט-אפ Runway משיקה את Runway Media Router, כלי חדש המאפשר למפתחים לנתב באופן אוטומטי בקשות יצירת תמונה, וידאו ואודיו למודל המתאים ביותר. הכלי, שהושק באמצעות פלטפורמת המפתחים Runway Dev, מנתב את הבקשות על פי העדפות המפתח לגבי איכות, מהירות או עלות. המהלך מסמן את שאיפתה של Runway להפוך לשכבת תשתית ואורקסטרציה עבור תעשיית המדיה הגנרטיבית, בתקופה שבה השוק נעשה צפוף ותחרותי במיוחד והחברה מתמודדת עם תחרות עזה מצד ענקיות טכנולוגיה כמו גוגל, בייטדאנס ועליבאבא.

קרא עוד
גוגל מציגה את דגמי Gemini 3.6 Flash ו-3.5 Flash-Lite
מוצר חדש
5 דקות
מ־DeepMind

גוגל מציגה את דגמי Gemini 3.6 Flash ו-3.5 Flash-Lite

חברת גוגל הכריזה על השקת דגמי בינה מלאכותית חדשים בסדרת פלאש: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite ו-Gemini 3.5 Flash Cyber. הדגמים מיועדים לפיתוח סוכני AI בייצור ומציעים שיפור ביעילות הטוקנים, מהירות וחיסכון בעלויות. דגם 3.6 Flash מפחית ב-17% את צריכת טוקני הפלט בהשוואה לגרסה הקודמת, ודגם 3.5 Flash-Lite פועל במהירות של 350 טוקני פלט לשנייה. כמו כן, דגם הסייבר הייעודי 3.5 Flash Cyber ישולב במערכת CodeMender ויופץ בשלב זה במתכונת פיילוט מוגבלת לממשלות ולשותפים מהימנים בלבד לצורך זיהוי ותיקון חולשות אבטחה.

קרא עוד
OpenAI משיקה מקלדת לניהול סוכני קוד ברקע מאבק משפטי
מוצר חדש
4 דקות
מ־TechCrunch

OpenAI משיקה מקלדת לניהול סוכני קוד ברקע מאבק משפטי

לפי דיווח ב-TechCrunch, חברת OpenAI נכנסת לשוק החומרה עם השקת מקלדת ה-Codex Micro במחיר של 230 דולר, המיועדת לניהול סוכני תכנות חצי-אוטונומיים. המקלדת פותחה בשיתוף עם Work Louder וכוללת מקשים מוארים להצגת סטטוס, ג'ויסטיק וחוגה לכיוונון רמת החשיבה של הסוכן. במקביל, דיווח של Bloomberg חשף כי החברה מפתחת רמקול חכם נייד ונטול מסך בעל חלקים נעים, המעוצב על ידי מהנדסי Apple לשעבר. פיתוח זה עומד במרכז תביעה שהגישה Apple נגד OpenAI בשבוע שעבר בטענה לגניבת סודות מסחריים, טענות ש-OpenAI מכחישה לחלוטין.

קרא עוד