גוגל משדרגת את ג'מיני 2.5: שמע מקורי מתקדם לשיחות טבעיות
מוצר חדש

גוגל משדרגת את ג'מיני 2.5: שמע מקורי מתקדם לשיחות טבעיות

עדכון חדש למודל Native Audio מאפשר סוכני קול חכמים יותר, תרגום בזמן אמת ותמיכה בשיחות מורכבות – זמין כעת ב-Vertex AI ובאפליקציית Translate

4 דקות קריאה
מבוסס על כתבה שלDeepMindתרגום וסיכום באמצעות מערכת חדשות בליווי AIאיך אנחנו עובדים

תקציר מנהלים

נקודות עיקריות

  • שדרוג ל-Gemini 2.5 Flash Native Audio משפר קריאת פונקציות, מעקב הוראות ושיחות רב-תוריות.

  • תרגום דיבור חי ב-Translate תומך ב-70+ שפות, שומר על טון הדובר ומתמודד עם רעש.

  • לקוחות כמו Shopify ו-UWM מדווחים על תוצאות עסקיות מרשימות עם המודל.

  • זמין כעת ב-Vertex AI, AI Studio, Gemini Live ו-Search Live.

גוגל משדרגת את ג'מיני 2.5: שמע מקורי מתקדם לשיחות טבעיות

  • שדרוג ל-Gemini 2.5 Flash Native Audio משפר קריאת פונקציות, מעקב הוראות ושיחות רב-תוריות.
  • תרגום דיבור חי ב-Translate תומך ב-70+ שפות, שומר על טון הדובר ומתמודד עם רעש.
  • לקוחות כמו Shopify ו-UWM מדווחים על תוצאות עסקיות מרשימות עם המודל.
  • זמין כעת ב-Vertex AI, AI Studio, Gemini Live ו-Search Live.

האם דמיינתם פעם שיחה טבעית לחלוטין עם בינה מלאכותית, כאילו מדובר באדם אמיתי? גוגל מציגה שדרוג משמעותי למודל Gemini 2.5 Flash Native Audio, שמביא עידן חדש של אינטראקציות קוליות חכמות. השדרוג משפר את היכולת להתמודד עם זרימות עבודה מורכבות, להבין הוראות משתמשים ולנהל שיחות רציפות. כעת, המודל זמין ב-Google AI Studio, Vertex AI, Gemini Live ו-Search Live, ומאפשר בניית סוכני שירות לקוחות מתקדמים.

השדרוג מתמקד בשלושה תחומים מרכזיים: קריאת פונקציות מדויקת יותר, מעקב אחר הוראות מורכבות ושיחות רב-תוריות חלקות יותר. על פי גוגל, המודל מצליח ב-71.5% במבחן ComplexFuncBench Audio לביצוע פונקציות מרובות שלבים, ומשיג 90% נאמנות להוראות מפתחים – עלייה מ-84%. זה אומר שהמודל יכול לשלב מידע בזמן אמת בתגובה קולית מבלי לשבור את זרימת השיחה, מה שמקל על פיתוח אפליקציות עסקיות.

במקביל, גוגל משיקה יכולת תרגום דיבור חי בזמן אמת באפליקציית Google Translate. המערכת תומכת ביותר מ-70 שפות וב-2000 זוגות שפות, שומרת על אינטונציה, קצב וטון הדובר, ומתמודדת עם רעש סביבתי. היא מזהה שפות אוטומטית ומאפשרת שיחות דו-כיווניות, כמו שיחה באנגלית עם דובר הינדי שמתורגמת מיידית לאוזניות. הבטא זמינה כעת למכשירי אנדרואיד בארה"ב, מקסיקו והודו, עם תמיכה ב-iOS ובאזורים נוספים בקרוב.

השיפורים הללו מגיעים בעקבות עדכון קודם למודלי Text-to-Speech של Gemini 2.5 Pro ו-Flash, שמאפשרים שליטה גבוהה יותר ביצירת דיבור רגשי. לקוחות כמו Shopify מדווחים כי משתמשים שוכחים שהם מדברים עם AI תוך דקה, ו-United Wholesale Mortgage הצליחו לייצר 14,000 הלוואות באמצעות המודל. Newo.ai משתמשים בו לקליטות שמזהות דובר ראשי בסביבה רועשת ומחליפות שפות באמצע שיחה.

בעולם העסקי, השדרוג הזה פותח אפשרויות חדשות לסוכני שירות לקוחות, עיבוד משכנתאות ותקשורת גלובלית. בישראל, שבה חברות טק רבות משלבות AI בשירותים, זה יכול לשפר משמעותית את חוויית הלקוח. בהשוואה למתחרים, Gemini 2.5 Native Audio מוביל במבחנים, ומציע ביצועים גבוהים יותר בשיחות מורכבות.

השילוב עם Vertex AI מאפשר פריסה מהירה בעסקים גדולים, בעוד Google AI Studio מקל על מפתחים להתחיל מיד. לקראת 2026, גוגל מתכננת להרחיב את התרגום ל-Gemini API, מה שייצור הזדמנויות חדשות לפיתוח אפליקציות רב-לשוניות.

עבור מנהלי עסקים ישראלים, השאלה היא: איך תשלבו סוכני קול כאלה כדי להפחית עלויות שירות ולהגביר שביעות רצון? השדרוג מדגיש את החשיבות של AI קולי בעידן הדיגיטלי.

בקיצור, Gemini 2.5 Native Audio הופך שיחות AI לטבעיות יותר, עם פוטנציאל לשנות את עולם השירותים והתקשורת. התחילו לבדוק עכשיו ב-Google AI Studio.

שאלות ותשובות

שאלות נפוצות

הכתבה הוכנה באמצעות מערכת בליווי בינה מלאכותית לתרגום, סיכום ובקרות איכות אוטומטיות מתוך פרסום מקורי של DeepMind. קראו על תהליך העריכה שלנו. קישור למקור המקורי.

קבלו עדכוני AI שימושיים למייל

תקציר ממוקד ממערכת החדשות שלנו.

גוגל משיקה את Gemini Robotics ER 2: מוח בינה מלאכותית לרובוטים
מוצר חדש
4 דקות
מ־DeepMind

גוגל משיקה את Gemini Robotics ER 2: מוח בינה מלאכותית לרובוטים

חברת גוגל הכריזה על השקת Gemini Robotics ER 2, מודל חשיבה מגולמת (embodied reasoning) מתקדם המשמש כ'מוח' ברמה גבוהה עבור רובוטים. המודל מאפשר תכנון משימות מרובות שלבים, תיאום כלים בזמן אמת, והבנת סביבה מבוססת וידאו רציף. הוא כולל שיפורים משמעותיים במעקב אחר התקדמות משימות (בדיוק של 57.4%) ואיתור רגעים קריטיים (בדיוק של 91.3%), וכן תומך בשיתוף פעולה בין מספר רובוטים שונים. המודל זמין כעת למפתחים דרך ה-Gemini API, Google AI Studio ובגרסת תצוגה מקדימה פרטית ב-Gemini Enterprise Agent Platform.

קרא עוד
גוגל משקיעה 40 מיליון דולר במשימת ג'נסיס הלאומית של ארה"ב
חדשות
3 דקות
מ־DeepMind

גוגל משקיעה 40 מיליון דולר במשימת ג'נסיס הלאומית של ארה"ב

בבלוג הרשמי של גוגל קלאוד הוכרז על הרחבת התמיכה של החברה במשימת ג'נסיס (Genesis Mission) הלאומית של ארצות הברית, באמצעות הקצאה של 40 מיליון דולר באסימוני בינה מלאכותית ובקרדיטים לענן. גוגל תעניק למעבדות הלאומיות של משרד האנרגיה האמריקאי (DOE) גישה לכלי בינה מלאכותית מתקדמים מבית Google DeepMind, בהם AlphaEvolve, AlphaFold 3 ו-AlphaGenome, לצד רישיונות שימוש ב-Gemini for Government למשך שנה עבור עשרות אלפי עובדים. הכלים כבר משולבים במעבדות כגון PNNL ו-NLR, ומסייעים בקיצור זמני כיול חומרה ובמיפוי מערכות מתמטיות מורכבות.

קרא עוד
גוגל מציגה את דגמי Gemini 3.6 Flash ו-3.5 Flash-Lite
מוצר חדש
5 דקות
מ־DeepMind

גוגל מציגה את דגמי Gemini 3.6 Flash ו-3.5 Flash-Lite

חברת גוגל הכריזה על השקת דגמי בינה מלאכותית חדשים בסדרת פלאש: Gemini 3.6 Flash, Gemini 3.5 Flash-Lite ו-Gemini 3.5 Flash Cyber. הדגמים מיועדים לפיתוח סוכני AI בייצור ומציעים שיפור ביעילות הטוקנים, מהירות וחיסכון בעלויות. דגם 3.6 Flash מפחית ב-17% את צריכת טוקני הפלט בהשוואה לגרסה הקודמת, ודגם 3.5 Flash-Lite פועל במהירות של 350 טוקני פלט לשנייה. כמו כן, דגם הסייבר הייעודי 3.5 Flash Cyber ישולב במערכת CodeMender ויופץ בשלב זה במתכונת פיילוט מוגבלת לממשלות ולשותפים מהימנים בלבד לצורך זיהוי ותיקון חולשות אבטחה.

קרא עוד
יצירת תמונות ווידאו באמצעות API לעסקים: גוגל משיקה מודלים חדשים
מוצר חדש
4 דקות
מ־DeepMind

יצירת תמונות ווידאו באמצעות API לעסקים: גוגל משיקה מודלים חדשים

חברת Google DeepMind (חטיבת הבינה המלאכותית של גוגל) השיקה שני מודלים חדשים למפתחים: Nano Banana 2 Lite ליצירת תמונות מהירה במיוחד ו-Gemini Omni Flash ליצירת וידאו ועריכה שיחתית. לפי הנתונים הרשמיים, Nano Banana 2 Lite מייצר תמונות בתוך 4 שניות בלבד בעלות של 0.034 דולר ל-1,000 תמונות, ומחליף את מודל הדור הקודם gemini-2.5-flash-image. במקביל, Gemini Omni Flash מאפשר יצירת סרטוני וידאו של עד 10 שניות בעלות תחרותית של 0.10 דולר לשנייה. שני המודלים זמינים כעת ב-Google AI Studio ובממשק ה-Gemini API, ומאפשרים לעסקים למכור ולייצר תוכן ויזואלי אינטראקטיבי ואוטומטי בקנה מידה רחב.

קרא עוד

עוד כתבות שיעניינו אותך

לכל הכתבות
Amazon Quick זמין כעת באופן כללי למחשב השולחני
מוצר חדש
4 דקות
מ־AWS Machine Learning

Amazon Quick זמין כעת באופן כללי למחשב השולחני

אפליקציית הדסקטופ של Amazon Quick זמינה כעת באופן כללי למשתמשי macOS ו-Windows, ובמקביל נוסף פיד פעילות למובייל ב-iOS וב-Android. המערכת מרכזת נתונים מדואר אלקטרוני, מיומן פגישות, ממערכות CRM ומהודעות לתצוגה מתועדפת אחת, כאשר סוכני AI מטפלים במשימות שגרתיות ברקע. Quick פועל על גבי תשתיות AWS ושומר על נתוני הארגון בסביבתו המקומית, כולל תמיכה במעקב ביקורת דרך CloudWatch ו-CloudTrail והסמכות תאימות דוגמת HIPAA, FedRAMP, SOC 2 ו-ISO 27001. לקוחות בארגונים כמו Southwest Airlines, LabCorp ו-PGA TOUR משתמשים בכלי להשלמת משימות, סינתזת מידע ופיתוח אבות-טיפוס.

קרא עוד
סיילספורס מציגה את סוכן התזמון של Agentforce לשירות שטח
מוצר חדש
4 דקות
מ־Salesforce Blog

סיילספורס מציגה את סוכן התזמון של Agentforce לשירות שטח

סיילספורס הציגה את Scheduling Agent במסגרת Agentforce Field Service, סוכן בינה מלאכותית הפועל 24/7 לתיאום, שינוי וביטול פגישות שירות שטח. הסוכן מחובר לנתוני הלקוחות, ללוחות הזמנים של הטכנאים ולמנוע האופטימיזציה של הארגון, ופועל בערוצי תקשורת מגוונים בהם וואטסאפ, דוא"ל, SMS, iMessage ושיחות קוליות. המערכת מבוססת על Agent Script לקבלת החלטות דטרמיניסטית ואכיפת כללים עסקיים ללא ניחושים של מודלי שפה, ומספקת מענה לפניות לקוחות, סדרנים, טכנאים וטריגרים מנכסים. המערכת תוצג בכנס Dreamforce וב-Salesforce+.

קרא עוד
אקספריאן מתרחבת לתחום סוכני ה-AI בשותפות עם ServiceNow
מוצר חדש
4 דקות
מ־SiliconANGLE AI

אקספריאן מתרחבת לתחום סוכני ה-AI בשותפות עם ServiceNow

חברת Experian משיקה את מערכת Agent OS ומעמיקה את פעילותה בתחום סוכני ה-AI באמצעות שותפות ראשונה עם ServiceNow. הפלטפורמה מאפשרת לשלב יכולות ניהול סיכונים, אימות וקבלת החלטות בתהליכי עבודה ארגוניים, תוך חיבור לפלטפורמת Ascend של אקספריאן. המערכת כוללת מנגנוני אבטחה מחמירים, שער בקרה על תעבורה, בדיקות אדברסריות ושמירה על מעורבות אנושית בהחלטות מפוקחות רגולטורית. הפתרון נגיש באמצעות ממשקי API ושרת MCP ומאפשר החלפת מודלים לפי עומס העבודה.

קרא עוד
שלושה סימנים לכך שסוכן AI יחיד אינו מספיק בארגון
מוצר חדש
4 דקות
מ־Salesforce Blog

שלושה סימנים לכך שסוכן AI יחיד אינו מספיק בארגון

לפי פרסום של צוות Agentforce מבית Salesforce, תזמור מרובה-סוכנים (Multi-agent orchestration) זמין כעת באופן כללי. הפרסום מציג שלושה סימנים לכך שסוכן AI בודד הגיע לקצה גבול היכולת שלו: הסוכן מנסה לבצע משימות רבות מדי וסובל מהתנגשות כוונות (Intent collision), הנתונים הנדרשים נמצאים מחוץ לגבולות ה-Salesforce org, או שצוותים שונים נדרשים לנהל חלקים שונים של הסוכן. המאמר מציג ארבעה נתיבי ארכיטקטורה ושאלות מוכנות לבחינת המעבר, ומציין כי בבדיקות פנימיות בעיות הסקה מתרחשות לרוב מעבר לשבעה תת-סוכנים.

קרא עוד