Groundsource של Google: דאטה משיטפונות עירוניים מחדשות
ניתוח

Groundsource של Google: דאטה משיטפונות עירוניים מחדשות

Google הפכה דיווחי חדשות ל-2.6 מיליון רשומות שיטפונות — ומה זה אומר לעסקים, ביטוח ורשויות בישראל

6 דקות קריאה
מבוסס על כתבה שלGoogle Researchתרגום וסיכום באמצעות מערכת חדשות בליווי AIאיך אנחנו עובדים

תקציר מנהלים

נקודות עיקריות

  • Google Research השיקה את Groundsource עם 2.6 מיליון רשומות שיטפונות מ-150+ מדינות מאז שנת 2000.

  • לפי Google, 82% מהאירועים שנשלפו היו מדויקים מספיק לניתוח מעשי, גם אם רק 60% היו מדויקים לחלוטין בזמן ובמיקום.

  • המערכת נשענת על Gemini,‏ Cloud Translation API,‏ Google Maps Platform וניתוח טקסטים מ-80 שפות.

  • לעסקים בישראל, אותו עיקרון מתאים לביטוח, נדל"ן, מרפאות ושירות לקוחות דרך חיבור WhatsApp,‏ CRM ו-N8N.

  • פיילוט בסיסי לחילוץ מידע מטקסטים פנימיים יכול להתחיל סביב ₪3,000-₪8,000 ולהימדד לפי איכות הנתונים שנכנסים ל-CRM.

Groundsource של Google: דאטה משיטפונות עירוניים מחדשות

  • Google Research השיקה את Groundsource עם 2.6 מיליון רשומות שיטפונות מ-150+ מדינות מאז שנת 2000.
  • לפי Google, 82% מהאירועים שנשלפו היו מדויקים מספיק לניתוח מעשי, גם אם רק 60% היו...
  • המערכת נשענת על Gemini,‏ Cloud Translation API,‏ Google Maps Platform וניתוח טקסטים מ-80 שפות.
  • לעסקים בישראל, אותו עיקרון מתאים לביטוח, נדל"ן, מרפאות ושירות לקוחות דרך חיבור WhatsApp,‏ CRM ו-N8N.
  • פיילוט בסיסי לחילוץ מידע מטקסטים פנימיים יכול להתחיל סביב ₪3,000-₪8,000 ולהימדד לפי איכות הנתונים שנכנסים...

Groundsource לשיטפונות עירוניים: איך Google הופכת חדשות לדאטה

Groundsource הוא מתודולוגיה של Google Research שממירה דיווחי חדשות לא מובְנים למאגר נתונים היסטורי usable למחקר ולחיזוי. במקרה הראשון, Google יצרה 2.6 מיליון רשומות על שיטפונות בזק ביותר מ-150 מדינות, והשתמשה בהן כדי לתמוך בתחזיות עירוניות עד 24 שעות מראש.

הסיבה שזה חשוב עכשיו אינה רק אקלימית אלא גם עסקית. בישראל, כל ארגון שמסתמך על רציפות תפעולית — מחברת ביטוח, דרך רשת קמעונאית ועד עירייה — תלוי באיכות הדאטה שלו. לפי הדיווח של Google, אחת הבעיות המרכזיות בעולם החיזוי היא מחסור בנתוני עבר איכותיים. כשאין דאטה מסודר, גם מודל AI חזק מתקשה לייצר תחזית אמינה, וזה נכון לא רק לשיטפונות אלא גם לשירות לקוחות, לוגיסטיקה וניהול סיכונים.

מה זה Groundsource?

Groundsource הוא framework לחילוץ "אמת קרקעית" ממקורות לא מובנים כמו כתבות חדשות, דוחות ציבוריים ועלונים מקומיים. בהקשר עסקי, המשמעות היא לקחת טקסט חופשי — למשל דיווח חדשותי, פנייה ב-WhatsApp או תיאור אירוע ב-CRM — ולהפוך אותו לשדה נתונים שניתן לחפש, למדוד ולחבר למערכות נוספות. לפי Google, המערכת פועלת על טקסטים מ-80 שפות, מתרגמת אותם לאנגלית באמצעות Cloud Translation API, ואז מפעילה את Gemini כדי לסווג אירועים, לזהות זמן ומיקום ולמפות אותם גיאוגרפית.

מה Google הכריזה בפועל על Groundsource ו-Gemini

לפי הדיווח, Google Research השיקה את Groundsource כמתודולוגיה סקיילבילית לחילוץ מידע היסטורי על אסונות טבע מתוך חדשות עולמיות. היישום הראשון הוא מאגר open access לשיטפונות בזק עירוניים עם 2.6 מיליון אירועים היסטוריים, המכסים יותר מ-150 מדינות משנת 2000 ועד היום. זה פער אדיר לעומת מאגרים מסורתיים: Google מזכירה ש-GDACS, יוזמה של האו"ם והנציבות האירופית, מחזיקה בערך 10,000 רשומות בלבד ומתמקדת בעיקר באירועים חריגים ובעלי השפעה הומניטרית גבוהה.

הצנרת הטכנולוגית עצמה מעניינת לא פחות מהמספרים. Google מסבירה שהיא מבודדת את הטקסט המרכזי באמצעות Google Read Aloud user-agent, מתרגמת תכנים מ-80 שפות דרך Cloud Translation API, ואז מפעילה את Gemini Large Language Model כדי לבצע שלושה שלבים: סיווג אם מדובר באירוע אמיתי ולא רק באזהרה עתידית, reasoning טמפורלי כדי לקבע מועד מדויק, וזיהוי מיקום granular עד רמת שכונה או רחוב באמצעות Google Maps Platform. זו דוגמה קלאסית למעבר מ-LLM כצ'אטבוט ל-LLM כמנוע חילוץ נתונים.

מה רמת הדיוק של המאגר החדש

Google מדווחת שבבדיקות ידניות, 60% מהאירועים שנשלפו היו מדויקים גם בזמן וגם במיקום, ו-82% היו מדויקים מספיק כדי להיות שימושיים בניתוח מעשי — למשל ברמת מחוז נכון או בטווח של יום אחד משיא האירוע. בנוסף, בהתאמה מרחבית-זמנית, Groundsource תפס בין 85% ל-100% מאירועי השיטפונות החמורים שתועדו ב-GDACS בין 2020 ל-2026. אלו לא מספרים של שלמות, אבל הם בהחלט מספרים שמספיקים כדי לשנות את נקודת האיזון בין "אין דאטה" ל"יש בסיס עבודה".

ההקשר הרחב: למה שוק ה-AI עובר מחיפוש מידע לבניית מאגרי אמת

המהלך של Google משתלב במגמה רחבה יותר: שימוש במודלי שפה כדי להפוך טקסט חופשי לתשתית נתונים. לפי McKinsey, חלק גדול מהערך הכלכלי של Generative AI יגיע לא מיצירת תוכן, אלא מאוטומציה של מיצוי ידע, סיווג ועיבוד תהליכים. גם בעולם העסקי רואים את זה: ארגונים רוצים לקחת מיילים, שיחות תמיכה, מסמכים ו-WhatsApp ולהכניס אותם ל-CRM עם מבנה אחיד. במילים אחרות, Groundsource אמנם נולד במחקר אקלים, אבל העיקרון שלו רלוונטי מאוד גם למוקדי שירות, תביעות ביטוח, נדל"ן ורפואה קהילתית.

ניתוח מקצועי: המשמעות האמיתית של Groundsource לעולם האוטומציה

מניסיון בהטמעה אצל עסקים ישראלים, המשמעות האמיתית כאן היא לא רק "Google יודעת לנתח חדשות", אלא שהמודל התפעולי של LLM משתנה. במקום לשאול את Gemini שאלה ולקבל תשובה, Google בונה pipeline שמגדיר חוקים, שלבי אימות, תרגום, geocoding ובקרת איכות. זה בדיוק ההבדל בין דמו מרשים לבין מערכת שאפשר להטמיע בארגון. מנקודת מבט של יישום בשטח, החידוש הוא בשילוב בין מקור טקסט לא מובנה, שכבת נרמול, שכבת אימות ושכבת הפעלה עסקית.

אותו דפוס עובד גם מחוץ לעולם האקלים. משרד ביטוח יכול לחלץ מפרטי תביעה טקסטואליים סוג נזק, תאריך, כתובת וסטטוס; רשת מרפאות יכולה להפוך הודעות WhatsApp חופשיות לישויות מסודרות ב-Zoho CRM; חברת נדל"ן יכולה לנתח פניות נכנסות ולסווג דחיפות, מיקום וסוג נכס. כאן נכנסת המומחיות שלנו סביב אוטומציה עסקית: לא מספיק להפעיל מודל GPT או Gemini, צריך לחבר אותו ל-N8N, למערכת CRM ולתהליך עבודה ברור. ההערכה שלי היא שב-12 החודשים הקרובים יותר ארגונים ימדדו LLM לפי אחוז נתונים שנכנסו נכון למערכת, לא לפי איכות הטקסט שהמודל כתב.

ההשלכות לעסקים בישראל

בישראל, הענפים שיכולים ללמוד הכי הרבה מהמודל של Groundsource הם ביטוח, רשויות מקומיות, נדל"ן, מרפאות וקמעונאות עם פריסה פיזית. חברת ביטוח, למשל, יכולה לבנות מנגנון שמחבר בין דיווחי שטח, כתבות מקומיות, טפסים דיגיטליים והודעות לקוחות כדי לזהות מוקדי סיכון בזמן קרוב לאירוע. משרד תיווך עם עשרות נכסים יכול לשלב מידע סביבתי, פניות דיירים ונתוני עירייה כדי לזהות תקלות חוזרות. במרפאות פרטיות, אותו עיקרון עובד על תיעוד שיחות, תיאום ובקשות חוזרות.

החסם המרכזי בישראל הוא לא רק טכנולוגי אלא גם רגולטורי ולשוני. חוק הגנת הפרטיות מחייב זהירות בעיבוד מידע אישי, ובתחומים כמו בריאות, ביטוח ושירות פיננסי צריך להגדיר במדויק אילו נתונים נשמרים, היכן, ולמי יש הרשאות. בנוסף, עברית מדוברת, שגיאות הקלדה, קיצורים מקומיים ושילוב בין עברית, אנגלית ורוסית מקשים על חילוץ ישויות איכותי. לכן ארגון ישראלי שרוצה לאמץ את הגישה הזו צריך לעבוד עם שכבת תהליכים ברורה: AI Agents לסיווג, WhatsApp Business API לקליטת פניות, CRM חכם לניהול ישויות, ו-N8N לחיבורים, בקרה וניטור.

מבחינת עלויות, פיילוט ישראלי בסיסי לחילוץ מידע מטקסטים פנימיים יכול להתחיל בטווח של כ-₪3,000-₪8,000 לאפיון והקמה ראשונית, לפני עלויות שימוש שוטפות ב-API, תרגום, אחסון וניטור. בארגון עם 3,000 עד 10,000 פניות טקסט בחודש, הערך לא נמדד בסיסמאות אלא בזמן טיפול, שיעור שדות מלאים ב-CRM וזמן תגובה. אם בעבר עובד היה קורא ידנית מאות הודעות ביום, היום אפשר להגדיר צנרת שמחלצת תאריך, כתובת, נושא, רמת דחיפות וסטטוס בתוך שניות בודדות לכל פנייה.

מה לעשות עכשיו: צעדים מעשיים לעסקים שרוצים לנצל טקסט לא מובנה

  1. בדקו אם ה-CRM הנוכחי שלכם — Zoho, HubSpot או Monday — מאפשר API פתוח לקליטת שדות מובנים מטקסט חופשי. בלי זה, המידע ייתקע ברמת הדמו.
  2. הריצו פיילוט של 14 יום על 500-1,000 פריטי טקסט אמיתיים: מיילים, טפסים או WhatsApp. מדדו דיוק בשדות כמו תאריך, כתובת וסיווג.
  3. חברו את הצנרת דרך N8N למקור ההודעות, למודל השפה ול-CRM, והגדירו human-in-the-loop עבור מקרים חריגים.
  4. הגדירו מראש כללי פרטיות, שמירת לוגים והרשאות גישה, במיוחד אם מדובר בבריאות, ביטוח או מידע פיננסי.

מבט קדימה: מחדשות על שיטפונות לתשתית נתונים ארגונית

Groundsource הוא סימן מובהק לכך שהגל הבא של AI אינו רק generation אלא structuring — הפיכת העולם הלא מסודר לדאטה שניתן להפעיל. ב-12 עד 18 החודשים הקרובים נראה יותר מערכות שמחברות בין AI Agents, WhatsApp Business API, Zoho CRM ו-N8N כדי לחלץ, לאמת ולהפעיל מידע בזמן אמת. לעסקים בישראל ההמלצה ברורה: להתחיל לאסוף טקסטים לא מובנים כמקור נתונים אסטרטגי, ולא כעוד ערוץ תקשורת שנשכח בתיבת ההודעות.

שאלות ותשובות

שאלות נפוצות

הכתבה הוכנה באמצעות מערכת בליווי בינה מלאכותית לתרגום, סיכום ובקרות איכות אוטומטיות מתוך פרסום מקורי של Google Research. קראו על תהליך העריכה שלנו. קישור למקור המקורי.

קבלו עדכוני AI שימושיים למייל

תקציר ממוקד ממערכת החדשות שלנו.

עוד מ־Google Research

כל הכתבות מ־Google Research
שחזור מידע הוא צוואר הבקבוק של עובדתיות במודלי שפה
מחקר
5 דקות
מ־Google Research

שחזור מידע הוא צוואר הבקבוק של עובדתיות במודלי שפה

פוסט מחקר חדש של מדעני Google Research, ניתאי קלדרון וגל יונה, מציג את מסגרת 'פרופילי הידע' ואת מדד WikiProfile המבוסס על 2,150 עובדות מוויקיפדיה. המחקר חושף כי שגיאות עובדתיות במודלי שפה מתקדמים כמו Gemini 3 ו-GPT-5 אינן נובעות מהיעדר המידע בפרמטרים (כשל קידוד), אלא מקושי של המודל לגשת אליו ולשחזר אותו באופן עצמאי (כשל שחזור). במודלי הקצה המובילים, כ-95% עד 98% מהעובדות מקודדות, אך המודלים נכשלים בשחזור ישיר של 26% עד 34% מהן. המחקר מדגים כי מנגנון חשיבה יכול לסייע בשחזור של כ-40% עד 65% מהעובדות המקודדות הללו, במיוחד במקרים של עובדות נדירות או שאלות הפוכות (קללת ההיפוך), ובכך הוא מהווה כלי יעיל לפתרון צוואר הבקבוק של השחזור.

קרא עוד
גוגל מציגה את AMIE (Video): בינה מלאכותית לייעוץ רפואי בווידאו
מחקר
4 דקות
מ־Google Research

גוגל מציגה את AMIE (Video): בינה מלאכותית לייעוץ רפואי בווידאו

חוקרי גוגל הציגו את AMIE (Video), שדרוג משמעותי למערכת הבינה המלאכותית המחקרית שלהם לשיחות ייעוץ רפואיות בזמן אמת. המערכת, המבוססת על מודל Gemini ופרויקט אסטרה (Project Astra), משתמשת בארכיטקטורה אסינכרונית מרובת סוכנים המאפשרת לה לנהל שיחה טבעית ומהירה תוך פענוח רמזים חזותיים וקוליים והנחיית בדיקות פיזיות וירטואליות. במחקר מבוקר אקראי (OSCE) שהקיף 100 תרחישים קליניים ו-300 מפגשי סימולציה עם שחקנים מקצועיים, הדגימה המערכת ביצועים קליניים המקבילים לרופאי משפחה מוסמכים. השחקנים שהשתתפו בניסוי העדיפו באופן מובהק את גרסת הווידאו על פני ממשק טקסטואלי, וציינו לטובה את רמת האמפתיה ויכולת יצירת הקשר של המערכת בהשוואה לרופאים אנושיים.

קרא עוד
גוגל מציגה את Science One Framework: פלטפורמה למחקר מדעי אוטונומי
מחקר
4 דקות
מ־Google Research

גוגל מציגה את Science One Framework: פלטפורמה למחקר מדעי אוטונומי

חוקרי Google Cloud הציגו את Science One Framework, אב-טיפוס ניסיוני למחקר מדעי אוטונומי המבוסס על בינה מלאכותית ומתוכנן למגר לחלוטין את תופעת ההזיות (hallucinations). המערכת פועלת על פי עקרון שרשרת הראיות (Chain-of-Evidence), הדורש כי כל טענה במאמר תקושר ישירות לראיה פיזית מתועדת בקוד, בניסוי או בספרות המדעית. במקביל, הוצג פרוטוקול ההערכה האוטומטי CoE Audit, הבוחן את אמינות המאמרים המיוצרים על ידי בינה מלאכותית מול קוד המקור ומזהה הפניות פיקטיביות, חוסר התאמה ושינוי ציונים. בניסויים שבוצעו, המערכת השיגה 0% הפניות פיקטיביות, עמדה בהצלחה במבחנים מורכבים כמו MLE-Bench ו-Parameter-Golf, והוכיחה כי ניתן לשלב אמינות מלאה מבלי לפגוע בביצועים המדעיים של הסוכן האוטונומי.

קרא עוד
SymptomAI: סוכן בינה מלאכותית שיחתי להערכת סימפטומים רפואיים
מחקר
5 דקות
מ־Google Research

SymptomAI: סוכן בינה מלאכותית שיחתי להערכת סימפטומים רפואיים

מחקר לאומי ראשון מסוגו שנערך על ידי Google Research בוחן את ביצועיו של SymptomAI – מערך סוכני בינה מלאכותית שיחתיים מבוססי Gemini Flash 2.0 המיועדים לראיונות סימפטומים והערכת אבחנה מבדלת (DDx). המחקר, שהקיף 13,917 משתתפים, השווה את האבחנות המבדלות שהפיק הסוכן אל מול הערכות של פאנל רופאים מומחים ודיווחים מביקורים רפואיים בעולם האמיתי. הממצאים מראים כי קלינאים העדיפו את אבחנות הסוכן בלמעלה מ-50% מהמקרים, וכי דיוק המערכת השתפר משמעותית באמצעות אסטרטגיות הנחיה אקטיביות. בנוסף, המחקר הדגים מתאם מובהק בין אבחנות המערכת לבין שינויים באותות פיזיולוגיים שנמדדו במכשירי פיטביט לבישים.

קרא עוד

עוד כתבות שיעניינו אותך

לכל הכתבות
תזמור תהליכים: מודלי ביצוע, אתגרי ייצור ותזמור מול כוריאוגרפיה
ניתוח
4 דקות
מ־n8n

תזמור תהליכים: מודלי ביצוע, אתגרי ייצור ותזמור מול כוריאוגרפיה

בפוסט שפורסם בבלוג של n8n, נסקרים מודלי הביצוע המרכזיים בתזמור תהליכים (Process Orchestration): דטרמיניסטי, דינמי וסוכני (Agentic). המאמר מנתח את הפשרות בין יכולת ניבוי, הסתגלות ואוטונומיה, מציג את המאפיינים של תהליכים המתאימים לתזמור מרכזי, וסוקר אתגרי ייצור נפוצים כגון צווארי בקבוק, השחתת מצב, נדידת סכמות וניפוי שגיאות במערכות מבוזרות. כמו כן, מוסברים ההבדלים בין תזמור לכוריאוגרפיה ואוטומציית משימות בודדות.

קרא עוד
הרחבת השימוש בסוכני פיתוח ב-Salesforce ל-15,000 מהנדסים
ניתוח
4 דקות
מ־Salesforce News

הרחבת השימוש בסוכני פיתוח ב-Salesforce ל-15,000 מהנדסים

בפוסט הנדסי שפורסם מטעם Salesforce מפורט כיצד הורחב השימוש בסוכני פיתוח בינה מלאכותית ל-15,000 מהנדסים בחברה. לפי הדיווח, המהלך לווה בעלייה של 90.5% בהשלמת משימות למפתח ועלייה של 200.3% במדד הפרודוקטיביות Effective Output שפותח עם אוניברסיטת סטנפורד. התהליך כלל פיילוט של 30 ימים, הגדרת מודל בשלות בן תשעה שלבים, ומשמעת ניהול הקשר וטוקנים שהביאה לחסכון כספי ולשיפור איכות הקוד.

קרא עוד
מילון מונחי AI מקיף: המושגים המרכזיים שצריך להכיר
ניתוח
4 דקות
מ־TechCrunch

מילון מונחי AI מקיף: המושגים המרכזיים שצריך להכיר

במדריך מושגים מקיף שפורסם ב-TechCrunch, מציגים כתבי האתר מילון מונחים מרכזי בעולם הבינה המלאכותית. המילון כולל הגדרות ברורות למונחים כמו AGI, סוכני AI, סוכני תכנות, ארכיטקטורת תערובת מומחים (MoE), פרוטוקול MCP לחיבור מקורות מידע, וטכניקת הישנות עמומה (Opaque recurrence) המייעלת עיבוד אך מעלה שאלות בטיחות ומעקב. בנוסף מפורטים תהליכי אימון, זיקוק, הסקה, מטמון זיכרון והשפעות המחסור בחומרת זיכרון המכונה RAMageddon.

קרא עוד
אבטחת תהליכי עבודה: בקרות לענפים מוסדרים לפי n8n
ניתוח
4 דקות
מ־n8n

אבטחת תהליכי עבודה: בקרות לענפים מוסדרים לפי n8n

בפוסט שפרסמה חברת n8n נסקרות שש בקרות אבטחה מרכזיות לתהליכי עבודה אוטומטיים בענפים מוסדרים כגון בריאות ופיננסים: בקרת גישה מבוססת תפקידים (RBAC), ניהול סודות, רישום יומני ביקורת, תושבות נתונים, בידוד סביבות ומערכות ניטור. המאמר מסביר כיצד כלי אוטומציה סגורים במודל SaaS עלולים להקשות על ביצוע הערכות אבטחה עצמאיות בשל היעדר שקיפות בקוד, ומנגד כיצד פלטפורמות עם קוד מקור זמין בהתקנה עצמית מאפשרות שליטה בהגדרות ובהרצה לצורך עמידה בתקני רגולציה כמו GDPR, HIPAA ו-SOC 2.

קרא עוד