חוקי קנה מידה אדפטיביים למודלים רב-לשוניים, מבוססי 774 ריצות אימון ב-400+ שפות.

מתי כדאי לכוונן עדין לעומת אימון מחדש?

כוונון עדין עדיף עד 144B-283B טוקנים; אימון מחדש טוב יותר לאחר מכן.

אילו שפות משלימות זו את זו?

שפות משפחתיות וסקריפט משותף, כמו עברית לערבית או סוודית לנורווגית.

מחקר

ATLAS: חוקי קנה מידה מעשיים למודלים רב-לשוניים

חוקרים מגוגל מציגים ATLAS – כלי חדשני לקביעת גודל מודל, נפח נתונים ותערובת שפות אופטימלית למודלים רב-לשוניים

צוות אוטומציות AI

27 בינואר 2026

4 דקות קריאה

מבוסס על כתבה שלGoogle Research ↗תרגום, סיכום והקשר עסקי על-ידי המערכתאיך אנחנו עובדים

✨תקציר מנהלים

Key Takeaways

ATLAS מבוסס על 774 ריצות אימון ב-400+ שפות ומספק חיזויים מדויקים לביצועים.
מטריצת העברה חושפת שפות משלימות כמו עברית לערבית או סוודית לנורווגית.
להכפלת שפות: הגדילו מודל ב-1.18 ונתונים ב-1.66.
כוונון עדין עדיף עד 144B-283B טוקנים; אחר כך אימון מחדש.
כלי פרקטי למפתחים לבניית מודלים גלובליים יעילים.

ATLAS: חוקי קנה מידה מעשיים למודלים רב-לשוניים

ATLAS מבוסס על 774 ריצות אימון ב-400+ שפות ומספק חיזויים מדויקים לביצועים.
מטריצת העברה חושפת שפות משלימות כמו עברית לערבית או סוודית לנורווגית.
להכפלת שפות: הגדילו מודל ב-1.18 ונתונים ב-1.66.
כוונון עדין עדיף עד 144B-283B טוקנים; אחר כך אימון מחדש.
כלי פרקטי למפתחים לבניית מודלים גלובליים יעילים.

בעולם שבו יותר מ-50% ממשתמשי מודלי AI מדברים שפות שאינן אנגלית, חסר כלי מדעי שמנחה בניית מודלים יעילים לשפות אלה. חוקרים מגוגל קלאוד וגוגל דיפמאיינד מציגים את ATLAS: חוקי קנה מידה רב-לשוניים מעשיים שמספקים הדרכה מדויקת להחלטות מפתח על גודל מודל, נפח נתונים ותערובת שפות. המחקר, שיוצג בכנס ICLR 2026, מבוסס על המחקר הציבורי הגדול ביותר עד כה – 774 ריצות אימון על מודלים מ-10 מיליון עד 8 מיליארד פרמטרים, כולל נתונים מ-400+ שפות והערכות ב-48 שפות.

ATLAS בוחן סינרגיות בין 1,400 זוגות שפות ומציע חוקי קנה מידה אדפטיביים להעברה בין-לשונית. בניגוד לחוקי קנה מידה מסורתיים שמתמקדים באנגלית, ATLAS מתאים לסביבות רב-לשוניות מורכבות וממזער את 'קללת הרב-לשוניות' – ירידה בביצועים עם כל שפה נוספת עקב מגבלות קיבולת. החוק כולל שלושה מרכיבים מרכזיים: מטריצת העברה בין-לשונית שמזהה שפות משלימות, חוק קנה מידה להרחבת גודל מודל ונתונים עם מספר שפות גובר, וכללים לבחירה בין אימון מחדש לבין כוונון עדין מנקודת בדיקה רב-לשונית.

המחקר השתמש במאגר MADLAD-400 לאימון מאות ניסויים רב-לשוניים, תוך חלוקת הנתונים לשלושה מקורות: שפת היעד, שפות העברה דומות (כגון ספרדית, פורטוגזית ואיטלקית לקטלאנית) ושאר השפות. ATLAS חוזה ביצועים על גודלי מודלים חדשים, נפחי נתונים משתנים ותערובות שפות חדשות, ומנצח על עבודות קודמות. בשש שפות לדוגמה – אנגלית, צרפתית, רוסית, סינית, הינדית וסווהילי – נצפו מסלולי קנה מידה דומים, אך עם 'מס קיבולת' לאימון רב-לשוני, במיוחד באנגלית.

מטריצת ההעברה מגלה תובנות אינטואיטיביות: נורווגית מועילה מסוודית וגרמנית, מלאית מאינדונזית, ערבית מעברית. אנגלית, צרפתית וספרדית הן השפות המועילות ביותר בשל איכות וריבוי טקסטים באינטרנט. הגורם החזק ביותר להעברה חיובית הוא שיתוף סקריפט ומשפחת שפה (p < 0.001). העברה אינה תמיד סימטרית, והנתונים הופכים השערות להחלטות מבוססות נתונים.

'קללת הרב-לשוניות' מפורמלת בחוק שמתחשב במספר שפות K, לצד גודל מודל N ונפח נתונים D. הוספת שפות גורמת למס קיבולת קל, אך עם העברה חיובית גבוהה. כדי לתמוך בפעמיים מספר שפות (2K), יש להגדיל גודל מודל ב-1.18 ונתונים ב-1.66, עם 83% נתונים בכל שפה. כך, הסינרגיות מפצות על פחות נתונים לכל שפה.

בנוגע לבחירה בין אימון מחדש לכוונון עדין, ATLAS קובע נקודת חיתוך: כוונון עדין מנקודת 'Unimax' רב-לשונית עדיף בתחילה, אך אימון מחדש עולה עליו לאחר 144B-283B טוקנים (תלוי שפה) במודלים של 2B פרמטרים. ככל שגודל המודל גדל, נקודת החיתוך עולה, ומספקת כלל אצבע מבוסס תקציב.

ATLAS מספק מפת דרכים למפתחים גלובליים לבניית מודלים רב-לשוניים יעילים יותר, תוך התאמה לנתונים זמינים ולשפות ספציפיות. זה מאפשר איזון אופטימלי בין יעילות, איכות ועלות, ומקדם מודלים המשרתים מיליארדי דוברי שפות שאינן אנגלית.

כיצד תיישמו זאת בפרויקט הבא שלכם? האם ATLAS ישנה את אסטרטגיית האימון שלכם?

שאלות ותשובות

FAQ

הכתבה הוכנה על-ידי המערכת בליווי בינה מלאכותית: תרגום, סיכום והוספת הקשר עסקי ישראלי מתוך פרסום מקורי של Google Research. קראו על תהליך העריכה שלנו. קישור למקור המקורי.

אהבתם את הכתבה?

הירשמו לניוזלטר שלנו וקבלו עדכונים חמים מעולם ה-AI ישירות למייל

עוד מ־Google Research

כל הכתבות מ־Google Research

מיפוי סביבתי באמצעות בינה מלאכותית: מפיקסלים לתכנון שיקום הטבע

מחקר

לפני 6 שעות

4 דקות

מ־Google Research

מיפוי סביבתי באמצעות בינה מלאכותית: מפיקסלים לתכנון שיקום הטבע

גוגל חשפה פריצת דרך בפרויקט Earth AI המאפשרת מעבר ממפות פיקסלים למידע וקטורי מפורט ברזולוציה של תת-מטר. המערכת שפותחה בשיתוף אוניברסיטת אוקספורד, מאפשרת מיפוי מדויק של גדרות חיות, קירות אבן וחורשות קטנות המהווים כלי קריטי לשיקום אקולוגי ולחישובי פחמן. עבור המגזר העסקי בישראל, טכנולוגיה זו מציעה הזדמנויות משמעותיות בתחומי הביטוח, הנדל״ן והחקלאות המדייקת, תוך התחשבות במגבלות חוק הגנת הפרטיות הישראלי.

Google Earth AI Google Earth Engine Leverhulme Centre for Nature Recovery

קרא עוד

אימות מחיקת מידע ממודלי בינה מלאכותית: פריצת הדרך של גוגל

מחקר

לפני 6 ימים

5 דקות

מ־Google Research

אימות מחיקת מידע ממודלי בינה מלאכותית: פריצת הדרך של גוגל

חוקרי Google Research הציגו בוועידת AISTATS 2026 מסגרת עבודה מהפכנית בשם Regularized f-Divergence Kernel Tests, המיועדת לבצע אימות מחיקת מידע ממודלי בינה מלאכותית. השיטה החדשה מתגברת על כשלי הבדיקות הדו-מדגמיות המסורתיות (כמו MMD), ומאפשרת למבקרים חיצוניים לזהות דליפות מידע מקומיות ברמת דיוק חסרת תקדים. באמצעות שימוש במדדי שונות מתקדמים כמו Hockey-stick divergence ורגולריזציה של ליבות, המערכת מזהה הפרות פרטיות תוך שימוש בכמה אלפי דגימות בלבד בהשוואה למיליוני דגימות שנדרשו בעבר בשיטות כמו DP-Auditorium. פיתוח זה מעניק לעסקים הפועלים תחת רגולציות פרטיות מחמירות כלי מתמטי מוכח להבטחת עמידה בדרישות החוק.

AISTATS 2026 Mónica Ribero Antonin Schrab

קרא עוד

גוגל חושפת את טכנולוגיית Agentic RAG לעסקים: דיוק חסר תקדים ל-AI

מחקר

לפני 5 שעות

4 דקות

מ־Google Research

גוגל חושפת את טכנולוגיית Agentic RAG לעסקים: דיוק חסר תקדים ל-AI

גוגל מציגה את Agentic RAG, ארכיטקטורת רב-סוכנים חדשה המשולבת בפלטפורמת Gemini Enterprise. בניגוד למערכות RAG מסורתיות המחזירות תשובות חלקיות כאשר המידע מבוזר, המנגנון החדש פועל בצורה איטרטיבית. המערכת מחלקת את השאילתה בין סוכנים מומחים (כמו סוכן תכנון וסוכן ניסוח מחדש) ומשתמשת ב'סוכן הקשר מספק' המבצע בקרת איכות קפדנית על תוצאות החיפוש. בבדיקות של גוגל על מאגר המידע FramesQA, המערכת הגיעה ל-90.1% דיוק בחיפושים מורכבים חוצי-מאגרים, תוך שמירה על מהירות מענה כמעט זהה (פגיעה של 3% בלבד בלייטנסי). הטכנולוגיה, הזמינה כעת בגרסת תצוגה מקדימה, פותחת עידן חדש של אמינות ודיוק עבור סוכני AI בארגונים.

Google Cloud Gemini Enterprise Agent Platform FramesQA

קרא עוד

מודל בינה מלאכותית לחיזוי שיטפונות: גוגל משחררת את קוד המקור

מחקר

3 ביוני 2026

5 דקות

מ־Google Research

מודל בינה מלאכותית לחיזוי שיטפונות: גוגל משחררת את קוד המקור

חוקרי Google Research שחררו רשמית את מודל ההידרולוגיה של החברה כקוד פתוח תחת רישיון Apache 2.0. המערכת, המבוססת על ספריית PyTorch ורשתות ME-LSTM, מניעה את חיזויי הזמן האמת של פלטפורמת Flood Hub הגלובלית. המהלך מאפשר לרשויות מטרולוגיות, חברות מים וגופי תשתית להריץ ולעבד נתוני אקלים ומשקעים מקומיים באופן עצמאי ומאובטח על שרתי הארגון. שילוב המודל, שנבחן בשיתוף פעולה עם המכון ההידרומטאורולוגי הצ'כי, מאפשר להאריך את טווח התחזית האמינה בעד שישה ימים באגנים מנוטרים, ומציע לעסקים ולרשויות בישראל כלי רב-עוצמה לניהול סיכוני מזג אוויר ושיפור ההיערכות לאירועי קיצון.

Google GitHub PyTorch

קרא עוד

עוד כתבות שיעניינו אותך

לכל הכתבות

מחקר

לפני 6 שעות

4 דקות

מ־Google Research

מיפוי סביבתי באמצעות בינה מלאכותית: מפיקסלים לתכנון שיקום הטבע

Google Earth AI Google Earth Engine Leverhulme Centre for Nature Recovery

קרא עוד

שילוב בינה מלאכותית במסרים שיווקיים פוגע באמון הלקוחות

מחקר

לפני 8 שעות

4 דקות

מ־TechCrunch

שילוב בינה מלאכותית במסרים שיווקיים פוגע באמון הלקוחות

סקר חדש של חברת WordPress VIP חושף כי 60% מהצרכנים בארה"ב מרגישים רתיעה ממותגים המשתמשים במילה "AI" במסרים השיווקיים שלהם. בעוד שחברות ממהרות לבצע אופטימיזציה למנועי חיפוש מבוססי בינה מלאכותית, פער האמון הולך וגדל: 86% מהצרכנים אינם נותנים אמון מלא בתשובות ה-AI ומעדיפים מקורות מידע מקוריים ואנושיים. המחקר מדגיש את החשיבות ההולכת וגוברת של שמירה על שקיפות וייחוס מקורות (Attribution) ברשת האינטרנט, המרגישה כיום 'פחות אנושית' עבור 74% מהגולשים. עבור עסקים ישראליים, הממצאים מהווים תמרור אזהרה מפני שיווק-יתר טכנולוגי ומדגישים את הצורך בשימור החיבור האנושי בקדמת הבמה, לצד שילוב אוטומציות חכמות מאחורי הקלעים.

WordPress VIP Automattic Brian Alvey

קרא עוד

פענוח תצלומי לוויין באמצעות בינה מלאכותית: מהפכת עיבוד הנתונים בחלל

מחקר

אתמול

4 דקות

מ־TechCrunch

פענוח תצלומי לוויין באמצעות בינה מלאכותית: מהפכת עיבוד הנתונים בחלל

פריצת דרך היסטורית נרשמה באפריל 2026, כאשר לוויין התצפית Yam-9 של חברת Loft Orbital הצליח לזהות ולפענח עצמים על פני כדור הארץ באופן עצמאי לחלוטין. באמצעות שימוש במעגל מחשוב קצה המבוסס על מעבד Nvidia Jetson Orin AGX ומעטפת התוכנה NAVI-Orbital שפותחה על ידי מעבדת JPL של נאס"א, הלוויין הריץ את מודל השפה-חזותי (VLM) מסוג Gemma 3 של Google DeepMind. פיתוח זה מאפשר ניתוח וסינון ראשוני של נתונים חזותיים מורכבים ישירות בחלל, ומקטין דרמטית את הצורך בהורדת נפחי מידע גולמי עצומים לקרקע. עבור עסקים ותעשיות בישראל כגון חקלאות מדויקת וביטחון מולדת, פריצת הדרך מסמנת מעבר לעיבוד נתונים מהיר, חסכוני ומבוזר המבוסס על בינה מלאכותית.

Loft Orbital NASA JPL

קרא עוד

מחקר

לפני 6 ימים

5 דקות

מ־Google Research