ג'יני (Genie)
הגדרה
ג'יני היא משפחת מודלי עולם של Google DeepMind שמייצרים מתוך טקסט או תמונה עולם וירטואלי שאפשר להסתובב בו ולשלוט בו בזמן אמת, ומשמשים גם לאימון סוכני AI ורכבים אוטונומיים.
💡 דוגמה
כותבים "טירה עשויה ממרשמלו בסגנון פלסטלינה", ותוך שניות אפשר ללכת בתוכה עם המקשים, כמו במשחק מחשב שאף אחד לא תכנת.
מה זה ג'יני, ואיפה הגבול מול הערכים השכנים
ג'יני (Genie) הוא שם של סדרת מודלים של Google DeepMind, מעבדת הבינה המלאכותית של גוגל. כל מודל בסדרה הוא "מודל עולם": הוא לא רק מצייר תמונה או סרטון, אלא מייצר סביבה שמגיבה למה שהמשתמש עושה. לוחצים על חץ, והדמות זזה; פונים ימינה, והעולם ממשיך להיבנות בכיוון הזה. הערך הזה מתאר את הסדרה עצמה, דור אחרי דור. המושג הכללי של מודל עולם מוסבר בערך מודל-עולם, והתחרות בין DeepMind, NVIDIA, World Labs ואחרות מתוארת בערך מירוץ מודלי-העולם.
ג'יני הראשון: למד לשחק מצפייה
את ג'יני הראשון הציגו חוקרי DeepMind בפברואר 2024, ותיארו אותו כ"סביבה אינטראקטיבית גנרטיבית" ראשונה שאומנה בלי פיקוח, מתוך סרטונים מהאינטרנט שאף אחד לא תייג. המודל, בן 11 מיליארד פרמטרים, אומן על 30 אלף שעות של סרטוני משחק ממאות משחקי פלטפורמה דו-ממדיים. הייחוד שלו: אף אחד לא אמר לו אילו מקשים לחץ השחקן בכל רגע. רכיב בשם "מודל פעולות סמוי" גילה לבד שמונה פעולות בסיסיות מתוך הצפייה בלבד. החוקרים הראו גם שהשיטה לא מוגבלת למשחקים: הם אימנו מודל נפרד באותה שיטה על סרטונים של זרועות רובוטיות, והציעו שהפעולות שהמודל לומד מצפייה יוכלו לשמש לאימון של סוכנים כלליים בעתיד. המגבלות היו ברורות: הוא רץ בקצב של בערך פריים אחד בשנייה, וזכר רק 16 פריימים אחורה, כך שהעולם לא נשאר עקבי לאורך זמן.
ג'יני 2: קפיצה לתלת-ממד
בדצמבר 2024 הציגה DeepMind את ג'יני 2, שהגדירה כ"מודל עולם יסודי". הוא מקבל תמונה אחת, שנוצרה בדרך כלל במחולל התמונות של גוגל, והופך אותה לעולם תלת-ממדי שאפשר לשחק בו, מנקודת מבט של גוף ראשון, גוף שלישי או מבט איזומטרי מלמעלה. לפי DeepMind, הוא מדמה פיזיקה, תנועה של דמויות ואינטראקציה עם חפצים, שומר על עולם עקבי עד דקה, וזוכר חלקים מהעולם שיצאו מהמסך ומחזיר אותם כשחוזרים אליהם. מבחינה טכנית, ג'יני 2 הוא מודל דיפוזיה אוטורגרסיבי שאומן על מאגר גדול של סרטונים: הוא מייצר את העולם פריים אחר פריים, וכל פריים תלוי בקודמים ובפעולה של המשתמש. החוקרים גם הכניסו לעולמות האלה את SIMA, סוכן ה-AI של DeepMind, כדי לבדוק אם הוא מבצע הוראות בסביבות שלא ראה מעולם.
ג'יני 3: זמן אמת
באוגוסט 2025 הגיע ג'יני 3, הראשון בסדרה שמגיב בזמן אמת: 24 פריימים בשנייה, ברזולוציה של 720p, עם עולם שנשאר עקבי לאורך כמה דקות. העולם נוצר מתיאור טקסט, ויש לו זיכרון חזותי של בערך דקה, כך שאם חוזרים לפינה שראו קודם, היא עדיין שם. חידוש נוסף הוא מה ש-DeepMind מכנה "אירועי עולם": באמצע ההליכה אפשר לכתוב בקשה בטקסט, למשל לשנות את מזג האוויר או להכניס לעולם דמות או חפץ חדש, והעולם משתנה בהתאם. DeepMind עצמה מונה את המגבלות: מרחב פעולות מצומצם, קושי לדמות כמה סוכנים יחד, דיוק חלקי בשחזור מקומות אמיתיים, טקסט קריא בתוך העולם רק כשהוא הופיע בתיאור המקורי, ומשך שמוגבל לדקות ולא לשעות. בשלב הראשון הוא נפתח רק לקבוצה קטנה של חוקרים ויוצרים.
Project Genie: מגיע לציבור
ב-29 בינואר 2026 השיקה גוגל את Project Genie, אב-טיפוס מחקרי שמאפשר למנויי התוכנית היקרה שלה, Google AI Ultra, בארצות הברית ומגיל 18, ליצור עולמות, לטייל בהם ולשנות אותם. הוא מבוסס על ג'יני 3, על מחולל התמונות Nano Banana Pro ועל Gemini. כל ביקור בעולם מוגבל ל-60 שניות, ולדברי שלומי פרוכטר, מנהל מחקר ב-DeepMind, זה בגלל עלות החישוב: "כשאתם משתמשים בזה, יש איפשהו שבב שהוא רק שלכם". כתבת TechCrunch שניסתה אותו התרשמה מעולמות מצוירים ומעוצבים, אבל דיווחה שדמויות עברו דרך קירות, שהשליטה לא הגיבה היטב ושבקשות לדמויות של דיסני נחסמו. במאי 2026 נוספה אפשרות לבנות עולם על בסיס תמונות Street View של מקומות אמיתיים בארצות הברית, והגישה התחילה להתרחב למנויי Ultra בכל העולם.
מעבר למשחקים: רובוטקסי ובהלה בבורסה
DeepMind מציגה את ג'יני בעיקר ככלי לאימון סוכנים, לא כמנוע משחקים. דוגמה בולטת: בפברואר 2026 הציגה Waymo, חברת הרכבים האוטונומיים, את "מודל העולם של Waymo", שנבנה על ג'יני 3. הוא מייצר תרחישי נהיגה נדירים שהצי שלה מעולם לא פגש, כמו פיל על הכביש, טורנדו או רחוב מוצף, וכולל גם נתוני מצלמה וגם נתוני לידאר. ובכל זאת, השוק ראה בג'יני איום על תעשיית המשחקים: ב-30 בינואר 2026 ירדו בחדות מניות של חברות משחקים, ו-Kotaku קשר את הירידה להשקת Project Genie. לפי Kotaku, בשעות הצהריים באותו יום ירדה מניית Unity בכ-20%, Roblox בכמעט 12%, Take-Two ביותר מ-9% ו-Nintendo בכמעט 5%. כותב הכתבה טען שהמשקיעים הגיבו ביתר: מה שג'יני מייצר הוא סביבות תלת-ממדיות שאפשר לטייל בהן זמן קצר, ולא משחקים, ובכל זאת נראה שמשקיעים רבים מאמינים שכלים כאלה יפיקו בקרוב משחקים שלמים.
📬 הגיליון השבועי של Wiki-AI
פעם בשבוע, ביום ראשון: שלושת הדברים החשובים שקרו בעולם הבינה המלאכותית, בעברית פשוטה, וערכים חדשים באנציקלופדיה. לגיליונות
| ג'יני (2024) | ג'יני 2 (2024) | ג'יני 3 (2025) | |
|---|---|---|---|
| סוג העולם | דו-ממדי, כמו משחק פלטפורמה | תלת-ממדי | תלת-ממדי |
| מקבל כקלט | טקסט, תמונה, צילום או סקיצה | תמונה אחת | תיאור טקסט |
| קצב ומשך | בערך פריים בשנייה, זיכרון של 16 פריימים | עולם עקבי עד דקה | זמן אמת, 24 פריימים בשנייה, כמה דקות |
שאלות נפוצות ❓
האם אפשר לנסות את ג'יני בישראל?
לפי ההודעה של גוגל ממאי 2026, Project Genie נפתח בהדרגה לכל מנויי Google AI Ultra הזכאים בעולם, מגיל 18 ומעלה. זו התוכנית של 200 דולר, כלשון ההודעה, כך שמי שלא מנוי לה לא יוכל לנסות. גוגל עדיין מגדירה את המוצר כאב-טיפוס מחקרי.
מה ההבדל בין ג'יני למחולל וידאו כמו Veo?
מחולל וידאו מפיק סרטון גמור שצופים בו. ג'יני מייצר עולם שמגיב לפעולות שלכם בזמן אמת, כמו משחק.
האם ג'יני יכול ליצור משחק מחשב?
לא במובן המלא. הוא מייצר סביבה שאפשר להסתובב בה למשך זמן קצר, בלי חוקים, ניקוד או עלילה של משחק. DeepMind מציגה אותו בעיקר ככלי לאימון סוכנים ורובוטים.
למה מודל עולם חשוב לרכבים אוטונומיים?
כי אפשר לדמות בו מצבים נדירים ומסוכנים שקשה או בלתי אפשרי לצלם במציאות. Waymo משתמשת בגרסה מבוססת ג'יני 3 בדיוק לשם כך.