Gemma
הגדרה
Gemma היא משפחת מודלי השפה הפתוחים של גוגל: מודלים קטנים יחסית, שנבנו מאותו מחקר כמו Gemini, ושאפשר להוריד ולהריץ על מחשב, טלפון או שרת. מאז Gemma 4 הם משוחררים ברישיון Apache 2.0.
💡 דוגמה
מפתחת אפליקציות בחיפה מריצה את Gemma 4 על המחשב הנייד שלה ב-Ollama, ומחברת אותו ל-Android Studio.
הקוד שלה לא יוצא מהמחשב, והעוזר ממשיך לעבוד גם כשאין אינטרנט.
מה זה Gemma, ובמה היא שונה מ-Gemini
Gemma היא משפחת מודלי שפה של גוגל שהמשקלים שלהם פתוחים: כל אחד יכול להוריד אותם ולהריץ אותם על החומרה שלו. כשהוצגה, ב-21 בפברואר 2024, כתבה גוגל שהמשפחה "נבנתה מאותו מחקר ומאותה טכנולוגיה ששימשו ליצירת מודלי Gemini". השם בא מהמילה הלטינית gemma, שפירושה "אבן יקרה". ההבדל העיקרי מ-Gemini הוא באופן השימוש. Gemini הוא מודל סגור: פונים אליו דרך האפליקציה, דרך החיפוש של גוגל או דרך ה-API, והוא רץ על השרתים של גוגל. Gemma היא קובץ שמורידים, והיא רצה איפה שבוחרים: במחשב נייד, בטלפון או בשרת של הארגון. כבר בהשקה כתבה גוגל שהמודלים יכולים לרוץ "על המחשב הנייד שלכם, על תחנת עבודה או ב-Google Cloud". לכן גם הגדלים שונים: המשפחה מכוונת למודלים שנכנסים לחומרה רגילה, לא למודלי ענק. המודלים של Gemini עצמם מתוארים בערך Gemini, והיחידה שמפתחת את שתי המשפחות בערך Google DeepMind.
ארבעה דורות, מ-2024 עד 2026
הדור הראשון יצא בשני גדלים, 2 ו-7 מיליארד פרמטרים. Gemma 2 יצא ביוני 2024, בגדלים 2, 9 ו-27 מיליארד. Gemma 3, ממרץ 2025, הגיע בגדלים 1, 4, 12 ו-27 מיליארד, עם חלון הקשר של 128 אלף טוקנים. לפי גוגל, הוא תומך מהקופסה ביותר מ-35 שפות, ובאימון המקדים שלו נכללו יותר מ-140 שפות; הגדלים 4, 12 ו-27 מיליארד מבינים גם תמונות. גוגל הציגה אותו כ"מודל המסוגל ביותר שאפשר להריץ על GPU או TPU יחיד". ביוני 2025 הצטרף Gemma 3n, גרסה שנועדה לרוץ על מכשירים של צרכנים, ובאוגוסט 2025 גרסה זעירה של Gemma 3, עם 270 מיליון פרמטרים בלבד. Gemma 4 הוכרז ב-2 באפריל 2026, בארבעה גדלים: E2B ו-E4B, כש-E הוא קיצור של Effective, גודל "אפקטיבי" של 2 ו-4 מיליארד פרמטרים; מודל תמהיל מומחים (Mixture of Experts) של 26 מיליארד, שלפי כרטיס המודל רק 3.8 מיליארד מהפרמטרים שלו פעילים בכל צעד; ומודל צפוף של 31 מיליארד. לפי גוגל, Gemma 4 "נבנה מאותו מחקר ומאותה טכנולוגיה כמו Gemini 3". כל הגדלים שלו מבינים תמונות ווידאו, ושני הקטנים מבינים גם דיבור. ב-3 ביוני 2026 נוסף Gemma 4 12B, מודל שמבין טקסט, תמונה וקול בלי רכיבי קידוד נפרדים, ולפי גוגל מספיקים לו 16GB של זיכרון גרפי (VRAM) או זיכרון מאוחד. נכון לתחילת אוקטובר 2026 זו הגרסה האחרונה ברשימת הגרסאות הרשמית של גוגל.
משפחה שלמה סביב המודל
סביב המודל הכללי בנתה גוגל שורה של גרסאות ייעודיות. CodeGemma נועדה להשלמה ולכתיבה של קוד. PaliGemma משלבת ראייה ושפה, לניתוח תמונות. MedGemma מיועדת ליישומים רפואיים, כמו ניתוח של תמונות רפואיות. ShieldGemma 2 היא מודל סינון: היא מזהה תמונות אלימות, מסוכנות או מיניות בוטות, כדי שמערכת אחרת תוכל לחסום אותן. TranslateGemma, מינואר 2026, מיועדת לתרגום מכונה. יש גם EmbeddingGemma, מודל של 308 מיליון פרמטרים שהופך טקסט לייצוג מספרי (Embedding), שימושי לחיפוש לפי משמעות. הדוגמה החריגה ביותר היא DolphinGemma, מודל של כ-400 מיליון פרמטרים לניתוח הקולות של דולפינים. לפי ויקיפדיה, לא המודל ולא הנתונים שלו פורסמו לציבור. גם הקהילה בונה: לפי גוגל, מפתחים פרסמו יותר מ-100 אלף גרסאות משלהם של Gemma. את האוסף הזה גוגל מכנה "Gemmaverse".
מרישיון של גוגל ל-Apache 2.0
שלושת הדורות הראשונים שוחררו תחת "תנאי השימוש של Gemma", מסמך שגוגל כתבה בעצמה. התנאים התירו מההתחלה "שימוש מסחרי אחראי והפצה לכל הארגונים, בלי קשר לגודלם", אבל עם הגבלות. מי שמשתמש במודל מחויב ל"מדיניות השימוש האסור" של Gemma, וגוגל "שומרת לעצמה את הזכות להגביל (מרחוק או בדרך אחרת)" שימוש שלדעתה מפר את ההסכם. מנגד, לפי אותם תנאים גוגל "אינה טוענת לזכויות" בטקסט שהמודל מייצר. בגלל ההגבלות האלה ויקיפדיה מסווגת את Gemma 1 עד 3 כמודלים "זמיני מקור" (source-available), ולא כקוד פתוח. Gemma 4 שינה את התמונה: הוא שוחרר ברישיון Apache 2.0, רישיון קוד פתוח מוכר, שגוגל מתארת כ"מתירני מבחינה מסחרית". התנאים הישנים לא נעלמו. הם עדיין חלים על הגרסאות הקודמות ועל רבות מהגרסאות הייעודיות, ותנאי השימוש עצמם מפנים את מי שמשתמש ב-Gemma 4 לרישיון הנפרד שלו. בפועל, ארגון שמשלב מודל Gemma במוצר צריך לבדוק איזו גרסה בדיוק הוא מוריד.
איפה הוא רץ, ומי משתמש בו
Gemma 4 תוכנן לטווח רחב של חומרה. לפי גוגל, הוא רץ על "מיליארדי מכשירי Android" ועל כרטיסים גרפיים של מחשבים ניידים, וגם על Raspberry Pi ועל לוח הפיתוח Jetson Orin Nano של NVIDIA. לגדלים הקטנים חלון הקשר של 128 אלף טוקנים, ולגדולים עד 256 אלף. כרטיס המודל של גרסת 31B מתאר גם "מצב חשיבה" מובנה, שבו המודל חושב צעד אחר צעד לפני שהוא עונה, ואפשר להפעיל אותו או לכבות אותו. דוגמה מעשית: מאפריל 2026 אפשר להשתמש ב-Gemma 4 כמודל מקומי בסביבת הפיתוח Android Studio, במצב הסוכן שכותב ומתקן קוד. גוגל מדגישה ש"הקוד שלכם נשאר על המחשב שלכם", שאין מכסות API לשלם עליהן, ושהכול עובד גם בלי חיבור לאינטרנט. ההתקנה עוברת דרך כלי הרצה כמו LM Studio או Ollama. הגרסה המומלצת, 26B, דורשת לפי גוגל 24GB זיכרון RAM, ו-E2B מסתפקת ב-8GB. באוגוסט 2026 הודיעה גוגל שהמשפחה עברה מיליארד הורדות. מהנדס בחברה הבהיר שהמספר "לא כולל את השילובים ב-Android וב-Chrome", ולפי The Next Web גוגל לא פרסמה את שיטת הספירה.
טענות היצרן, והמקרה של בלקבורן
נתוני הביצועים בהכרזות מגיעים מגוגל עצמה. לפי ההכרזה על Gemma 4, גרסת 31B דורגה אז במקום השלישי בין המודלים הפתוחים בעולם בטבלת הטקסט של Arena, וגרסת 26B במקום השישי. גם על Gemma 3 כתבה גוגל שבהערכות ראשוניות של העדפות אנושיות בדירוג LMArena הוא עקף את Llama3-405B, את DeepSeek-V3 ואת o3-mini. אלה מדידות שפרסם היצרן, נכונות לרגע ההכרזה. אחת הבעיות של מודלי שפה היא הזיות, וב-Gemma היא הגיעה לכותרות. בסוף 2025 התלוננה הסנאטורית האמריקאית מרשה בלקבורן שכשנשאלה Gemma אם בלקבורן הואשמה באונס, המודל בדה סיפור על האשמה כזו, עם קישורים שהובילו לדפי שגיאה ולכתבות שאינן קשורות. לדבריה, "שום דבר מזה אינו נכון, אפילו לא שנת מערכת הבחירות". לפי TechCrunch מ-2 בנובמבר 2025, גוגל הסירה את Gemma מ-AI Studio, ממשק הניסוי שלה בדפדפן, והסבירה: "מעולם לא התכוונו שזה יהיה כלי או מודל לצרכנים, או שישתמשו בו כך". המודלים נשארו זמינים למפתחים דרך ה-API.
📬 הגיליון השבועי של Wiki-AI
פעם בשבוע, ביום ראשון: שלושת הדברים החשובים שקרו בעולם הבינה המלאכותית, בעברית פשוטה, וערכים חדשים באנציקלופדיה. לגיליונות
| Gemma 1 (2024) | Gemma 3 (2025) | Gemma 4 (2026) | |
|---|---|---|---|
| גדלים | 2 ו-7 מיליארד פרמטרים | 1, 4, 12 ו-27 מיליארד פרמטרים | ארבעה גדלים, עד 31 מיליארד פרמטרים; ביוני 2026 נוסף מודל של 12 מיליארד |
| רישיון | תנאי השימוש של Gemma | תנאי השימוש של Gemma | רישיון Apache 2.0 |
| מה חידש | מודל פתוח מאותו מחקר כמו Gemini | חלון הקשר של 128 אלף טוקנים, הבנת תמונות, יותר מ-35 שפות מהקופסה ויותר מ-140 באימון המקדים | תמונות ווידאו בכל הגדלים, עד 256 אלף טוקנים, מצב חשיבה |
שאלות נפוצות ❓
האם Gemma היא גרסה חינמית של Gemini?
לא בדיוק. Gemma נבנתה מאותו מחקר, אבל היא משפחה נפרדת של מודלים קטנים יותר, שמורידים ומריצים לבד. Gemini רץ על השרתים של גוגל, ופונים אליו דרך האפליקציה, החיפוש או ה-API.
מותר להשתמש ב-Gemma במוצר מסחרי?
כן, אבל התנאים תלויים בגרסה. Gemma 4 משוחרר ברישיון Apache 2.0, שמתיר שימוש מסחרי. הגרסאות הקודמות כפופות לתנאי השימוש של Gemma, שמתירים שימוש מסחרי אבל מחייבים לעמוד במדיניות השימוש האסור של גוגל.
אפשר להריץ את Gemma על מחשב ביתי?
כן. לפי גוגל, גרסת E2B של Gemma 4 מסתפקת ב-8GB זיכרון RAM, וגרסת 26B דורשת 24GB. את המודלים מריצים בכלים כמו Ollama או LM Studio.
למה גוגל הסירה את Gemma מ-AI Studio?
בתחילת נובמבר 2025, לפי TechCrunch, אחרי שהסנאטורית מרשה בלקבורן התלוננה שהמודל בדה עליה האשמה פלילית. גוגל אמרה שמעולם לא התכוונה ש-Gemma תשמש ככלי לצרכנים, והשאירה אותה זמינה למפתחים דרך ה-API.