דלג לתוכן

Nemotron

מודלים ושפה

הגדרה

Nemotron היא משפחת מודלי השפה הפתוחים של NVIDIA, שמכוונת לבניית סוכני AI. לצד המודלים NVIDIA משחררת גם נתוני אימון. המודל הגדול במשפחה, Nemotron 3 Ultra, מונה 550 מיליארד פרמטרים.

💡 דוגמה

חברת תוכנה בונה סוכן שעונה לפניות של לקוחות ומטפל בהן.

היא מריצה אותו על Nemotron 3.5 Lightning, מודל פתוח שרץ לפי NVIDIA גם על מחשב עם כרטיס RTX.

מה זה Nemotron, ולמה יצרנית שבבים בונה מודלים

Nemotron היא משפחת מודלי שפה שמפתחת NVIDIA, החברה שמוכרת את השבבים שעליהם מאמנים ומריצים מודלי AI רבים. כלומר, זו לא חברת מודלים שבונה שבבים, אלא יצרנית שבבים שבונה גם מודלים. NVIDIA משחררת אותם במשקלים פתוחים. לפי ויקיפדיה, אפשר להוריד אותם ולהריץ אותם מקומית, או להשתמש בהם דרך ה-API ושירותי ההרצה NIM של NVIDIA. את ההסבר הרשמי נתן מנכ"ל החברה, ג'נסן הואנג, בהכרזה על Nemotron 3 בדצמבר 2025: "חדשנות פתוחה היא הבסיס להתקדמות של ה-AI. עם Nemotron אנחנו הופכים AI מתקדם לפלטפורמה פתוחה, שנותנת למפתחים את השקיפות והיעילות שהם צריכים כדי לבנות מערכות סוכניות בקנה מידה". באותה הכרזה קשרה NVIDIA את המשפחה גם ליוזמות ה-AI הריבוני שלה, כלומר למדינות ולאזורים שרוצים שליטה במערכות ה-AI שלהם. ההיסטוריה של NVIDIA עצמה מתוארת בערך אנבידיה. הערך הזה עוסק במודלים.

מנתונים סינתטיים ל-Llama Nemotron

לפי ויקיפדיה, המודלים הראשונים בשם, Nemotron-3 8B, יצאו בנובמבר 2023 ונועדו ליישומי בינה מלאכותית יוצרת בארגונים. ב-14 ביוני 2024 הגיע Nemotron-4 340B, מודל של 340 מיליארד פרמטרים שאומן על 9 טריליון טוקנים, בשלוש גרסאות: מודל בסיס, מודל שמכוון לביצוע הוראות ומודל תגמול. מטרתו המוצהרת הייתה "לייצר נתונים סינתטיים שיכולים לעזור לבנות מודלי שפה חזקים". מודל ההוראות כותב טקסט, ומודל התגמול מסנן את התשובות לפי חמש תכונות: מועילות, נכונות, קוהרנטיות, מורכבות ואורך. ב-18 במרץ 2025 הציגה NVIDIA את Llama Nemotron, מודלי חשיבה שלפי הודעת החברה נבנו על בסיס מודלי Llama של Meta. הם יצאו בשלושה גדלים: Nano למחשבים אישיים ולמכשירי קצה, Super לכרטיס גרפי יחיד ו-Ultra לשרתים עם כמה כרטיסים. שמות הגדלים האלה, Nano, Super ו-Ultra, מלווים את המשפחה גם בדורות שאחריה.

Nemotron 3: הכלאה של Mamba, Transformer ומומחים

ב-15 בדצמבר 2025 הכריזה NVIDIA על Nemotron 3, דור שבנוי על ארכיטקטורה היברידית: שכבות Mamba, שצורכות פחות זיכרון בטקסטים ארוכים, לצד שכבות קשב של Transformer ושכבות של תמהיל מומחים (Mixture of Experts). מודל Nano, הראשון שיצא, מונה 30 מיליארד פרמטרים, ולפי כרטיס המודל כ-3.5 מיליארד מהם פעילים בכל צעד. לפי NVIDIA, התפוקה שלו גבוהה פי 4 מזו של Nemotron 2 Nano, והוא מייצר עד 60% פחות טוקני חשיבה. לפי כרטיסי המודל, כל שלושת הגדלים תומכים בחלון הקשר של עד מיליון טוקנים. Super, עם 120 מיליארד פרמטרים ו-12 מיליארד פעילים, יצא ב-11 במרץ 2026. Ultra, עם 550 מיליארד פרמטרים ו-55 מיליארד פעילים, יצא ב-4 ביוני 2026. לפי כרטיס המודל, Ultra נועד ל"הסקה ברמת החזית, תהליכי עבודה סוכניים מורכבים, ניתוח הקשרים ארוכים, שימוש בכלים…". לפי כרטיס המודל, הרצה שלו דורשת לפחות שמונה מאיצי B200 או 16 כרטיסי H100.

פתוח גם בנתונים, ושינוי ברישיון

NVIDIA משחררת לצד המודלים גם חלק ממה שנדרש כדי לבנות אותם. עם Nemotron 3 פרסמה החברה שלושה טריליון טוקנים של נתוני אימון, לשלבי האימון המקדים, אימון ההמשך ולמידת החיזוק. לפי כרטיס המודל, Ultra אומן מראש על כ-20 טריליון טוקנים, ותומך בעשר שפות, בהן אנגלית, צרפתית, גרמנית, יפנית, הינדי וסינית. גם הרישיון השתנה. Nemotron-4 340B שוחרר ב"רישיון המודלים הפתוחים של NVIDIA", שהחברה תיארה כ"מתירני באופן ייחודי" וכמאפשר שימוש מסחרי. גם Nano ו-Super של Nemotron 3 יצאו ברישיון של החברה עצמה. ב-28 במאי 2026 הכריזה קרן לינוקס על OpenMDW-1.1, רישיון פתוח שמכסה במפורש לא רק קוד, אלא גם משקלים, נתונים ותיעוד. NVIDIA הודיעה שתאמץ אותו במהדורות הבאות של Nemotron ושל משפחות מודלים פתוחים נוספות שלה. לפי כרטיס המודל של Nemotron 3 Ultra ולפי Artificial Analysis, Ultra ו-Nemotron 3.5 Lightning כבר שוחררו ברישיון הזה.

Nemotron 3.5 Lightning, והקואליציה לקראת Nemotron 4

ב-11 באוגוסט 2026 יצא Nemotron 3.5 Lightning, מודל תמהיל מומחים של כ-30 מיליארד פרמטרים, שלפי Artificial Analysis 3.6 מיליארד מהם פעילים. NVIDIA מציגה אותו כ"המודל היעיל ביותר בקטגוריה שלו" לעבודה ארוכה של סוכנים. לדבריה, הוא רץ לא רק בחוות שרתים ובענן, אלא גם על מחשבים עם כרטיסי RTX, על DGX Spark ועל לוחות Jetson. לצידו שוחררה NeMo Switchyard, ספריית קוד פתוח שמנתבת כל בקשה של סוכן למודל המתאים לה, מתוך שילוב של מודלים פתוחים, סגורים ומודלים של NVIDIA. במרץ 2026 הקימה NVIDIA את קואליציית Nemotron, ובה Mistral AI, Perplexity, Cursor, LangChain, Black Forest Labs, Reflection AI, Sarvam ו-Thinking Machines Lab. הפרויקט הראשון שלה הוא מודל בסיס שמפתחות יחד Mistral AI ו-NVIDIA, ושישמש בסיס למשפחת Nemotron 4 העתידית. כדאי לשים לב לשמות: Nemotron-4 340B מ-2024 הוא מודל אחר. משפחת Nemotron 4 שהקואליציה עובדת עליה עוד לא שוחררה, נכון לתחילת אוקטובר 2026.

טענות היצרן, ומי משתמש

NVIDIA מלווה כל השקה במספרים משלה. על Nemotron 3.5 Lightning היא כותבת שקצב הפלט שלו "מהיר עד פי 4" מחלופות דומות, ושהוא מסיים משימות של סוכנים מהר יותר ב-30%. על Switchyard היא כותבת שבבדיקות פנימיות הספרייה שמרה על דיוק של מודלי חזית, והורידה את עלות המשימה לכמעט שליש מהעלות של שימוש ב-Opus 4.8 לבדו. אלה מדידות של היצרן. מדידה חיצונית אחת: לפי Artificial Analysis, Lightning קיבל במדד האינטליגנציה שלה ציון 24, כמו gpt-oss-120b של OpenAI. בין הלקוחות המוקדמים של Nemotron 3 מנתה NVIDIA, בין היתר, את Accenture, CrowdStrike, Cursor, Oracle Cloud, Palantir, Perplexity, ServiceNow, Siemens ו-Zoom. כמה מהשמות, כמו Cursor ו-Perplexity, מופיעים גם ברשימת חברי הקואליציה.

📬 הגיליון השבועי של Wiki-AI

פעם בשבוע, ביום ראשון: שלושת הדברים החשובים שקרו בעולם הבינה המלאכותית, בעברית פשוטה, וערכים חדשים באנציקלופדיה. לגיליונות

שלושת הגדלים של Nemotron 3 (לפי כרטיסי המודל)
Nemotron 3 NanoNemotron 3 SuperNemotron 3 Ultra
פרמטרים30 מיליארד, כ-3.5 מיליארד פעילים120 מיליארד, 12 מיליארד פעילים550 מיליארד, 55 מיליארד פעילים
יצא15 בדצמבר 202511 במרץ 20264 ביוני 2026
רישיוןרישיון של NVIDIAרישיון של NVIDIAרישיון OpenMDW-1.1 של קרן לינוקס

שאלות נפוצות ❓

למה NVIDIA, שמוכרת שבבים, מפתחת מודלי שפה?

לפי מנכ"ל החברה, ג'נסן הואנג, "חדשנות פתוחה היא הבסיס להתקדמות של ה-AI", ו-Nemotron נועד להיות פלטפורמה פתוחה שמאפשרת למפתחים לבנות מערכות של סוכנים. NVIDIA קושרת את המשפחה גם ליוזמות ה-AI הריבוני שלה.

מותר להשתמש ב-Nemotron בעסק?

כן. רוב המודלים הקודמים יצאו ברישיונות של NVIDIA שמאפשרים שימוש מסחרי, ו-Nemotron 3 Ultra ו-Nemotron 3.5 Lightning יצאו ברישיון OpenMDW-1.1 של קרן לינוקס. כדאי לבדוק את הרישיון של המודל הספציפי.

מה ההבדל בין Nemotron-4 340B ל-Nemotron 4?

Nemotron-4 340B הוא מודל מיוני 2024, שנועד בעיקר לייצר נתונים סינתטיים. Nemotron 4 היא משפחה עתידית, שתתבסס על מודל שמפתחות Mistral AI ו-NVIDIA במסגרת קואליציית Nemotron, ונכון לתחילת אוקטובר 2026 טרם שוחררה.

אפשר להריץ Nemotron על מחשב ביתי?

חלק מהמודלים כן. לפי NVIDIA, Nemotron 3.5 Lightning רץ גם על מחשבים עם כרטיסי RTX. Nemotron 3 Ultra, לעומת זאת, דורש לפחות שמונה מאיצי B200 או 16 כרטיסי H100.

שתפו:וואטסאפטלגרם

מצאתם טעות בערך, או שיש לכם מקור שכדאי להוסיף? כתבו לנו