Xiaomi MiMo
הגדרה
MiMo היא משפחת מודלי הבינה המלאכותית של שיאומי. היא התחילה ב-2025 במודל קטן לחשיבה, וב-2026 הגיעה למודלים של יותר מטריליון פרמטרים, שנבנו לסוכנים ומשוחררים במשקלים פתוחים ברישיון MIT.
💡 דוגמה
סטודנט בבאר שבע בונה סוכן שעובר על הקבצים שלו ומסדר לו משימות.
הוא מחבר אותו ל-MiMo-V2.6-Flash דרך OpenRouter ומשלם לפי שימוש: 14 סנט למיליון טוקנים בקלט.
מה זה MiMo
MiMo הוא השם של משפחת מודלי השפה של שיאומי, החברה הסינית שמוכרת טלפונים וגם מכוניות חשמליות, וגם השם של צוות הבינה המלאכותית שמפתח אותם. בראש הצוות עומדת לואו פולי, שעבדה קודם ב-DeepSeek.
ההשקעה מאחורי המודלים גדולה. ב-19 במרץ 2026 הודיע מנכ"ל שיאומי, ליי ג'ון, שהחברה תשקיע בבינה מלאכותית לפחות 60 מיליארד יואן, כ-8.7 מיליארד דולר, בשלוש השנים הבאות. לדברי ליי ג'ון, כפי שדיווחה Reuters, הגיל הממוצע בצוות שפיתח את MiMo-V2-Pro, מודל הדגל שהוצג באותו שבוע, היה 25.
2025: מודל קטן שנבנה לחשיבה
המודל הראשון, MiMo-7B, יצא בסוף אפריל 2025, ובו 7 מיליארד פרמטרים בלבד. שיאומי בנתה אותו במיוחד למשימות חשיבה, כמו מתמטיקה ותכנות. המודל הבסיסי אומן על 25 טריליון טוקנים, ובשלב החיזוק נעשה שימוש ב-130 אלף בעיות מתמטיקה ותכנות שאפשר לבדוק את פתרונן אוטומטית. לפי המאמר של הצוות, הגרסה הסופית עקפה את o1-mini של OpenAI במתמטיקה, בקוד ובחשיבה כללית, וזו טענה של המפתחים עצמם.
במהלך 2025 הוסיפה שיאומי מודלים קטנים נוספים באותו גודל: MiMo-VL, שמבין גם תמונות, MiMo-Audio לשמע, ו-MiMo-Embodied. כולם פורסמו במשקלים פתוחים ב-Hugging Face.
MiMo-V2-Flash: המעבר לתמהיל מומחים
בדצמבר 2025 יצא MiMo-V2-Flash, קפיצה בסדר גודל: 309 מיליארד פרמטרים, מתוכם 15 מיליארד פעילים בכל צעד, בשיטת תמהיל מומחים. רוב השכבות בו מסתכלות רק על חלון של 128 הטוקנים האחרונים, ועל כל חמש שכבות כאלה יש שכבה אחת שרואה את כל הטקסט. המודל אומן על 27 טריליון טוקנים, וחלון ההקשר שלו הורחב ל-256 אלף טוקנים.
בשלב האחרון של האימון השתמש הצוות בשיטה שכינה MOPD: כמה מודלי "מורים", שכל אחד מהם התמחה בתחום אחר, מלמדים את המודל הסופי. לפי הדוח הטכני, MiMo-V2-Flash מתחרה במודלים פתוחים מובילים כמו DeepSeek-V3.2 ו-Kimi-K2, אף שהוא משתמש בחצי ובשליש, בהתאמה, ממספר הפרמטרים שלהם. המשקלים פורסמו לציבור.
Hunter Alpha: המודל האנונימי שהתגלה
ב-11 במרץ 2026 הופיע בשירות OpenRouter, שדרכו אפשר לגשת למודלים של ספקים שונים, מודל בשם Hunter Alpha בלי שום ציון של מי פיתח אותו. הוא טיפס מהר בטבלאות השימוש, והיו שחשדו שזה המודל הבא של DeepSeek. ב-18 במרץ חשף צוות MiMo שזו "גרסת ניסיון פנימית מוקדמת" של MiMo-V2-Pro, מודל של טריליון פרמטרים עם חלון הקשר של עד מיליון טוקנים, שנועד לשמש "מוח" לסוכני בינה מלאכותית. לפי צוות MiMo, כפי שדיווחה Reuters, עד אז עבר בו יותר מטריליון טוקנים, והוא הגיע לראש טבלאות OpenRouter.
"אני קוראת לזה מארב שקט, לא כי תכננו אותו, אלא כי המעבר מצ'ט לסוכנים קרה כל כך מהר שאפילו אנחנו בקושי האמנו", כתבה לואו פולי ברשת X. מניית שיאומי בהונג קונג עלתה אחרי החשיפה בעד 5.8%. ליי ג'ון סיפר שמפתחים בעולם כתבו שלמודל יש "IQ גבוה וגם EQ גבוה", ושהוא מבצע משימות מהר ובדיוק.
V2.5 ו-V2.6: פתוח, רב-מודלי ובנוי לסוכנים
ב-27 באפריל 2026 שחררה שיאומי את סדרת MiMo-V2.5 בקוד פתוח, ברישיון MIT, שמתיר שימוש מסחרי, המשך אימון וכוונון בלי אישור נוסף. היא כללה שני מודלים עם חלון הקשר של מיליון טוקנים: MiMo-V2.5-Pro, לסוכנים ולתכנות מורכב, ו-MiMo-V2.5. לפי שיאומי, V2.5-Pro דורג ראשון מבין המודלים הפתוחים בטבלאות הדירוג GDPVal-AA ו-ClawEval. לצד השחרור הודיעה החברה על חלוקה של 100 טריליון טוקנים ליוצרים במשך 30 יום, כתמריץ.
ב-22 בספטמבר 2026 הוכרזה סדרת MiMo-V2.6, שוב ברישיון MIT. לפי כרטיסי המודלים, MiMo-V2.6-Pro כולל 1.02 טריליון פרמטרים, מתוכם 42 מיליארד פעילים, ו-MiMo-V2.6-Flash כולל 309 מיליארד, מתוכם 15 מיליארד פעילים. שניהם מקבלים טקסט, תמונות, וידאו ושמע, עם חלון הקשר של מיליון טוקנים. הצוות מתאר שיטה שכינה "You Only RL Once": ריצת אימון אחת בלמידת חיזוק שמערבבת תכנות, סוכנים, משימות חזותיות ואבטחת סייבר, במקום ריצה נפרדת לכל תחום. לפי Caixin, הסדרה פותחה במחזור של חמישה חודשים.
מה המספרים אומרים, ומי מדד
רוב המספרים על V2.6 מגיעים משיאומי עצמה. בטבלה שבכרטיס המודל, V2.6-Pro השיג 53.1 במבחן AutomationBench, מעט מעל 50.3 של Claude Opus 5, והשתווה לו עם 31.6 במבחן Agents' Last Exam. באותה טבלה הוא מפגר בבירור במבחנים אחרים: 34.9 מול 49.0 של Opus 5 ב-Terminal Bench 4.0, ו-47.9 מול 78.5 של GPT-5.6 Sol במבחן ExploitBench.
בדף של Artificial Analysis, כפי שנבדק ב-4 באוקטובר 2026, V2.6-Pro מקבל 46 במדד האינטליגנציה של החברה, הרבה מעל החציון של 19 בקרב מודלים פתוחים בגודל דומה. באותו דף הוא מתואר גם כאיטי במיוחד: 39.9 טוקנים בשנייה דרך הממשק של שיאומי. לפי SiliconANGLE, שיאומי מציגה את הציון כגבוה מזה של Kimi K3 ו-Qwen3.8 Max, אבל המודל עדיין מתחת למודלים הסגורים המובילים כמו Claude Fable 5.1 ו-GPT-6 Astra. היתרון הבולט הוא המחיר: ב-OpenRouter עולה Flash 14 סנט למיליון טוקנים בקלט ו-28 סנט בפלט, ו-Pro 43.5 סנט ו-87 סנט. נכון לאוקטובר 2026, סדרת V2.6 היא העדכנית במשפחה.
📬 הגיליון השבועי של Wiki-AI
פעם בשבוע, ביום ראשון: שלושת הדברים החשובים שקרו בעולם הבינה המלאכותית, בעברית פשוטה, וערכים חדשים באנציקלופדיה. לגיליונות
| MiMo-7B (2025) | MiMo-V2-Flash (2025) | MiMo-V2.6-Pro (2026) | |
|---|---|---|---|
| גודל | 7 מיליארד פרמטרים | 309 מיליארד פרמטרים, מתוכם 15 מיליארד פעילים | 1.02 טריליון פרמטרים, מתוכם 42 מיליארד פעילים |
| מה מבין | טקסט | טקסט | טקסט, תמונות, וידאו ושמע |
| מיועד ל | חשיבה במתמטיקה ובקוד | חשיבה מהירה ומשימות של סוכנים | סוכנים, תכנות ומשימות ארוכות |
שאלות נפוצות ❓
האם המודלים של MiMo פתוחים?
רבים מהם כן. MiMo-7B, MiMo-V2-Flash וסדרות V2.5 ו-V2.6 פורסמו במשקלים פתוחים, ו-V2.5 ו-V2.6 ברישיון MIT, שמתיר שימוש מסחרי, המשך אימון וכוונון בלי אישור נוסף. לפי ויקיפדיה, MiMo-V2-Pro, שהוצג במרץ 2026, לא שוחרר במשקלים פתוחים.
מה היה Hunter Alpha?
מודל שהופיע ב-OpenRouter ב-11 במרץ 2026 בלי שם מפתח, ורבים חשבו שהוא של DeepSeek. ב-18 במרץ חשפה שיאומי שזו גרסת ניסיון פנימית מוקדמת של MiMo-V2-Pro.
מה ההבדל בין Pro ל-Flash?
Pro הוא מודל הדגל הגדול: ב-V2.6 יש בו 1.02 טריליון פרמטרים, מתוכם 42 מיליארד פעילים. Flash קטן וזול יותר, עם 309 מיליארד פרמטרים, מתוכם 15 מיליארד פעילים, ומחירו ב-OpenRouter נמוך יותר.
מי עומד מאחורי MiMo?
צוות MiMo של שיאומי, בהובלת לואו פולי, שעבדה קודם ב-DeepSeek. במרץ 2026 הודיע מנכ"ל שיאומי ליי ג'ון על השקעה של לפחות 60 מיליארד יואן בבינה מלאכותית בשלוש השנים הבאות.