דלג לתוכן

Wan — משפחת מודלי הווידאו של Alibaba

תמונה, קול ווידאו

הגדרה

Wan היא משפחת מודלים של Alibaba ליצירת וידאו ותמונות. הגרסאות 2.1 ו-2.2 שוחררו ב-2025 כמשקלים פתוחים שכל אחד יכול להוריד ולהריץ, והגרסאות 2.6, 2.7 ו-3.0 מוצעות כשירות בענן של החברה.

💡 דוגמה

סטודנטית לקולנוע ברחובות מורידה את הדגם הקטן של Wan 2.1 ומריצה אותו על כרטיס המסך במחשב הביתי.

כך היא בודקת רעיון לשוט של חמש שניות לפני שהיא יוצאת לצלם אותו באמת.

מה זה Wan

Wan היא משפחת מודלים של Alibaba ליצירת וידאו, ובהמשך גם תמונות. לפי דף הפרויקט של Wan 2.1 ב-GitHub, המודלים יודעים ליצור וידאו מטקסט ומתמונה, לערוך וידאו, ליצור תמונות ולהוסיף לסרטון שמע. לפי הדוח הטכני שפרסמה החברה במרץ 2025, המודלים בנויים בגישת טרנספורמר-דיפוזיה. הערך הזה עוסק רק במשפחה הרשמית של Alibaba. מודלי השפה של החברה, משפחת Qwen, מתוארים בערך נפרד.

Wan 2.1: מודל וידאו פתוח (פברואר 2025)

ב-25 בפברואר 2025 פרסמה Alibaba את הקוד ואת המשקלים של Wan 2.1, בשני גדלים: 1.3 מיליארד ו-14 מיליארד פרמטרים. לפי מדידה של צוות הפרויקט, המודל הקטן צריך 8.19 ג'יגה-בייט של זיכרון בכרטיס המסך, ויצר סרטון של חמש שניות ברזולוציית 480p בכארבע דקות על כרטיס RTX 4090. הביצועים בפועל תלויים בחומרה ובהגדרות. החברה טענה שזה מודל הווידאו הראשון שיודע לכתוב בתוך הסרטון טקסט גם בסינית וגם באנגלית. המודלים שוחררו ברישיון Apache 2.0, ובדף הפרויקט נכתב שהמשתמש אחראי לשימוש שלו, ושאסור לו לשתף תוכן שמפר את החוק, פוגע באנשים או מפיץ מידע כוזב. ב-27 בפברואר 2025 שולב המודל בכלי הקוד הפתוח ComfyUI, וב-3 במרץ בספריית Diffusers של Hugging Face.

Wan 2.2: מומחים מרובים (יולי 2025)

ב-28 ביולי 2025 יצאה Wan 2.2, גם היא עם משקלים פתוחים. לפי דף הפרויקט, החידוש המרכזי הוא ארכיטקטורת מומחים מרובים (MoE): כמה "מומחים" שונים מטפלים בשלבים שונים של ניקוי הרעש שממנו נבנה הסרטון, ולדברי צוות הפרויקט, כך גדלה קיבולת המודל בלי שעלות החישוב תגדל. החברה ציינה שאימנה את 2.2 על 65.6% יותר תמונות ועל 83.2% יותר סרטונים מאשר את 2.1, ופרסמה גם מודל בגודל 5 מיליארד פרמטרים שמייצר סרטונים ב-720p בקצב של 24 פריימים לשנייה. לפי הוראות ההרצה, הוא פועל על כרטיס מסך עם 24 ג'יגה-בייט זיכרון לפחות, כמו RTX 4090. באוגוסט 2025 נוסף מודל שמייצר וידאו לפי הקלטת קול, ובספטמבר 2025 מודל להנפשת דמויות.

מ-2.6 ל-3.0: מעבר לענן

הגרסאות 2.6, 2.7 ו-3.0 מוצעות כשירות. ב-17 בדצמבר 2025 הציגה Alibaba את Wan 2.6. לדברי החברה, היא כוללת מודל שיוצר סרטון חדש לפי סרטון ייחוס של דמות ושומר על המראה ועל הקול שלה, עם סרטונים של עד 15 שניות. לפי הודעת החברה, הגישה למודלים היא דרך פלטפורמת הענן Model Studio ואתר Wan. באפריל 2026 יצאה Wan 2.7, ולדברי Alibaba היא כוללת ממשק לעסקים ועריכת וידאו בהוראות בשפה רגילה, כולל שינוי דיאלוג והתאמת תנועות השפתיים. באוגוסט 2026 הציגה Alibaba את Wan 3.0, תחילה כגרסת בטא. לפי Alibaba Cloud, כפי שדיווחה רויטרס, היא יוצרת סרטונים של עד 30 שניות, גם ממסמכים, מגיליונות, ממצגות ומדפי אינטרנט.

📬 הגיליון השבועי של Wiki-AI

פעם בשבוע, ביום ראשון: שלושת הדברים החשובים שקרו בעולם הבינה המלאכותית, בעברית פשוטה, וערכים חדשים באנציקלופדיה. לגיליונות

חמש גרסאות של Wan: מהקוד הפתוח לשירות בענן
גרסה 2.1גרסה 2.2גרסה 2.6גרסה 2.7גרסה 3.0
מתי יצאהפברואר 2025יולי 2025דצמבר 2025אפריל 2026אוגוסט 2026
איך משיגיםמשקלים פתוחים, רישיון Apache 2.0משקלים פתוחים, רישיון Apache 2.0שירות בענן ובאתר Wanשירות בענן וממשק לעסקיםשירות בענן
מה חדש לפי החברהמודל קטן שרץ על כרטיס מסך ביתיארכיטקטורת מומחים מרובים, מודל 720p בגודל 5 מיליארד פרמטריםוידאו לפי דמות-ייחוס עם מראה וקולעריכת וידאו בהוראות בשפה רגילהסרטונים של עד 30 שניות, גם ממסמכים

שאלות נפוצות ❓

האם Wan הוא קוד פתוח?

חלקית. הגרסאות 2.1 ו-2.2 שוחררו ב-2025 עם משקלים פתוחים ברישיון Apache 2.0. הגרסאות 2.6, 2.7 ו-3.0 מוצעות כשירות בענן של Alibaba.

אפשר להריץ את Wan על מחשב ביתי?

את הגרסאות הפתוחות כן, בתלות בחומרה. לפי מדידת צוות הפרויקט, המודל הקטן של 2.1 צריך 8.19 ג'יגה-בייט זיכרון בכרטיס המסך, ומודל 5 מיליארד הפרמטרים של 2.2 פועל, לפי הוראות ההרצה, על כרטיס עם 24 ג'יגה-בייט זיכרון לפחות.

מה ההבדל בין Wan ל-Qwen?

שתיהן משפחות מודלים של Alibaba. Qwen היא משפחת מודלי השפה של החברה, ו-Wan היא משפחת המודלים שלה ליצירת וידאו ותמונות.

מה חדש ב-Wan 3.0?

לפי Alibaba, הגרסה שהוצגה באוגוסט 2026 יוצרת סרטונים של עד 30 שניות, וגם ממסמכים, גיליונות, מצגות ודפי אינטרנט.

שתפו:וואטסאפטלגרם

מצאתם טעות בערך, או שיש לכם מקור שכדאי להוסיף? כתבו לנו