אפרטוס (Apertus)
הגדרה
אפרטוס הוא מודל שפה פתוח לגמרי שפיתחו מוסדות מחקר ציבוריים בשווייץ ושוחרר ב-2025: לצד המשקלים פורסמו גם נתוני האימון, הקוד והתיעוד, והוא אומן על טקסט ביותר מאלף שפות.
💡 דוגמה
חברת תוכנה בהרצליה מוכרת מערכת לבנקים באירופה, והלקוח שואל על מה בדיוק אומן המודל שבפנים.
עם אפרטוס אפשר להראות לו את נתוני האימון ואת הקוד עצמם, ולא רק הצהרה של הספק.
מה זה אפרטוס, ומה פירוש "פתוח לגמרי"
אפרטוס הוא מודל שפה גדול ששחררו ב-2 בספטמבר 2025 שלושה גופים ציבוריים בשווייץ: המכון הטכנולוגי הפדרלי של לוזאן (EPFL), המכון הטכנולוגי הפדרלי של ציריך (ETH Zurich) והמרכז הלאומי השווייצרי למחשוב-על (CSCS). בהודעה לעיתונות הם הציגו אותו כמודל השפה הפתוח, הרב-לשוני והגדול הראשון של שווייץ. השם הוא המילה הלטינית ל"פתוח", והוא מסמן את מה שמייחד את המודל: לפי המפתחים, כל תהליך הפיתוח, כולל הארכיטקטורה, המשקלים, נתוני האימון ושיטות האימון, פתוח לציבור ומתועד במלואו.
זה ההבדל בין מודל קוד פתוח מלא לבין מודל במשקלים פתוחים. במודל כמו Llama של Meta או Qwen של עליבאבא אפשר להוריד את המשקלים ולהריץ אותם, אבל לא בהכרח לדעת על מה בדיוק אומנו. אתר החדשות השווייצרי swissinfo.ch מונה את אפרטוס ואת OLMo כדוגמאות לקבוצה הראשונה, המצומצמת יותר. המודל פורסם בשני גדלים, 8 מיליארד ו-70 מיליארד פרמטרים, והקטן מביניהם מתאים יותר לשימוש אישי.
איך הוא אומן: 15 טריליון טוקנים ויותר מאלף שפות
לפי ההודעה לעיתונות, אפרטוס אומן על 15 טריליון טוקנים ביותר מאלף שפות, ו-40% מהנתונים אינם באנגלית. בין השפות יש כאלה שכמעט אינן מיוצגות במודלים אחרים, כמו גרמנית שווייצרית ורומאנש. המאמר הטכני של הצוות מדבר על יותר מ-1,800 שפות, וכרטיס המודל מונה 1,811 שפות שהמודל תומך בהן.
האימון נעשה במחשב-העל Alps של CSCS. לפי ההודעה, פיתוח המודל והמחקר על מודלי יסוד נוספים ממומנים בהשקעה של יותר מ-10 מיליון שעות עבודה של מעבדים גרפיים במחשב הזה. כדי שהמודל לא ישנן קטעים מנתוני האימון ויחזיר אותם מילה במילה, השתמש הצוות בשיטת אימון בשם Goldfish, שלפי המאמר מצמצמת מאוד שליפה מילולית של נתונים בלי לפגוע בביצועים במשימות.
ציות לחוק כחלק מהתכנון
המפתחים מציגים את הציות לחוק כעיקרון, לא כתוספת. לפי ההודעה לעיתונות, המודל פותח בהתחשב בחוקי הגנת הפרטיות וזכויות היוצרים של שווייץ ובחובות השקיפות של חוק הבינה המלאכותית האירופי. נתוני האימון לקוחים רק ממידע שזמין לציבור, והם סוננו כדי לכבד בקשות של אתרים שלא לאסוף את התוכן שלהם, גם בדיעבד, וכדי להסיר מידע אישי ותוכן לא רצוי לפני תחילת האימון.
לצד המודל פורסמו קוד ההכנה של הנתונים, נקודות ביניים מהאימון, כלי ההערכה וקוד האימון, כך שחוקרים אחרים יכולים לבדוק ולשחזר כל שלב. לפי המאמר, בגדלים האלה אפרטוס מתקרב לתוצאות הטובות ביותר מבין המודלים הפתוחים לגמרי במבחנים רב-לשוניים, ומשתווה למודלים במשקלים פתוחים או עוקף אותם. זו הערכה של המפתחים עצמם. בכרטיס של הגרסה הראשונה צוין גם שבשלב השחרור עוד לא סופק מסנן שמסיר מידע אישי מהפלט.
אפרטוס 1.5: תמונות, חשיבה והקשר ארוך
ב-24 ביולי 2026 יצא אפרטוס 1.5, שוב בגדלים של 8 ו-70 מיליארד פרמטרים. זה לא מודל חדש מאפס אלא המשך אימון של הגרסה הראשונה: לפי הצוות נוספו 4 טריליון טוקנים של טקסט ושל נתונים רב-מודליים לדגם הקטן, ו-2 טריליון לדגם הגדול. המודל מבין עכשיו גם תמונות, כמו מסמכים, תרשימים ותצלומים, ויכול לעבד גם דיבור, אם כי היכולת הזו מוגדרת עדיין ניסיונית. נוסף לו מצב חשיבה שאפשר להפעיל לפי הצורך, וחלון ההקשר גדל ל-262,144 טוקנים, פי ארבעה מאשר בגרסה 1.0, לפי הצוות. לפי ההודעה, הוא גם ממלא הוראות טוב יותר ומשתמש טוב יותר בכלים חיצוניים.
ב-17 בספטמבר 2026 הוכרזה זמינות כללית של הגרסה, דרך שורה של ספקים, ביניהם Swisscom, Infomaniak ו-Public AI, ועם הוראות הפעלה בעננים של אמזון, מיקרוסופט וגוגל. המשקלים משוחררים ברישיון Apache 2.0 לצד מדיניות שימוש מקובל, ובאתר Hugging Face צריך לאשר את התנאים ולמסור פרטי קשר לפני ההורדה. נכון לאוקטובר 2026, אפרטוס 1.5 היא הגרסה העדכנית, ומפת הדרכים של הצוות מציינת את אפרטוס 2.0, מודל גדול בסדר גודל מהגרסה הנוכחית, ל-2027.
מי משתמש בו בפועל
שנה אחרי ההשקה, לפי swissinfo.ch, המודל עבר ארבעה מיליון הורדות ב-Hugging Face, והצוות מתאר אותו כמודל האירופי שהורד הכי הרבה באתר. אבל הורדה איננה שימוש. אולג לברובסקי, שמוביל את הקהילה סביב אפרטוס, אמר שהוא מכיר לפחות 70 התקנות חיצוניות ויותר ממאה גרסאות נגזרות של המודל. אחת מהן היא של SEA-LION, פרויקט של AI Singapore לשפות של דרום-מזרח אסיה. ליסלי טאו מ-AI Singapore הסביר שבחרו באפרטוס כי זה "אחד המודלים הבודדים בעולם שהם באמת קוד פתוח".
לפי אותה כתבה, הקנטון טיצ'ינו החליט לעבור לאפרטוס בתרגום אוטומטי של מסמכים מנהליים, והמשרד הקנטונלי להגירה, שמטפל במסמכים אישיים בשפות רבות, נהנה מכך יותר מכולם. חברת Artificialy מלוגאנו מספרת שהיא מעדיפה לעיתים קרובות את אפרטוס במשימות תרגום ללקוחות, במיוחד כשמדובר בארבע השפות הרשמיות של שווייץ או במסמכים רגישים. ביוני 2026 הציג EPFL גם את MeditronFO, מסגרת פתוחה לבניית מודלים רפואיים, שמבוססת בין היתר על אפרטוס.
הביקורת: המחיר של פתיחות מלאה
התגובות הראשונות היו קשות. כמה שבועות אחרי ההשקה כינו אותו חלק מהמשתמשים "לא שמיש". לפי swissinfo.ch, הפער נראה גם בטבלאות שפרסם הצוות עצמו: הדגם המקורי והגדול, של 70 מיליארד פרמטרים, נשאר הרחק מאחורי מודלים במשקלים פתוחים בגודל דומה, במיוחד בתכנות, במתמטיקה ובחשיבה. גרסה 1.5 צמצמה את הפער אבל לא סגרה אותו. Artificialy מעריכה שביכולות של סוכנים הוא עדיין לא ברמה של מודלים פתוחים אחרים, וסוכנות הדיגיטל Liip מציריך, שבדקה אותו בכלי חיפוש לתושבי העיר, מצאה שהוא מפגר אחרי מודלים מסחריים בנאמנות למקורות, כלומר בשאלה אם כל חלק בתשובה נשען על המידע שבידיו. פדריקו מגנולפי מ-Artificialy העריך שבהשקה הוא היה בפיגור של כשנתיים אחרי המודלים האמריקאיים הטובים ביותר.
לפי המשתמשים עצמם, חלק מהפער נובע מהבחירה בפתיחות. דמיאנו בינאגי מ-Artificialy אומר שאפרטוס נשען על נתונים ציבוריים שאפשר לאמת, בעוד מפתחים מסחריים משתמשים לעיתים קרובות בנתונים ברישיון או בנתונים שלא נחשפו. "להיות קוד פתוח באמת פירושו שכנראה לא תשתמש בחלק מהנתונים, ולזה יש השלכות על הביצועים ועל היכולות הכלליות", אמר טאו. לברובסקי מדגיש שאפרטוס לא נועד להתחרות ב-ChatGPT: זה בסיס שחברות, מוסדות וחוקרים יכולים להתאים לצרכים שלהם, לא מוצר מסחרי גמור.
📬 הגיליון השבועי של Wiki-AI
פעם בשבוע, ביום ראשון: שלושת הדברים החשובים שקרו בעולם הבינה המלאכותית, בעברית פשוטה, וערכים חדשים באנציקלופדיה. לגיליונות
| אפרטוס 1.0 (ספטמבר 2025) | אפרטוס 1.5 (יולי 2026) | |
|---|---|---|
| גדלים | 8 ו-70 מיליארד פרמטרים | 8 ו-70 מיליארד פרמטרים |
| אימון | 15 טריליון טוקנים | המשך אימון: עוד 4 טריליון טוקנים לדגם הקטן ו-2 טריליון לגדול |
| חלון הקשר | 65,536 טוקנים | 262,144 טוקנים |
| מה מבין | טקסט | טקסט ותמונות, ודיבור באופן ניסיוני |
| מצב חשיבה | אין | אפשר להפעיל לפי הצורך |
| רישיון | רישיון Apache 2.0 ומדיניות שימוש מקובל | רישיון Apache 2.0 ומדיניות שימוש מקובל |
שאלות נפוצות ❓
מה ההבדל בין אפרטוס למודלים כמו Llama או Qwen?
Llama ו-Qwen משוחררים במשקלים פתוחים: אפשר להוריד ולהריץ אותם, אבל נתוני האימון וקוד האימון לא פורסמו במלואם. באפרטוס פורסמו גם הנתונים, הקוד, נקודות הביניים מהאימון והתיעוד, כך שאפשר לבדוק ולשחזר את כל התהליך.
מותר להשתמש בו בעסק?
כן. המשקלים משוחררים ברישיון Apache 2.0, שמתיר גם שימוש מסחרי, לצד מדיניות שימוש מקובל. כדי להוריד את גרסה 1.5 מ-Hugging Face צריך לאשר את התנאים ולמסור פרטי קשר.
אפשר להריץ אותו במחשב אישי?
את הדגם הקטן, של 8 מיליארד פרמטרים, הצוות מתאר כמתאים להרבה מחשבים ניידים ותחנות עבודה. הדגם של 70 מיליארד פרמטרים מיועד לשרתים.
מה חדש בגרסה 1.5?
היא יצאה ב-24 ביולי 2026 והוסיפה הבנת תמונות, הבנת דיבור ניסיונית, מצב חשיבה שאפשר להפעיל, חלון הקשר של 262,144 טוקנים ושימוש טוב יותר בכלים.