כנס חדש לגמרי: ההכרזה ב-2023
COLM (Conference on Language Modeling — שם-הכנס עצמו מבוטא, לפי מייסדו, "collum") הוא כנס-מחקר אקדמי חדש שהוקדש במפורש למודלי-שפה — לא כנס-למידת-מכונה כללי עם מסלול-שפה, אלא כנס שכל-כולו בנושא הזה. הכנס הוכרז לראשונה באוקטובר 2023 על-ידי סשה ראש (Sasha Rush), חוקר-NLP מאוניברסיטת קורנל-טק (Cornell Tech), שמשמש נשיא-הכנס ומייסדו. דני ג'ואו (Denny Zhou) מ-Google DeepMind, שהצטרף כיושב-ראש-הכנס לצד יג'ין צ'וי (Yejin Choi), כינה אותו בהכרזה הפומבית "כנס חדש שמוקדש למודלי-שפה עבור כולם". באתר-הכנס עצמו מנוסחת ההצדקה להקמתו: הקפיצה ביכולות-הכלליות של מודלי-שפה היא ציון-דרך בהתפתחות הבינה המלאכותית, ואופי-הטכנולוגיה הזו יצר מערך שאלות-מחקר שונה מזה שבו מתמקדים בדרך-כלל הזירות הקשורות. המטרה המוצהרת היא ליצור קהילת-חוקרים ממגוון תחומים, שמתמקדת בהבנה, שיפור וביקורת של התפתחות טכנולוגיית מודלי-השפה.
הכנס הראשון: פילדלפיה, אוקטובר 2024
הכנס הראשון בפועל, COLM 2024, התקיים ב-7–9 באוקטובר 2024 באוניברסיטת פנסילבניה שבפילדלפיה, באולם התיאטרון Zellerbach שבמרכז Annenberg — אירוע תלת-יומי במתכונת מסלול-יחיד (single-track), שכלל הרצאות-מוזמנות, הצגות-מאמרים בעל-פה ומושבי-פוסטרים. יושבי-ראש-התוכנית היו דיפנג'אן דאס (Dipanjan Das), דאנצ'י צ'ן (Danqi Chen, פרינסטון), יואב ארצי (Yoav Artzi, קורנל-טק) ואנג'לה פאן (Angela Fan, Meta). לכנס הוגשו 1,036 מאמרים, מהם התקבלו 299 — שיעור-קבלה של 28.86% — במתכונת ארכיבית (archival), כלומר המאמרים המתקבלים נחשבים לפרסום מדעי מלא, לא רק להצגה בכנס. בין ארבעת פרסי-המאמר-המצטיין של המהדורה הראשונה נמנה גם המאמר שהציג את ארכיטקטורת Mamba.
צמיחה מהירה: מונטריאול 2025, סן-פרנסיסקו 2026
לפי סשה ראש, ההרשמה ל-COLM 2024 התמלאה עד תום, וכנס 2025 תוכנן מראש להיות גדול פי שניים ממנו. המהדורה השנייה, COLM 2025, התקיימה במרכז הכנסים Palais des Congrès במונטריאול שבקנדה ב-7–10 באוקטובר 2025, בהיקף גדול משמעותית מזה של מהדורת-הבכורה — סשה ראש עצמו כתב שהמהדורה הוזמנה להיות "גדולה פי שניים" מקודמתה. המהדורה השלישית, COLM 2026, מתוכננת למלון Hilton בסן-פרנסיסקו ב-6–9 באוקטובר 2026. הקצב הזה — מכנס-בכורה של כ-1,000 הגשות לכנס בין-לאומי שהוכפל בגודלו בתוך שנה אחת בלבד — משקף ביקוש של ממש לזירה נפרדת למחקר מודלי-שפה, לא ניסוי חד-פעמי. הגיבוי המוסדי הגיע מהר גם מהתעשייה: כבר במהדורתו השנייה, ב-2025, שימשה Amazon כ'ספונסרית-יהלום' (Diamond sponsor) של הכנס, לצד חברות נוספות שהציגו דוכני-גיוס והדגמות-מוצר במקביל למושבי-המחקר — סימן לכך שהתעשייה מתייחסת ל-COLM כזירה מבוססת ולא כניסוי חד-פעמי.
ההקשר: למה כנס נפרד, כשכבר יש NeurIPS ו-ICML
הכנסים הכלליים של למידת-מכונה — NeurIPS (נוסד 1987) ו-ICML (נוסד 1980) — ממשיכים לגדול בקצב שממחיש את סוג-הבעיה ש-COLM נותן לה מענה, גם אם הוא לא הוצג רשמית כתגובה-ישירה אליהם: הגשות ל-NeurIPS גדלו מ-9,467 ב-2020 ל-21,575 ב-2025, וצוות-יושבי-הראש של הכנס כתב בפומבי, בסיכום תהליך-הביקורת של 2025, שההיקף הזה מקשה על שמירת מומחיות נושאית על-פני תחומי-מחקר מגוונים והולכים — ובפרט בתחומים מתפתחים כמו מודלי-שפה גדולים. חשוב לדייק: זהו תיאור-הקשר מאוחר יותר (2025), לא הצהרה מייסדת של COLM עצמו מ-2023 — הכנס ניסח את הצדקתו-שלו סביב מערך שאלות-מחקר שונה, לא סביב עומס-הגשות במפורש. מחקר אקדמי שבחן מאמרים הקשורים למודלי-יסוד (foundation models) בשמונה כנסי-למידת-מכונה מובילים בין 2022 ל-2024 כלל את COLM לצד NeurIPS, ICLR, ICML וגם הכנסים הממוקדים-בלשנות-חישובית ACL, EMNLP, EACL ו-NAACL — סימן לכך ש-COLM כבר נחשב, תוך שנה מהקמתו, לזירת-פרסום מרכזית ולא רק לניסוי צעיר בשולי המפה.
היקף-הנושאים: מיישור-מודלים ועד רובוטיקה מגולמת
קריאת-המאמרים (Call for Papers) של COLM 2024 הגדירה 17 אשכולות-נושא — מה שממחיש עד כמה 'מודלי-שפה' הפך שם-כולל לתחום רחב בפני עצמו, לא נישה צרה: יישור-מודלים (Alignment — כוונון-הנחיות, RLHF), נתוני-אימון וסינתטיים, שיטות-הערכה ואמות-מידה, השלכות חברתיות, בטיחות ועמידות-בפני-תקיפות, 'מדע מודלי-השפה' (חוקי-קנה-מידה, פרשנות), יעילות-חישובית, הנדסת-אימון מבוזרת, אלגוריתמי-למידה, אלגוריתמי-היסק, פרספקטיבות בלשניות ופילוסופיות, מודלים רב-לשוניים, עובדתיות, מודלים מגולמים (embodied) ורובוטיקה, מודלים אינטראקטיביים ורב-סוכניים, שילוב עם כלים וקוד, ומודליות מגוונות. הביקורת מתבצעת בעיוורון-כפול (double-blind) דרך פלטפורמת OpenReview, ומגבלת-האורך למאמר עומדת על תשעה עמודי-טקסט-עיקרי, ללא הגבלה על אורך רשימת-המקורות.