ארתור סמואל (Arthur Samuel)

היסטוריה ואנשי מפתח

הגדרה

ארתור סמואל היה מדען-מחשב אמריקאי שטבע ב-1959 את המונח "למידת מכונה" (Machine Learning), ופיתח ב-IBM את תוכנת-הדמקה שלו — אחת מתוכניות-הלמידה-העצמית הראשונות שנבנו אי-פעם.

מי היה ארתור סמואל

סמואל נולד ב-5 בדצמבר 1901 באמפוריה שבקנזס, למד בקולג' אמפוריה (סיים ב-1923) והשלים תואר שני בהנדסת-חשמל ב-MIT (1926), שם גם לימד כמדריך עד 1928. בין 1928 ל-1946 עבד בבל לאבס (Bell Labs), עסק בפיתוח שפופרות-ואקום ותרם לשיפור מכ"ם בזמן מלחמת-העולם השנייה, ובהם שפופרת ה-TR למיתוג-אנטנות. ב-1946 עבר לאוניברסיטת אילינוי באורבנה-שמפיין כפרופסור להנדסת-חשמל, ושם יזם את פרויקט ILLIAC, אחד ממחשבי-האוניברסיטה המוקדמים בארה"ב.

תוכנית-הדמקה על IBM 701 וההדגמה הטלוויזיונית של 1956

ב-1949 עבר סמואל ל-IBM בפוקיפסי שבמדינת ניו יורק, ושם החל ב-1952 לפתח תוכנת-דמקה עבור ה-IBM 701 — המחשב המסחרי הראשון של החברה. הגרסה הראשונה שכללה יכולת-למידה הושלמה ב-1955, וב-24 בפברואר 1956 הודגמה התוכנית בשידור-טלוויזיה חי, כשסמואל, אז בן 54, שיחק נגד המחשב מול מצלמות. נשיא IBM דאז, תומאס ווטסון חזה מראש שההדגמה "תעלה את מניית החברה ב-15 נקודות" — וכך אכן קרה, בין-לילה.

"כמה מחקרים בלמידת מכונה", 1959 — לידת המונח

ב-1959 פרסם סמואל בכתב-העת IBM Journal of Research and Development את המאמר "Some Studies in Machine Learning Using the Game of Checkers" (כמה מחקרים בלמידת מכונה באמצעות משחק הדמקה), ובו טבע לראשונה בכתב את הצירוף "Machine Learning" (למידת מכונה). התוכנית שתיאר שילבה "למידה-בעל-פה" (rote learning) — שמירת כל מצב-לוח שכבר נראה יחד עם ערך-התגמול הסופי שלו — עם אלגוריתם מיני-מקס לבחירת מהלכים, ועם גיזום אלפא-בטא (alpha-beta pruning) כדי להתמודד עם מגבלות-הזיכרון הקשות של המחשבים דאז.

המשחק המפורסם נגד רוברט נילי, 1962

ב-1962 ארגן סמואל משחק-הדגמה מול רוברט נילי, שחקן-דמקה עיוור מקונטיקט שחומרי-הפרסום של IBM תיארו כ"אלוף-קונטיקט-לשעבר, אחד השחקנים המובילים במדינה" — התוכנית ניצחה את המשחק, ותוצאה זו פורסמה בהרחבה כהוכחה לעליונות-מחשב במשחק-אסטרטגיה. בדיקה מאוחרת שערך צוות-המחקר צ'ינוק באוניברסיטת אלברטה גילתה שנילי כלל לא היה עדיין אלוף-קונטיקט באותו שלב — הוא זכה בתואר רק ב-1966 — ושהפסדו נבע מטעות-מהלך בודדת; במשחק-חוזר בן שישה משחקים ב-1963 ניצח נילי בהכרעה, ניצחון אחד וחמישה תיקו. ב-1966, כשעימתו את התוכנית מול וולטר הלמן — אלוף-העולם המכהן — ומול דרק אולדברי, ארבעה משחקים מול כל אחד, היא הפסידה בכל שמונת המשחקים, בקלות יחסית. עם זאת, המשחק מ-1962 נותר אבן-דרך תודעתית בהיסטוריה של למידת-מכונה, גם אם תדמיתו הוגזמה בדיעבד.

סטנפורד, פרסים ומורשת

ב-1966 עבר סמואל לאוניברסיטת סטנפורד, שם המשיך לחקור למידת-מכונה ותרם גם לעבודת-התיעוד של מערכת הדפוס TeX שפיתח דונלד קנות'. זכה בפרס-החלוצים-של-המחשוב (Computer Pioneer Award) ב-1987, על עבודתו בעיבוד מסתגל לא-מספרי, וב-1990 נבחר לעמית-מייסד של איגוד AAAI (האיגוד לקידום הבינה המלאכותית). נפטר ב-29 ביולי 1990 בסטנפורד, קליפורניה, בגיל 88, מסיבוכי מחלת-פרקינסון. המונח שטבע — "למידת מכונה" — הפך מאז לשם הגישה המרכזית בבניית מערכות בינה-מלאכותית מודרניות.

שאלות נפוצות ❓

מתי ואיפה טבע סמואל את המונח "למידת מכונה"?

ב-1959, במאמרו "Some Studies in Machine Learning Using the Game of Checkers" שפרסם בכתב-העת IBM Journal of Research and Development, בהקשר של תוכנית-הדמקה שפיתח ב-IBM.

מה גרם למניית IBM לעלות בעקבות תוכנית-הדמקה?

הדגמת-הטלוויזיה החיה של התוכנית ב-24 בפברואר 1956, אחרי שנשיא IBM דאז, תומאס ווטסון חזה מראש שהיא "תעלה את מניית החברה ב-15 נקודות" — תחזית שהתממשה בין-לילה.

האם רוברט נילי, שהתוכנית ניצחה ב-1962, היה באמת אלוף?

לא באותו זמן. חומרי-הפרסום של IBM תיארו אותו כ"אלוף-קונטיקט-לשעבר", אך בדיקה מאוחרת של צוות-המחקר צ'ינוק מצאה שהוא זכה בתואר-האלוף רק ב-1966, ארבע שנים אחרי המשחק, ושתבוסתו לתוכנה נבעה מטעות-מהלך בודדת.

אילו שיטות שילבה תוכנית-הדמקה של סמואל?

"למידה-בעל-פה" (rote learning) — שמירת מצבי-לוח שכבר נראו יחד עם ערכי-התגמול שלהם — לצד אלגוריתם מיני-מקס לבחירת מהלכים וגיזום אלפא-בטא כדי להתמודד עם מגבלות-הזיכרון של מחשבי אותה תקופה.