רונלד פישר (Ronald Fisher)

היסטוריה ואנשי מפתח

הגדרה

רונלד פישר היה סטטיסטיקאי וגנטיקאי בריטי, שפיתח ב-1936 שיטת-הפרדה ליניארית לסיווג נתונים ("ההפרדה-הליניארית של פישר") — שיטה שעודנה משמשת בסיס לשיטות-סיווג מודרניות בזיהוי-תבניות ובלמידת-מכונה.

רקע והשכלה

רונלד איילמר פישר נולד ב-17 בפברואר 1890 בפינצ'לי שבצפון-לונדון, ולמד מתמטיקה בקולג' גונוויל-אנד-קיז (Gonville and Caius) שבקיימברידג', שם סיים בהצטיינות ב-1912. בין 1919 ל-1933 עבד כסטטיסטיקאי בתחנת-הניסויים החקלאית של רות'מסטד (Rothamsted) שבאנגליה, שם ניתח את מאגר נתוני-היבולים העצום שנאסף באתר מאז שנות ה-1840. שם פרסם ב-1921 את המאמר ‘Studies in Crop Variation I’, שהציג לראשונה את שיטת ‘ניתוח-השונות’ (ANOVA), וב-1925 את ספרו המשפיע ‘Statistical Methods for Research Workers’, שקבע את סף-המובהקות הסטטיסטית המקובל של 0.05 — שניהם עדיין בשימוש נרחב במחקר המדעי.

ההפרדה הליניארית של פישר, 1936

ב-1936 פרסם פישר, בכתב-העת Annals of Eugenics, את המאמר ‘The Use of Multiple Measurements in Taxonomic Problems’. במאמר תיאר שיטה למציאת צירוף-ליניארי של כמה מדדים נמדדים, שמפריד בצורה הטובה ביותר בין שתי קבוצות או יותר — שיטה הידועה כיום כ‘ההפרדה-הליניארית של פישר’ (Fisher's Linear Discriminant). להמחשת השיטה השתמש פישר בקובץ-נתונים של 150 פרחי-איריס משלושה מינים שונים, שכל אחד מהם נמדד לפי ארבעה מאפיינים גיאומטריים של עלי-הכותרת והגביע — קובץ-הנתונים ‘Iris’, שהפך מאז לדוגמה קלאסית וחוזרת בהוראת סיווג וזיהוי-תבניות, ומשמש עד היום למבחני-בדיקה (benchmark) בסיסיים לאלגוריתמי למידת-מכונה חדשים.

מהבוטניקה לזיהוי-תבניות וללמידת-מכונה

שיטת-ההפרדה-הליניארית שתיאר פישר קדמה בעשרות שנים למחשבים דיגיטליים, אך נותרה רלוונטית מאוד: היא עומדת בבסיס משפחת שיטות-הסיווג הסטטיסטיות המודרניות (הפרדה ליניארית וריבועית כאחד), ומשמשת עד היום גם כשיטת-בסיס (baseline) להשוואה מול מסווגים מתוחכמים יותר כמו מכונת-הווקטורים-התומכים (SVM), וגם ישירות ביישומים כגון זיהוי-פנים מוקדם (בטכניקת ‘Fisherfaces’) וביואינפורמטיקה.

תרומות סטטיסטיות נוספות

מעבר להפרדה-הליניארית, פישר נחשב לאחד מעצבי הסטטיסטיקה המודרנית: פיתח את שיטת האמד-הרב-סבירות (Maximum Likelihood Estimation) ואת מושג ‘מידע-פישר’, ואת עקרונות תכנון-הניסויים בספרו ‘The Design of Experiments’ (1935), הכולל את ניסוי-המחשבה המפורסם ‘האישה שטועמת תה’. בין 1933 ל-1943 כיהן כפרופסור לאאוגניקה על-שם גולטון (Galton Professor of Eugenics) באוניברסיטת לונדון (UCL), ובין 1943 ל-1956 כיהן בקיימברידג' כפרופסור לגנטיקה.

מחלוקת: תפקידו בתנועת האאוגניקה

פישר כיהן בתפקידי-הנהגה בארגוני-אאוגניקה בבריטניה, והתנגד באופן פומבי להצהרת אונסק"ו מ-1950 בשאלת הגזע, בטענה שקבוצות-אוכלוסין נבדלות זו מזו ביכולתן המולדת להתפתחות אינטלקטואלית ורגשית. עמדותיו נותרו שנויות-במחלוקת עד היום, ומוסדות אחדים הסירו לאורך השנים אזכורים והנצחות על-שמו לאור פרשה זו — לצד מורשתו המדעית שנותרה יסודית לתחום הסטטיסטיקה.

שאלות נפוצות ❓

מה זו ההפרדה-הליניארית של פישר?

שיטה שפרסם רונלד פישר ב-1936 במאמר "The Use of Multiple Measurements in Taxonomic Problems", למציאת צירוף-ליניארי של כמה מדדים נמדדים שמפריד בצורה הטובה ביותר בין שתי קבוצות או יותר — שיטה שעודנה בסיס לשיטות-סיווג סטטיסטיות מודרניות.

למה השתמש פישר בפרחי איריס?

להמחשת השיטה השתמש פישר בקובץ-נתונים של 150 פרחי-איריס משלושה מינים, שנמדדו לפי ארבעה מאפיינים גיאומטריים — קובץ-הנתונים "Iris" שהפך מאז לדוגמה קלאסית בהוראת סיווג וזיהוי-תבניות, ומשמש עד היום למבחני-בדיקה בסיסיים לאלגוריתמים חדשים.

איך שיטת פישר קשורה ללמידת-מכונה של היום?

השיטה עומדת בבסיס משפחת שיטות-הסיווג הסטטיסטיות המודרניות, ומשמשת עד היום גם כשיטת-בסיס להשוואה מול מסווגים מתוחכמים יותר כמו מכונת-הווקטורים-התומכים, וגם ביישומים כמו זיהוי-פנים מוקדם (Fisherfaces) וביואינפורמטיקה.

האם יש היבטים שנויים-במחלוקת בקריירה של פישר?

כן — פישר כיהן בתפקידי-הנהגה בארגוני-אאוגניקה בבריטניה והתנגד פומבית להצהרת אונסק"ו מ-1950 בשאלת הגזע, בטענה שקבוצות-אוכלוסין נבדלות זו מזו ביכולתן המולדת להתפתחות אינטלקטואלית ורגשית; עמדותיו נותרו שנויות-במחלוקת עד היום, לצד מורשתו המדעית היסודית לתחום הסטטיסטיקה.