Fernando Pereira — בלשן-חישובי, מהמובילים במעבר לעיבוד-שפה סטטיסטי

היסטוריה ואנשי מפתח

הגדרה

פרננדו פררה הוא בלשן-חישובי פורטוגלי-אמריקאי, מהדמויות-המפתח בעיבוד-שפה-טבעית — ממציא-שותף של דקדוקי-הפסוקים-המוגדרים (DCG, 1980) ושל תיאוריית "צוואר-הבקבוק המידעי" (1999), ולשעבר בכיר-מחקר באוניברסיטת פנסילבניה, AT&T Labs וגוגל.

פרננדו פררה הוא בלשן-חישובי ומדען-מחשב יליד פורטוגל. במהלך הקריירה שלו עבד באוניברסיטת פנסילבניה (בה שימש חבר-סגל למדעי-המחשב), ב-SRI International, ב-AT&T Labs Research, ולבסוף בגוגל, שבה שימש שנים רבות בתפקידי-מחקר בכירים בתחומי עיבוד-שפה-טבעית ולמידת-מכונה.

ב-1980, יחד עם דיוויד וורן, פיתח פררה את "דקדוקי-הפסוקים-המוגדרים" (Definite Clause Grammars, DCG) — פורמליזם לתיאור דקדוק-שפה-טבעית בשפת-התכנות Prolog, שהתבסס על עבודה מוקדמת יותר של אלן קולמרואר (יוצר Prolog) על "דקדוקי-מטמורפוזה". ה-DCG הפכו לכלי נפוץ בבלשנות-חישובית מוקדמת ובעיבוד-שפה מבוסס-לוגיקה.

ב-1999 ניסחו פררה, נפתלי תשבי וויליאם ביאלק יחד את תיאוריית "צוואר-הבקבוק המידעי" (information bottleneck) — עקרון מתמטי לתיאור האופן שבו מערכת-למידה "סוחטת" מתוך קלט רועש רק את המידע הרלוונטי למשימה נתונה. התיאוריה, שפורסמה תחילה בכנס אלרטון ולאחר מכן כפרה-פרינט מורחב, הפכה מאוחר יותר לאחת המסגרות המשפיעות ביותר בניסיון להסביר מדוע רשתות-למידה-עמוקה מכלילות היטב.

לאורך הקריירה שלו פרסם פררה עשרות מאמרים משפיעים בתחומי הפירוק-התחבירי (parsing), מודלים סטטיסטיים לעיבוד-שפה, ואוטומטים-משוקללים-סופיים (weighted finite-state automata) ליישומי-דיבור ושפה — ונחשב לאחת הדמויות המשפיעות ביותר בדור המעבר מבלשנות-חישובית מבוססת-כללים לגישות סטטיסטיות ולמידת-מכונה בתחום.