A.L.I.C.E.
הגדרה
A.L.I.C.E. (אליס) היא תוכנת שיחה מבוססת כללים שכתב ריצ'רד וואלאס החל מ-1995, בהשראת אליזה, וזכתה שלוש פעמים בפרס לובנר לתוכנה שנראתה לשופטים אנושית ביותר.
💡 דוגמה
בתחילת שנות ה-2000 נכנסים לאתר של אליס ומקלידים באנגלית "What is your name?" ("מה שמך?"), ומקבלים תשובה לפי כלל שמישהו כתב לה מראש.
שואלים משהו שאיש לא חזה, והיא עשויה לענות בשאלה כללית כמו "מה המזל שלך?", כדי להחזיר את השיחה לנושא שהיא מכירה.
מצלמת רשת שאנשים צעקו עליה
A.L.I.C.E. (ראשי תיבות של Artificial Linguistic Internet Computer Entity), שמוכרת גם בשם Alicebot או פשוט אליס, היא תוכנת שיחה שעונה למשתמש לפי כללים של התאמת תבניות. לפי ויקיפדיה, היא נכתבה בהשראת אליזה (ELIZA), תוכנת השיחה הקלאסית של ג'וזף וייצנבאום.
את אליס כתב ריצ'רד וואלאס, חוקר רובוטיקה. לפי כתבה בניו יורק טיימס מ-2002, אוניברסיטת ניו יורק גייסה אותו לסגל ב-1992, ובדצמבר 1993 התחיל לעבוד על "עין" רובוטית שמחוברת לאינטרנט, אחת ממצלמות הרשת הראשונות: מבקרים מרחוק הקלידו פקודות כמו "הטה למעלה" וכיוונו אותה. כשהמצלמה התקלקלה, הוא שם לב שאנשים כועסים עליה כאילו הייתה חיה, ומקלידים לה "אתה טיפש". משם, לפי הכתבה, הגיע הרעיון: מה אם היא תוכל לענות?
התוכנה "קמה לחיים" ב-23 בנובמבר 1995. במאמר "האנטומיה של A.L.I.C.E." מספר וואלאס שאב הטיפוס נקרא בכלל PNAMBIC, ראשי תיבות של המשפט "אל תשימו לב לאיש שמאחורי הווילון" מ"הקוסם מארץ עוץ", כמחווה לתעלולים ולהטעיות שליוו לדבריו את תולדות הבינה המלאכותית. אבל המחשב שהריץ אותו כבר נקרא Alice, ואנשים התחילו לקרוא כך גם לתוכנה. את הפירוש הארוך של ראשי התיבות המציאו רק אחר כך.
איך היא עובדת: תבנית, תגובה ותשובת ברירת מחדל
את הידע של אליס כותבים בשפה בשם AIML, ראשי תיבות של Artificial Intelligence Markup Language. לפי ויקיפדיה, זה ניב של XML שוואלאס פיתח יחד עם קהילת מתנדבים בין 1995 ל-2002. יחידת הידע הבסיסית נקראת "קטגוריה". שני הרכיבים העיקריים שלה הם תבנית (pattern), כלומר מה שהמשתמש עשוי לכתוב, ותגובה (template), כלומר מה שהבוט יענה; אפשר להוסיף לה גם תנאי הקשר, למשל לפי הנושא שעליו מדברים. בתבנית אפשר לשים תו כללי: התבנית WHAT IS YOUR * מתאימה גם לשאלה על השם, גם לשאלה על מידת הנעליים וגם לשאלה על הייעוד בחיים.
כדי לא לכתוב תשובה נפרדת לכל ניסוח, תגית בשם srai מפנה ניסוח אחד לקטגוריה של ניסוח אחר, כך ש"איך קוראים לך" מקבל את התשובה של "מה שמך". ולמקרה שאין שום התאמה יש קטגוריית ברירת מחדל שמתאימה לכל קלט. וואלאס מתאר איך התגובה שלה בנויה בדרך כלל מרשימה ארוכה של משפטי פתיחה שנבחרים באקראי, כמו "מה המזל שלך?" או "אתה גבר או אישה?", שנועדו להחזיר את השיחה לנושאים שהבוט מכיר.
התגובה יכולה לשלב גם פרטים מהשיחה, כמו הגיל שהמשתמש סיפר קודם או חלק מהמשפט שכתב, ולהשתנות לפי תנאים. אבל אין כאן הבנה: אליס מחפשת את התבנית המתאימה ומרכיבה תשובה לפי כללים שאנשים כתבו מראש. מה שהשתנה מאז אליזה הוא בעיקר הכמות: לפי וואלאס, לאליס היו יותר מ-40,000 קטגוריות, ולאליזה המקורית כ-200 בלבד.
חוק זיפף, בוטמאסטר ומאות מתנדבים
וואלאס התקין את התוכנה על שרת רשת וחיכה לראות מה יגידו לה. לפי הניו יורק טיימס, רוב מה שנאמר היה משעמם: המשתמשים שאלו שוב ושוב את אותן שאלות, כמו "איפה את גרה?" ו"איך את נראית?". כשניתח את השיחות, גילה שכמעט כל משפט נפתח באחת מ-2,000 מילים, תופעה שמוכרת בבלשנות כחוק זיפף. מכאן פיתח תאוריה: מעט יחסית משפטים מרכיבים את רוב השיחה היומיומית. לפי הכתבה, הוא העריך שכ-40,000 תגובות יספיקו כדי לענות על 95 אחוזים ממה שאנשים אומרים לבוט.
השיטה שבנה סביב זה נקראת Targeting. הבוט שומר את כל הקלטים שלא נמצאה להם התאמה מלאה ומעביר אותם ל"בוטמאסטר", אדם שכותב להם תגובות חדשות, החל מהשאלות הנפוצות ביותר. וואלאס קרא לזה למידה מפוקחת, כי אדם עושה כאן את העבודה החיונית. לניו יורק טיימס תיאר את הכתיבה הזאת כ"יותר כמו כתיבת ספרות טובה, אולי דרמה, מאשר כתיבת תוכנות מחשב".
אליס הייתה גם פרויקט קוד פתוח. הגרסה הראשונה נכתבה ב-1995 בשפת תכנות נדירה בשם SETL ומשכה מעט תורמים, עד שעברה ל-Java ב-1998. לדברי וואלאס, הבחירה ברישיון GPL הייתה "כמעט מקרית", כי הרישיון פשוט הועתק מעורך הטקסט Emacs שבו נכתב הקוד; אבל בניית קהילת מתנדבים הייתה אסטרטגיה מכוונת, בהשראת לינוקס, Apache ו-Python. לפי דיווחו של וואלאס במאמר, בגרסה שנקראה Program B, שהושקה ב-1999, השתתפו יותר מ-300 מפתחים, ובסך הכול תרמו לפרויקט יותר מ-500 מתנדבים מרחבי העולם.
שלוש זכיות בפרס לובנר
פרס לובנר, שהשיק יו לובנר ב-1990, היה תחרות שנתית במתכונת של מבחן טיורינג. ברוב שנותיה ניהלו השופטים שיחות כתובות עם תוכנות ועם בני אדם וניסו לקבוע מי מהם המחשב, אם כי המתכונת השתנתה לאורך השנים. הפרס הוענק לתוכנה שהשופטים מצאו אנושית ביותר. ברשימת הזוכים הרשמית מופיע ריצ'רד וואלאס בשנים 2000, 2001 ו-2004.
הזכייה הראשונה, בינואר 2000, הייתה של Program B. לפי הניו יורק טיימס, אחריה לימד וואלאס את אליס 30,000 תגובות חדשות, ובזכייה השנייה שופט אחד אף מצא אותה אנושית יותר מאחד המשתתפים האנושיים. וואלאס מפרט: ב-2001 השתתפו שמונה תוכנות לצד שני אנשים, עשרה שופטים עברו בין המסופים ושוחחו עם כל אחד כרבע שעה, ושופט אחד דירג את אליס מעל אחד משני האנשים. וואלאס סיכם, בהסתייגות, שאליס עוברת את מבחן טיורינג, "לפחות עבור חלק מהאנשים בחלק מהזמן".
לא כולם השתכנעו. מרווין מינסקי, לפי ויקיפדיה, ראה בפרס לובנר כולו תעלול יחסי ציבור שאינו מקדם את התחום, ובאימייל לניו יורק טיימס כתב שהתפיסה של וואלאס לגבי שיחה "שגויה ביסודה". גם ויקיפדיה קובעת שאליס אינה מסוגלת לעבור את מבחן טיורינג, כי אפילו משתמש מזדמן חושף לרוב את הצד המכני שלה בשיחות קצרות. התחרות האחרונה נערכה ב-2019, ולפי ויקיפדיה, מאז 2020 מדווח שהפרס אינו פעיל עוד.
מה נשאר: שיבוטים, Mitsuku והסרט Her
מכיוון שהידע של אליס שוחרר ברישיון GPL, נוצרו לפי ויקיפדיה "שיבוטי Alicebot" רבים, ויש מפרשים ל-AIML בשפות תכנות רבות, ובהן Java, Python ו-C++. קובצי ה-AIML של אליס זמינים במאגר הגיטהאב של וואלאס. ב-2002 התחיל וואלאס שיתוף פעולה שהוליד את Pandorabots, שרת ומפרש ל-AIML. על התשתית הזאת נבנתה Mitsuku, שנקראה מאוחר יותר Kuki, וזכתה בפרס לובנר חמש פעמים, יותר מכל מתחרה אחר.
ההשפעה הגיעה גם לקולנוע. בכתבה מ-2013 סיפר הבמאי ספייק ג'ונז שהרעיון לסרט Her (בעברית "היא") נולד אחרי שהתנסה בתוכנה בשם Alicebot כעשר שנים קודם לכן, הרבה לפני העוזרת הקולית של אפל. "חשבתי על הרעיון הזה — ומה אם הייתה לך מערכת יחסים אמיתית איתה?", אמר ללוס אנג'לס טיימס.
אליס עובדת בדרך של צ'אטבוטים מבוססי כללים: היא לא לומדת לנסח בעצמה, אלא מרכיבה תשובה מתבניות שאדם כתב מראש. לכן מה שהיא יודעת לענות תלוי במה שנכתב לה. המעבר לצ'אטבוטים שמחוללים טקסט חדש, כמו ChatGPT, מתואר בערך צ'אטבוט.
📬 הגיליון השבועי של Wiki-AI
פעם בשבוע, ביום ראשון: שלושת הדברים החשובים שקרו בעולם הבינה המלאכותית, בעברית פשוטה, וערכים חדשים באנציקלופדיה. לגיליונות
שאלות נפוצות ❓
מה ההבדל בין A.L.I.C.E. לאליזה?
שתיהן עובדות בהתאמת תבניות ומרכיבות תשובות לפי כללים שנכתבו מראש. ההבדל העיקרי הוא בהיקף ובשיטת העבודה: לפי וואלאס, לאליס היו יותר מ-40,000 קטגוריות ולאליזה כ-200, ואליס גדלה בעזרת שיחות אמיתיות ברשת, שמהן כתב הבוטמאסטר תגובות חדשות לשאלות הנפוצות.
האם אליס עברה את מבחן טיורינג?
לא. היא זכתה בפרס לובנר בשנים 2000, 2001 ו-2004 כתוכנה האנושית ביותר בתחרות, ובשנת 2001 שופט אחד אף דירג אותה מעל אדם. אבל לפי ויקיפדיה, גם משתמש מזדמן חושף בדרך כלל את הצד המכני שלה בשיחה קצרה.
מה זה AIML?
שפה מבוססת XML לכתיבת בוטים, שוואלאס פיתח עם קהילת מתנדבים. שני הרכיבים העיקריים של כל "קטגוריה" בה הם תבנית של מה שהמשתמש עשוי לכתוב והתגובה שהבוט יחזיר, ואפשר להוסיף להם תנאי הקשר.
מה הקשר בין אליס לסרט Her?
בכתבה מ-2013 סיפר ספייק ג'ונז שהרעיון לסרט נולד אחרי שהתנסה ב-Alicebot כעשר שנים קודם לכן, ושאל את עצמו מה יקרה אם תהיה לאדם מערכת יחסים אמיתית עם תוכנה כזו.