שני דגמים: עוזר לנציג או בוט מול הלקוח
בשירות לקוחות משמשת הבינה המלאכותית בשתי צורות עיקריות. בראשונה היא עוזרת לנציג אנושי במהלך העבודה, והנציג הוא שמשיב ללקוח. זה הכלי שנבדק במחקר של אריק בריניולפסון, דניאל לי ולינדזי ריימונד, שבחן עוזר שיחה מבוסס בינה מלאכותית יוצרת אצל 5,179 נציגי תמיכה. בצורה השנייה הבוט עונה ללקוח ישירות, כמו העוזר של חברת Klarna, שפועל על בסיס טכנולוגיה של OpenAI ושעליו דיווחה החברה בפברואר 2024, כשהלקוח עדיין יכול לבקש נציג אנושי. ההבדל מהותי: בדגם הראשון יש אדם בין המודל ללקוח, ובשני התשובה מגיעה אל הלקוח בלי שאדם ראה אותה.
מה נמדד במחקר בלתי תלוי
המחקר של בריניולפסון ועמיתיו, שפורסם כנייר עבודה של NBER באפריל 2023 ועודכן בנובמבר 2023, בחן כניסה הדרגתית של הכלי לעבודת הנציגים. הגישה לכלי העלתה את התפוקה, שנמדדה כמספר הפניות שנפתרו בשעה, ב-14% בממוצע, ובקרב נציגים חדשים ופחות מיומנים ב-34%, בעוד שעל נציגים מנוסים ומיומנים ההשפעה הייתה מזערית. החוקרים מצאו גם שיפור ברגשות שהביעו הלקוחות בשיחות ובשימור העובדים, ומציגים ראיות ראשוניות לכך שהכלי מעביר לנציגים חדשים את דרכי העבודה של הנציגים הטובים. זו מדידה של כלי אחד בחברה אחת, והיא עוסקת בדגם שבו נציג אנושי נשאר בתמונה.
טענות היצרן: המקרה של Klarna
בפברואר 2024, חודש אחרי ההשקה, פרסמה Klarna נתונים על העוזר שלה: 2.3 מיליון שיחות, שהן שני שלישים מצ'אטי השירות של החברה, עבודה ששווה לפי החברה לזו של 700 נציגים במשרה מלאה, שביעות רצון לקוחות דומה לזו של נציגים אנושיים, ירידה של 25% בפניות חוזרות, זמן טיפול של פחות משתי דקות לעומת 11 קודם לכן, ותמיכה ביותר מ-35 שפות. אלה נתונים שהחברה מסרה על עצמה ולא מדידה חיצונית. במאי 2025 דיווחה CNBC שמנכ"ל החברה, סבסטיאן סימיאטקובסקי, אמר בראיון ל-Bloomberg שהחברה תגייס שוב נציגי שירות אנושיים, והודה שהמעבר הגורף לשירות מבוסס בינה מלאכותית הוביל לאיכות עבודה נמוכה יותר.
מי אחראי למה שהבוט אומר
בפברואר 2024 הכריע בית הדין ליישוב סכסוכים אזרחיים של קולומביה הבריטית בקנדה בתביעה של ג'ייק מופאט (Jake Moffatt) נגד Air Canada. הצ'אטבוט באתר החברה כתב לו שאפשר להגיש בקשה להנחת אבל בדיעבד, תוך 90 יום, ובפועל ההנחה אינה חלה על נסיעה שכבר בוצעה, כפי שנכתב בעמוד אחר באתר. החברה טענה שאינה אחראית למידע שמסר הצ'אטבוט, וחבר בית הדין כריסטופר ריברס קבע שהצ'אטבוט הוא חלק מאתר החברה, שהחברה אחראית לכל המידע שבו ושהיא לא נקטה זהירות סבירה כדי לוודא את דיוקו. Air Canada חויבה לשלם למופאט 812 דולר. לפי CBC, זה נראה המקרה הראשון במאגר הפסיקה הקנדי שעוסק בעצה שגויה של צ'אטבוט.
עברית: למה זו לא עוד שפה ברשימה
מפתחי לוח ההשוואה הפתוח למודלי שפה בעברית, שהושק במאי 2024 בשיתוף דיקטה וגופים נוספים, מסבירים מדוע תמיכה בעברית אינה מובנת מאליה. העברית נחשבת לשפה דלת משאבים, והיא עשירה מורפולוגית: מילים נבנות משורשים ומתבניות, עם תחיליות וסופיות שמשנות את המשמעות, את הזמן או את המספר. לכן לאותו שורש יש צורות תקינות רבות, ושיטות פירוק הטקסט ליחידות (טוקניזציה) שתוכננו לשפות פשוטות יותר מורפולוגית אינן יעילות בה. לדבריהם, מודלים קיימים עלולים להתקשות בדקויות של השפה, ולכן נדרשים מבחנים ייעודיים לעברית. במילים אחרות, הופעת העברית ברשימת השפות של מוצר אינה מלמדת על איכות התשובות בה.
פרטיות, טעויות ותלות-יתר
מסגרת NIST לניהול סיכונים של בינה מלאכותית יוצרת (NIST AI 600-1, יולי 2024), שנועדה לשימוש וולונטרי, מונה כמה סיכונים שנוגעים ישירות לשירות לקוחות: קונפבולציה, כלומר תוכן שגוי שנאמר בביטחון; פגיעה בפרטיות בדרך של דליפה או חשיפה לא מורשית של מידע אישי; ונטייה של משתמשים לסמוך על המערכת יותר מדי. המסגרת מציינת גם שמערכות כאלה חשופות להזרקת פרומפט, כולל הזרקה עקיפה דרך מידע שהמערכת שולפת, ושחוקרים הדגימו בדרך זו גניבת מידע. המדדים שנזכרו כאן — פניות שנפתרו בשעה, פניות חוזרות, שביעות רצון — מודדים דברים שונים, ואף אחד מהם לבדו אינו מראה אם הבוט מסר ללקוח מידע נכון.