הזיה (Hallucination)

מודלים ושפה

הזיה (Hallucination) היא כשמודל AI מציג מידע שגוי, לא מדויק, או מומצא לחלוטין — בביטחון מלא ובאותו סגנון בדיוק כאילו היה מציג עובדה אמיתית ומאומתת. אין שום "סימן אזהרה" חזותי שמבדיל בין תשובה נכונה לתשובה מוזה — שתיהן נשמעות ונראות אותו הדבר.

זו לא "תקלה" נקודתית שאפשר פשוט לתקן ולסגור, אלא תוצאה ישירה מהאופן שבו מודלי שפה עובדים מיסודם: הם מייצרים בכל רגע את הרצף הסביר-ביותר סטטיסטית לפי מה שראו באימון — לא רצף שנבדק ואומת מול המציאות. הבעיה חריפה במיוחד בשאלות על פרטים ספציפיים וסתמיים-לכאורה — תאריכים מדויקים, ציטוטים, שמות — שבהם קל למודל "לנחש" ערך שנשמע משכנע, גם אם הוא שגוי.

טכניקות כמו RAG (חיפוש במקור חיצוני לפני מתן תשובה) מצמצמות משמעותית את התופעה, כי הן מעגנות את התשובה במקור בר-אימות — אבל אינן מבטלות אותה לגמרי, כי המודל עדיין יכול לפרש לא נכון גם מידע אמיתי שמצא. המסקנה המעשית: תמיד כדאי לבדוק עובדות קריטיות (רפואיות, משפטיות, פיננסיות) במקור עצמאי לפני הסתמכות עליהן.