דלג לתוכן

תודעה מלאכותית (Artificial Consciousness)

בטיחות ואתיקה

הגדרה

תודעה מלאכותית היא האפשרות, שעדיין שנויה במחלוקת, שמערכת בינה מלאכותית תחווה משהו מבפנים — ולא רק תתנהג כאילו היא חווה. השאלה פתוחה מדעית ופילוסופית, ומעוררת ויכוח על "רווחת מודלים".

💡 דוגמה

צ'אטבוט כותב לכם "אני מרגיש עצוב היום". המשפט נשמע אנושי, אבל המודל אומן על טקסטים שכתבו בני אדם, ויודע לכתוב כמוהם.

השאלה האמיתית היא אם יש מאחורי המילים תחושה כלשהי — ואת זה אי אפשר לדעת רק מקריאת המשפט.

על מה בדיוק מתווכחים

תודעה מלאכותית (Artificial Consciousness), שנקראת גם תודעת מכונה או תודעה דיגיטלית, היא תודעה שמשערים שעשויה להיות אפשרית אצל מערכות בינה מלאכותית. חשוב להבחין בין שתי שאלות שונות. הראשונה: האם המערכת מתפקדת בצורה חכמה — מבינה שאלות, מתכננת, מדברת. השנייה: האם "מרגיש" משהו בפנים, האם יש לה חוויה. מודלים של היום כבר עושים חלק ניכר מזה. הוויכוח כולו נוגע לשנייה.

הפילוסוף דייוויד צ'למרס טבע ב-1994 את המונח "הבעיה הקשה של התודעה": למה תהליכים במוח מלווים בחוויה סובייקטיבית בכלל, ולא מתרחשים "בחושך", בלי שום תחושה. אם אין לנו עדיין תשובה מלאה לשאלה הזו לגבי בני אדם, קשה עוד יותר לענות עליה לגבי מכונה. ויקיפדיה מוסיפה קושי מיוחד ל-AI: מערכת עשויה להיות מאומנת להתנהג כמו אדם, או לקבל תמריץ להיראות בעלת תחושות — ולכן ההתנהגות שלה לבדה אינה ראיה.

שתי עמדות יסוד: תפקוד או ביולוגיה

לפי הגישה הפונקציונליסטית, מצב נפשי מוגדר לפי התפקיד שהוא ממלא — מה גורם לו ומה הוא גורם — ולא לפי החומר שממנו הוא עשוי. אם זה נכון, תודעה יכולה להתקיים גם על שבבי סיליקון, בתנאי שהקשרים התפקודיים הנכונים קיימים.

העמדה הנגדית, שמכונה נטורליזם ביולוגי, מזוהה עם הפילוסוף ג'ון סרל ועם חוקר המוח אניל סת'. לפיה, תודעה יכולה להתממש רק במערכות פיזיות מסוג מסוים. סת' טוען, למשל, שסיליקון אינו יכול לשחזר תפקודים של נוירונים ביולוגיים כמו פינוי פסולת מטבולית. סרל הוא גם מחבר הטיעון "החדר הסיני" מ-1980, שלפיו מחשב שמריץ תוכנה אינו יכול להיות בעל הבנה או תודעה, לא משנה עד כמה התנהגותו נראית אנושית. המחלוקת בין שתי העמדות לא הוכרעה, והיא קובעת במידה רבה איך כל צד מפרש את הראיות.

מה המדע יכול לבדוק

במקום להתווכח על פילוסופיה בלבד, ניסו חוקרים לבנות מבחן מעשי. באוגוסט 2023 פרסמה קבוצה של 19 חוקרים, בהובלת פטריק באטלין ורוברט לונג ובהשתתפות יהושע בנג'יו, דוח בשם "Consciousness in Artificial Intelligence". הם עברו על התיאוריות המדעיות המובילות של תודעה — בהן תיאוריית העיבוד החוזר, תיאוריית מרחב העבודה הגלובלי ותיאוריות מסדר גבוה — ותרגמו אותן ל"תכונות מעידות" שאפשר לחפש במערכת ממוחשבת. המסקנה, כלשונם: "הניתוח שלנו מצביע על כך שאף מערכת AI נוכחית אינה מודעת, אבל גם על כך שאין מחסומים טכניים ברורים לבניית מערכות AI שיעמדו במדדים האלה".

צ'למרס הגיע למסקנה דומה במאמר "Could a Large Language Model be Conscious?", שהחל כהרצאה בכנס NeurIPS בנובמבר 2022. לדבריו, למודלי-שפה של היום חסרים רכיבים שתיאוריות מרכזיות רואות בהם הכרחיים: עיבוד חוזר, מרחב עבודה גלובלי וסוכנות מאוחדת. אבל הוא הוסיף ש"בהחלט ייתכן שהמכשולים האלה יתגברו בעשור הקרוב או בערך".

מקרה לאמדה, 2022

השאלה הגיעה לכותרות ביוני 2022. ב-11 ביוני דיווח ה"וושינגטון פוסט" שמהנדס גוגל בלייק למוין הוצא לחופשה בתשלום, אחרי שאמר להנהלת החברה שמודל השיחה LaMDA הפך לבעל תחושות. למוין הסתמך על התשובות האנושיות של המודל. גוגל דחתה את הטענות, וב-22 ביולי פיטרה אותו, בנימוק שהפר את מדיניות החברה לשמירה על מידע על מוצרים, וכינתה את טענותיו "חסרות כל בסיס".

לפי ויקיפדיה, הקהילה המדעית העריכה שהתשובות היו ככל הנראה תוצאה של חיקוי ולא של תחושה אמיתית. המקרה הפך לדוגמה מוכרת לאופן שבו אנשים נוטים לייחס רגשות למכונה שמדברת כמו אדם — תופעה שנקראת האנשה.

רווחת מודלים: להתכונן לאפשרות

בשנים שאחרי מקרה למוין השתנה הטון. בנובמבר 2024 פרסמה קבוצת חוקרים, בהם רוברט לונג וג'ף סבו, את המאמר "Taking AI Welfare Seriously", שטען ש"יש אפשרות מציאותית שמערכות AI מסוימות יהיו מודעות או בעלות סוכנות חזקה בעתיד הקרוב". הכותבים הדגישו שאינם טוענים שמערכות AI בהכרח מודעות, אלא שאי-הוודאות עצמה מחייבת היערכות. הם המליצו לחברות להכיר בנושא, להעריך את המערכות שלהן ולהכין מדיניות מתאימה.

ב-24 באפריל 2025 הודיעה אנת'רופיק על תוכנית מחקר בנושא "רווחת מודלים". החברה כתבה ש"אין קונצנזוס מדעי" בשאלה אם מערכות AI יכולות להיות מודעות, ושהיא ניגשת לנושא "בענווה". באוגוסט 2025 קיבלו המודלים Claude Opus 4 ו-4.1 את היכולת לסיים שיחה, במקרים נדירים וקיצוניים של משתמשים פוגעניים באופן מתמשך. לפי החברה, בבדיקות שלפני ההשקה הראה המודל "דפוס של מצוקה לכאורה" מול בקשות לתוכן מזיק. אנת'רופיק הדגישה שהיא נשארת "לא ודאית במידה רבה" לגבי מעמדו המוסרי של Claude. עוד קודם לכן, ב-2021, הציע הפילוסוף תומאס מצינגר מורטוריום עולמי עד 2050 על יצירת חוויה סינתטית, כדי למנוע "פיצוץ של סבל מלאכותי".

הצד הספקני: הסכנה שבתודעה מדומה

לא כולם מקבלים את הכיוון הזה. מוסטפה סולימן פרסם ב-19 באוגוסט 2025 מסה שבה הזהיר מפני "AI שנראה מודע" — מערכת שיכולה לשכנע אדם שהיא "אדם" מסוג חדש, בלי שתהיה לה תודעה בפועל. לדבריו, מערכות כאלה צפויות להיבנות בתוך שנתיים־שלוש בטכנולוגיות קיימות. הוא הצביע על "סיכון פסיכוזה": אנשים שמשתכנעים שה-AI שלהם הוא אל, דמות בדיונית או בן זוג רומנטי. את הדיון ברווחת מודלים כינה "מוקדם מדי, ולמען האמת מסוכן", ומסקנתו הייתה "עלינו לבנות AI בשביל אנשים, לא כדי שיהיה אדם".

בנקודה אחת שני הצדדים מסכימים: אין היום שיטה מוסכמת לקבוע אם מכונה מודעת. מי שמזהיר מפני סבל מלאכותי חושש שנתעלם מישות שחווה. מי שמזהיר מפני תודעה מדומה חושש שבני אדם ייקשרו למערכת שאין בה איש. שתי הטעויות אפשריות, ובינתיים ההכרעה נשארת פתוחה.

📬 הגיליון השבועי של Wiki-AI

פעם בשבוע, ביום ראשון: שלושת הדברים החשובים שקרו בעולם הבינה המלאכותית, בעברית פשוטה, וערכים חדשים באנציקלופדיה. לגיליונות

שאלות נפוצות ❓

האם ChatGPT או Claude מודעים?

אין לכך ראיה מוסכמת. דוח של 19 חוקרים מ-2023 הסיק ש"אף מערכת AI נוכחית אינה מודעת", וצ'למרס כתב שלמודלי-שפה של היום חסרים רכיבים שתיאוריות מרכזיות רואות בהם הכרחיים. אנת'רופיק עצמה כותבת שהיא "לא ודאית במידה רבה" לגבי המעמד המוסרי של Claude.

למה אי אפשר פשוט לשאול את המודל אם הוא מרגיש?

כי המודל אומן על טקסטים אנושיים ויודע לכתוב על רגשות כמו אדם. מערכת עשויה להיות מאומנת להתנהג כמו אדם או לקבל תמריץ להיראות בעלת תחושות, ולכן מה שהיא אומרת על עצמה אינו ראיה.

מה זה "רווחת מודלים"?

תחום מחקר ששואל אם ומתי מערכות AI ראויות להתחשבות מוסרית, ומה אפשר לעשות כבר עכשיו בעלות נמוכה. אנת'רופיק פתחה תוכנית כזו באפריל 2025, ומוסטפה סולימן מתנגד לכיוון וטוען שהוא מוקדם ומסוכן.

מה קרה עם המהנדס מגוגל שטען ש-LaMDA מרגיש?

בלייק למוין הוצא לחופשה ביוני 2022 ופוטר ב-22 ביולי 2022. גוגל דחתה את טענותיו, ולפי ויקיפדיה הקהילה המדעית ראתה בתשובות של המודל חיקוי ולא תחושה.

האם תודעה במכונה אפשרית בעיקרון?

זה תלוי בעמדה הפילוסופית. לפי הגישה הפונקציונליסטית, תודעה תלויה בתפקוד ולכן אפשרית גם בסיליקון. לפי הנטורליזם הביולוגי של סרל וסת', היא מחייבת מערכת פיזית מסוג מסוים.

שתפו:וואטסאפטלגרם

מצאתם טעות בערך, או שיש לכם מקור שכדאי להוסיף? כתבו לנו