דלג לתוכן

בטיחות ואתיקה

השאלות שמעבר ל"איך זה עובד" — האם אפשר לסמוך על מערכת AI, למי היא עלולה להזיק, ואיך מגנים מפני שימוש לרעה.

מה תמצאו כאן תשובה עליו

אם מודל למד מכל מה שכתוב באינטרנט, האם הוא ירש משם גם דעות קדומות — ואיך אפשר בכלל לגלות את זה?

מי מחליט מה מודל מסרב לענות עליו, ואיך בודקים שההגבלות האלה באמת מחזיקות?

כמה באמת צריך לדאוג, ומה ההבדל בין נזק שכבר קורה היום לבין תרחיש עתידי רחוק?

מה קורה למידע שאני מקליד בצ'אט או שהמכשיר הצמוד לגוף שלי אוסף — מי רואה אותו ולכמה זמן הוא נשמר?

מה ההבדל בין חוק שמחייב חברות בינה מלאכותית לבין תקן שהן בוחרות לאמץ מרצון?

מאיפה מתחילים

  1. הטיה אלגוריתמית (Bias) אם תקראו רק אחדהטיה אלגוריתמית (Bias) היא כשמודל AI משקף בתשובותיו דעות קדומות שהוא "ירש" מהנתונים העצומים שעליהם אומן — בלי כוונה מצד מי שבנה אותו.
  2. יישור (Alignment)יישור (Alignment) הוא התחום שעוסק בלוודא שמודל AI פועל בהתאם לכוונות וערכים אנושיים, ולא רק "עונה נכון" מבחינה טכנית.
  3. מעקות בטיחות (Guardrails)מעקות בטיחות (Guardrails) הם כללים והגבלות שמוטמעים במודל AI כדי למנוע ממנו לספק תוכן מזיק, מסוכן או בלתי הולם.
עוד על הקטגוריה הזו

הקטגוריה מכסה מונחים מתחום בטיחות ה-AI (כמו הטיה אלגוריתמית שמשקפת הטיות קיימות בנתוני-האימון), פרטיות (מה בדיוק AI "יודע" עלינו ואיך זה נשמר), ואתיקה (מי אחראי כשמערכת AI טועה, ואילו שימושים נחשבים בעייתיים גם כשהטכנולוגיה עצמה כשירה). זו לא קטגוריה תיאורטית בלבד: רוב המונחים כאן קשורים ישירות להחלטות מעשיות שחברות, ממשלות ומשתמשים בודדים כבר צריכים לקבל היום — מהאם לסמוך על תשובה של צ'אטבוט בעניין רפואי ועד לשאלה איך לזהות תוכן מזויף. הכתיבה כאן מכוונת במיוחד להישאר מאוזנת: לא להפחיד יתר על המידה ולא להמעיט בסיכונים אמיתיים, אלא להסביר מה בדיוק הבעיה הטכנית או החברתית שכל מונח מתאר, כדי שהקורא יוכל לגבש דעה מבוססת בעצמו. חלק מהמונחים כאן — כמו רגולציית AI או שקיפות אלגוריתמית — נמצאים עדיין בשלב מוקדם יחסית של דיון ציבורי ומשפטי, ולכן חשוב לקרוא אותם כתיאור של מצב מתפתח ולא כתשובה סופית וקבועה.

מה לא נמצא כאן

כאן נמצאים הנזק האפשרי, מי נפגע ממנו והאמצעים שנועדו למנוע אותו. תקיפה טכנית שמכוונת למודל עצמו, כמו הזרקת פרומפט, מתוארת במודלים ושפה; הטכניקה שמאפשרת לזייף וידאו או קול נמצאת בתמונה, קול ווידאו, וכאן נמצא רק הנזק שהיא מאפשרת; והנוכחות הציבורית של הטכנולוגיה שייכת ל-AI בחברה.

81 מונחים בקטגוריה זו, מסודרים לפי א״ב

ט

אנגלית / ראשי-תיבות

  • COMPASכלי הערכת-סיכון-פלילי; 137 שאלות, אין שאלה ישירה על גזע
  • Gender Shadesמחקר-הטיה בזיהוי-פנים: 34.7% בנשים כהות, 0.8% בגברים בהירים
📋 קריטריונים לבחירת הערכים בקטגוריה זו

נכנס לכאן מונח שעוסק בנזק אפשרי, במי שנפגע ממנו ובדרכים למנוע אותו — הטיה, יישור, פרטיות, פיקוח אנושי, רגולציה ושימוש לרעה. הסף: בעיה או אמצעי-הגנה שיש להם שם מוכר ודיון ציבורי או מקצועי מאחוריהם, לא דעה של הכותב. תקיפה טכנית ברמת המודל עצמו, כמו הזרקת פרומפט, מובאת במודלים ושפה; הנוכחות התרבותית של AI בקולנוע, בתקשורת ובפוליטיקה שייכת ל-AI בחברה. החלוקה הזו בין המודל לחברה היא שיקול-דעת שלנו ולא גבול חד, וחלק מהמונחים כאן — במיוחד הרגולטוריים — מתארים מצב משפטי שעדיין משתנה.