דלג לתוכן

בינה מלאכותית בוויקיפדיה

AI בחברה

הגדרה

השימוש בבינה מלאכותית בוויקיפדיה ובשאר מיזמי ויקימדיה, והוויכוח סביבו: מבוטים שמזהים השחתות, דרך איסור על ערכים שנכתבו בצ'אטבוט, ועד זחלני AI שמעמיסים על השרתים.

💡 דוגמה

פותחים ערך בוויקיפדיה ונתקלים בניסוח כמו "ציון דרך משמעותי" או "יופי עוצר נשימה" בלי שום מקור — עורכים מתנדבים רואים בניסוח כזה סימן אפשרי לטקסט שנכתב בצ'אטבוט.

ובוויקיפדיה האנגלית, מי שמדביק בעורך החזותי טקסט שנושא סימני זיהוי של צ'אטבוט עשוי לקבל הודעת אזהרה.

המקור שממנו המודלים למדו

ויקיפדיה היא מהאתרים הנצפים בעולם: לפי קרן ויקימדיה, בינואר 2026 היא הייתה בין עשרת האתרים המבוקרים ביותר, והקוראים צפו ביותר מ-65 מיליון ערכים שלה, ביותר מ-300 שפות, כמעט 15 מיליארד פעמים בחודש. לפי ויקיפדיה, נכון ל-2023 נחשבו חלקים ממנה לאחד ממאגרי הטקסט המסודרים הגדולים ביותר לאימון בינה מלאכותית. הרישיון של ויקיפדיה מתיר לכל אחד להשתמש בתוכן ולעבד אותו, בכפוף לתנאיו — ובהם מתן קרדיט ושיתוף בתנאים זהים; לפי ויקיפדיה, קרן ויקימדיה ותומכיה מודאגים מכך שמודלים כמו ChatGPT ועוזרים כמו סירי ואלקסה משתמשים בתוכן בלי לציין שהגיע משם. הערך עוסק בשני הכיוונים: איך כלי בינה מלאכותית משמשים בתוך ויקיפדיה, ואיך עולם הבינה המלאכותית משתמש בוויקיפדיה.

בוטים ולמידת מכונה עוד לפני ChatGPT

בינה מלאכותית אינה חדשה בוויקיפדיה. לפי ויקיפדיה, בוטים מורשים לפעול בה מאז 2002, בתנאי שאושרו ושאדם מפקח עליהם. המאבק בהשחתות היה תחום מרכזי: ClueBot משנת 2007 הסתמך על כללים פשוטים, ויורשו ClueBot NG משנת 2010 משתמש ברשת נוירונים מלאכותית. בסוף 2015 הושק ORES, שירות בינה מלאכותית שמדרג את איכותן של עריכות. בוויקיפדיה העברית, לפי טיוטת ההנחיות בנושא, ORES רק מסמן עריכות חשודות בדף השינויים האחרונים ואינו משחזר אותן בעצמו; שחזור, אזהרה או חסימה נשארים בידי עורכים מנוסים. גם תרגום מכונה משמש עורכים כבר שנים.

גל הצ'אטבוטים: טקסט שנשמע נכון

אחרי השקת ChatGPT בסוף 2022 התחילו עורכים לנסות לכתוב בעזרתו ערכים, ולפי ויקיפדיה התעורר ויכוח, בין השאר בגלל הנטייה של מודלי שפה לייצר מידע שגוי שנשמע אמין, כולל מקורות מומצאים. מחקר של חוקרים מפרינסטון, שפורסם באוקטובר 2024, בדק ערכים שנוצרו באוגוסט 2024 בעזרת שני כלים לזיהוי טקסט מכונה, GPTZero ו-Binoculars. בסף שכויל כך שרק 1% מהערכים מלפני GPT-3.5 יסומנו בטעות, הכלים סימנו יותר מ-5% מהערכים החדשים בוויקיפדיה האנגלית כנוצרים בבינה מלאכותית, ושיעור נמוך יותר בגרמנית, בצרפתית ובאיטלקית. הערכים שסומנו היו לרוב באיכות נמוכה יותר, ולעיתים קרובות קידמו את עצמם או צד אחד במחלוקת. כבר ב-2023 הקימו עורכים את מיזם AI Cleanup לניקוי תוכן כזה, והמיזם ניסח מדריך ל"סימנים של כתיבת AI". המדריך מזהיר שלא להסתמך רק על גלאים אוטומטיים, שיש להם שיעורי שגיאה לא זניחים, ומפרט הרגלי כתיבה שעשויים להצדיק בדיקה נוספת, ובהם הדגשה כללית של חשיבות הנושא ושפה שיווקית שבה כל נוף "עוצר נשימה". בוויקיפדיה העברית יש דף מקביל, עם ביטויים כמו "ציון דרך משמעותי" ו"יופי עוצר נשימה".

הקרן: AI בשירות העורכים, לא במקומם

ב-30 באפריל 2025 פרסמה קרן ויקימדיה אסטרטגיית AI. "לא מזמן שאלו אותנו מתי נחליף את הידע שבני אדם אוצרים בוויקיפדיה בבינה מלאכותית. התשובה? לא נחליף", כתבו כריס אלבון ולילה זיא מהקרן. לפי המסמך, הקרן תשתמש ב-AI כדי לחסוך לעורכים משימות מייגעות, לתרגם ולהתאים נושאים נפוצים בין שפות ולעזור בקליטת מתנדבים חדשים, ותעדיף מודלים בקוד פתוח או במשקלים פתוחים. ביוני 2025 החלה הקרן ניסוי של תקצירי AI בראש ערכים, למשתמשים שהתקינו תוסף דפדפן ובחרו להשתתף, עם תווית צהובה של "לא מאומת". עורכים מחו כמעט מיד, מחשש שטעויות של המודל יפגעו באמינות האתר, ולפי TechCrunch הניסוי הושהה עוד באותו חודש. הקרן ציינה שהיא עדיין מעוניינת בתקצירים כאלה, למשל לשיפור הנגישות.

הקהילה מחמירה

באוגוסט 2025, לפי ויקיפדיה, אימצה הקהילה בוויקיפדיה האנגלית כלל שמאפשר מחיקה מהירה של דפים שנוצרו באופן מובהק במודל שפה ועומדים בסימנים שהוגדרו. במרץ 2026 היא הלכה רחוק יותר: לפי TechCrunch, נקבע ש"השימוש במודלי שפה גדולים כדי לייצר או לשכתב תוכן של ערכים אסור", וההחלטה התקבלה, לפי TechCrunch שהסתמך על 404 Media, ברוב של 40 מול 2. עדיין מותר לבקש ממודל הצעות הגהה לטקסט שהעורך כתב בעצמו ולשלב אותן אחרי בדיקה אנושית, כל עוד המודל לא מוסיף תוכן משלו; לפי ויקיפדיה, הוחרג גם תרגום מכונה מוויקיפדיה בשפה אחרת. ב-24 בספטמבר 2026 הופעל בוויקיפדיה האנגלית כלי בשם LLM Paste Check: מי שמדביק בעורך החזותי קטע טקסט באורך מינימלי שנושא סימני זיהוי של צ'אטבוטים כמו Gemini, Claude, ChatGPT, Copilot ו-DeepSeek מקבל הסבר ונדרש להחליט אם להשאיר אותו. לפי התוכנית, הכלי אמור לעלות ב-8 באוקטובר 2026 בכל מהדורות ויקיפדיה. בוויקיפדיה העברית יש טיוטת מדיניות, לא מדיניות רשמית, שקובעת ש"אין לפרסם תוכן שנוצר על־ידי בינה מלאכותית בלי לעבור עליו, לבדוק אותו ואת אמיתותו", וממליץ — "כל עוד לא הוגדרו כללים רשמיים" — להצהיר על השימוש בתקציר העריכה.

זחלנים, ירידה בתנועה ועסקאות

הלחץ מגיע גם מבחוץ. באפריל 2025 דיווחה קרן ויקימדיה שמאז ינואר 2024 גדל ב-50% רוחב הפס שמשמש להורדת תמונות ומדיה, ושהגידול מגיע בעיקר מתוכנות שסורקות את מאגר התמונות של ויקישיתוף כדי להזין מודלי AI; לפי הקרן, לפחות 65% מהתעבורה עתירת המשאבים שנמדדה במרכזי הנתונים שלה הגיעה מבוטים. באוקטובר 2025 דיווחה הקרן על ירידה של בערך 8% בצפיות של בני אדם בחודשים האחרונים, לעומת אותם חודשים ב-2024, אחרי שעדכון של מערכות זיהוי הבוטים הראה שחלק ניכר מהתנועה הגבוהה במאי וביוני הגיע מבוטים שנבנו לחמוק מזיהוי. מרשל מילר מהקרן ייחס את הירידה למנועי חיפוש שעונים בעצמם בעזרת AI ולדור צעיר שמחפש מידע בסרטונים ברשתות; גוגל, לפי TechCrunch, חלקה על הטענה שתקצירי AI מקטינים את התנועה. בנובמבר 2025 קראה הקרן לחברות AI לתת קרדיט לוויקיפדיה ולגשת לתוכן דרך Wikimedia Enterprise, המוצר בתשלום שלה, במקום לסרוק את האתר. ב-15 בינואר 2026, במסגרת חגיגות 25 שנה לוויקיפדיה, חשפה הקרן שבשנה שחלפה הצטרפו כלקוחות של המוצר אמזון, מטא, מיקרוסופט, Mistral AI ו-Perplexity, לצד גוגל, שהשותפות איתה הוכרזה ב-2022.

📬 הגיליון השבועי של Wiki-AI

פעם בשבוע, ביום ראשון: שלושת הדברים החשובים שקרו בעולם הבינה המלאכותית, בעברית פשוטה, וערכים חדשים באנציקלופדיה. לגיליונות

שאלות נפוצות ❓

האם מותר לכתוב ערך בוויקיפדיה בעזרת ChatGPT?

בוויקיפדיה האנגלית, מאז מרץ 2026, אסור להשתמש במודלי שפה כדי לייצר או לשכתב תוכן של ערכים; מותר לבקש הצעות הגהה לטקסט שכתבתם בעצמכם ולבדוק אותן, ולהיעזר בתרגום מוויקיפדיה בשפה אחרת לפי ההנחיות. בוויקיפדיה העברית, טיוטת המדיניות מדגישה שיש לבדוק כל טקסט כזה ואת אמיתותו, וממליצה לציין את השימוש בתקציר העריכה.

איך עורכי ויקיפדיה מזהים טקסט שנכתב בבינה מלאכותית?

העורכים נעזרים בסימני כתיבה — הדגשה כללית של חשיבות הנושא, שפה שיווקית — ובבדיקה שהמקורות באמת תומכים בטקסט; סימן סגנוני לבדו אינו הוכחה. יש לכך מדריכים בוויקיפדיה האנגלית ובעברית, ומספטמבר 2026 בוויקיפדיה האנגלית גם אזהרה אוטומטית כשמדביקים בעורך החזותי טקסט שנושא סימני זיהוי של צ'אטבוט.

למה ויקיפדיה מודאגת מחברות ה-AI?

בגלל עלויות ותנועה: באפריל 2025 דיווחה הקרן שלפחות 65% מהתעבורה עתירת המשאבים שלה הגיעה מבוטים, ובאוקטובר 2025 — על ירידה של בערך 8% בצפיות של בני אדם. ב-2025 קראה הקרן לחברות AI לתת קרדיט ולהשתמש ב-Wikimedia Enterprise לשימוש מסחרי רחב היקף.

האם ויקיפדיה עצמה משתמשת בבינה מלאכותית?

כן, כבר שנים: ClueBot NG מזהה השחתות בעזרת רשת נוירונים מאז 2010, ו-ORES מדרג עריכות מאז 2015. ניסוי תקצירי AI מיוני 2025 הושהה אחרי מחאת עורכים.

מי משלם לוויקיפדיה על השימוש בתוכן?

חברות שמתחברות ל-Wikimedia Enterprise, המוצר המסחרי של הקרן. בינואר 2026 נחשף שבין הלקוחות אמזון, מטא, מיקרוסופט, Mistral AI ו-Perplexity, לצד גוגל מאז 2022.

שתפו:וואטסאפטלגרם

מצאתם טעות בערך, או שיש לכם מקור שכדאי להוסיף? כתבו לנו