חיזוי בבינה מלאכותית (AI Forecasting)
הגדרה
חיזוי בבינה מלאכותית הוא שימוש במערכות בינה מלאכותית כדי להעריך בהסתברות את הסיכוי שאירועים בעולם — בחירות, החלטות כלכליות, מגמות בטכנולוגיה ובתרבות — יתרחשו, ולהתחרות בכך בחזאים אנושיים. בספטמבר 2026 סיים בוט לראשונה בראש גביע Metaculus, טורניר חיזוי בין-לאומי.
💡 דוגמה
השאלה: האם הבנק המרכזי יוריד את הריבית בהחלטה הקרובה?
חזאית אנושית: קוראת את הפרשנויות, נותנת 35% ומעדכנת פעם בכמה ימים.
בוט חוזה: קורא כל ידיעה חדשה ברגע שהיא מתפרסמת, ומעדכן את ההסתברות שלו — ובו בזמן עונה על עוד מאות שאלות אחרות.
אחרי ההחלטה: שניהם מקבלים ציון לפי כמה קרובה הייתה ההסתברות שנתנו למה שקרה באמת.
מה זה חיזוי שיפוטי, ואיך מודדים אותו
חיזוי בבינה מלאכותית, במובן של הערך הזה, הוא הפעלה של מערכת בינה מלאכותית על שאלות פתוחות על העולם — מי ינצח בבחירות, האם מחיר הנפט יעלה, האם חוק מסוים יעבור — כשהתשובה עוד לא ידועה לאיש. בתחום קוראים לזה חיזוי שיפוטי (judgmental forecasting): לא חישוב מתוך סדרת מדידות קבועה, כמו בחיזוי מזג אוויר או בחיזוי ביקושים, אלא שיקול דעת על שאלות "מבולגנות" מעולמות העסקים, הטכנולוגיה, הגיאופוליטיקה, המדיניות והתרבות. התוצר אינו "כן" או "לא" אלא הסתברות, למשל 40%. כדי לדעת אם חזאי טוב, בודקים אחרי שהשאלה הוכרעה כמה רחוקה הייתה ההסתברות שנתן מהתוצאה. המדד הוותיק לכך הוא ציון ברייר (Brier score), שהציע גלן ברייר ב-1950: ממוצע ריבועי הפערים בין ההסתברות לתוצאה, כש-0 הוא חיזוי מושלם. מי שנתן 70% לגשם וירד גשם מקבל 0.09; אם לא ירד, 0.49.
השורשים: סופר-חזאים ופלטפורמות חיזוי
לפני שהמכונות נכנסו לתחום, הוא נבנה סביב בני אדם. פרויקט Good Judgment, שהקימו ב-2011 שלושה פרופסורים מאוניברסיטת פנסילבניה — פיליפ טטלוק, ברברה מלרס ודון מור — השתתף בטורניר חיזוי שמימנה סוכנות המחקר של קהילת המודיעין האמריקאית (IARPA), ובו נשאלו כ-100 עד 150 שאלות גיאופוליטיות בשנה. הפרויקט גייס חובבנים מוכשרים במקום מומחים, שילב את התחזיות שלהם באלגוריתם, והיה מדויק ב-35% עד 72% מכל צוות מחקר אחר. לפי דיווח של NPR, החזאים הטובים ביותר היו טובים בכ-30% מאנשי מודיעין שהייתה להם גישה למידע מסווג. מכאן נולד המונח "סופר-חזאי" (superforecaster), וב-2015 יצא הספר Superforecasting של טטלוק ודן גרדנר. באותה שנה, 2015, הוקמה Metaculus — פלטפורמה מקוונת שבה אנשים מגישים הסתברויות לשאלות עתידיות וצוברים מוניטין לפי הדיוק שלהם, בלי הימור בכסף אמיתי.
איך בונים בוט שחוזה את העתיד
בוטים חוזים רבים כיום אינם מודל ייעודי שנבנה מאפס, אלא מודל שפה גדול כללי שמחובר לחיפוש ברשת: הבוט קורא חדשות על השאלה, מסכם מה ידוע ומנסח הסתברות. בסיכום של Metaculus לעונת האביב של 2026 מתואר בדיוק הדפוס הזה — מודל שפה וחיפוש ברשת — ונכתב שתשעה מעשרת בוני הבוטים המובילים השתמשו בדגמי GPT-5 של OpenAI. החברה הבריטית Mantic מתארת גישה דומה: היא מתאימה מודלים מתקדמים של מעבדות אחרות למשימת החיזוי, בוחנת את המערכת על אירועי עבר, מדרגת את הביצועים שלה ומשפרת אותה. כדי לבדוק בוטים כאלה ביושר צריך שאלות שהתשובה להן עוד לא קיימת — אחרת המודל עלול פשוט "לזכור" אותה מנתוני האימון. לכן אמת-המידה ForecastBench של מכון המחקר לחיזוי (Forecasting Research Institute) בנויה משאלות על אירועים עתידיים שאין להן תשובה ידועה בזמן ההגשה, ו-Metaculus מקיימת מדי עונה טורניר בוטים בשם FutureEval.
גביע Metaculus, קיץ 2026
גביע Metaculus הוא תחרות עונתית שבה בני אדם ובוטים חוזים את אותן שאלות. בעונת הקיץ של 2026 הגישו 885 משתתפים 88,558 תחזיות על 58 שאלות בכלכלה, טכנולוגיה, בריאות ואירועים עולמיים. התוצאות פורסמו בספטמבר 2026: במקום הראשון הבוט laertes, שבנה מפתח עצמאי בשם ג'פרי ליאנג — לדבריו בפחות מ-150 שעות עבודה ובכמה אלפי דולרים; במקום השני הבוט של Mantic; במקומות השלישי והרביעי חזאים אנושיים; ובמקום החמישי בוט נוסף, של FutureSearch. זו הפעם הראשונה שמערכת בינה מלאכותית סיימה בראש התחרות העונתית של הפלטפורמה. בוטים אינם זכאים לפרסים או למדליות בגביע, ולכן הזוכים הרשמיים נשארו בני אדם. סוכנות הידיעות רויטרס הביאה שתי דוגמאות מהטורניר: Mantic נתנה בשלב מוקדם סיכוי של כ-40% לאבלרדו דה לה אספרייה לנצח בבחירות לנשיאות קולומביה, מול תחזית קונצנזוס של כ-30%, והוא אכן ניצח; ובשאלה אם שירו של שאקירה "Dai Dai" יעקוף את "Waka Waka" במצעד הבילבורד, רוב בני האדם הימרו שלא — וטעו — בעוד ש-Mantic לא הימרה בכבדות על דעת הרוב.
הכסף שבא אחרי הניצחון
Mantic הוקמה בלונדון ב-2024 בידי טובי שבליין, לשעבר חוקר ב-Google DeepMind, ובן דיי. ב-18 בספטמבר 2026 דיווחה רויטרס שהחברה גייסה 25 מיליון דולר בסבב סיד בהובלת Radical Ventures, בהשתתפות קרן ההון סיכון של מיקרוסופט M12, Thinking Machines Lab ו-Balderton Capital. לדברי החברה, קרנות גידור וחברות מסחר גילו עניין מיוחד בתחזיות שלה, וחברות וסוכנויות ממשלתיות בעולם כבר שילבו את המערכת. "אנחנו משדרגים עכשיו את הרמה שבה בני אדם יכולים להבין את העתיד", אמר שבליין. בעיתונות הכלכלית בישראל הוצגו שימושים אפשריים כמו הערכת מחירי נחושת, עיכובים בשרשרת האספקה, תנועות ריבית וביקוש למוצרים.
אז המכונה כבר חוזה טוב מאיתנו?
לא בהכרח, וההבדל נמצא בשיטת הניקוד. הגביע מעניק נקודות על הסתברויות מדויקות שנשמרות לאורך זמן, ולכן הוא מעדיף מי שמסוגל לחקור ולעדכן כל הזמן — ובוט, בניגוד לאדם, יכול לעקוב אחרי מאות אירועים בו בזמן. בהשוואה מבוקרת שפרסמה Metaculus ב-9 בספטמבר 2026 על עונת האביב, צוות של עשרה חזאים מקצועיים התמודד מול צוות עשרת הבוטים המובילים על 99 שאלות משותפות. בני האדם הקדימו את הבוטים בממוצע של 1.25 נקודות לשאלה, אבל ההפרש לא היה מובהק סטטיסטית; ובדירוג של יחידים, תשעה מעשרת המקומות הראשונים היו נתפסים בידי בני אדם. גם ב-ForecastBench בני האדם עדיין הובילו בפרסום מינואר 2026: ציון ברייר של 0.085 לסופר-חזאים, מול 0.102 למערכות הטובות ביותר. המכון העריך אז, לפי קו מגמה, שהמודלים ישתוו לסופר-חזאים בנובמבר 2026, בטווח ביטחון שבין ינואר 2026 לנובמבר 2027. Metaculus עצמה מזהירה שטענות על שוויון שמבוססות על בדיקה בדיעבד של שאלות שכבר הוכרעו אינן שקולות להערכה חיה של תחזיות אמיתיות.
📬 הגיליון השבועי של Wiki-AI
פעם בשבוע, ביום ראשון: שלושת הדברים החשובים שקרו בעולם הבינה המלאכותית, בעברית פשוטה, וערכים חדשים באנציקלופדיה. לגיליונות
| מי חוזה | מה מניע את הדיוק | חולשה ידועה | |
|---|---|---|---|
| סופר-חזאים אנושיים | חובבנים מוכשרים שנבחרו לפי ביצועים, ותחזיותיהם משולבות לתחזית אחת | מוניטין וניקוד לפי הדיוק | אדם יכול לעקוב רק אחרי מספר מוגבל של שאלות ולעדכן מדי פעם |
| שוקי תחזיות | סוחרים שקונים ומוכרים חוזים על תוצאה; המחיר משקף את ההסתברות | כסף אמיתי על הקרן | חשיפה לניסיונות מניפולציה ולתנודות של עדר |
| בוטים חוזים | מודל שפה גדול שמחובר לחיפוש ברשת, קורא חדשות ומנסח הסתברות | ניסוי על אירועי עבר ושיפור חוזר, כפי שמתארת זאת Mantic | בהשוואה מבוקרת על עונת האביב של 2026 עדיין פיגרו מעט אחרי חזאים מקצועיים |
שאלות נפוצות ❓
במה זה שונה מחיזוי מזג אוויר או מחיזוי ביקושים בבינה מלאכותית?
חיזוי מזג אוויר וחיזוי ביקושים מחשבים תחזית מתוך סדרות מדידה קבועות — לחץ אוויר, היסטוריית מכירות. כאן השאלות פתוחות וחד-פעמיות, כמו תוצאת בחירות או החלטת ריבית, והבוט צריך לקרוא חדשות, לשקול ולתת הסתברות.
האם בינה מלאכותית ניצחה את בני האדם בגביע Metaculus?
בדירוג הכללי של גביע הקיץ של 2026 — כן: הבוט laertes סיים ראשון והבוט של Mantic שני, לפני כל המשתתפים האנושיים. אבל בוטים אינם זכאים לפרסים, ובהשוואה מבוקרת על עונת האביב חזאים מקצועיים עדיין הקדימו את הבוטים המובילים, בהפרש לא מובהק.
איך יודעים אם חזאי, אדם או מכונה, טוב?
אחרי שהשאלה מוכרעת משווים את ההסתברות שנתן לתוצאה בפועל. מדד נפוץ הוא ציון ברייר: 0 הוא חיזוי מושלם, ומי שנתן 70% לאירוע שקרה מקבל 0.09.
מה זה סופר-חזאי?
אדם שהתחזיות שלו מדויקות באופן מובהק יותר מאלה של הציבור או של מומחים. המונח נולד בפרויקט Good Judgment של פיליפ טטלוק ועמיתיו, שפעל מ-2011 בטורניר חיזוי גיאופוליטי שמימנה קהילת המודיעין האמריקאית.
מי משתמש בתחזיות של בוטים כאלה?
לדברי Mantic, קרנות גידור וחברות מסחר גילו בהן עניין מיוחד, וחברות וסוכנויות ממשלתיות כבר שילבו את המערכת שלה. אלה טענות של החברה, לא נתון בלתי תלוי.