דלג לתוכן

שרשור מחשבה (Chain of Thought)

כלים וסוכנים

הגדרה

שרשור מחשבה (Chain of Thought) היא טכניקה שבה מודל "חושב בקול רם" צעד-אחר-צעד לפני שהוא נותן תשובה סופית.

💡 דוגמה

"היו לי 3 תפוחים, קניתי עוד 2 תריסרים ואכלתי 5". במקום לזרוק מספר, המודל כותב: 2 תריסרים הם 24, ועוד 3 זה 27, פחות 5 זה 22. צעד אחרי צעד, ופחות טעויות.

שרשור מחשבה (Chain of Thought) היא טכניקה שבה מודל AI "חושב בקול רם" צעד-אחר-צעד לפני שהוא נותן תשובה סופית — פירוק הבעיה לשלבי-ביניים מפורשים, בדיוק כפי שתלמיד כותב פתרון מלא ולא רק תשובה. הטכניקה פורסמה לראשונה במחקר של גוגל בריין ב-2022, שהראה שהנחיית מודל-שפה לענות על בעיה רב-שלבית באמצעות שרשרת של צעדי-היגיון משפרת משמעותית את הדיוק שלו במשימות מורכבות.

בגרסתו המקורית, שרשור מחשבה דרש דוגמאות מוכנות-מראש בתוך הפרומפט (למידה מכמה-דוגמאות); מאוחר יותר התגלה שגם הוספת המשפט הפשוט "בוא נחשוב על זה צעד-אחר-צעד" (למידה-מאפס) משפרת את הדיוק בצורה ניכרת, בלי צורך בדוגמאות כלל. דוגמה מוחשית לעוצמת השיטה: כשהוחלה על מודל PaLM בגודל 540 מיליארד פרמטרים, שרשור מחשבה הביא לתוצאות שיא (נכון-אז) על מבחן GSM8K, מאגר-שאלות סטנדרטי לבעיות חשבון מילוליות רב-שלביות.

עם זאת, מחקר-סקירה מ-2024 מצא שהיתרון של שרשור מחשבה אינו אחיד: השיפור המשמעותי ביותר מתרכז במשימות מתמטיות, לוגיות וסימבוליות, בעוד שבמשימות אחרות (כתיבה יצירתית, שיפוט כללי) השיפור קטן בהרבה או כמעט לא-קיים. שימוש בשרשור מחשבה גם מאריך את התשובה ואת זמן-העיבוד, ולעיתים המודל "מציג" שרשרת-היגיון שאינה משקפת במדויק את התהליך הפנימי שהוביל אותו לתשובה. על אותו טקסט נשענת גם גישת-פיקוח שהציע מאמר-עמדה מ-15 ביולי 2025, שעליו חתומים 41 מחברים ממעבדות וממכוני-מחקר שונים. ניטור שרשרת-המחשבה (Chain-of-Thought Monitorability) הוא הרעיון לקרוא את הטקסט הזה במערכת אוטומטית ולסמן אינטראקציות חשודות — והמאמר עצמו מגדיר את ההזדמנות הזאת, כבר בכותרתו, כחדשה ושבירה, וממליץ למפתחים לשקול כיצד החלטות-פיתוח משפיעות עליה.

כיום שרשור מחשבה משולב באופן מובנה בתוך מודלי-שפה מתקדמים המאומנים במיוחד ל"חשיבה מורחבת" — האטה מכוונת של שלב ההיגיון הפנימי לפני מתן תשובה סופית, לא רק תגובה לבקשה חיצונית להוסיף אותו בפרומפט. השינוי הופך את שרשור המחשבה מ"טריק-ניסוח" חיצוני לתכונה שמעוצבת ישירות בתוך תהליך-האימון של המודל עצמו, ומאפשרת דיוק גבוה יותר במשימות שדורשות תכנון רב-שלבי — כמו הוכחות מתמטיות או ניתוח-קוד מורכב.

📬 הגיליון השבועי של Wiki-AI

פעם בשבוע, ביום ראשון: שלושת הדברים החשובים שקרו בעולם הבינה המלאכותית, בעברית פשוטה, וערכים חדשים באנציקלופדיה. לגיליונות

שתפו:וואטסאפטלגרם

מצאתם טעות בערך, או שיש לכם מקור שכדאי להוסיף? כתבו לנו