תמחור אמיתי של משימת סוכן (True Cost of an Agent Task)

עולם המוצר והעסקים

הגדרה

תמחור אמיתי של משימת סוכן הוא חישוב העלות של משימה שלמה שסוכן-AI מבצע — טוקנים, קריאות לכלים, ניסיונות חוזרים, זמן בדיקה אנושי ותשתית — ולא רק מחיר הטוקן.

למה מחיר הטוקן אינו מחיר המשימה

מחירון של מודל-שפה נקוב בדולרים למיליון טוקנים, כמתואר בערך תמחור-לפי-טוקן. אבל סוכן אינו שולח בקשה אחת: הוא מתכנן, קורא לכלים, קורא את התוצאות ושולח בקשה נוספת, ולעיתים מפעיל סוכני-משנה. Anthropic דיווחה ביוני 2025, בתיאור מערכת-המחקר שלה, שבנתונים שלה סוכנים צורכים בדרך-כלל פי 4 בקירוב יותר טוקנים משיחה רגילה, ומערכות מרובות-סוכנים פי 15 בקירוב. זה נתון של יצרן אחד על המערכות שלו, לא מדידה כללית, אבל הוא ממחיש שהיחידה הכלכלית הנכונה היא המשימה ולא הבקשה. באותו פוסט נכתב שמערכות כאלה משתלמות רק במשימות שערכן גבוה מספיק כדי לשלם על הביצועים הנוספים.

מה נכנס לחשבון של משימה אחת

דף-התמחור של Anthropic, כפי שנבדק ב-27.9.2026, מפרט ממה מורכבת עלות של בקשה שמשתמשת בכלים: טוקני-הקלט, כולל הגדרות הכלים עצמן; טוקני-הפלט; ולכלים שרצים בצד השרת, תשלום נוסף לפי שימוש. כשמגדירים כלים מתווספת גם הנחיית-מערכת מובנית של כמה מאות טוקנים, ותוצאות שהכלים מחזירים נספרות כקלט. חיפוש-רשת עולה שם 10 דולר לכל 1,000 חיפושים, בנוסף לטוקנים של התוצאות. גם אצל OpenAI, לפי דף-התמחור שלה באותו תאריך, חיפוש-רשת מתומחר ב-10 דולר לכל 1,000 קריאות בתוספת טוקני-התוכן, וסביבות-הרצה של קוד מתומחרות לפי זמן-שימוש. כש-Anthropic מריצה את הסוכן בשירות Claude Managed Agents, מתווסף תשלום של 8 סנט לכל שעת-ריצה של סשן, שנספרת רק בזמן שהסשן פעיל ולא בזמן המתנה.

דוגמה מחושבת של היצרן

אותו דף מביא דוגמה: סשן-קידוד של שעה עם Claude Opus 5, שצורך 50,000 טוקני-קלט ו-15,000 טוקני-פלט. לפי המחירון שם, הקלט עולה 0.25 דולר, הפלט 0.375 דולר ושעת-הריצה 0.08 דולר — בסך הכול 0.705 דולר. אם 40,000 מטוקני-הקלט נקראים מהמטמון, העלות יורדת ל-0.525 דולר. זו דוגמה חשבונית שהיצרן בחר, לא מדידה של משימה אמיתית, וכמויות הטוקנים בה הן הנחה. מה שחסר בה הוא בדיוק מה שהופך מחיר-טוקן למחיר-משימה: ניסיונות שנכשלו, זמן של אדם ועלויות סביב המודל.

ניסיונות חוזרים: הרחבת הדוגמה בהנחות גלויות

סוכן לא מצליח בכל ניסיון, וניסיון שנכשל צורך טוקנים ומחויב כמו ניסיון מוצלח. קרן FinOps, הגוף המקצועי לניהול עלויות-ענן, מציינת במסמך שלה על FinOps ל-AI שהערכת התוצרים ה"מוצלחים" של מודל והפרדתם מהלא-מוצלחים היא משימה חדשה וגדולה בתכנון עלויות. כדי להמחיש, נוסיף לדוגמה של היצרן הנחה שאינה מדידה: נניח שבממוצע נדרשים שני ניסיונות כדי לקבל תוצאה אחת שעוברת בדיקה, ושכל ניסיון עולה כמו הסשן שבדוגמה ללא מטמון. בהנחות האלה, עלות הטוקנים והריצה לכל תוצאה מוצלחת היא פעמיים 0.705 דולר, כלומר 1.41 דולר. המספר עצמו אינו חשוב; מה שחשוב הוא שהמכנה הוא תוצאה שעברה, ולא ניסיון.

זמן אדם ותשתית

לרוב מישהו צריך לבדוק את התוצאה לפני שמשתמשים בה. נמשיך את ההמחשה בהנחה נוספת, שגם היא אינה מדידה: בודק אנושי מקדיש עשר דקות לכל תוצאה, ושעת-עבודה שלו עולה לארגון 60 דולר. בהנחות האלה הבדיקה לבדה עולה 10 דולר, והמשימה כולה 11.41 דולר — כלומר רוב החשבון אינו טוקנים. לצד זה יש תשתית: מאגר-משימות להערכה, שעליו Anthropic ממליצה לעקוב אחרי עלות-למשימה, השהיה ושיעורי-שגיאה, וכלים לניטור ולתיעוד. נתוני-שימוש שפרסם יצרן מראים גם פיזור רחב: לפי תיעוד Claude Code, בפריסות ארגוניות העלות הממוצעת היא כ-13 דולר למפתח ליום-עבודה פעיל, ו-150 עד 250 דולר למפתח בחודש, ואצל 90 אחוזים מהמשתמשים היא נשארת מתחת ל-30 דולר ליום פעיל. לפי אותו תיעוד, העלות תלויה במודל, בגודל בסיס-הקוד ובאופן השימוש.

איך מודדים את זה בארגון

קרן FinOps מציעה מדדי-יחידה פשוטים, כמו עלות להסקה — סך עלויות-ההסקה חלקי מספר הבקשות — ועלות לקריאת-API, ולשירות-לקוחות מבוסס AI היא מזכירה גם עלות-לשיחה וזמן-עד-סגירה. לגבי סוכנים היא מצביעה על פער: עדיין אין מסגרות מקובלות להקצאת עלויות בעומסי-עבודה מרובי-סוכנים. המשמעות המעשית של הערך הזה היא לספור את כל מה שמשימה אחת צורכת — בקשות, כלים, ניסיונות וזמן אדם — ולחלק במספר המשימות שהצליחו. כאן החישוב מתחבר לערכים עלות בעלות כוללת, שמרחיב את המבט למחזור-החיים של המערכת כולה, FinOps ל-AI, שעוסק בניהול השוטף של ההוצאה, ותמחור מבוסס-תוצאה, שבו הספק גובה על תוצאה ולא על שימוש.

שאלות נפוצות ❓

למה לא מספיק להכפיל את מספר הטוקנים במחיר?

כי משימת סוכן כוללת גם תשלומים שאינם טוקנים, כמו חיפוש-רשת לפי מספר חיפושים או זמן-ריצה של סשן, וגם ניסיונות שנכשלו וזמן של אדם שבודק את התוצאה. מחיר הטוקן הוא רכיב אחד בחשבון.

האם המספרים בדוגמה בערך הם עלות אמיתית?

לא. הדוגמה הבסיסית היא דוגמה חשבונית שפרסמה Anthropic בדף-התמחור שלה, עם כמויות-טוקנים שהיא בחרה. ההרחבה — שני ניסיונות לתוצאה ועשר דקות בדיקה בעלות של 60 דולר לשעה — היא הנחה להמחשה בלבד, והיא מסומנת כך בערך.

כמה עולה חיפוש-רשת בתוך משימת סוכן?

לפי דפי-התמחור של Anthropic ושל OpenAI, כפי שנבדקו ב-27.9.2026, 10 דולר לכל 1,000 חיפושים, בתוספת הטוקנים של התוצאות שנכנסות להקשר. מחירים משתנים, ולכן כדאי לבדוק את הדף העדכני.

כמה עולה סוכן-קידוד בשימוש יומיומי?

לפי תיעוד Claude Code, בפריסות ארגוניות העלות הממוצעת היא כ-13 דולר למפתח ליום-עבודה פעיל, ו-150 עד 250 דולר למפתח בחודש. זה נתון של היצרן, והוא תלוי במודל, בגודל בסיס-הקוד ובאופן השימוש.

איך ניסיון שנכשל משפיע על העלות?

ניסיון שנכשל צורך טוקנים ומחויב כמו ניסיון מוצלח, אבל אינו מייצר תוצאה. לכן החישוב הנכון מחלק את כל העלות במספר התוצאות שעברו בדיקה, ולא במספר הניסיונות.