הסקה (Inference)

יסודות בינה מלאכותית

הסקה (Inference) היא הרגע שבו מודל AI כבר מאומן ומשתמשים בו בפועל — לענות על שאלה, לזהות תמונה, לתרגם משפט — בניגוד לשלב האימון, שבו המודל עדיין לומד ומתעדכן.

ההבדל חשוב כלכלית: אימון הוא תהליך חד-פעמי ויקר במיוחד, בעוד הסקה קורית בכל פעם שמישהו שולח הודעה ל-ChatGPT או Claude — מיליוני פעמים ביום — ולכן העלות והמהירות שלה, לא רק של האימון, קריטיות לכלכלת המוצר.

"זמן הסקה" (inference time) — כמה זמן לוקח למודל לייצר תשובה — הוא אחד המדדים המרכזיים שמפתחי AI עובדים על שיפורו, כי הוא משפיע ישירות על חוויית המשתמש בזמן אמת.