מה זו ערכת ה-AI של Vercel: איחוד-ספקים ל-API אחד
ערכת ה-AI של Vercel (Vercel AI SDK, לעיתים מכונה בקיצור AI SDK) היא ערכת-פיתוח קוד-פתוחה בשפת TypeScript, שנועדה לפתור בעיה מוכרת מאוד למפתחי-אתרים ואפליקציות-ווב: כל ספק-מודל (OpenAI, Anthropic, Google, xAI, ועוד) מציע ממשק-API משלו, עם פורמטים שונים-מעט לבקשה ולתשובה, ומעבר בין ספקים דורש בדרך-כלל שכתוב-קוד לא-מבוטל. הערכה מציעה שכבת-הפשטה אחידה מעל כל הספקים האלה — כך שאפליקציה יכולה "להחליף" ספק-מודל בשינוי-הגדרה קטן, בלי לשכתב את לוגיקת-האפליקציה. מעבר לכך, היא כוללת תמיכה מובנית בהזרמת-תשובות (Streaming) בזמן-אמת אל ממשק-המשתמש, בפלט מובנה (Structured Output) בפורמטים קבועים-מראש, ובקריאה-לכלים (Tool Calling) בתחביר אחיד — שלושת המרכיבים הטכניים המרכזיים שכמעט כל אפליקציית-AI מודרנית מבוססת-דפדפן זקוקה להם. חשוב להבהיר את גבולות ה"סוכנות" כאן: הערכה עצמה אינה מסגרת-רב-סוכנים במובן של קרו-איי-איי או אוטוג'ן (ראו הערכים הנפרדים) — אין בה תפיסה מובנית של "צוות" סוכנים משתפי-פעולה. מה שהיא כן מספקת הוא את שכבת-התשתית שסוכן-בודד (או מספר סוכנים שמפתח בונה בעצמו) זקוק לה כדי לתקשר עם משתמש בממשק-ווב בזמן-אמת — שכבה שכל מסגרת-סוכנים אחרת, בסופו של דבר, צריכה איכשהו לגעת בה אם היא רוצה להציג תוצאות בדפדפן.
למה זה חשוב דווקא לבניית-ממשק-משתמש
ההבדל בין ערכת ה-AI של Vercel לרוב מסגרות-הסוכנים האחרות בסקירה הזאת הוא זווית-הראייה: מסגרות כמו קרו-איי-איי, אוטוג'ן, או לאנגגרף (ראו הערכים הנפרדים) נכתבות בעיקר מנקודת-מבטו של השרת (Backend) — איך הסוכן חושב, מחליט, ומבצע פעולות. ערכת ה-AI של Vercel נכתבת בעיקר מנקודת-מבטו של הדפדפן: איך המשתמש-הסופי חווה את הסוכן בזמן-אמת. השלכה מעשית לכך היא ניהול "מצב-הזרמה" (Streaming State) מורכב יותר ממה שנראה במבט ראשון — למשל, מה קורה אם המשתמש סוגר את הכרטיסייה באמצע קבלת-תשובה, או שולח הודעה חדשה לפני שהתשובה הקודמת הסתיימה. הערכה מטפלת בתרחישים כאלה כחלק מובנה מהעיצוב שלה, בעוד שמסגרות-שרת אחרות בדרך-כלל משאירות את הטיפול בהם לשכבת-הממשק שמעליהן.
מקור: מאי 2023, מיוצרות Next.js
הערכה פותחה על ידי Vercel, החברה שמאחורי מסגרת-הפיתוח הפופולרית Next.js — קשר שמוזכר במפורש בתיאור-הפרויקט הרשמי בגיטהאב: "ערכת-הכלים ל-AI עבור TypeScript. מיוצרות Next.js". מאגר-הקוד נפתח ב-23 במאי 2023, בשלב מוקדם יחסית של "גל-הצ'אטבוטים" שבא בעקבות פרסום ChatGPT. עד ספטמבר 2026 צבר מאגר-הקוד כ-26,900 כוכבי-GitHub — נתון גבוה יחסית, בהתחשב בכך שמדובר בכלי שמיועד בעיקרו לקהילת-הפיתוח הצרה-יותר של TypeScript/JavaScript, ולא לקהילת-הפייתון הרחבה-יותר שרוב מסגרות-הסוכנים האחרות מיועדות לה. הפער הזה בין העולמות — רוב מסגרות-האורקסטרציה שנסקרות באתר זה מבוססות-פייתון, בעוד שערכת ה-AI של Vercel היא כמעט-הנציגה-היחידה מעולם ה-TypeScript — משקף חלוקת-עבודה מקובלת בתעשייה: צוותי-הנתונים והמחקר נוטים לעבוד בפייתון, וצוותי-הפיתוח-הצד-לקוח (Frontend) נוטים לעבוד ב-TypeScript/JavaScript; הערכה של Vercel נותנת לצוותי-הצד-לקוח דרך לבנות תכונות-AI בלי לעבור לשפה אחרת או להסתמך על צוות נפרד.
שש גרסאות-מרכזיות תוך שלוש שנים
קצב-ההתפתחות של הערכה מהיר יחסית: גרסה 3.0 פורסמה ב-29 בפברואר 2024 (לפי נתוני-פרסום רשמיים במאגר-החבילות npm), ובאמצע 2025 יצאה גרסה 5.0 — שכתוב-מקיף שהחברה תיארה ב-31 ביולי 2025 ככולל הפרדה בין "הודעות-ממשק" (שנשמרות) ל"הודעות-מודל" (שנשלחות בפועל ל-LLM), טיפוסיות מקצה-לקצה בכמה מסגרות-ווב (React, Vue, Svelte, Angular), מחלקת-הפשטה ייעודית בשם Agent לניהול-לולאות רב-שלביות, ותמיכה בקריאה-לכלים דינמית שכוללת גם התאמת-שמות למונחי פרוטוקול הקשר למודל (MCP — ראו הערך הנפרד). מאז המשיכה הערכה להתעדכן — עד גרסה 7, הגרסה הנוכחית נכון לספטמבר 2026 — בקצב של גרסה-מרכזית חדשה בערך כל שנה.
מלולאת-כלים בסיסית ל"רתמות"-סוכן (Harnesses)
מעבר לתפקידה כשכבת-הפשטה, הערכה כוללת גם כלים ישירים לבניית סוכנים: פונקציות כמו streamText יכולות לבצע "כמה שלבי-כלים אוטומטית" בתוך קריאה בודדת — כלומר, המודל יכול לקרוא לכלי, לקבל תוצאה, ולהחליט על קריאה נוספת, בלולאה, בלי שהמפתח יצטרך לכתוב את הניהול הזה בעצמו — עם תיעוד ייעודי תחת הכותרות "בניית סוכנים" (Building Agents), "תבניות-זרימת-עבודה" (Workflow Patterns) ו"בקרת-לולאה" (Loop Control). תוספת עדכנית ומעניינת-במיוחד, נכון לגרסתה האחרונה: "רתמות ערכת-ה-AI" (AI SDK Harnesses) — ממשק אחיד לעבודה מול "רתמות-סוכן" מבוססות-שורת-פקודה שכבר קיימות, ובהן Claude Code עצמה — כלומר, הערכה לא רק מריצה סוכנים משלה, אלא גם מנסה להיות שכבת-אחידות מעל כלי-סוכן חיצוניים ובוגרים-יותר.
אימוץ
הערכה שינתה בפועל את האופן שבו נכתבות אפליקציות-AI בעולם ה-JavaScript/TypeScript: דפוס ה"הזרמת-תשובה-לממשק-המשתמש עם ניהול-לולאת-כלים אוטומטי" שהיא הציגה מוקדם יחסית הפך לציפייה סטנדרטית אצל מפתחי-ווב שבונים תכונת-צ'אט או סוכן בתוך אפליקציה — ומסגרות מתחרות רבות בעולם ה-JS מתייחסות אליה כנקודת-ייחוס בעת השוואת-יכולות. מכיוון שמדובר בערכה חינמית וקוד-פתוחה (Vercel מרוויחה בעיקר מתשתית-הענן שעליה רצות אפליקציות שנבנות איתה, לא מהערכה עצמה), מדדי-האימוץ המרכזיים הזמינים הם טכניים — כוכבי-GitHub והורדות-npm — ולא רשימת-לקוחות-ארגוניים רשמית כפי שמפרסמות חלק ממסגרות-הסוכנים המסחריות-יותר.
מקום ה-"Vercel" בשם: קשר לפריסה, לא רק לפיתוח
השם "ערכת ה-AI של Vercel" אינו מקרי: Vercel היא בראש-ובראשונה חברת-אירוח-ופריסה (Hosting) לאפליקציות-ווב, שמייצרת רווח מהרצת-האפליקציות שנבנות באמצעות הכלים שלה — לא ממכירת הערכה עצמה, שנשארת חינמית וקוד-פתוחה. המשמעות המעשית: הערכה מותאמת-במיוחד לפעול היטב בסביבת-הענן של Vercel (למשל, יעילות בפונקציות-חסרות-שרת, Serverless Functions, שדורשות זמני-תגובה קצרים), אך אינה נעולה אליה — ניתן להריץ אפליקציה שבנויה עם ערכת ה-AI על כל תשתית-שרת אחרת. זהו אותו דגם-עסקי שמאפיין ספקיות-תשתית נוספות שמפרסמות כלי-פיתוח חינמיים כדי למשוך תעבורה לתשתית-הענן שלהן.
התמודדות עם ריבוי-ספקים בקוד יומיומי
כדי להמחיש מה שכבת-ההפשטה חוסכת בפועל: מפתח שכותב אפליקציית-צ'אט שתומכת גם במודל-של-OpenAI וגם במודל-של-Anthropic, בלי ערכה מאחדת, היה צריך לכתוב שני נתיבי-קוד נפרדים — כל אחד עם פורמט-הבקשה, פורמט-ההזרמה, ומבנה-שגיאות משלו — ולתחזק את שניהם במקביל, כולל כשמתעדכן ה-API של אחד מהספקים. עם ערכת ה-AI של Vercel, אותה קריאה בדיוק (`streamText` עם פרמטר "מודל" משתנה) עובדת מול שני הספקים; המעבר בין OpenAI ל-Anthropic (או כל ספק אחר מבין העשרות הנתמכים) הופך משינוי-ארכיטקטוני לשינוי-הגדרה בשורה אחת.
עומק-התמיכה בפועל ניכר במספר חבילות-הספק הרשמיות: התיעוד מפרט למעלה מעשרים חבילות First-Party Providers שצוות Vercel עצמו מתחזק — ביניהן OpenAI, Anthropic, Google Generative AI ו-Vertex AI, xAI Grok, Amazon Bedrock, Azure OpenAI, Mistral, Cohere, Groq, Together.ai, Fireworks, DeepSeek, Cerebras, Perplexity ו-Hugging Face — לצד שער-ניתוב מרכזי בשם Vercel AI Gateway שמנתב בקשות בין ספקים שונים דרך נקודת-כניסה אחידה. היקף כזה של תמיכה פותר בעיה מעשית שמפתחים נתקלים בה בתדירות גבוהה: הרצון לבדוק כמה מודלים שונים מול אותה משימה כדי להחליט איזה מהם משתלם ביותר, בלי לכתוב שכבת-אינטגרציה נפרדת לכל ספק שנבדק.
פלט-מובנה: מעבר לטקסט חופשי
מרכיב-ליבה שלישי, לצד הזרמת-הטקסט וקריאה-לכלים, הוא "פלט-מובנה" (Structured Output): יכולת לבקש ממודל-השפה להחזיר תשובה שמצייתת במדויק למבנה-נתונים מוגדר-מראש (למשל אובייקט-JSON עם שדות קבועים), ולא טקסט-חופשי שהאפליקציה צריכה לנתח בעצמה בדיעבד ולנחש את המבנה שלו. היכולת הזאת קריטית לבניית-סוכנים, שבהם התוצאה של שלב אחד (למשל "האם המשתמש ביקש לבטל הזמנה?", כן/לא, עם מזהה-הזמנה) צריכה להיות ניתנת-לעיבוד-אוטומטי בקוד השלב הבא, ולא רק קריאה-לאדם. הערכה מיישמת את זה תוך שילוב עם ספריות-אימות-סכמה נפוצות בעולם ה-TypeScript, כך שאותו הגדרת-סכמה שמתארת את המבנה-הרצוי משמשת גם לאימות-התשובה בפועל וגם לתיעוד-עצמי של מה שהאפליקציה מצפה לקבל.
שלוש שכבות: Core, UI, ו-Harnesses
התיעוד הרשמי מחלק את הערכה לשלוש "שכבות-שימוש" נפרדות, שאפשר לשלב או להשתמש בהן בנפרד: "AI SDK Core" — הרובד שעוסק ביצירת-טקסט, יצירת-אובייקטים מובנים, קריאה-לכלים, ובניית-סוכנים, ללא תלות במסגרת-ווב מסוימת; "AI SDK UI" — קבוצת-hooks אחידה (עצמאית-ממסגרת) לחיבור ממשק-משתמש של צ'אט לשכבת ה-Core, שעובדת באותו אופן ב-React, Vue, Svelte, ו-Angular; ו"AI SDK Harnesses", התוספת החדשה-יותר, שמספקת ממשק-תכנות אחיד לעבודה מול כלי-סוכן חיצוניים ובוגרים שכבר קיימים ופועלים כתהליכי-שורת-פקודה. החלוקה הזאת לשלוש שכבות עצמאיות-אך-משתלבות היא שמאפשרת למפתחים לאמץ רק את מה שהם צריכים — למשל להשתמש ב-Core בלבד בפרויקט שרת (Backend) בלי שום ממשק-משתמש כלל.