מוכנים להעצים את היכולות היצירתיות של הארגון שלכם?
צרו איתנו קשר עוד היום לתיאום הדרכת עיצוב בבינה מלאכותית מעשית שתצייד את הארגון שלכם בכלים המתקדמים ביותר בתחום!


אמיר משה
Claude של Anthropic עשתה צעד ענק קדימה בעולם סוכני הבינה המלאכותית עם השקת Claude Managed Agents בבטא פתוחה ב-8 באפריל 2026. מדובר בתשתית מנוהלת מלאה שמאפשרת למפתחים לבנות, לפרוס ולהריץ סוכני AI אוטונומיים בענן - בלי לבנות לבד את כל התשתית, ה-sandboxing, לולאת הסוכן וניהול ההרשאות. במקום חודשים של פיתוח, Anthropic מבטיחה שתגיעו לפרודקשן תוך ימים בודדים. במאמר הזה נצלול לעומק לכל מה ש-Claude Managed Agents מציע, איך הארכיטקטורה עובדת, כמה זה עולה, ולמה זה משנה את כללי המשחק.
Claude Managed Agents היא סוויטה של APIs קומפוזביליים לבנייה ופריסה של סוכני AI בענן בקנה מידה גדול. במקום לבנות בעצמכם לולאת סוכן (agent loop), ניהול כלים (tool execution), וסביבת הרצה (runtime) - אתם מקבלים סביבה מנוהלת מלאה שבה Claude יכול לקרוא קבצים, להריץ פקודות, לגלוש באינטרנט ולהריץ קוד בצורה מאובטחת.
Anthropic מציעה שתי דרכים לבנות עם Claude. ה-Messages API מספק גישה ישירה למודל עם שליטה מלאה על לולאת הסוכן - מתאים למי שרוצה שליטה מדויקת (fine-grained control). לעומתו, Claude Managed Agents מספק harness מוכן מראש עם תשתית מנוהלת - מתאים למשימות ארוכות טווח ועבודה אסינכרונית. הבחירה תלויה בצרכים: אם אתם רוצים לבנות לולאת סוכן מותאמת אישית, Messages API עדיף. אם אתם רוצים להגיע לפרודקשן מהר עם תשתית מוכנה - Managed Agents זה הכלי.
הבחירה ב-Managed Agents מתאימה במיוחד כשאתם צריכים: הרצה ממושכת (משימות שרצות דקות או שעות עם קריאות כלים מרובות), תשתית ענן מאובטחת עם חבילות מותקנות מראש וגישה לרשת, מינימום תשתית ללא צורך לבנות sandbox או שכבת הרצת כלים, וסשנים stateful עם מערכת קבצים ושיחה שנשמרים לאורך אינטראקציות מרובות.
אם אתם בונים צ’אטבוט פשוט שעונה על שאלות לקוחות עם תגובות מהירות, Messages API מספיק ויותר חסכוני. אבל ברגע שהסוכן שלכם צריך לקרוא קבצים, לכתוב קוד, להריץ בדיקות ולפתוח Pull Requests - Managed Agents חוסך לכם חודשי פיתוח.
הארכיטקטורה של Managed Agents מבוססת על הפרדה חכמה בין שלושה רכיבים וירטואליים. כל רכיב פועל באופן עצמאי דרך ממשקים מוגדרים היטב, מה שמאפשר לשנות מימוש בלי לשבור את השאר.
ה-Session הוא לוג append-only שמתעד את כל האירועים שקרו במהלך הרצת הסוכן. הסשן שורד באופן עצמאי מה-harness - אם ה-harness נופל, instance חדש קורא ל-wake(sessionId), שולף את לוג האירועים דרך getSession(id), וממשיך מהאירוע האחרון. זה אומר שהסוכנים שלכם שורדים ניתוקים ותקלות ללא אובדן נתונים.
ה-Harness הוא לולאת הבקרה שקוראת ל-Claude ומנתבת את קריאות הכלים לתשתית המתאימה. ב-Anthropic הגדירו את ההפרדה הזו כ-“Brain-Hands Separation” - הפרדת המוח (harness) מהידיים (sandboxes וכלים). בעבר הכל רץ בקונטיינר אחד, מה שיצר שבריריות תשתיתית. העיצוב מחדש מתייחס לכל “יד” ככלי שניתן לקרוא אליו באמצעות execute(name, input) string.

קונטיינרים עברו משיטת “חיות מחמד” (שמתחזקים בזהירות ולא ניתן להחליף) לשיטת “עדר” (חד-פעמיים וניתנים להחלפה). כשקונטיינר נכשל, ה-harness תופס את השגיאה כתקלת tool-call. קונטיינרים חדשים מאותחלים דרך provision({resources}) בלי שחזור ידני.


ההפרדה הזו אפשרה scale של harnesses חסרי מצב (stateless). בבדיקות פנימיות של Anthropic, ה-p50 של TTFT (Time To First Token) ירד בכ-60% וה-p95 ירד ביותר מ-90%. מספרים מרשימים שמראים שההפרדה הארכיטקטונית לא רק משפרת אמינות - היא גם משפרת ביצועים דרמטית.
ה-Sandbox הוא סביבת ההרצה שבה Claude יכול להריץ קוד ולערוך קבצים. כל סשן מקבל קונטיינר ענן מוגדר מראש עם חבילות מותקנות (Python, Node.js, Go ועוד), כללי גישה לרשת וקבצים שמורכבים מראש. הכלים הזמינים כוללים: Bash להרצת פקודות, פעולות קבצים (קריאה, כתיבה, עריכה, glob, grep), חיפוש וגלישה באינטרנט, ושרתי MCP להתחברות לספקי כלים חיצוניים.
אחת היכולות המרגשות ביותר של Managed Agents היא תמיכה ב-Multi-Agent orchestration - תזמור מרובה סוכנים. יכולת זו נמצאת כרגע ב-Research Preview ודורשת בקשת גישה מיוחדת.
סוכן מתאם (coordinator) יכול להאציל משימות לסוכנים אחרים שרצים במקביל עם הקשר מבודד משלהם. כל הסוכנים חולקים את אותו קונטיינר ומערכת קבצים, אבל כל אחד רץ ב-thread נפרד - זרם אירועים מבודד עם היסטוריית שיחה משלו. ה-coordinator מדווח פעילות ב-thread הראשי, ו-threads נוספים נוצרים בזמן ריצה כש-coordinator מחליט להאציל.
סשנים מולטי-אייג’נטיים עובדים הכי טוב כשיש מספר משימות מוגדרות ומתמחות בתוך מטרה כוללת. לדוגמה: סקירת קוד- סוכן reviewer עם system prompt ממוקד וכלי read-only; יצירת בדיקות- סוכן test שכותב ומריץ בדיקות בלי לגעת בקוד פרודקשן; מחקר- סוכן search עם כלי אינטרנט שמסכם ממצאים חזרה ל-coordinator. כל סוכן משתמש בהגדרות שלו (מודל, system prompt, כלים, שרתי MCP) כפי שהוגדר כשהסוכן נוצר.
ה-threads הם persistent - ה-coordinator יכול לשלוח follow-up לסוכן שקרא אליו קודם, והסוכן שומר את הכל מהתורות הקודמות שלו. אירועים ייחודיים כמו session.thread_created, session.thread_idle, ו-agent.thread_message_sent מאפשרים מעקב מלא אחרי הפעילות הרב-סוכנית.
נכון לגרסת הבטא, נתמכת רק רמת האצלה אחת: ה-coordinator יכול לקרוא לסוכנים אחרים, אבל אותם סוכנים לא יכולים לקרוא לסוכנים משלהם. מגבלה זו צפויה להשתנות בעתיד, אך כרגע חשוב לתכנן את הארכיטקטורה בהתאם.
Anthropic שמו דגש מיוחד על אבטחה ב-Managed Agents, עם מספר שכבות הגנה שמבטיחות שסוכנים פועלים בצורה בטוחה גם כשהם מקבלים גישה למערכות אמיתיות.
Credentials לעולם לא מגיעים ל-sandboxes שבהם Claude מריץ קוד שנוצר. שתי דפוסים מבטיחים בידוד: עבור Git- טוקנים של repositories משמשים לשכפול repos במהלך אתחול ה-sandbox ומחוברים ל-git remotes מקומיים; push/pull עובדים בלי לחשוף טוקנים. עבור כלים מותאמים/MCP- טוקני OAuth מאוחסנים ב-vaults מאובטחים. Claude קורא לכלים דרך proxy ייעודי ששולף credentials מה-vault.
המערכת תומכת בהרשאות scoped - אתם מגדירים בדיוק לאילו כלים ומשאבים לסוכן יש גישה. ניהול זהויות (Identity Management) ומעקב הרצה (execution tracing) מובנים, מה שנותן שקיפות מלאה על מה הסוכן עשה ומתי. כלים מסוימים ניתנים להגדרה כ-always_ask, שמחייב אישור מפורש מהמשתמש לפני שהסוכן מריץ אותם - שכבת ביטחון נוספת למשימות רגישות.
התמחור של Managed Agents בנוי משני ממדים: טוקנים ו-זמן ריצה.
טוקנים מחויבים לפי התעריפים הסטנדרטיים של Claude API - אותו תמחור per-million-token שתשלמו דרך Messages API. מעבר לכך, נוספת עלות של $0.08 לשעת סשן (session-hour) עבור זמן ריצה פעיל (active runtime). הזמן נמדד עד לאלפית השנייה ומצטבר רק כשסטטוס הסשן הוא running. זמן סרק - כשהסוכן ממתין לקלט או לכלי - לא נספר.
חיפוש אינטרנט שמופעל בתוך סשן Managed Agents עולה $10 לכל 1,000 חיפושים, לפי התעריף הסטנדרטי. חשוב לציין שהמחירים הנוכחיים הם מחירי בטא - Anthropic עשויה לעדכן אותם בגרסה הסופית.
ה-endpoints של Managed Agents מוגבלים לפי ארגון: 60 בקשות לדקה ל-endpoints של יצירה (agents, sessions, environments) ו-600 בקשות לדקה ל-endpoints של קריאה (retrieve, list, stream). בנוסף, חלים מגבלות הוצאות ומגבלות rate ברמת הארגון.
Claude Managed Agents כבר נמצא בשימוש של חברות טכנולוגיה מובילות. מגזין AI שלנו עוקב מקרוב אחרי ההתפתחויות, ולהלן חלק מהלקוחות הבולטים:
Notion- משתמשת ב-Managed Agents לסוכני עבודה שיתופיים שפועלים לצד צוותים בכלי ניהול פרויקטים. Rakuten- פורסת סוכנים לעיבוד מסמכים בתחומי פיננסים ומשפט. Asana- מפעילה סוכני code review שקוראים codebases, מתכננים תיקונים ופותחים PRs. Sentry ו-Vibecode- מדווחות על מחזורי פיתוח שהתקצרו מחודשים לשבועות.
בבדיקות פנימיות של Anthropic סביב משימות structured file generation, Claude Managed Agents שיפר את אחוז ההצלחה של משימות עד 10 נקודות אחוז לעומת לולאת prompting סטנדרטית - עם הרווחים הגדולים ביותר דווקא בבעיות הקשות ביותר.
כדי להתחיל, צריך מפתח API של Claude, ה-beta header (managed-agents-2026-04-01 - ה-SDK מגדיר אותו אוטומטית), וגישה ל-Managed Agents (מופעלת כברירת מחדל לכל חשבונות API). התהליך כולל חמישה שלבים פשוטים.
ראשית, יוצרים Agent - מגדירים מודל, system prompt, כלים, שרתי MCP ו-skills. אחר כך יוצרים Environment - קונטיינר ענן מוגדר עם חבילות מותקנות, כללי גישה לרשת וקבצים. ואז מפעילים Session שמפנה להגדרות ה-Agent וה-Environment. שולחים הודעות משתמש כאירועים, ו-Claude מריץ כלים באופן אוטונומי ושולח חזרה תוצאות דרך Server-Sent Events (SSE).
משימות ארוכות שחוצות את חלון ההקשר של Claude מטופלות באמצעות שלוש שכבות: Compaction- Claude מסכם חלונות הקשר, והסיכומים נשמרים; Context Trimming- הסרה סלקטיבית של טוקנים (תוצאות כלים ישנות, thinking blocks); External Storage- אירועים נשמרים בלוג הסשן וניתנים לשליפה ולטרנספורמציה לפני העברה לחלון ההקשר. Claude Agent Skills מרחיב את היכולות עוד יותר עם skills ייעודיים.
כן, Managed Agents נמצא בבטא פתוחה מאפריל 2026 ומופעל כברירת מחדל לכל חשבונות API. תכונות מתקדמות כמו Multi-Agent ו-Outcomes נמצאות ב-Research Preview ודורשות בקשת גישה נפרדת.
עלות הטוקנים זהה לתעריפי Claude API הסטנדרטיים, בתוספת $0.08 לשעת סשן פעילה. זמן סרק (המתנה לקלט) לא נספר. חיפוש אינטרנט עולה $10 לכל 1,000 חיפושים.
כן, Managed Agents תומך בחיבור לשרתי MCP חיצוניים ככלי נוסף. טוקני OAuth מאוחסנים ב-vaults מאובטחים והסוכן קורא לכלים דרך proxy ייעודי.
הסשן שורד תקלות - הוא מבוסס על לוג אירועים append-only. harness חדש מתעורר, שולף את הלוג ומחזיר את הסוכן לנקודה שבה הפסיק, ללא אובדן נתונים.
בהחלט. Managed Agents תומך ב-Bash, פעולות קבצים, חיפוש אינטרנט ו-MCP servers. צוותים משתמשים בו לסקירות קוד, יצירת בדיקות, עיבוד מסמכים ועוד. SDKs זמינים ב-Python, TypeScript, Go, Java, C#, PHP ו-Ruby.
Claude Managed Agents מייצג שינוי פרדיגמה באופן שבו מפתחים בונים ופורסים סוכני AI. במקום להשקיע חודשים בבניית תשתית - sandboxing, ניהול credentials, לולאות סוכן ו-context management - Anthropic מספקת הכל מוכן, מאובטח ומותאם לביצועים. הארכיטקטורה של הפרדת ה-“מוח” מה-“ידיים”, התמיכה ב-multi-agent orchestration, ושכבות האבטחה המתקדמות הופכים את Managed Agents לפתרון הכי מקיף שיש כרגע בשוק. עם תמחור מבוסס שימוש ($0.08 לשעת סשן), SDKs בשבע שפות, ולקוחות כמו Notion, Rakuten ו-Asana שכבר בפרודקשן - זו כבר לא רק הבטחה, אלא מציאות. העתיד של פיתוח סוכני AI כבר כאן.

צרו איתנו קשר עוד היום לתיאום הדרכת עיצוב בבינה מלאכותית מעשית שתצייד את הארגון שלכם בכלים המתקדמים ביותר בתחום!

4 באוגוסט 2026
נראה שסין פשוט מסרבת להוריד את הרגל מהגז. רק כמה שבועות אחרי ש-Moonshot הרעישה עם מודל הקוד הפתוח שלה, עכשיו תורה של עליבאבא. ב-3…
קרא עוד
4 באוגוסט 2026
בעולם ה-AI יש כלל לא כתוב: הגרסה הגדולה תמיד חזקה יותר מהגרסה הקטנה. אבל DeepSeek החליטה לשבור אותו. ב-31 ביולי 2026 הפך רשמית DeepSeek…
קרא עוד
26 ביולי 2026
אנתרופיק לא נחה לרגע, ובזמן שכולם עדיין מתרגלים לדור הקודם, היא כבר משחררת את הדור הבא. ב-24 ביולי 2026 הושק Claude Opus 5, ולדעתי…
קרא עוד