בניית סוכנים
בניית סוכנים מנוהלים והפעלתם
סוכן שאי אפשר להוכיח לפני שהוא יוצא לאוויר הוא סיכון. Agent Studio הוא המקום שבו סוכן ארגוני מתוכנן, נבדק מול מנגנון ההרשאה של ה-runtime עצמו, מפורסם כגרסה שניתן להשוות ולחזור ממנה, ואז מופעל - והכל על אותם מודלים שה-runtime אוכף, לעולם לא על העתק שלהם.
מתיאור ועד סוכן שפורסם
ארבעה שלבים, וכל אחד מהם מפיק משהו שבודק יכול לבחון, ולא לקבל על אמונה.
1 · הגדרה
הגדירו לסוכן בעלים עסקי וטכני, רמת סיכון, תקרת רגישות, והגבלות מפורשות על הכלים, הפעולות וסוגי המשימות שמותר לו להשתמש בהם. סיוע AI יכול לנסח את השדות האלה מתוך תיאור קצר - הוא אינו שומר דבר עד שאדם בודק ומאשר.
2 · הרשאות
הרשאות מפורשות למשאבים ולפעולות, כלים, תהליכי עבודה, ריצות מתוזמנות ואישורים אנושיים. מתחילים מתבניות מנוהלות ומתפקידים עסקיים, לא מדף ריק.
3 · הוכחה
Test Lab מעריך תרחישים באמצעות מנגנון ההרשאה של ה-runtime עצמו, במקום לממש אותו מחדש - כך שמה שעובר בבדיקה הוא מה שה-runtime יעשה. לצדו הערכת סיכון דטרמיניסטית - כלי עזר תחום, לעולם לא שיפוט של מודל, והיא כשלעצמה אינה חוסמת דבר.
4 · פרסום
פרסמו גרסה עם diff ברמת השדה שמראה היכן ההרשאות התרחבו, וחזרו משינוי הגדרה. אישורי גישה לעולם אינם נשמרים בתצלום, והרשאות משאבים חיות אינן מוחזרות על ידי rollback.
הפעלת סוכן שפורסם
מה שמפעיל רואה משסוכן פעיל, כולל החלקים שאינם מחמיאים. כל מספר להלן הוא התנהגות המוצר כיום, לא יעד.
- כל הרצה נרשמת עם הטריגר שלה, הסטטוס, קוד הסיבה, גרסת הסוכן המדויקת שתחתיה רצה, מספר השלבים וקריאות הכלים ומי הפעיל אותה. הרצה נקשרת לגרסה שתחתיה התחילה, כך שעריכה מאוחרת לעולם אינה משכתבת היסטוריה. נשמרים ארבעה סטטוסים: הושלמה, נעצרה, ממתינה לאישור, שגיאה.
- הרצה שנכשלה נרשמת עם סיבתה ונשארת זמינה כראיה, וכשל של סוכן אחד אינו עוצר את האחרים. אין ניסיון חוזר אוטומטי להרצה שנכשלה ואין התראה — סוכן מתוזמן פשוט נשקל שוב במועדו הבא, וכשל ממתין עד שמישהו יבחין בו. דוא"ל נשלח על בקשת אישור חדשה, לא על כשל.
- פעולה משמעותית - כתיבת נתונים, שלב בעל השפעה או רגישות גבוהה, קריאה חיצונית - נעצרת להכרעה אנושית הקשורה לתוכנית פעולה מדויקת. הפרדת תפקידים היא ברירת המחדל, וכל בדיקה שנכשלת שומרת עליה: הגדרה יכולה להתיר למבקש לאשר את בקשתו, ופרופיל ציות גובר על ההגדרה הזו ומחייב אדם שני בכל מקרה. עבודה לקריאה בלבד ובעלת השפעה נמוכה רצה בגבולות המדיניות ללא אישור.
- בקשת אישור תקפה 60 דקות; לאחר אישור, לביצוע יש חלון נפרד של 30 דקות. שניהם קבועים במוצר ואינם ניתנים להגדרה. בקשה שפג תוקפה נדחית ולא מבוצעת בשקט, והיא יוצאת מרשימת הבקשות ברות-הפעולה של המאשר.
- היסטוריית ההרצות מציגה את ההרצות החדשות ביותר — רשימה תחומה ולא ארכיון לחיפוש, וללא פילטרים כיום. מה שנשמר הוא מטא-נתוני ממשל: ההחלטה והראיה, לעולם לא ה-payload, ה-prompt או הסודות של הסוכן.
הרצת סוכן ממערכת אחרת
לקוח אינטגרציה מורשה יכול להתחיל הרצה מעל HTTP, לתשאל אותה ולבטל אותה. האימות הוא אישורי הלקוח של השער עצמו עם הרשאת agents:invoke מפורשת, ואותן בקרות לקוח חלות — רשימת כתובות IP מותרות, חלון פעילות ותקרה יומית. הרצה קצרה מחזירה את תוצאתה; ארוכה יותר מחזירה מזהה הרצה לתשאול.
זה מתחיל הרצות. זה אינו SDK לניהול מחזור חיים: יצירה, עריכה ופרסום של הגדרת סוכן נעשים ב-Agent Studio, ואין עבורם API ציבורי. תישאול מדווח על הרצה כ-running עם הזמן שבו התחילה, ולעולם אינו מנחש מצב סופי שאינו יכול לצפות בו.
runtime מנוהל, לא מסגרת פתוחה
Vayon AI מספקת runtime מנוהל לסוכנים ולתהליכי עבודה ארגוניים, עם הרשאות מפורשות למשאבים ולפעולות, כלים, ריצות מתוזמנות, אישורים אנושיים וריצות הניתנות לביקורת. סוכנים פועלים בגבולות המדיניות, וכל פעולה משנה נעצרת לאישור אנושי חד-פעמי - לא מסגרת פתוחה שמריצה קוד שרירותי.
שאלות נפוצות
האם ל-Agent Studio יש מערכת הרשאות משלו?
לא, וזו בדיוק הנקודה. Agent Studio משתמש באותם מודלי Agent, Workflow, Resource והרשאות שעליהם פועל ה-runtime. אין מערכת הרשאות מקבילה שתוכל להיפרד ממה שבאמת נאכף.
האם סוכן יכול להעניק לעצמו גישה רחבה יותר?
לא. הערכת המדיניות מצטלבת את סמכות המבצע, את ההרשאות של הסוכן עצמו, את זהות עומס-העבודה שלו ואת מדיניות הארגון - סוכן לעולם אינו יכול להרחיב את סמכותו שלו. לפני שפעולה מאושרת רצה, נבדקים מחדש טביעת האצבע של תוכנית הפעולה, גרסת הסוכן, מצב מחזור-החיים ותוקף האישור; אם הסוכן או תוכניתו השתנו, האישור כבר אינו תקף.
האם זו מסגרת להרצת קוד שרירותי?
לא. זהו runtime מנוהל לסוכנים ולתהליכי עבודה ארגוניים, עם הרשאות מפורשות למשאבים ולפעולות, כלים, ריצות מתוזמנות, אישורים אנושיים וריצות הניתנות לביקורת. סוכנים פועלים בגבולות המדיניות, וכל פעולה משנה נעצרת לאישור אנושי חד-פעמי.
