התשובה הקצרה
ארגונים נוטים להתייחס אל Human in the Loop Agentforce כאל פרויקט מערכת. בפועל מדובר בשינוי של תהליך, אחריות ומידע. המטרה היא לתכנן נקודות אישור לפי סיכון, הפיכות ורגישות. לכן איכות העבודה נמדדת פחות במספר הרכיבים שנבנו ויותר ביכולת של משתמשים ומנהלים לבצע תהליך אמין מקצה לקצה.
הגישה המומלצת היא להתחיל בהחלטה ובתהליך, לא בכלי. מטרת העבודה היא לתכנן נקודות אישור לפי סיכון, הפיכות ורגישות. לאחר מכן מתכננים את המידע, ההרשאות, האינטגרציות, הבדיקות והאימוץ בהתאם לרמת הסיכון. אם אחד המרכיבים עדיין אינו ידוע, מציינים זאת כהנחה ומקצים שלב שמטרתו לצמצם אי-ודאות לפני התחייבות רחבה.
בהקשר של Human in the Loop Agentforce, ההיבט הזה מתרחב מעבר לגבולות המאמר — הרקע המלא מופיע בAgentforce לארגונים.
מה ההחלטה שהמאמר עוזר לקבל?
המטרה איננה לייצר עוד רשימת Best Practices, אלא לאפשר לארגון לקבל החלטה אחראית לגבי Human in the Loop Agentforce. החלטה טובה מגדירה ארבעה דברים: תוצאה עסקית, Owner, גבולות פתרון וראיה שתוכיח שהפתרון עובד. ב-Salesforce יש כמעט תמיד כמה דרכי מימוש אפשריות; הערך של ארכיטקטורה הוא לבחור ביניהן לפי ההקשר ולתעד את ה-Trade-offs.
ארבעת מוקדי ההחלטה
| נושא החלטה | שאלה עסקית | שאלה ארכיטקטונית | ראיה נדרשת |
|---|---|---|---|
| סיווג פעולות לפי סיכון | איזה Outcome עסקי נדרש ומי אחראי עליו? | מהו מקור האמת ואילו הרשאות חלות? | תהליך מאושר ו-Baseline |
| Approval ו-Authentication | מה נכנס ל-Scope ומה נשאר במפורש בחוץ? | אילו מערכות, נתונים והחלטות תלויות בכך? | Scope, ADR ותלויות מתועדות |
| Escalation ו-Fallback | מי מבצע את העבודה ומה משתנה ביום-יום? | כיצד מטפלים בחריג, בעומס ובכשל חלקי? | תרחיש End-to-End ותוצאת בדיקה |
| Auditability ו-Exception handling | איזה KPI יוכיח שההחלטה יצרה ערך? | כיצד בודקים, מנטרים ומשנים בבטחה? | Dashboard, Sign-off ותוכנית תפעול |
סיווג פעולות לפי סיכון
השלב של סיווג פעולות לפי סיכון קובע את איכות ההחלטות שבאות אחריו. במקרה של Human in the Loop Agentforce, המשמעות היא Actions עם הרשאות מצומצמות, Validation ונקודות Human Approval. צריך לכתוב מי מקבל את ההחלטה, מהו הגבול ואיזו ראיה נדרשת לפני שמתקדמים. אחרת, פער קטן בהגדרה מתגלגל ל-Data Model, לאוטומציות, לבדיקות ולחוזה.
מבחינה ארכיטקטונית ותפעולית, יש לבחון את סיווג פעולות לפי סיכון דרך בעלות על מידע, הרשאות, סדר ריצה וטיפול בכשל חלקי. בדיקה מקצועית כוללת לא רק את ה-Happy Path אלא גם נתון חסר, משתמש ללא הרשאה, עומס, שינוי דרישה וכשל של מערכת תלויה. העיקרון המנחה כאן הוא Observability, משוב ו-Governance כחלק ממחזור החיים של הסוכן.
תוצר עבודה מתאים הוא Decision Log קצר שמציג את החלופות, ההנחות והסיבה לבחירה. הוא צריך להיות קצר מספיק לשימוש ושיטתי מספיק לביקורת: מטרה, Owner, הנחות, חלופות, החלטה, קריטריון קבלה ותאריך לבחינה מחדש. אם אין קריטריון קבלה או Decision Record עבור סיווג פעולות לפי סיכון, הנושא עדיין אינו בשל לפיתוח או להתחייבות מסחרית.
החלטה זו בתחום Human in the Loop Agentforce נשענת לרוב על עבודה מקדימה שמתוארת בAgentforce שירות לקוחות.
Approval ו-Authentication
Approval ו-Authentication הוא המקום שבו הנחות עמומות הופכות להתחייבויות תפעוליות. במקרה של Human in the Loop Agentforce, המשמעות היא בדיקות איכות ושימוש בתרחישי קצה לפני חשיפה ללקוחות או לעובדים. צריך לכתוב מי מקבל את ההחלטה, מהו הגבול ואיזו ראיה נדרשת לפני שמתקדמים. כאשר ההבחנה אינה ברורה, הצוות בונה לפי פרשנות והעסק בודק לפי ציפייה אחרת.
מבחינה ארכיטקטונית ותפעולית, יש לבחון את Approval ו-Authentication דרך נפח, Latency, יכולת בדיקה ויכולת חזרה לאחור. בדיקה מקצועית כוללת לא רק את ה-Happy Path אלא גם נתון חסר, משתמש ללא הרשאה, עומס, שינוי דרישה וכשל של מערכת תלויה. העיקרון המנחה כאן הוא בחירת Job-to-be-done מדיד במקום התחלה מצ'אטבוט כללי.
תוצר עבודה מתאים הוא מסמך תכנון שניתן לבדיקה ובו Owner, תלויות וקריטריוני קבלה. הוא צריך להיות קצר מספיק לשימוש ושיטתי מספיק לביקורת: מטרה, Owner, הנחות, חלופות, החלטה, קריטריון קבלה ותאריך לבחינה מחדש. אם אין קריטריון קבלה או Decision Record עבור Approval ו-Authentication, הנושא עדיין אינו בשל לפיתוח או להתחייבות מסחרית.
Escalation ו-Fallback
כדי לנהל נכון את Escalation ו-Fallback, צריך להפריד בין צורך, אילוץ ופתרון. במקרה של Human in the Loop Agentforce, המשמעות היא Observability, משוב ו-Governance כחלק ממחזור החיים של הסוכן. צריך לכתוב מי מקבל את ההחלטה, מהו הגבול ואיזו ראיה נדרשת לפני שמתקדמים. הפער בדרך כלל אינו מופיע ב-Demo הראשון; הוא מופיע בחריג, בעומס או בשינוי הבא.
מבחינה ארכיטקטונית ותפעולית, יש לבחון את Escalation ו-Fallback דרך Source of Truth, תלויות, חריגים ויכולת תחזוקה. בדיקה מקצועית כוללת לא רק את ה-Happy Path אלא גם נתון חסר, משתמש ללא הרשאה, עומס, שינוי דרישה וכשל של מערכת תלויה. העיקרון המנחה כאן הוא Grounding במקורות מידע מאושרים, עדכניים ומורשי גישה.
תוצר עבודה מתאים הוא תרחיש End-to-End שמתחיל באירוע עסקי ומסתיים בתוצאה נמדדת. הוא צריך להיות קצר מספיק לשימוש ושיטתי מספיק לביקורת: מטרה, Owner, הנחות, חלופות, החלטה, קריטריון קבלה ותאריך לבחינה מחדש. אם אין קריטריון קבלה או Decision Record עבור Escalation ו-Fallback, הנושא עדיין אינו בשל לפיתוח או להתחייבות מסחרית.
מי שנמצא בשלב מוקדם יותר מHuman in the Loop Agentforce ימצא רקע משלים במחיר Agentforce.
Auditability ו-Exception handling
ב-Auditability ו-Exception handling חשוב לאשר את ההיגיון לפני שמאשרים את המימוש. במקרה של Human in the Loop Agentforce, המשמעות היא בחירת Job-to-be-done מדיד במקום התחלה מצ'אטבוט כללי. צריך לכתוב מי מקבל את ההחלטה, מהו הגבול ואיזו ראיה נדרשת לפני שמתקדמים. העלות האמיתית של החלטה עמומה מתגלה לאחר שהפתרון כבר תלוי במערכות ובצוותים נוספים.
מבחינה ארכיטקטונית ותפעולית, יש לבחון את Auditability ו-Exception handling דרך Auditability, Least Privilege, ניטור ותהליך שינוי. בדיקה מקצועית כוללת לא רק את ה-Happy Path אלא גם נתון חסר, משתמש ללא הרשאה, עומס, שינוי דרישה וכשל של מערכת תלויה. העיקרון המנחה כאן הוא Actions עם הרשאות מצומצמות, Validation ונקודות Human Approval.
תוצר עבודה מתאים הוא מפת אחריות המפרידה בין העסק, צוות Salesforce, ספקים ומערכות חיצוניות. הוא צריך להיות קצר מספיק לשימוש ושיטתי מספיק לביקורת: מטרה, Owner, הנחות, חלופות, החלטה, קריטריון קבלה ותאריך לבחינה מחדש. אם אין קריטריון קבלה או Decision Record עבור Auditability ו-Exception handling, הנושא עדיין אינו בשל לפיתוח או להתחייבות מסחרית.
תהליך עבודה מומלץ
1. בחרו תהליך אחד ותוצאה עסקית
יש לנסח את התוצאה במונחי תהליך או סיכון: זמן מחזור, שיעור השלמה, איכות, קיבולת או חשיפה. יעד כמו 'להטמיע Salesforce' אינו מדד משום שהוא מתאר אמצעי ולא תוצאה. בהקשר של Human in the Loop Agentforce, השלב קשור במיוחד ל-סיווג פעולות לפי סיכון. העיקרון המקצועי הוא בדיקות איכות ושימוש בתרחישי קצה לפני חשיפה ללקוחות או לעובדים. התוצר צריך לציין קלט, Owner, החלטה, קריטריון קבלה ותלות; רק כך ניתן לדעת שהצוות התקדם ולא רק השקיע זמן.
2. מפו נתונים, ידע, הרשאות וסיכונים
האיסוף צריך להתבסס על ראיונות, צפייה בעבודה ונתונים קיימים. מסמך הנהלה לבדו כמעט תמיד מחמיץ חריגים, Shadow Systems ועבודה ידנית שמבצעים המשתמשים. בהקשר של Human in the Loop Agentforce, השלב קשור במיוחד ל-Approval ו-Authentication. העיקרון המקצועי הוא Observability, משוב ו-Governance כחלק ממחזור החיים של הסוכן. התוצר צריך לציין קלט, Owner, החלטה, קריטריון קבלה ותלות; רק כך ניתן לדעת שהצוות התקדם ולא רק השקיע זמן.
3. הגדירו Topics, Instructions ו-Actions
ב-To-Be יש להסיר שלבים שאינם יוצרים ערך לפני שמבצעים להם אוטומציה. כל דרישה מסווגת כ-Must, Should או Later ומקבלת Owner ותלות. בהקשר של Human in the Loop Agentforce, השלב קשור במיוחד ל-Escalation ו-Fallback. העיקרון המקצועי הוא בחירת Job-to-be-done מדיד במקום התחלה מצ'אטבוט כללי. התוצר צריך לציין קלט, Owner, החלטה, קריטריון קבלה ותלות; רק כך ניתן לדעת שהצוות התקדם ולא רק השקיע זמן.
4. הוסיפו Guardrails ו-Human-in-the-loop
הארכיטקטורה צריכה להיות מתועדת בהחלטות קצרות: מודל נתונים, גישה, Automation, Integration, Failure handling ויכולת תחזוקה. לכל החלטה מציינים חלופה שנפסלה והסיבה. בהקשר של Human in the Loop Agentforce, השלב קשור במיוחד ל-Auditability ו-Exception handling. העיקרון המקצועי הוא Grounding במקורות מידע מאושרים, עדכניים ומורשי גישה. התוצר צריך לציין קלט, Owner, החלטה, קריטריון קבלה ותלות; רק כך ניתן לדעת שהצוות התקדם ולא רק השקיע זמן.
5. בנו Test Set וקריטריוני איכות
בנייה במחזורים קצרים אינה פוטרת מתכנון. כל מחזור צריך להציג Vertical Slice עובד, עם נתונים והרשאות מייצגים, ולא אוסף מסכים שאינם משלימים תהליך. בהקשר של Human in the Loop Agentforce, השלב קשור במיוחד ל-סיווג פעולות לפי סיכון. העיקרון המקצועי הוא Actions עם הרשאות מצומצמות, Validation ונקודות Human Approval. התוצר צריך לציין קלט, Owner, החלטה, קריטריון קבלה ותלות; רק כך ניתן לדעת שהצוות התקדם ולא רק השקיע זמן.
6. השיקו לקבוצה מצומצמת ונטרו Traces
לפני Go Live מריצים תרחישים מלאים, עומסים רלוונטיים ו-Rehearsal. תקלות מסווגות לפי השפעה עסקית, ובעלי התהליך חותמים על קריטריוני הקבלה. בהקשר של Human in the Loop Agentforce, השלב קשור במיוחד ל-Approval ו-Authentication. העיקרון המקצועי הוא בדיקות איכות ושימוש בתרחישי קצה לפני חשיפה ללקוחות או לעובדים. התוצר צריך לציין קלט, Owner, החלטה, קריטריון קבלה ותלות; רק כך ניתן לדעת שהצוות התקדם ולא רק השקיע זמן.
7. שפרו ורק לאחר מכן הרחיבו שימוש
לאחר ההשקה מודדים שימוש, איכות ותוצאה מול Baseline. פריטים שלא עמדו ביעד נכנסים ל-Improvement Backlog עם Owner, עדיפות ותאריך בדיקה. בהקשר של Human in the Loop Agentforce, השלב קשור במיוחד ל-Escalation ו-Fallback. העיקרון המקצועי הוא Observability, משוב ו-Governance כחלק ממחזור החיים של הסוכן. התוצר צריך לציין קלט, Owner, החלטה, קריטריון קבלה ותלות; רק כך ניתן לדעת שהצוות התקדם ולא רק השקיע זמן.
תרחיש ארגוני לדוגמה
נניח חברת שירותים B2B שבוחנת Human in the Loop Agentforce. הארגון מפעיל כמה צוותים, חלק מהמידע נמצא ב-Salesforce וחלקו במערכות נוספות, והנהלה רוצה להתקדם מהר. בתרחיש כזה, התחלה מפיתוח הייתה מסתירה את המחלוקת לגבי סיווג פעולות לפי סיכון. הצוות בוחר תחילה תהליך אחד, מגדיר Owner, נתוני קלט ותוצאה רצויה, ורושם אילו מקרים יישארו מחוץ לגרסה הראשונה.
בסדנת התכנון מתגלה כי Approval ו-Authentication הוא התלות האמיתית. במקום להוסיף שדה או Flow נקודתי, הארגון מגדיר כלל עסקי, מקור אמת ותרחיש בדיקה. לאחר מכן נבנית גרסה מצומצמת בסביבה נפרדת, נבדקת עם משתמשים מייצגים ומושווית ל-Baseline. התוצאה אינה 'הצלחה מובטחת', אלא החלטה שמצמצמת סיכון ומייצרת ראיות לפני הרחבה.
מה שהתרחיש מלמד על Human in the Loop Agentforce הוא שסדר הפעולות קובע לא פחות מהבחירה הטכנולוגית: קודם מגדירים את התוצאה העסקית, אחריה מאמתים נתונים והרשאות, ורק אז בונים, בודקים ומרחיבים. בהקשר של Agentforce ו-AI, דילוג על אחד השלבים הוא בדרך כלל מה שמייצר עבודה חוזרת בהמשך.
את ההשלכות המעשיות של הנקודה הזו על Human in the Loop Agentforce פירטנו בנפרד בבדיקות Agentforce.
סיכונים נפוצים ופעולות מניעה
| סיכון | כיצד הוא נראה בפועל | פעולת מניעה |
|---|---|---|
| Actions ללא Guardrails | הסוכן מבצע פעולה רגישה ללא אימות | Least Privilege, Validation ו-Human Approval |
| בדיקות Happy Path בלבד | כשלי שפה, הקשר והרשאה מגיעים ל-Production | Test set מגוון ו-Red Teaming תפעולי |
| אין מדידת עלות | הצריכה גדלה בלי קשר לערך | תקציב, Telemetry ו-KPI עסקי לכל Use Case |
| Use case רחב מדי | אין דרך למדוד איכות או לשלוט בהתנהגות | להתחיל בתהליך אחד עם גבולות ברורים |
| Grounding חלש | תשובות נשענות על מידע לא מעודכן או לא מוסמך | מקורות מאושרים, Owner ו-SLA לעדכון |
ברמת הניהול של Human in the Loop Agentforce, הטבלה הזו היא נקודת פתיחה ולא Risk Register מלא. עבור Risk, Legal, Operations ו-AI Leads כדאי לתחזק רישום סיכונים ייעודי לאשכול Agentforce ו-AI, שבו לכל סיכון יש Owner, הסתברות, השפעה, פעולת מניעה ו-Trigger שמפעיל תוכנית תגובה לפני שהסיכון הופך לתקלה בייצור.
כיצד מודדים הצלחה
| תחום | מה מודדים | קצב בדיקה |
|---|---|---|
| Task success | שיעור השלמת המשימה בהתאם לקריטריון עסקי | שבועי |
| Escalation | העברות לאדם והסיבה להן | שבועי |
| Quality | דיוק Grounding, חריגות ותוצאות Scorers | בכל גרסה |
| Cost to outcome | צריכה ועלות ביחס למשימות שהושלמו | חודשי |
לצורך Human in the Loop Agentforce, כדאי לבחור שלושה עד חמישה מדדים בלבד לגרסה הראשונה. מדד טוב ניתן לחישוב לפני השינוי ולאחריו, קשור לבעל תהליך, ואינו ניתן לשיפור מלאכותי באמצעות הזנת נתונים טכנית בלבד. כאשר אין Baseline, יש להקדיש תקופה קצרה למדידת המצב הקיים ולא להציג שיפור על בסיס תחושה.
כאשר Human in the Loop Agentforce דורש עבודה מלווה ולא רק מסגרת עבודה, זהו התחום של שירות Agentforce ו-AI.
Checklist לפני קבלת החלטה
- ☐ הבעיה העסקית וה-Outcome מוגדרים במשפט אחד
- ☐ קיים Sponsor ובעל תהליך עם סמכות החלטה
- ☐ ה-Scope וה-Out of Scope כתובים
- ☐ מקורות המידע וה-Source of Truth ידועים
- ☐ מודל הרשאות ורגישות מידע נבדקו
- ☐ תרחישי חריג וכשל כלולים בתכנון
- ☐ קיימים קריטריוני קבלה שניתן לבדוק
- ☐ תלויות, הנחות וסיכונים מתועדים
- ☐ הוגדרו מדדי הצלחה ו-Baseline
- ☐ קיימת תוכנית תפעול, תמיכה ושינוי לאחר ההשקה
מקורות מקצועיים
- Salesforce – How Agentforce Works — https://www.salesforce.com/agentforce/how-it-works/
- Salesforce – Agentforce Guardrails — https://help.salesforce.com/s/articleView?id=ai.agent_plan_risks_guardrails.htm&language=en_US&type=5
- Salesforce – Agent Testing Custom Scorers — https://developer.salesforce.com/docs/ai/agentforce/guide/testing-api-custom-scorers.html
- HPI Pro – Agentforce ו-AI — https://hpi.pro/agentforce-ai
