לקוח שאל פעם את עוזר התמיכה החדש והמבריק של חברה אם אפשר להחזיר מוצר אחרי 45 יום. העוזר ענה מיד, בחמימות, ובביטחון מוחלט: כן, בוודאי, יש לכם 90 יום. המדיניות האמיתית הייתה 30. אף אחד מעולם לא סיפר למודל מה המדיניות, אז כשהשאלה נחתה על פער, הוא עשה מה שמודלים כאלה עושים, והפיק משהו שנשמע נכון בול.
ההמצאה הבטוחה-בעצמה הזאת היא הדרך המהירה ביותר שיש לאבד אמון ב-AI, ויש לה שורש אחד: העוזר ענה מהזיכרון של עצמו במקום מהעובדות של החברה. התיקון הוא לא מודל חכם יותר. הוא למסור למודל את המקורות שלכם ולהתעקש שיענה מהם.
לענות מהמקורות, לא מהזיכרון
מערכת מעוגנת עושה משהו שצ'אטבוט רגיל לא. לפני שהיא עונה, היא מאחזרת מהחומר שלכם את הקטעים שבאמת נוגעים לשאלה, מדיניות ההחזרות, החוזה החתום, הרשומה של הלקוח עצמו, ומוסרת אותם למודל יחד עם השאלה, עם הוראה אחת: תענה רק ממה שקיבלת עכשיו, ותראה מאיפה כל טענה הגיעה. עכשיו הלקוח שומע 30 יום, לפי מדיניות ההחזרות, עם קישור לסעיף. הציטוט הוא לא קישוט. הוא הדרך שבה אדם בודק את התשובה תוך שניות במקום לקבל אותה באמונה.
ללמד אותו להגיד שהוא לא יודע
החצי השני של עיגון הוא רשות לסרב. כשהמקורות שאוחזרו באמת לא מכילים את התשובה, המערכת צריכה לומר זאת ולהעביר את השאלה לאדם, לא לטשטש את הפער בבדיה שוטפת. זו אותה משמעת של רף ביטחון שעומדת מאחורי ההוכחה ש-AI צודק לפני ההשקה: מתחת לרף שנקבע, הוא מוותר במקום לנחש. עוזר שמכיר את הגבול של מה שהוא יודע שימושי הרבה יותר, ובטוח הרבה יותר, מעוזר שתמיד בטוח בעצמו.
התשובה טובה בדיוק כמו מה שהוא מצליח לקרוא
עיגון הופך בשקט את הדיוק לבעיה של אחזור. אם המסמך הנכון חסר, מתויג לא נכון, או מפוזר בין שלוש מערכות, למודל אין על מה לעגן נכון ואתם חוזרים לנחש. לכן עבודה רצינית של AI מעוגן מתחילה בדרך כלל בחלק הלא זוהר, ניקוי וארגון של המקורות ותיחום מי מורשה לראות מה, כדי שהעוזר יאחזר תמיד רק את מה שהשואל מורשה לראות. עוזר של חברת ביטוח אחת המשיך להמציא תשובות עד שבדיוק העבודה הזאת בוצעה, ואותו שכתוב שתיקן את הדיוק הוא מה שהפך אותו לבטוח מספיק כדי להעמיד אותו מול העובדים.
הפער בין צ'אטבוט שעושה הדגמה מרשימה לבין מערכת שאפשר להעמיד מול לקוח, או מול רגולטור, הוא לא רהיטות. הוא שאלת המקור: מאיפה התשובה הגיעה. אחזרו את התשובה ממקור אמיתי, צטטו אותו, ותנו למערכת להודות בפערים שהיא לא יכולה למלא. ביטחון זול, ומודל ייתן לכם אותו בחינם. להיות צודק, ולהיות מסוגל להראות את העבודה שלכם, זה הדבר ששווה לבנות.
שאלות נפוצות
מה זה אומר לעגן את התשובה של AI?
זה אומר שהמערכת מאחזרת את הקטעים הרלוונטיים מהמסמכים שלכם עצמכם, ומורה למודל לענות רק מהם, תוך ציטוט המקור, במקום להסתמך על הזיכרון הכללי של המודל. את התשובה אפשר לעקוב חזרה עד מסמך אמיתי.
האם עיגון ימנע מה-AI להמציא דברים?
זה מפחית את זה בחדות, במיוחד בשילוב עם רף ביטחון שגורם למערכת לומר שהיא לא יודעת ולהעביר לאדם כשהמקורות שאוחזרו לא מכסים את השאלה, במקום להמציא תשובה שוטפת.
האם אנחנו צריכים דאטה מושלם לפני שמתחילים?
לא, אבל התשובה תמיד טובה בדיוק כמו מה שהמערכת מצליחה לאחזר. ניקוי, ארגון ותיחום של המקורות המרכזיים הם חלק מהעבודה, לא תנאי מקדים שחייבים לסיים קודם.