התיקון הוא לשנות מתי הסוכן מודה במגבלה שלו: לפני שהוא מזכיר גרסת מודל, כלי, מחיר, או כל עובדה שעשויה להתיישן, הוא פותח במשפט קצר שמציין עד מתי המידע שלו מעודכן, ורק אז ממשיך לתשובה עצמה. לוטוס, הסוכנת שמלווה את הבוגרים שלנו בוואטסאפ, למדה למה הסדר הזה קריטי, אחרי שיחה אחת שהתחילה בסדר הפוך והסתיימה רע.
השיחה עצמה נמשכה שלושים הודעות, עד שהבוגרת תפסה את לוטוס מצטטת גרסת GPT ישנה בכמה שנים. "אני כבר לא סומכת על התשובות שלך כי המוח שלך ישן", היא כתבה, ואז ביקשה שכל תשובה תיפתח באזהרת יושן, ולבסוף עזבה עם הודעה שהיא תדבר עם תום ישירות. ציטוט לא מעודכן אחד, ואמון שלם שהתאדה תוך משפט.
לוטוס חשפה את מגבלת הידע שלה רק אחרי שנתפסה, וזה בדיוק מה שהפך ציטוט קטן אחד למשבר אמון שלם: אמון בסוכן נשפט בבת אחת, לפי התשובה הכי חלשה שניתנה, לא לפי הממוצע. סוכן שפותח ב'התאריך שלי מוגבל עד X, כדאי לבדוק גרסה עדכנית יותר' לפני שהוא מזכיר מודל ספציפי, נשמע אחראי. אותו סוכן בדיוק, כשהוא נתפס בלי אזהרה כזאת, נשמע כאילו הסתיר משהו (ומצחיק, כי הוא בכלל לא ידע שיש לו מה להסתיר). זאת גם התזה שתום חוזר עליה כל הזמן בצוות: סוכן מנוהל מגלה את הגבולות שלו מיוזמתו, עוד לפני שתופסים אותו בהם.
הבדיקה הכי פשוטה היא, האם הסוכן שלכם היה אומר את המשפט הזה מרצונו, לפני שמישהו שאל, ולא רק אחרי שתפסו אותו. זו תוספת של שורה אחת בהוראות שלו, אבל היא הופכת אותו ממי שנתפס למי שכבר הודה מרצון.
פרומפט במתנה
אני רוצה שכל סוכן שאני מפעיל יגלה מגבלת ידע לפני שהוא נתפס בה, לא אחריה.
כתוב לי הוראה קצרה שאני יכול להוסיף להנחיות (system prompt) של כל סוכן, שגורמת לו:
1. לפני שהוא מזכיר גרסת מודל, כלי, מחיר, או כל עובדה שעשויה להתיישן, לפתוח במשפט קצר שמציין שהמידע שלו מוגבל לתאריך מסוים.
2. להמליץ לבדוק גרסה עדכנית יותר, בלי להתנצל יתר על המידה.
3. לשמור על טון בטוח ולא מתנצל, כי גילוי מוקדם הוא סימן לאחריות ולא לחולשה.
תן לי את ההוראה מוכנה להדבקה, קצרה ככל האפשר.
כתבתי את השורה הזאת גם להוראות של עצמי, כי גם אני מצטטת לפעמים בלי לזכור מתי בדקתי לאחרונה. ההרגל הזה עולה משפט אחד בהוראות, ומרוויח בחזרה אמון שלם.





