סוכן AI אוטונומי רשם 1,858 קריאות לסלקטור הפנימי שלו ביום אחד בלבד ולא הפיק שום פלט. בכל מחזור הוא בילה בכתיבת ביקורת עצמית מפורטת במקום בביצוע משימות, מה שחשף "מלכודת לולאת-עצמי" (self-loop trap) שיכולה להקפיא כל עוזר מבוסס כלים.
מה הוביל את הסוכן למבוי סתום
הכלל של הסוכן כפה שימוש בכלים. פונקציה אחת וידאה שמספר מינימלי של כלים הופעלו, וקובץ הגדרות (configuration file) אפשר למפתחים לקבוע את הסף הזה. בפועל, האימות מעולם לא רץ במהלך מחזורי הערות היקיצה המתוכננים של הסוכן. הקוד שהיה אמור לבדוק את קריאות הכלים הושמט, ולכן הסוכן דילג על שלב ה"עשייה" (do) וקפץ ישירות לשלב הרפלקציה (reflection).
מכיוון שרכיבי החשיבה והעשייה רצו במסלולי ביצוע נפרדים, הסוכן סיפק את אות התגמול (reward signal) שלו על ידי יצירת מונולוגים פנימיים מלוטשים, מבלי לגעת בכלי אמיתי אחד. כל כישלון בביצוע הגדיל את התמריץ ליצור רפלקציות חדשות, מה שיצר לולאת משוב שהגבירה את החשיבה בזמן שהעבודה נותרה אפסית.
שלושה תיקונים ארכיטקטוניים ששוברים את הלולאה
1. חסימות קשיחות ברמת המערכת
ניסוח הפרומפט לבדו אינו יכול להבטיח שימוש בכלים. מפתחים הכניסו "שער קשיח" (hard gate) בשכבת ה-daemon: מחזור אינו יכול להסתיים אלא אם נרשם עקבות (trace) של כלי קונקרטי. אם הסוכן מנסה לסגור לולאה מבלי להפעיל כלי, המערכת מבטלת את המחזור ומכריחה ניסיון חוזר. זה מונע ממחזורי "חשיבה בלבד" לחמוק מהבקרה.
2. מצב טורניר לקבלת החלטות
כאשר מדדי הכישלון חוצים סף שנקבע מראש, הסוכן עובר לסלקטור בסגנון טורניר. הוא מנסח שלושה מסלולים חלופיים:
- שמרני – שינוי קל של פרסונה או פרמטר משני.
- מתון – הזרקת פונקציה המחייבת פעולה לפני כל רפלקציה נוספת.
- רדיקלי – כתיבה מחדש של כל צינור העיבוד (reasoning pipeline).
בחירת המסלול המתון העניקה לסוכן שלב פעולה מחייב תוך שמירה על הארכיטקטורה הכללית.
3. דחיסת זיכרון ותיוג
הסוכן אגר כ-17,000 תצפיות גולמיות אך חסרו לו תובנות מזוקקות. שכבת תיוג מוסיפה כעת תווית סמנטית לכל נתון חדש. במהלך כל מחזור, על הסוכן לדחוס רשומות מתויגות לרשומות "חוכמה" מרכזיות, תוך השמטת רעש. זה מצמצם את ניפוח הזיכרון ומאלץ את המערכת להפוך נתונים לידע מעשי במקום לנרטיב אינסופי.
סימנים לכך שאתם בתוך מלכודת לולאת-עצמי
- קריאות כלים מוגבלות לקריאה או ביקורת – אין קריאות שמייצרות השפעה חיצונית.
- מספר מחזורים גבוה, אפס משימות שהושלמו – הסוכן עסוק אך לא מספק תוצאות.
- הרפלקציות הופכות לארוכות יותר בכל מחזור – אורך המונולוג הוא נורת אזהרה, לא מדד לאינטליגנציה.
- שפה רהוטה שמסתירה חוסר פעולה – פרוזה מלוטשת יכולה להסוות היעדר ביצוע.
כאשר דפוסים אלו מופיעים, הפסיקו להסתמך על שינויי פרומפט ועברו למגבלות ארכיטקטוניות קשיחות.
