Anthropic השיקה רשמית את המודלים המצופים מאוד Claude Fable 5.1 ו-Mythos 5.1, במטרה לענות על הביקוש הגובר לסוכני AI יעילים ובעלי ביצועים גבוהים. עדכון זה מתמקד בהפחתת עלויות תפעוליות, שכלול מנגנוני בטיחות ושיפור יכולות ההסקה (reasoning) עבור תהליכי עבודה מורכבים ורב-שלביים.
הפחתות עלויות דרסטיות עבור תהליכי עבודה סוכניים (Agentic Workflows)
אחד השינויים המשמעותיים ביותר בשחרור זה הוא מבנה התמחור האגרסיבי החדש שנועד למשימות "סוכניות" (agentic) — תהליכי עבודה שבהם ה-AI חייב לבצע מספר שלבים חוזרים ונשנים כדי להשלים מטרה. Anthropic טוענת כי Claude Fable 5.1 זול בדרך כלל ב-25% מהקודם לו, Fable 5, אך יכול להציע חיסכון של עד 45% עבור פעולות סוכניות מורכבות.
הפחתה עצומה זו מושגת באמצעות תמחור אופטימלי של נתונים במטמון (cached data). על ידי הורדת העלות עבור נתונים שכבר עובדו ואוחסנו, Anthropic הופכת את בניית סוכני ה-AI ארוכי-טווח ובעלי צריכת זיכרון גבוהה, המסתמכים על שליפת הקשר (context retrieval) חוזרת, למשתלמת מבחינה כלכלית עבור מפתחים.
יכולות קידוד והסקה עדיפות
המאמצים המוקדמים בתעשייה כבר מדווחים על קפיצות משמעותיות בביצועים. Dan Shipper, מנכ"ל Every, כינה את Fable 5.1 מודל הקידוד החזק ביותר הזמין כיום, וציין כי המודל לא רק מהיר ויעיל יותר בשימוש בטוקנים (token-efficient), אלא גם בעל טון שיחה טבעי יותר, דמוי אדם.
השיפורים חורגים מעבר ליצירת טקסט פשוטה וכוללים פרשנות נתונים מורכבת. מנכ"ל Box, Aaron Levie, ציין כי הסוכנים של החברה שלו המשתמשים ב-Fable 5.1 הצליחו לזהות דקויות ועמימות במאגרי נתונים שמודל Fable 5 הקודם החמיץ לחלוטין. יתרה מכך, מודל Mythos 5.1 הראה יעילות יוצאת דופן; נתוני בנצ'מרק (benchmark) מצביעים על כך ש-Mythos 5.1 במצב "low reasoning" מתפקד ברמה של הגדרות ה-"Max reasoning" של הדור הקודם, מה שמהווה קפיצה אדירה ביעילות הארכיטקטונית.
מנגנוני הגנה משופרים ופרטיות ארגונית
Anthropic מתייחסת גם לביקורות ארוכות שנים בנוגע למסנני בטיחות "קנאיים" מדי. Fable 5.1 כולל מנגנוני הגנה מדויקים יותר, מה שמפחית את הסבירות להפעלת התראות שווא (false positives) על שאילתות תמימות, כגון שאלות ביולוגיה בסיסיות. בעוד ש-Mythos 5.1 שומר על הגבלות ביולוגיות מחמירות יותר, המטרה הכוללת היא חווית משתמש ממוקדת-תועלת.
בניצחון גדול עבור אבטחת מידע ארגונית, Anthropic הכריזה על ה-"Enterprise Frontier Safeguards" שלה. תכונה זו, שתצא לדרך מאוחר יותר בסתיו הקרוב, מאפשרת "פרטיות מלאה" על ידי מתן אפשרות ללקוחות לאחסן נתונים בשרתי הענן שלהם עצמם במקום בתשתית של Anthropic. בנוסף, בעוד ש-Fable 5.1 מורשה כעת לזיהוי פגיעויות תוכנה, Anthropic שומרת על גבול ברור על ידי הפניית משימות בסיכון גבוה — כגון יצירת אקספלויטים (exploit generation) ובדיקות חדירות (penetration testing) — למודלי ה-Opus החזקים יותר שלה.
נקודות מרכזיות
- יעילות כלכלית: Claude Fable 5.1 מציע עלויות נמוכות בשיעור של עד 45% למשימות סוכניות באמצעות תמחור אופטימלי של נתונים במטמון.
- שיפור בביצועים: משוב ראשוני מדגיש יכולות קידוד עדיפות, טיפול טוב יותר בעמימות בנתונים ויעילות הסקה משופרת.
- פרטיות משופרת: ה-"Enterprise Frontier Safeguards" החדשים יאפשרו לעסקים לאחסן נתונים בשרתי הענן שלהם כדי להבטיח פרטיות מוחלטת.
