Anthropic הטמיעה עדכון משמעותי למודל Fable 5 שלה, המפחית באופן דרסטי את מספר השאילתות הביולוגיות התמימות שנחסמו על ידי שכבות הבטיחות שלה. התאמה אסטרטגית זו שואפת להשיב את התועלת למחקר מדעי לגיטימי תוך שמירה על אמצעי זהירות מחמירים מפני איומים ביולוגיים בסיכון גבוה.

הפחתת חיכוך עבור מחקר מדעי

בתגובה לביקורת מצד הקהילה המדעית, Anthropic הצליחה לצמצם את אחוזי ה"חיובי השגוי" (false positives) במסנני הבטיחות הביולוגיים של Fable 5 בכ-85 אחוזים. בעבר, מסווג הבטיחות של המודל היה אגרסיבי מדי, חסם לעיתים קרובות שאלות מדעיות לגיטימיות והפנה משתמשים למודל Opus 5 בעל היכולות הנמוכות יותר.

עדכון זה מאפשר לחוקרים ולאנשי מקצוע בתחום הרפואה למנף את יכולות ההסקה המלאות של Fable 5 למגוון רחב של משימות תמימות. משתמשים יכולים כעת לבצע פעולות מורכבות כגון פרשנות של תוצאות מעבדה, ניתוח תסמינים קליניים ומענה על שאלות רפואיות מתוחכקות מבלי להיתקל ב"חומה של בטיחות" שעיכבה בעבר את הפרודוקטיביות.

שמירה על מגבלות מפני סיכוני שימוש כפול

למרות ההקלה במגבלות הביולוגיה הכלליות, Anthropic שומרת על קו נוקשה בנוגע למחקר "שימוש כפול" (dual-use) — מידע שניתן להשתמש בו מחדש למטרות מזיקות. החברה לא הסירה את המגבלות בנושאים רגישים ביותר, כולל וירולוגיה, טוקסיקולוגיה ועיצוב מולקולרי מתקדם.

ההיגיון של Anthropic מבוסס על הטבע הייחודי של איומים ביולוגיים. בניגוד למתקפת סייבר, שניתן לצמצם את נזקיה באמצעות עדכוני אבטחה וכיבוי מערכות, סוכן ביולוגי ששוחרר הוא כמעט בלתי אפשרי ל"כיבוי" מרגע שהוא מתחיל להתפשט. החברה ציינה מספר חששות בעלי חשיבות מכרעת המניעים את הזהירות הזו, ביניהם:

  • ניתוחים של סוכנויות מודיעין בארה"ב בנוגע לסיכונים ביולוגיים.
  • מחקרים המראים כי ניתן להשתמש ב-AI כדי לעצב נגיפים סינתטיים לחלוטין.
  • ניסיונות מתועדים של משתמשים לבקש הוראות לייצור נשק ביולוגי ממודלי LLM קיימים.

איזון בין בטיחות לבין גישה מיוחדת

האתגר עבור מעבדות AI הוא לנווט במתח שבין קידום מדעי פתוח לבין מניעת שימוש לרעה קטסטרופלי. Anthropic מנסה לפתור זאת באמצעות פיתוח תוכניות גישה מיוחדות. תוכניות אלו נועדו לאפשר לחוקרים מאומתים גישה לתכונות מוגבלות — כגון אלו הנוגעות לוירולוגיה או מידול מולקולרי — בתוך סביבה מבוקרת ומבוקרת (audited).

על ידי הבחנה בין שאילתה רפואית תמימה לבין מחקר מסוכן בשימוש כפול, Anthropic מנסה לקבוע תקדים לאופן שבו מודלים מתקדמים (frontier models) מטפלים ב"חזית הביולוגית", תוך הבטחה שכלי הרפואה המודרניים לא יהפכו בטעות לכלי של טרור ביולוגי.

נקודות מרכזיות

  • הפחתה של 85% ב"חיובי שגוי": Anthropic הורידה משמעותית את המחסום עבור שאילתות ביולוגיה לגיטימיות, והפנתה משתמשים הרחק מהמודל המוגבל Opus 5.
  • מגבלות נוקשות על תחומים בסיכון גבוה: מגבלות מחמירות נותרו בתוקף עבור וירולוגיה, טוקסיקולוגיה ועיצוב מולקולרי כדי למנוע יצירת נשק ביולוגי.
  • גישה מבוקרת לחוקרים: Anthic בונה תוכניות גישה ספציפיות כדי לספק למדענים שעברו אימות את היכולות המוגבלות שהם זקוקים להן למחקר לגיטימי.

Anthropic הפחיתה בכ-85 אחוזים את חסימות ה"חיובי השגוי" על שאילתות ביולוגיות תמימות במודל Fable 5 שלה, ובכך החזירה לחוקרים את הגישה ליכולות ההסקה המלאות של המודל. השינוי שומר על אמצעי זהירות מחמירים בנושאים ביולוגיים בעלי שימוש כפול, וממשיך למנוע מהמודל לספק הוראות שעלולות לאפשר יצירת נשק ביולוגי.

מדוע העדכון חשוב

שכבת הבטיחות של Fable 5 כוילנה במקור כך שתטה לצד הזהירות, ותסווג מגוון רחב של שאלות מדעיות לגיטימיות כבעלות סיכון גבוה. משתמשים שביקשו פרשנויות שגרתיות של תוצאות מעבדה או ניתוח תסמינים קליניים הופנו באופן קבוע למודל Opus 5 בעל היכולות הנמוכות יותר. החסימה המוגזמת עוררה ביקורת מצד הקהילה המדעית, שטענה כי החיכוך פגע במחקר אמיתי ועיכב קבלת החלטות רפואיות. על ידי צמצום שיעור החיובי השגוי בכארבע חמישיות, Anthropic שואפת להחזיר את יכולות ההסקה המתקדמות של המודל לידי רופאים, ביולוגים ואנשי מקצוע אחרים הזקוקים להן למשימות יומיומיות.

כיצד שונו המסננים

The improvement stems from a retuned classifier that distinguishes between ordinary biomedical queries and those that touch on “dual-use” research—information that could be repurposed for harm. The new classifier still intercepts requests involving virology, toxicology, and advanced molecular design, but it lets through questions about standard diagnostics, symptom triage, and data interpretation.

Anthropic’s engineers noted that biological threats differ from cyber threats: once a pathogen is released, it cannot be patched or shut down. That reality drove the decision to keep a hard line on high-risk domains while loosening the net around routine medical inquiries.

What remains off-limits

The model continues to refuse requests that could facilitate the creation of harmful agents. Specifically, any prompt seeking:

  • detailed virology protocols that could aid virus synthesis,
  • toxicology pathways for weaponizable chemicals, or
  • step-by-step molecular engineering instructions.

Anthropic cited three sources for its caution: analyses from U.S. intelligence agencies highlighting biological risk, research showing AI can design fully synthetic viruses, and documented attempts by users to solicit bioweapon instructions from existing language models.

Access program for vetted scientists

To balance open research with security, Anthropic is rolling out a specialized access program. Verified researchers can apply for a controlled environment where the restricted capabilities are unlocked under audit. The program is designed to let legitimate scientists explore high-risk topics—such as novel vaccine platforms or pathogen modeling—without exposing the broader public to dangerous guidance.

Takeaway

By cutting 85 % of false-positive blocks while keeping strict dual-use bans, Anthropic aims to give researchers the power of its most capable model without opening the door to bioweapon design. The success of this calibrated safety strategy could set a template for how frontier AI models handle other high-stakes scientific fields.