Anthropic מטמיעה כעת דפוס סטטיסטי נסתר — SynthID-Text — בכל תגובה של Claude. החברה אומרת שהמהלך עונה על קוד השקיפות (Transparency Code) של ה-EU AI Act ומעניק למפתחים דרך להוכיח שקטע טקסט מסוים הגיע ממודל בינה מלאכותית. סימן המים שורד עריכה קלה תוך שהוא משאיר את הפרוזה ללא שינוי עבור קוראים אנושיים.

מדוע מתווסף סימן המים

הרגולטורים האירופיים הפעילו לחץ על ספקי מודלי שפה גדולים (LLM) כדי להפוך תוכן שנוצר על ידי בינה מלאכותית למובחן מכתיבה אנושית. קוד השקיפות של ה-EU AI Act, שייכנס בקרוב לתוקף בכל רחבי הבלוק, מחייב מפתחים לספק שיטת זיהוי אמינה לכל טקסט שהמודלים שלהם מייצרים. Anthropic השיבה על ידי אימוץ טכניקת SynthID-Text שתוארה לראשונה על ידי Google DeepMind בשנה שעברה.

ההחלטה עוררה גל של דיונים ב-Reddit וב-X, שם משתמשים חששו שסימן המים עלול לפגוע באיכות הפלט או להפוך ל"דלת אחורית" למעקב. Anthropic טוענת כי הדפוס אינו נראה לעין עבור הקוראים, אינו מוסיף השהיה (latency), וניתן לכבותו עבור פריסות פרטיות. על ידי פרסום הפרטים הטכניים, החברה מקווה להרגיע את ההשערות ולהציב תקן (benchmark) בתעשייה.

כיצד SynthID-Text עובד

גלאי בינה מלאכותית מסורתיים סורקים אחר מוזרויות לשוניות — חזרתיות של ניסוחים, פיסוק מוזר או סטיות סטטיסטיות מכתיבה אנושית. אותות אלו נעלמים ברגע שאדם כותב מחדש פסקה, מה שהופך את הגלאים לבלתי אמינים. לעומת זאת, SynthID-Text מטמיע אות נסתר במהלך שלב בחירת הטוקנים (token-selection) של המודל.

כאשר Claude בוחר בין שני טוקנים סבירים באותה מידה — למשל “overcast” לעומת “grey” — המערכת מנחה את ההחלטה לכיוון זה שמתאים לדפוס בינארי שחושב מראש. לאורך מסמך, הנחיות אלו יוצרות רצף של ביטים ש-API לזיהוי יכול לשלוף מאוחר יותר. הדפוס הוא בעל השפעה נמוכה במכוון: המילה הנרדפת שנבחרת היא עדיין מילה טבעית לחלוטין, כך שזרימת הטקסט נותרת ללא שינוי. מכיוון שסימן המים נמצא בזרם הטוקנים ולא בטקסט הגלוי, הוא שורד את רוב העיבודים המאוחרים (downstream processing) שאינם מחליפים כל טוקן.

עמידות לעריכה: מה שורד ומה לא

ביקורת נפוצה היא שמשתמשים יכולים פשוט לערוך פרוזה שנוצרה על ידי בינה מלאכותית כדי למחוק את סימן המים. הבדיקות הפנימיות של Anthropic מפרטות שלושה תרחישי עריכה:

  • עריכה קלה – תיקון שגיאות כתיב, החלפת מספר תארים או שינוי סדר המשפטים. החתימה הסטטיסטית של סימן המים נשארת ברובה ללא שינוי מכיוון שרוב הטוקנים נותרים ללא שינוי.
  • עריכה כבדה בסיוע Claude – מתן הנחיה (prompting) ל-Claude לכתוב מחדש טיוטה שכבר מכילה משפטים שנוצרו על ידי בינה מלאכותית. אם המשתמש שומר על שליטה ברוב הניסוח, האות של סימן המים נחלש ביחס לכמות הטקסט החדש שנבחר על ידי האדם.
  • כתיבה מחדש מלאה – החלפת כל טוקן בתוצר חדש או בכתיבה ידנית מחדש. בנקודה זו סימן המים המקורי מושמד, אך הטקסט שנוצר כבר אינו עונה על ההגדרה של ה-EU ל"נוצר על ידי בינה מלאכותית" מכיוון שלא נותר עקבות של פלט המודל המקורי.

השורה התחתונה: סימן המים עמיד בפני ליטוש קל, אך לא בפני יצירה מחדש מלאה של התוכן.

יצירת קוד: היכן סימן המים נמצא

Claude נמצא בשימוש נרחב כעוזר תכנות, ומפיק הכל — החל מקטעי קוד של שורה אחת ועד למודולים של full-stack. שפות תכנות משאירות מעט מאוד מקום לבחירה במילים נרדפות; החלפת טוקן כמו “for” ב-“while” תשנה את הלוגיקה. לכן, Anthropic מצפה שסימן המים יופיע כמעט אך ורק בחלקים שבהם למודל יש חופש לבחור מילים — הערות (comments), docstrings ופרוזה הסברית המלווה את הקוד.

מכיוון שהחלק הפונקציונלי של הקוד נותר ללא שינוי, מפתחים לא אמורים לראות ירידה בנכונות או בביצועים. נוכחותו של סימן המים מוגבלת לטקסט הנלווה שעוזר לבני אדם להבין את הקוד, מה שמספק את דרישת השקיפות מבלי לפגוע בתועלת.

השפעות על התעשייה

Anthropic אינה פועלת לבדה. מספר מפתחי LLM אחרים חתמו על אותו קוד פרקטיקה (Code of Practice) הקורא ל-API זיהוי סטנדרטי. אם לוח הזמנים של אכיפת ה-EU יתקדם כמתוכנן, סימון במים עלול להפוך לשכבה ברירת מחדל במחסנית ה-LLM, בדומה לאופן שבו הצפנה משמשת כיום להעברת נתונים. חברות שיתעלמו מהדרישה מסתכנות בקנסות, באובדן גישה לשוק באירופה, או בהסרה כפויה של שירותיהן.

נקודות מחלוקת

Critics argue that a hidden signature, even if invisible, could be repurposed for tracking or attribution beyond regulatory compliance. They also fear false positives: a detection API that mislabels human-written text could undermine trust in platforms that rely on the signal. Anthropic acknowledges these risks and says the detection algorithm will be open-source, allowing independent audits and calibration.

Another practical worry is the computational overhead of generating the watermark. Anthropic reports that the additional processing adds less than a fraction of a percent to inference time, a claim that third-party benchmarks will soon test.

What to watch next

  • API rollout – Anthropic plans to release a public endpoint that extracts the hidden bit pattern from any Claude output. Developers will be able to integrate the check into content-moderation pipelines.
  • Standardization efforts – Regulatory bodies and industry groups are drafting a common format for watermark metadata, which could make cross-model detection easier.
  • Empirical studies – Independent researchers are beginning to probe the resilience of SynthID-Text against adversarial rewriting tools. Their findings will shape how much confidence platforms place in the signal.

Bottom line

Anthropic’s adoption of SynthID-Text gives the AI community a concrete tool to meet upcoming European transparency rules while keeping Claude’s output quality intact. The watermark survives everyday proofreading but falls away when text is fully regenerated, and it lives in the non-code parts of programming output where it does not interfere with functionality. Whether the approach becomes the industry norm hinges on how well the detection API performs in real-world settings and whether concerns about privacy and false alarms can be addressed.