WebMCP מאפשר לאפליקציות React לחשוף ממשקי API מובנים של כלים (tools) ישירות לסוכני AI, ובכך מחליף את שיטות ה-UI-scraping השבריריות בקריאות אמינות שאינן תלויות בממשק המשתמש. התכונה זמינה ב-origin-trial עבור Chrome 149 ומעלה, וניתן להפעיל אותה דרך chrome://flags/#enable-webmcp-testing.

הבעיה בללמד סוכנים ללחוץ

רוב הניסיונות הנוכחיים לאפשר לסוכני AI לתקשר עם דף אינטרנט מסתמכים על רמזים ויזואליים. סוכן מנתח את ה-DOM, מנחש איזה אלמנט הוא כפתור, מדמה לחיצות, גלילה ומילוי שדות בטפסים. ברגע שכפתור זז, תווית משתנה או פריסת הדף (layout) עוברת התאמה, הסקריפט נכשל. הגישה הזו איטית מכיוון שהיא ממתינה שהדפדפן ירנדר כל שלב, ועיצוב מחדש שגרתי עלול לשבור צינור אוטומציה שלם.

WebMCP משנה את המודל

WebMCP הוא תקן אינטרנט חדש שהוצג על ידי Google Chrome. במקום לחשוף משטח ויזואלי שהסוכן יחקור, דף מפרסם סט של כלים (tools) — פעולות בעלות שם וסוג (typed) שהדף יכול לבצע. סוכן AI שואל תחילה "אילו כלים זמינים?"; הדף עונה עם רשימה כגון "searchProducts" או "checkout". לאחר מכן, הסוכן מפעיל כלי על ידי שליחת JSON payload התואם לסכימת הקלט (input schema) שהוגדרה לכלי, למשל searchProducts(query: "jacket"). הדפדפן מנתב את הבקשה ישירות ל-JavaScript של הדף, שמריץ את הלוגיקה שבבסיס ללא כל מעורבות של ממשק המשתמש (UI).

התוצאה היא אינטראקציה מיידית, שעובדת ללא קשר לשינויי CSS ונשארת תפקודית כל עוד הגדרות הכלים נשארות יציבות.

יתרונות שחשובים למפתחים

  • מהירות – התקשורת נשארת בתוך מערכת ההודעות של הדפדפן, מה שמבטל את ה-round-trip של רינדור לחיצות והמתנה לעדכוני דף.
  • אמינות – הכלים קוראים לאותן פונקציות שהאתר כבר משתמש בהן עבור ממשק המשתמש שלו, כך שעיצוב מחדש אינו שובר את ה-API.
  • שליטה – מפתחים מחליטים אילו פעולות ייחשפו, אילו פרמטרים הן מקבלות ומה הסוכן יכול לראות בתגובה.
  • אי-תלות ב-UI – עיצוב (styling), פריסה (layout) או ארגון מחדש של רכיבים (component refactoring) כבר לא משפיעים על יכולתו של הסוכן להפעיל תכונה מסוימת.

WebMCP אינו מחליף את ה-MCP (Message-Channel-Protocol) הקיים המשמש בצד השרת. ה-MCP ממשיך לטפל בשליפת נתונים כבדה ובתזמור (orchestration) של צד השרת, בעוד WebMCP מטפל באינטראקציות חיות בתוך הלשונית (in-tab).

איך מפתחי React יכולים להתחיל

קוד React יכול לרשום כלים באמצעות JavaScript API אימפרטיבי או באמצעות HTML API דקלרטיבי מבוסס טפסים. תבנית נפוצה היא לעטוף את הרישום ב-custom hook:

  1. קריאה לפונקציית רישום עם שם הכלי ותיאור קצר.
  2. אספקת סכימת קלט (למשל, JSON schema המתארת שדות חובה).
  3. אספקת callback מסוג execute שמריץ את לוגיקת העסק הקיימת — לעיתים קרובות אותה פונקציה שקליקת כפתור הייתה מפעילה.

כאשר ה-hook רץ, הדפדפן מוסיף את הכלי ל-WebMCP manifest של הדף. סוכן AI שמגלה את ה-manifest יכול אז להפעיל את הכלי מבלי לגעת ב-DOM לעולם.

מכיוון שהרישום מתבצע בזמן ה-mount של הרכיב, ניתן להגביל את הכלים לנתיבים (routes) ספציפיים או לדגלי תכונות (feature flags), מה שמעניק לצוותים שליטה גרנולרית על מה שה-AI יכול לעשות בסביבת ייצור לעומת סביבת בדיקות.

אזהרות ודברים שצריך לשים לב אליהם

WebMCP הוא עדיין ב-origin trial. הוא עובד רק ב-Chrome 149+ ויש להפעילו ידנית באמצעות flag.

מה הלאה

גוגל פתחה את הניסוי למפתחים שרוצים להתנסות בחוויות אינטרנט AI-native. הצעדים הבאים לכל מי שמעוניין הם:

  • הפעלת ה-flag ב-Chrome וטעינה מחדש של האתר המיועד.
  • הוספת רישום כלי פשוט ברכיב React וצפייה ב-manifest מופיע ב-devtools של הדפדפן.
  • בדיקת AI client (למשל, סקריפט מקומי שעוקב אחר פרוטוקול WebMCP) כדי לקרוא לכלי ולאמת את התגובה.
  • מעקב אחר דף הסטטוס של הניסוי לקבלת עדכונים על שחרור גרסה יציבה.

בשורה התחתונה: WebMCP מעניק למפתחי React דרך להפוך את האפליקציות שלהם לניתנות לקריאה ישירות על ידי סוכני AI, והופך אלמנטים של UI לשירותים יציבים ובעלי סוג (typed). השינוי הזה מסיר את סיוט התחזוקה של screen-scraping ופותח נתיב לעבר אפליקציות אינטרנט AI-native אמיתיות — בתנאי שהצוותים מרגישים בנוח לעבוד בסביבת Chrome ניסיונית.