З уразливістю до порушення приватності, пов'язаною з Anthropic Claude, виникла проблема: приватні розмови та «Artifacts» стали доступними для пошуку в Google. Цей інцидент протиставляє функцію спільного використання користувачами принципам веб-індексації в епоху ШІ.

Механізм витоку

Користувачі Reddit виявили порушення за допомогою операторів Google, таких як site:claude.ai/share, що дозволило обійти передбачену приватність функції «share chat». Claude попереджає, що «будь-хто, хто має посилання, може переглянути його», проте ця функція призначена для цільового обміну інформацією, а не для глобальної видимості.

На відміну від Google Docs, який за замовчуванням блокує пошукових роботів, спільні URL-адреси Claude були проіндексовані Google, що дозволило будь-кому випадково знайти конфіденційну інформацію через звичайний пошук.

Конфіденційні дані та контент під загрозою

Такі видання, як Futurism та TechCrunch, повідомили, що проіндексовані результати містили:

  • Персональні дані (PII): імена та номери телефонів дітей молодшого шкільного віку.
  • Медичні записи: детальні результати клінічних випробувань та реальні звіти пацієнтів.
  • Корпоративна розвідка: документи з позначкою «internal use only» та оцінки ефективності роботи працівників.
  • Технічні активи: фрагменти коду та робочі нотатки з функції «Artifacts» у Claude.

Деякі розкриті чати також пройшли повз фільтри безпеки Anthropic, містячи контент сексуального характеру, що викликало додаткові занепокоєння щодо модерації.

Реакція Anthropic та Google

Anthropic захистила свою архітектуру, заявивши, що вона не передає каталоги чатів або карти сайтів (sitemaps) пошуковим системам. Речниця Amie Rotherham пояснила, що посилання для обміну з'являються в результатах пошуку лише після того, як користувачі публікують їх на зовнішніх платформах, доступних для сканування, і що ці URL-адреси «неможливо вгадати». Як тільки посилання потрапляє «у відкритий доступ», воно може бути архівоване третіми сторонами.

Речник Google Ned Adriance підтвердив, що пошукові системи індексують усе, що можуть знайти, якщо власники сайтів явно не заблокують сканування. Тести свідчать про те, що витік було видалено з індексу Google, проте подібний інцидент минулого року також призвів до індексації сотень чатів Claude.

Чому це важливо для користувачів ШІ

Розробники та засновники, які інтегрують LLM, повинні ставитися до «спільних посилань» як до публічних, а не захищених. Оскільки інструменти ШІ переходять від ролі персональних помічників до ролі корпоративних співробітників, межа між публічним вебконтентом і приватними даними потребує технічного забезпечення, а не лише попередження у вигляді підказки.

Основні висновки

  • Перевірте свої налаштування: Перейдіть у Settings → Privacy → Shared Chats у Claude та анулюйте всі активні публічні посилання.
  • Ставтеся до посилань для обміну як до публічних: Припускайте, що будь-яке згенероване ШІ посилання може бути проіндексоване пошуковими системами.
  • Корпоративна обережність: Впроваджуйте сувору політику щодо функцій «share», щоб запобігти випадковим витокам пропрієтарного коду або конфіденційних персональних даних (PII).

Платформа Claude AI від Anthropic ненавмисно розкрила приватні чати та «Artifacts» після того, як Google проіндексував URL-адреси посилань для обміну, зробивши конфіденційні розмови доступними для пошуку. Користувачі Reddit помітили витік за допомогою специфічного запиту в Google, що призвело до розкриття особистих, медичних та корпоративних даних.

Як стався витік

Функція «share chat» у Claude створює URL-адресу, про яку інтерфейс попереджає, що її може переглянути будь-хто, хто її має. Мета полягає в тому, щоб передати посилання колезі, а не поширювати його публічно. Оскільки URL-адреси знаходяться в домені claude.ai/share, публікація посилання на будь-якому публічно доступному для сканування сайті — форумах, у соціальних мережах або в коментарях на Reddit — дозволяє пошуковому роботу Google перейти за ним.

Користувачі Reddit виявили проблему, використавши пошуковий запит site:claude.ai/share у Google, що повернуло розмови, які мали залишатися приватними. На відміну від Google Docs, чиї спільні посилання за замовчуванням захищені від індексації, посилання Claude не мали такого захисту, що дозволило пошуковій системі каталогізувати їх.

Що було розкрито

Кілька видань повідомили, що проіндексовані результати містили:

  • Персональні дані (PII): імена та номери телефонів дітей молодшого шкільного віку.
  • Медичні записи: детальні дані клінічних випробувань та реальні звіти пацієнтів.
  • Корпоративна розвідка: документи з позначкою «internal use only», оцінки ефективності роботи працівників та інша пропрієтарна інформація.
  • Технічні активи: фрагменти коду, робочі нотатки та інші артефакти, створені за допомогою функції «Artifacts» у Claude.

У кількох випадках публічно доступні чати також містили контент, який пройшов повз фільтри безпеки Anthropic, створюючи матеріали сексуального характеру.

Реакція Anthropic

Anthropic стверджує, що вона не публікує каталоги чатів або карти сайтів для пошукових систем. Представник компанії пояснив, що посилання, якими діляться користувачі, з'являються в результатах пошуку лише після того, як користувач розмістить URL на зовнішній платформі, доступній для сканування, і наголосив, що ці URL «неможливо вгадати». Щойно посилання навмисно опубліковано в мережі, компанія не може контролювати архівування сторонніми сервісами.

Позиція Google

Google підтвердив, що він не вирішує, який контент є публічним; він індексує те, що може знайти, якщо сайт явно не блокує сканування. Компанія заявила, що поважає такі директиви, як robots.txt або метатеги, які запитують виключення. Попередні тести після інциденту свідчать про те, що розкриті URL були видалені з індексу Google, хоча Google не підтвердив постійне виправлення.

Чому це важливо для користувачів ШІ

Цей епізод підсвічує ширший ризик у міру того, як великі мовні моделі переходять від ролі персональних помічників до інтеграції в робочі процеси підприємств. «Посилання для спільного доступу» — це механізм зручності, який може зібрати будь-який сканер. Для організацій, що працюють із регульованими даними — медичними записами, оцінками працівників, пропрієтарним кодом — припущення, що посилання є безпечним лише тому, що воно «просто поширене», може призвести до дороговартісних витоків.

Контраргумент: обмеження платформ

Anthropic стверджує, що відповідальність лежить на користувачах, які публікують посилання. Платформа попереджає, що будь-хто, хто має URL, може переглянути вміст, і вона не розкриває URL у публічному каталозі. Google у відповідь зазначає, що не може контролювати кожне приватне посилання, яке з'являється в мережі; його роль полягає в тому, щоб виконувати запити власників сайтів не потрапляти в результати пошуку.

Обидві позиції є технічно правильними, проте вони залишають прогалину: досвід користувача не робить ризик індексації очевидним, а платформа не застосовує автоматично директиви "no-index" до сторінок, якими діляться. Таким чином, тягар запобігання випадковому публічному розкриттю даних лягає на користувачів, які можуть не усвідомлювати, наскільки легко знайти посилання за допомогою простого пошукового запиту.

За чим стежити далі

Практичні кроки для користувачів

  • Аудит активних посилань: Відкрийте налаштування Claude, перейдіть до розділу конфіденційності для спільних чатів і відкличте всі URL, які вам більше не потрібні.
  • Ставтеся до кожного посилання для спільного доступу як до публічного: Припускайте, що щойно посилання опубліковано будь-де в інтернеті, воно може бути проіндексоване, якщо не встановлено явне блокування.
  • Корпоративний контроль: Впроваджуйте інструменти моніторингу, які фіксують створення посилань для спільного доступу, що містять такі ключові слова, як "PII", "confidential" або "internal", і впроваджуйте робочі процеси схвалення, перш ніж такі посилання покинуть корпоративну мережу.

Інцидент із Claude нагадує нам, що зручність миттєвого обміну даними може стати фактором ризику, коли веб переглядає ці посилання як звичайні сторінки. Поки платформи не почнуть автоматично захищати посилання, якими діляться, користувачі мають залишатися пильними.