Google이 게임의 규칙을 바꿨습니다. 지난주에 Google Lens로 사진을 찍었거나, Google Translate로 스페인어 문장을 소리 내어 연습했거나, Maps에 점심 식사 장소를 물어봤다면, 그 콘텐츠는 이제 회사의 생성형 AI 모델을 학습시키기 위한 대기열에 쌓여 있을 수 있습니다. Google은 최근 사용자가 생태계 전반에서 업로드하는 이미지, 오디오 클립, 비디오를 보관하고 머신러닝 시스템 구축에 사용할 수 있도록 개인정보 보호 아키텍처를 재편했습니다. 이는 공개된 웹 페이지를 스크래핑하는 방식에서 벗어나, 사람들이 매일 Google 제품과 나누는 직접적이고 의도가 명확한 상호작용을 수집하는 방향으로 의도적으로 전환한 것입니다.

조용한 정책 변화

이것은 일상적인 서비스 약관 업데이트가 아닙니다. 수년 동안 대규모 AI 모델을 학습시키는 표준 방식은 이미 세상에 공개된 수십억 개의 공개 웹 페이지를 크롤링하여 텍스트, 이미지, 링크를 수집하는 것이었습니다. 그 방식에는 한계가 있습니다. 오픈 웹은 유한하며, 많은 분야에서 가장 가치 있는 공개 데이터는 이미 추출되어 기존 시스템에 입력되었습니다. Meta와 같은 경쟁사들도 최근 사용자 생성 콘텐츠를 활용하는 방향으로 움직이고 있으며, Google 역시 이제 같은 방향으로 나아가고 있습니다.

이번 업데이트는 두 가지 새로운 개인정보 보호 제어 기능인 Search Services HistoryPersonalized Recommendations를 소개하는 고객 이메일을 통해 사용자에게 전달되었습니다. 표면적으로는 다음 검색을 빠르게 하거나 추천을 정교화하기 위한 표준 개인화 도구처럼 들립니다. 하지만 세부 조항을 읽어보면 그 범위가 명확해집니다. Google은 저장된 미디어가 "AI 모델 및 안전 조치를 포함한 Google 서비스 및 기술을 개발하고 개선하는 데" 사용될 수 있다고 명시합니다. 문구는 포괄적이고, 기본 설정은 '켜짐' 상태이며, 이를 해제하려면 어디를 찾아봐야 하는지 직접 알아내야 합니다.

Google이 실제로 원하는 것

데이터 수집 범위는 사용자가 접하는 거의 모든 주요 Google 서비스를 아우릅니다. 관광객이 Google Lens로 외국 거리 표지판이나 저녁 메뉴를 비추면, 시각적 입력 데이터는 결과가 나타난 후 단순히 사라지지 않습니다. 학생이 Google Translate를 사용하여 소리 내어 말하기 연습을 할 때, 해당 세션 중에 캡처된 오디오 녹음은 보관 대상이 됩니다. Search Live 또는 표준 음성 검색을 통해 전송된 음성 쿼리도 동일한 정책의 적용을 받습니다. Maps, Shopping, Flights, Hotels, News와의 일상적인 상호작용조차도 Google이 이제 학습 자료로 분류하는 미디어를 생성할 수 있습니다.

이전에는 개인정보 보호를 중요하게 생각하는 사용자들이 Web & App Activity 스위치를 사용하여 Google이 이 상호작용 데이터를 얼마나 보유할지 제한할 수 있었습니다. 그 전략은 더 이상 통하지 않습니다. Google은 이 새로운 설정들을 Web & App Activity와 명시적으로 분리했습니다. Search Services History는 독립적인 제어 기능입니다. 기본적으로 켜져 있으며, 2~3년 전에 개인정보 보호 대시보드에서 어떤 선택을 했더라도 검색 관련 미디어가 AI 학습을 위해 저장되는 것을 막을 수 없습니다. 기존의 '끄기' 스위치는 더 이상 이 특정 회로를 제어하지 않습니다.

실제로 거부(Opt Out)하는 방법

Google이 수동으로 설정을 변경할 수 있는 기능을 제공하긴 하지만, 그 책임은 전적으로 사용자에게 있습니다. 한 번의 클릭으로 AI 학습 데이터 수집을 비활성화하는 계정 전체 토글 스위치는 없습니다. Google 계정 대시보드 내의 두 가지 특정 페이지인 Search Services History 페이지와 Search Services Personalization 페이지를 방문해야 합니다.

Search Services History에 접속하면 "Save Media" 체크박스가 보일 때까지 스크롤하십시오. 체크를 해제하십시오. 이 단 한 번의 작업이 향후 이미지, 오디오, 비디오가 저장되어 모델 학습에 사용될 가능성을 방지합니다. Web & App Activity를 비활성화하면 이 문제가 해결될 것이라고 생각하지 마십시오. 그렇지 않습니다. 분리 방식이 명시적이지만 놓치기 쉽기 때문에, 많은 사용자가 거부 설정을 했다고 믿지만 실제로는 그렇지 않은 상황이 발생할 수 있습니다.

미디어 저장을 비활성화한 후, 동일한 대시보드에서 자동 삭제 설정을 구성하십시오. Google은 3개월, 18개월, 36개월 후 데이터를 삭제하는 세 가지 옵션을 제공합니다. 가장 엄격한 제어를 원한다면 3개월 옵션을 선택하십시오. 이는 Google이 이 제어 기능을 통해 허용하는 가장 짧은 정리 주기이며, 과거 상호작용 데이터의 누적을 제한합니다. Save Media를 꺼두면 향후 수집은 중단된다는 점을 명심하십시오. 이전 설정에 따라 Google이 이미 기록한 모든 데이터는 동일한 계정 도구를 통해 기존 기록을 수동으로 삭제하지 않는 한 저장소에 남아 있을 수 있습니다.

If you manage a shared family account or a workspace where multiple people interact with Google services, everyone with access should check these settings individually. Personalization controls are tied to the account, not the device, and the default opt-in applies across the board.

이것이 AI의 다음 단계에 대해 말해주는 것

이번 정책 변경은 업계가 어디로 향하고 있는지에 대한 명확한 신호입니다. 공개된 웹은 이미 학습 자료로서 철저히 채굴되었습니다. 거대 언어 모델(LLM)과 멀티모달 시스템을 개선하기 위한 다음 개척지는 폐쇄형 플랫폼 내부에서 실제 사용자들이 생성하는 독점 데이터입니다. 사용자의 시각적 검색에는 공간적 맥락이 포함되어 있습니다. 번역 연습 세션에는 발음 패턴과 대화 의도가 담겨 있습니다. 음성 쿼리에는 정적인 웹 텍스트가 복제할 수 없는 어조, 문구, 긴급성이 포함되어 있습니다.

개발자, 창업자, 그리고 경쟁 구도를 지켜보는 모든 이들에게 시사하는 바는 명확합니다. 하나의 거대 언어 모델을 다른 모델과 차별화하는 '데이터 해자(data moat)'는 점점 더 플랫폼 자체 사용자층의 개인적인 상호작용과 업로드 데이터로부터 구축되고 있습니다. 오픈 소스 웹 크롤링은 여전히 유용하지만, 이제 가장 가치 있는 데이터는 서비스에 로그인하여 무언가를 능동적으로 수행하는 과정에서 생성되는 데이터입니다.

결론

기존의 개인정보 보호 방식은 이제 시대에 뒤떨어졌습니다. Google의 새로운 학습 데이터 체제에서는 Search Services History 내에서 'Save Media' 상자의 체크를 해제함으로써 구체적이고 의도적인 옵트아웃(opt-out)을 수행해야 합니다. 이 조치를 짧은 자동 삭제 기간과 결합하는 것이 사용자가 업로드한 이미지, 오디오, 비디오를 Google의 AI 학습 파이프라인에서 제외할 수 있는 유일하고 확실한 방법입니다. 이 정보를 주변에 알리세요. 이제 기본 설정은 더 이상 사용자에게 유리하게 설정되어 있지 않습니다.