Googleはゲームのルールを変えました。先週、Google Lensで写真を撮ったり、Google Translateでスペイン語のフレーズを声に出して練習したり、あるいはMapsでランチの場所を探したりした場合、そのコンテンツは現在、同社の生成AIモデルをトレーニングするためのキュー(待ち行列)に並んでいる可能性があります。Googleは最近、プライバシーアーキテクチャを再構築し、ユーザーがそのエコシステム全体でアップロードした画像、音声クリップ、ビデオを保持し、機械学習システムの構築に使用できるようにしました。これは、公開されているウェブページをスクレイピングする手法から、人々が毎日Google製品に対して行う、直接的で意図の高いインタラクションを収穫する手法への、意図的な転換です。
静かなポリシーの転換
これは、単なる定期的な利用規約の更新ではありません。長年、大規模なAIモデルをトレーニングするための標準的な手法は、数十億もの公開ウェブページをクロールし、すでに世界中に公開されているテキスト、画像、リンクを収集することでした。しかし、そのアプローチには限界があります。オープンなウェブは有限であり、多くの領域において、最も価値のある公開データはすでに抽出され、既存のシステムに投入されています。Metaのような競合他社も最近、ユーザー生成コンテンツの活用へと舵を切っており、Googleも今、同じ方向に動き出しています。
このアップデートは、2つの新しいプライバシー管理機能、Search Services HistoryとPersonalized Recommendationsを紹介するカスタマーメールを通じてユーザーに通知されました。表面上、これらは次のクエリを迅速化したり、推奨事項を洗練させたりするための標準的なパーソナライゼーションツールのように聞こえます。しかし、細かい注意書きを読むと、その範囲が明らかになります。Googleは、保存されたメディアは「AIモデルや安全対策を含む、Googleのサービスおよびテクノロジーの開発と改善」に使用される可能性があると述べています。文言は広範であり、デフォルト設定は「オン」になっており、オプトアウトするにはどこを確認すべきかを知っておく必要があります。
Googleが実際に求めているもの
データ収集の傘は、ユーザーが触れるほぼすべての主要なGoogleサービスをカバーしています。観光客がGoogle Lensを外国の道路標識やディナーメニューに向けるとき、その視覚的な入力は、結果が表示された後に単に消え去るわけではありません。学生がGoogle Translateを使用して声に出して話す練習をするとき、それらのセッション中にキャプチャされた音声録音は、保持の対象となります。Search Liveや標準の音声検索を通じて送信される音声クエリも、同じポリシーの対象となります。Maps、Shopping、Flights、Hotels、Newsとの日常的なやり取りでさえ、Googleが現在トレーニング素材として分類するメディアを生成する可能性があります。
以前であれば、プライバシーを重視するユーザーは、Web & App Activityのスイッチを利用して、Googleが保持するインタラクションデータの量を制限することができました。しかし、その戦略はもはや通用しません。Googleは、これらの新しい設定をWeb & App Activityから明示的に切り離しました。Search Services Historyは独立したコントロールです。これはデフォルトでオンになっており、あなたが2、3年前にプライバシーダッシュボードで行ったどのような選択も、検索関連のメディアがAIトレーニングのために保存されることを防ぐことはできません。古い「オフ」スイッチは、もはやこの特定の回路を制御していないのです。
実際のオプトアウト方法
Googleは手動による上書き設定を提供していますが、その負担は完全にユーザー側にあります。ワンクリックでAIトレーニング用のデータ収集を無効にするアカウント全体のトグルスイッチは存在しません。Googleアカウントのダッシュボード内にある、Search Services HistoryページとSearch Services Personalizationページの2つの特定のページにアクセスする必要があります。
Search Services Historyに入ったら、**"Save Media"**のチェックボックスが見つかるまでスクロールしてください。そのチェックを外します。この単一のアクションこそが、将来の画像、音声、ビデオが保存され、モデルのトレーニングに投入されるのを防ぐ方法です。Web & App Activityを無効にすれば、これが自動的に処理されると考えてはいけません。そうはならないのです。この切り離しは明示的であり、見落としやすいため、多くのユーザーはオプトアウトしたつもりでも、実際にはできていないという状況に陥ります。
メディアの保存を無効にした後、同じダッシュボード内で自動削除の設定を行ってください。Googleは、3ヶ月、18ヶ月、36ヶ月の3つの選択肢を提供しています。最も厳格に管理したい場合は、3ヶ月の期間を選択してください。これは、このコントロールを通じてGoogleが許可している最短のクリーンアップサイクルであり、過去のインタラクションの蓄積を制限できます。なお、「Save Media」をオフにすると、将来の収集は停止しますが、以前の設定に基づいてGoogleがすでにログに記録したものは、同じアカウントツールを使用して既存の履歴を手動で削除しない限り、ストレージに残る可能性があることに注意してください。
共有のファミリーアカウントや、複数の人が Google サービスを利用するワークスペースを管理している場合は、アクセス権を持つ全員が個別にこれらの設定を確認する必要があります。パーソナライズ設定はデバイスではなくアカウントに紐付いており、デフォルトのオプトイン設定は全体に適用されます。
これがAIの次なるフェーズについて示唆していること
このポリシー変更は、業界がどこに向かっているのかを示す明確なシグナルです。公開されているウェブは、学習素材として徹底的に使い尽くされました。大規模言語モデルやマルチモーダル・システムの向上における次のフロンティアは、クローズドなプラットフォーム内で実在のユーザーによって生成される独自のデータです。画像検索には空間的なコンテキストが含まれます。翻訳の練習セッションには、発音パターンや会話の意図が含まれます。音声クエリには、静的なウェブテキストでは再現できないトーン、言い回し、そして緊急性が含まれています。
開発者、創業者、そして競争環境を注視しているすべての人にとって、その意味するところは明快です。ある大規模言語モデルと別のモデルを隔てる「データの堀(data moat)」は、そのプラットフォーム自体のユーザーベースによるプライベートなやり取りやアップロードから、ますます構築されるようになっています。オープンソースのウェブクロールも依然として有用ですが、現在最も価値の高いデータは、サービスにログインし、何かを成し遂げようと能動的に活動している最中に生成されるものです。
結論
これまでのプライバシー対策の常識は、もはや通用しません。Google の新しい学習データ体制では、「検索サービス履歴」内で「メディアを保存」のチェックを外すという、具体的かつ意図的なオプトアウトが必要です。その操作を、短い自動削除期間の設定と組み合わせることこそが、アップロードした画像、音声、動画を Google の AI 学習パイプラインから遠ざける唯一の確実な方法です。この情報を周囲に伝えてください。デフォルトの設定は、もはやユーザーに有利なものではありません。