Google Vids、カスタムAIアバターとGemini Omniの統合を発表

Googleは、AIを活用したワークプレイスツールを、パーソナライズされたビデオ制作の強力なプラットフォームへと変貌させようとしています。Google Vidsの最新アップデートにより、ユーザーは自身の容姿や声を模倣したカスタムデジタルアバターを作成できるようになり、企業のビデオコミュニケーションへのアプローチに大きな転換点をもたらしています。

パーソナライズされたデジタルアバターがワークスペースに登場

プロフェッショナルなビデオ制作市場を直接ターゲットにした動きとして、Google Vidsはユーザーが自身のコンテンツに「出演」することを可能にしました。セルフィー1枚と音声録音をアップロードするだけで、ユーザーは自分に驚くほどよく似た外見と声を持つカスタムデジタルアバターを生成できます。この機能は、頻繁に撮影を行う必要なく、社内アップデート、トレーニングビデオ、社内コミュニケーションの制作を効率化するように設計されています。

ディープフェイクをめぐる倫理的な懸念に対処するため、Googleは厳格な保護策を導入しています。これらのパーソナライズされたアバターは、特定のユーザーのGoogleアカウントに紐付けられており、SynthIDテクノロジーを使用して不可視のウォーターマーク(電子透かし)が付与されます。現在、これらのアバター機能へのアクセスは、特定の地域における18歳以上のユーザーに限定されており、この高精度な合成メディアの展開が制御された形で行われるようになっています。

Gemini Omniによる創造性の強化

Google Vidsの進化を支えているのは、Googleの高度なマルチモーダルAIモデルであるGemini Omniの統合です。この統合により、テキストプロンプトとアップロードされた参照画像を組み合わせることができる、洗練された「プロンプトからビデオへ(prompt-to-video)」のワークフローが可能になります。Gemini Omniは、これらの異なる入力を合成して、一貫性のあるビデオシーケンスを生成します。

単なる生成にとどまらず、Gemini Omniはインテリジェントなポストプロダクション(後編集)スイートとしても機能します。このモデルは、背景の入れ替え、スマートフォンでの録画による照明の問題の修正、シネマティックなエフェクトの追加など、複雑な視覚的タスクを実行できます。重要な点として、今回のアップデートではステップバイステップの編集サポートが導入されました。これにより、クリエイターは制作の途中でプロジェクトに対してきめ細かく反復的な変更を加えることができ、細部を調整するためにレンダリングを最初からやり直さなければならないというフラストレーションを解消します。

変化する競争環境

これらのアップデートは、Googleにとって戦略的な転換を意味しています。Vidsは当初、Google Workspace向けのAI支援プレゼンテーションツールとして位置付けられていましたが、急速にオールインワンのビデオ制作プラットフォームへと進化しています。これらの機能をWorkspaceのエコシステムに直接組み込むことで、Googleは単なるスライドデッキの枠を超え、ハイエンドなビデオ制作の領域へと踏み込んでいます。

この進化により、GoogleはHeyGen、Synthesia、Captions、D-IDといったAIビデオ専門のスタートアップ企業と直接競合することになります。これらのプラットフォームが合成プレゼンターに重点を置いているのに対し、Googleの強みは既存のエンタープライズ・ワークフローとのシームレスな統合にあります。創業者や開発者にとって、これはGemini Omniのようなマルチモーダルモデルが、研究段階の実験から、プロフェッショナルな生産性スタックに不可欠なインタラクティブなコンポーネントへと移行しているトレンドを示唆しています。

主なポイント

  • カスタムデジタルツイン: セルフィーと音声録音だけでAIアバターを生成でき、プロフェッショナルなビデオメッセージングを効率化します。
  • マルチモーダル編集: Gemini Omniの統合により、複雑なプロンプトベースのビデオ作成や、反復的なステップバイステップの視覚的編集が可能になります。
  • エンタープライズグレードの安全性: すべてのパーソナライズされたアバターは、悪用を防ぐためにSynthIDの不可視ウォーターマークによって保護され、認証済みのGoogleアカウントに紐付けられています。