Gemini Live Avatarは、説明動画の出演者と吹き替えを置き換えるか?

ポスプロ番頭@てつお
ポスプロ番頭@てつお

@tetsuo_postpro ・ 4本

サムネイル

説明動画や研修動画のたびに出演者とスタジオを押さえ、英語版は吹き替えを別に発注する。この段取りがAIでどこまで変わるのか、気になっていませんか? 2026年9月24日に企業向けに出たGemini Live Avatarで見積書を引き直すと、消えるのは出演者を拘束する費目で、撮影そのものはあまり減りません。

Gemini Live Avatarでできること、できないこと

Gemini Live Avatarは、会話モデル「Gemini 3.8 Live」に、話す顔の映像をほぼリアルタイムで生成する機能を足したものです。相手の話を聞き、口の動きと表情を合わせて返事をします。対応は97言語で、会話の途中で言語が変わっても口の動きが追いかけます。

使えるのは企業向けのGemini Enterpriseからで、個人向けのGeminiアプリにはありません。基本は用意されたアバターから顔を選ぶ方式で、参照画像から自社独自のアバターを作る機能は、Googleさんの許可リストに入った企業に限られます。発表時点で案内されている接続先は米国とEUで、日本での提供条件は書かれていません。

公式ブログが挙げる用途は、顧客対応と対話しながらの案内です。デモではホテルのチェックインを受け付けていました。会話を続けたまま裏で予約データを取りに行ける非同期のツール呼び出しにも対応していて、受付の「少々お待ちください」の間を埋める作りになっています。

現場的に押さえておきたいのは、これが録画を納品する道具ではないって話です。

収録型のAIアバター動画とリアルタイムアバター、何が違うのか?

収録ブースで台本を読む人の後ろ姿と、ホテルのフロントに置かれたモニターに来客が話しかける様子を並べた鉛筆スケッチ

AIアバターと聞いて多くの人が思い浮かべるのは、原稿を入れると人が話す動画が書き出されるツールです。研修や製品説明で使われているのはこちらの収録型で、できあがるのは1本の動画ファイルです。編集で直せますし、社内ポータルにも動画サイトにも置けます。

Gemini Live Avatarの映像は、相手がいて初めて生まれます。受付の画面やWebの窓口で、来た人の質問に合わせてその場で話すので、映像は会話ごとに違い、同じものは二度と出てきません。

たとえば、新しい経費精算システムの使い方を全社員に見せたい場合。台本が決まっている説明動画なので、収録型の領分です。一方で「自分の出張費はどの区分で申請するのか」という質問に1人ずつ答える窓口なら、リアルタイム型が効いてきます。

いま発注を考えている動画は、どちらでしょうか?

見る人が質問しない前提なら、Gemini Live Avatarを検討する理由はあまりありません。

出演料と吹き替え費、見積書のどの行が消えるか

見積書の出演料、二次使用料、スタジオ費、吹き替え収録の行にアンバーの線が引かれ、下に利用料と会話設計が書き足された鉛筆スケッチ

出演者と声に関わる行だけを見積書から拾って、人が出演する収録と、問い合わせ窓口をGemini Live Avatarに任せた場合を並べるとこうなります。

見積書の項目
人が出演して収録
Gemini Live Avatarの窓口
出演料、ナレーター料
発生する
既定のアバターなら発生しない
二次使用料、使用期間の延長
発生する
既定のアバターなら発生しない。自社の人の顔なら本人との取り決め次第
スタジオ費、ヘアメイク
発生する
発生しない
翻訳、多言語の吹き替え収録
言語ごとに発生する
収録としては発生しない
台本、ディレクション
発生する
会話の設計と回答内容の監修に置き換わる
利用料
なし
アバターが話した時間に応じて発生する

利用料はGoogle Cloudの料金ページに、トークン単位の従量課金として載っています。アバター映像は1秒を6,192トークンと数え、課金されるのはアバターが話している時間だけです。100万トークンあたり1ドル(約150円)なので、映像部分だけなら話している1分あたり約55円の計算になります。

ただし、ここに音声や入力の分が乗りますし、Gemini Enterpriseの契約やカスタムアバターの許可リストは営業窓口を通す話です。単価は変わる可能性もあり、総額は見積もりを取らないと出ません。

消えるのは、出演者の時間を押さえることにかかる費目です。何をどう答えさせるかを決める仕事は残り、見積書では台本やディレクションの行が「会話設計」「回答の監修」に名前を変えます。ナレーターさんや出演者さんの仕事が減るのは、決まった質問に繰り返し答える窓口の分からだと自分は見ています。

97言語の吹き替え、多言語の説明動画はどう変わるか

多言語の説明動画は、日本語版を作ってから翻訳し、言語ごとにナレーターを手配して収録し、口の動きが合わないところは字幕で逃がす、という順で進みます。言語が1つ増えるたびに、収録の行が1つ増える構造なんですよ。

Gemini Live Avatarは1つのアバターが97言語を話し、相手が言語を変えればそのまま合わせます。窓口の用途なら、言語ごとの吹き替え収録という行そのものが要らなくなります。

それでも翻訳の確認は残ります。話す中身は会話ごとに生成されるので、訳の正確さを事前に1本ずつ確かめられません。医療や契約の説明のように言い間違いが問題になる内容なら、その言語が読める人による確認と、人に引き継ぐ条件を先に決めておきたいところです。

海外向けの問い合わせ窓口、いま何言語で人を置いていますか? 人を置けていない言語の分から試すのが、段取りとしては無理がありません。

参照画像と音声サンプル、AIアバターの肖像権は誰に許諾を取るか?

カスタムアバターを作るときは、参照写真1枚と音声ファイルのサンプルを渡す手順だと、Google Cloudの発表に書かれています。実在の人の顔と声を素材にできるということです。

ここは後で揉めるところです。社長や社員、起用したタレントさんの写真を使うなら、本人の許諾に加えて、何の用途で何年使うのか、何語で話させるのか、退職や契約終了のあとはどうするのかまで書面で決めておく必要があります。収録動画なら「この動画に出る」という範囲で済んだ話が、会話型だと本人が言っていないことを本人の顔で話し続けるからです。契約の書き方は弁護士さんに確認してください。

Googleさんの側では、カスタムアバターの作成を許可リストと審査を通った企業に絞っています。出力された映像と音声には人の目や耳では分からない透かしが埋め込まれ、AIが作ったものだと後から確かめられます。この透かしがSynthIDです。

前日の9月23日には、MetaさんもMuse Realtime Avatarを発表しました。18歳以上向けのMuseアプリの機能で、写真だけでなくイラストや動物、身の回りの物まで話す姿にできます。企業の窓口に絞って顔の作成に審査を挟むGeminiとは、向いている方向がかなり違います。

Gemini Live Avatarを検討する前に、制作会議で確認すること

  • その動画は、見る人が質問する前提か。質問しないなら収録型のままでよい
  • アバターは既定の顔でよいか。自社の人の顔にするなら、許可リストの申請と本人の許諾書が先
  • 何言語で受けるか、回答内容の確認は誰がするか
  • 日本からの利用条件と接続先。発表時点で案内されているのは米国とEU
  • 利用料の見積もり。話した時間の従量課金に、契約費用がどう乗るか

説明動画の撮影と吹き替えは、Gemini Live Avatarが出てもすぐにはなくなりません。変わるのは、同じ質問に何度も答えてきた窓口の出演者と声の手配で、見積書ではその行が利用料と会話設計に入れ替わります。

次に説明動画の相談が来たら、まず「見る人は質問しますか?」と聞いてみてください。