Googleは2026年9月24日、音声対話AI「Gemini 3.8 Live」に表情豊かな映像を組み合わせた新機能「Gemini 3.8 Live with Live Avatar」を発表しました。声だけでなく、口の動きや表情がリアルタイムで会話に同期するアバターが登場し、97言語に対応します。現時点では法人向けの「Gemini Enterprise」限定の提供ですが、企業の問い合わせ対応や案内業務での活用が見込まれる注目のアップデートです。本記事では、できること・対応言語・利用条件を整理します。
音声だけだったGemini Liveに「顔」が付いた
Gemini 3.8 Liveは、これまで音声のみで応答する対話モデルでした。今回のLive Avatarは、そこに次のような映像機能を追加するアップデートです。
- リアルタイムでの映像生成と音声対話を組み合わせ、口の動き(リップシンク)と表情を会話に同期
- 97言語に対応し、会話の途中で言語が切り替わっても自然に追従
- 参照画像から独自のアバターを作成できるカスタマイズ機能(企業向けに許可制)
- バックグラウンドでのツール実行に対応し、情報を調べている間も会話が途切れない
- SynthIDによる電子透かしで、AI生成映像であることを明示
Googleは、これまでのGemini 3.8 Liveが音声のみの一方向的な対話にとどまっていたのに対し、Live Avatarは「表情や仕草を伴う、より人間らしい対話体験」を目指したものだと位置づけています。
仕組み:音声と映像を同時に生成
Live Avatarは、ユーザーの音声・視覚情報を同時に処理しながら、それに同期した映像と音声の応答を生成する仕組みです。単に事前に用意したアバター映像に音声を後から合わせる方式ではなく、リアルタイムで映像そのものを生成している点が特徴です。
また、非同期のツール呼び出し(バックグラウンドでのデータ取得や外部連携)に対応しているため、アバターが情報を調べている間も自然な相槌や間を保ちながら会話を続けられます。会話が「お待ちください」で止まってしまう従来型の音声アシスタントとは異なる体験を狙った設計です。
対応言語:日本語を含む97言語
Live Avatarは97言語に対応しており、日本語も含まれます。会話の途中で言語が切り替わった場合でも、リップシンクと表情表現をその言語に合わせて自動調整できるとGoogleは説明しています。多言語での接客・案内業務を想定した設計といえます。
利用条件:現時点は法人向け「Gemini Enterprise」限定
2026年9月28日時点で、Live Avatarは一般消費者向けのGeminiアプリでは利用できません。提供は法人向けプラットフォームの「Gemini Enterprise」を通じてのみで、以下の点に注意が必要です。
- 個人向けの無料プラン・Google AI Plus・Google AI Proなどでは利用不可
- カスタムアバターの作成には、Googleによる個別の許可(アローリスト登録)が必要
- 料金の詳細は公式発表では明示されておらず、Gemini Enterpriseの契約内容に応じて案内される見込み
既存のGemini 3.8 Live(音声のみ)は、Geminiアプリの「Gemini Live」やGoogle検索の「Search Live」を通じて一般ユーザーでも利用できていますが、映像付きのLive Avatarは当面、企業の問い合わせ対応やカスタマーサポート、社内向け案内システムといった用途を中心に展開される見通しです。
既存のGemini 3.8 Liveとの違い
| 項目 | Gemini 3.8 Live(音声のみ) | Gemini 3.8 Live with Live Avatar |
|---|---|---|
| 発表日 | 2026年9月15日 | 2026年9月24日 |
| 出力形式 | 音声のみ | 音声+リアルタイム映像(アバター) |
| 対応言語 | 97言語 | 97言語 |
| 提供先 | Geminiアプリ、Search Live、API等 | Gemini Enterprise(法人向け)限定 |
| カスタマイズ | ― | 参照画像からのアバター作成(許可制) |
| 電子透かし | ― | SynthIDによる明示 |
音声モデルそのものはGemini 3.8 Liveと共通の技術基盤を使いながら、Live Avatarはそこに映像生成レイヤーを追加した拡張版という位置づけです。テキスト・画像処理を担う土台モデルについては、Gemini 3.8 Flashの性能・料金を解説した記事で詳しく紹介しています。
どんな用途に向いているか
Googleが想定する主な活用シーンは、次のようなものです。
- コールセンターやカスタマーサポートでの一次対応
- 店舗・受付窓口での多言語案内
- 社内ヘルプデスクや新入社員向けの案内役
- ブランドイメージに合わせたオリジナルキャラクターによる接客
表情や身振りを伴うことで、テキストチャットや音声のみの対応よりも「話しかけやすさ」を感じてもらいやすい点が、企業が導入を検討する主な動機になりそうです。音声合成そのものの進化については、Gemini 3.8 Flash TTSの音声クローン機能を解説した記事もあわせてご覧ください。
SynthIDによる電子透かしの意味
Live Avatarが生成する映像には、Googleが開発した電子透かし技術「SynthID」が組み込まれています。これは、映像がAIによって生成されたものであることを技術的に識別できるようにする仕組みです。実写の人物とAIアバターの区別がつきにくくなる中で、なりすましや誤解を防ぐための対策として位置づけられています。企業が顧客対応にアバターを導入する際も、透明性を担保する仕組みとしてSynthIDの存在は安心材料の一つになりそうです。
疑問点
Q. 個人のGeminiアプリでもLive Avatarを使えるか? A. 2026年9月28日時点では利用できません。提供はGemini Enterprise契約者に限定されています。一般提供の時期は未発表です。
Q. 自分の顔や会社のキャラクターをアバターにできるか? A. 参照画像からのカスタムアバター作成は可能ですが、Googleによる許可(アローリスト登録)が必要で、現状は一部の組織に限定されています。
Q. 既存のGemini 3.8 Live(音声のみ)を使っている場合、自動でLive Avatarに切り替わるか? A. いいえ。Live Avatarは別機能としての追加提供であり、既存の音声のみのGemini 3.8 Liveがそのまま映像付きに変わるわけではありません。利用には別途Gemini Enterpriseでの申し込みが必要です。
まとめ
Gemini 3.8 Live with Live Avatarは、音声のみだったGemini Liveに表情豊かな映像を組み合わせた新機能で、97言語に対応しリアルタイムでリップシンクする点が特徴です。現時点ではGemini Enterprise限定の提供で、個人ユーザーがすぐに試せるものではありませんが、企業の問い合わせ対応や多言語案内の分野で、今後の展開が注目されます。一般提供の時期や料金については、続報が入り次第お伝えします。

