t>

Google、同時通訳級の新音声モデル「Gemini 3.5 Live Translate」公開 70言語対応で翻訳アプリやMeetに搭載

1 minutes reading View : 69
アバター画像
Mika Nakamura
国内 - 10 6月 2026

米Googleは6月9日(現地時間)、最新の音声モデル「Gemini 3.5 Live Translate」を発表した。従来の話し終わり待ち翻訳から進化し、話し手から数秒遅れで継続的に音声を生成する同時通訳に近い体験を提供する。対応言語は70以上で、話し手のイントネーションやペース、ピッチを維持した自然な合成音声を実現するという。

展開は3つの層で同時に進む。開発者向けには「Gemini Live API」および「Google AI Studio」でパブリックプレビューを開始。企業向けには「Google Meet」で一部のGoogle Workspace法人顧客を対象にプライベートプレビューが今月から始まり、年内に広範なロールアウトを予定する。一般ユーザー向けにはAndroidおよびiOSの「Google翻訳」アプリでグローバルに順次展開される。

「Google翻訳」アプリの「ライブ翻訳モード」では、任意のヘッドフォンを接続することで、話し手のトーンを反映した同時通訳を70以上の言語で利用できる。またAndroid版では、ヘッドフォンを使わず端末の受話口から訳出音声を聞ける「リスニング」モードのロールアウトも開始された。

Google Meetにおいては、既存の音声翻訳機能が「Gemini 3.5 Live Translate」ベースに刷新される。従来は英語との間で5言語のみだったが、今回の更新で70以上の言語に対応し、1つの会議内で2000を超える言語ペアでの会話が可能になる。インタフェースも更新され、音声翻訳機能へのアクセスが容易になった。

Gemini 3.5 Live Translateはストリーミングで音声を処理しながら、文脈を待って品質を高めるか即時に訳すかのトレードオフを動的に調整する。多言語入力を手動設定なしで扱えるほか、騒がしい環境にも対応するノイズ耐性を備える。Googleは応用先として多言語の通話や会議、授業、ライブ放送を挙げており、配車サービスGrabはドライバーと乗客のコミュニケーション向けにテスト中で、同社では月間1000万件超の音声通話が発生している。

なお、同モデルが生成する音声にはすべて電子透かし技術「SynthID」が埋め込まれ、AI生成コンテンツであることを検出可能にしている。これにより透明性を確保し、悪用リスクを低減する狙いがある。

編集部注:この記事はAIを使用して作成されており、ITmedia NEWSの記事を元に、内容を変更せずにリライトしたものです。
Share Copied

Trending Post