Gemini 3.8 Liveを選ぶ|2モデルの違いと音声会話の新機能
代表取締役 上坂大地郎

Geminiの音声会話に、応答を重視するモデルと、裏で考えながら会話を続けるモデルの2つの選択肢が加わりました。 Googleは2026年9月15日、Gemini 3.8 LiveとGemini 3.8 Live Extended Thinkingを発表しました。APIの更新履歴では、同日付で一般提供と案内されています。Googleの発表、API更新履歴。
- 短いやり取りから試すなら通常のLive、複数の条件を考えるならExtended Thinkingが候補です。 名前が長い方を一律に選ぶ必要はありません。
- APIでは、思考の設定とツールの動かし方が違います。 モデル名だけを入れ替えると、既存の設定が合わない場合があります。
- 料金は音声の入力と出力を分けて数えます。 会話をつないだ時間だけで見積もらないようにします。
音声AIを日常の相談に使う人、アプリへ組み込みたい開発者、問い合わせ対応への利用を検討する人へ向けて、今回の変更を整理します。読み終えたら、試すモデルと利用経路を選び、比べる条件を用意できます。仕様の確認日は2026年9月17日です。日本語での通話品質や個別アカウントの提供状況を実測した記事ではありません。
同じ「3.8」でも、今回は声で対話するモデル
Flashの更新とLiveの登場を分けて読む
Gemini 3.8 Flashは9月2日付で一般提供が案内されています。今回のLiveは、音声を受け取り音声で応じる用途に向けた別のモデルです。「3.8へ更新された」という説明だけでは、どの製品で何が変わったのかを取り違えます。API更新履歴。
以前のGemini 3.8 FlashとCyberの記事を読んだ人も、Liveの利用条件は別に確認してください。Flashを使うチャットやコード生成の設定を、そのまま音声会話へ持ち込めるという発表ではありません。
公式資料の掲載日 | 対象 | 読み取れること |
|---|---|---|
9月2日 | Gemini 3.8 Flash | FlashモデルのAPI一般提供 |
9月15日 | Gemini 3.8 Live、Extended Thinking | Live API向け2モデルの一般提供 |
9月15日 | Googleの製品向け発表 | アプリや各サービスでの展開を案内 |
日付は発表元の掲載表記です。発表ページの時刻が明記されていないため、日本時間の提供開始時刻まで確定するものではありません。APIの一般提供と、アプリで自分に届く時期は分けて見ます。
「話せる」から、会話しながら作業する方向へ
Live APIは、音声・画像・テキストを継続的に受け取り、会話に応答する仕組みです。毎回録音ファイルを完成させて送る処理とは、入力の渡し方が異なります。電話で相談を続けるように、相手の言い直しや追加条件も扱う設計です。Live API概要。
読者にとって気になるのは、声が自然かだけではありません。「さっきの条件を変えたい」と途中で伝えたときに、どこまで話を追い、どの段階で答えを確定するかも使い勝手を左右します。今回の2モデルは、その依頼の複雑さに応じて試し分ける候補になります。
2モデルは、待たせ方と考える仕事で選ぶ
通常のLiveは、会話の応答を重視
公式モデル資料は、Gemini 3.8 Liveを多くの低遅延な音声対話の既定候補と位置づけています。APIで指定する名前は gemini-3.8-live です。短い質問への応答や、すぐに結果が返る操作などから試す場面が考えられます。通常Liveのモデル資料。
ただし、「通常版だから考えない」という区分ではありません。公式には会話の中で推論を行う設計が説明されています。一方で、thinking_levelを指定する設定には対応していません。 思考量を上げるつもりで別モデルの設定をコピーするのは避けてください。
Extended Thinkingは、複数の手順を裏で進める
Extended Thinkingは、複雑な条件の検討や、いくつもの手順が必要な音声対話向けです。APIの名前は gemini-3.8-live-extended-thinking。バックグラウンドで考えたりツールを呼んだりしながら、途中の応答を返すと説明されています。Extended Thinkingのモデル資料。
たとえるなら、相談を受けた担当者が「条件を確認しています」と伝えながら、手元で候補を調べる形です。最初の返事が来ても、調査が終わったとは限りません。利用者は途中経過を聞けますが、開発者は「返事」と「処理の終わり」を分けて扱う必要があります。
比べる点 | Gemini 3.8 Live | Extended Thinking |
|---|---|---|
公式が想定する中心用途 | 低遅延な対話、直接的な依頼 | 複雑な問題、複数手順の処理 |
APIでの思考量指定 |
|
|
ツール実行 | 非同期が既定。同期にも対応 | 非同期のみ。同期指定はエラー |
最初に比べたいこと | 短い往復のしやすさ | 追加条件を含む依頼の完了状況 |
最後の行は、本記事が提案する評価の観点です。公式の用途区分だけで、個別業務の品質や速度が決まるわけではありません。根拠は通常LiveとExtended Thinkingの各資料です。
どちらから試すかを、依頼の内容から整理できます。

長い名前や機能の多さだけで選ばず、普段の依頼に近い会話で比べます。試す内容をそろえると、違いが必要な場面を見つけやすくなります。
アプリで話すか、AI Studioで試すか
製品ごとの展開とアカウント条件を見る
Googleの発表は、開発者向けにGemini APIとGoogle AI Studio、一般利用者向けにGemini LiveやSearch Liveなどの経路を示しています。ただし、モデルごとに挙げられた製品は同一ではなく、企業向けにはプレビューや今後提供の案内もあります。 提供経路の発表。
まず声で使いたい人は、利用中のアプリの案内とアカウントの対象条件を確認してください。APIで一般提供されたというニュースから、「日本の全利用者に同じ画面が出る」「すべての機能が無料」とまでは判断できません。
新しい機能が見つからないときは、利用製品、プラン、端末、確認日を控えます。「Geminiでは使えない」という一括りの記録より、どの入口で確認したかを残す方が、後日の案内と照合しやすくなります。
開発者はモデルを明示して比較する
APIでの差を確かめたい場合は、公式のLive APIページからAI Studioの試用入口へ進み、選択できるモデルを確認する方法があります。モデル名を記録し、音声での依頼、追加条件、結果をそれぞれ残します。利用可否は対象プロジェクトで確認してください。Live APIの試用入口。
アプリを作る段階では、サーバーを経由してLive APIへつなぐ方法と、クライアントから直接つなぐ方法があります。後者を本番で使う場合、公式資料は通常のAPIキーの代わりに短期トークンを使う方法を推奨しています。短期トークンは、期限を短くした一時的な入場券に近い仕組みです。接続方式、短期トークン。
APIで注意したいのは「発話が終わった後」
Extended Thinkingでは受信を早く閉じない
既存アプリの変更で見落としやすい点は、turnComplete: trueの受信だけでは、Extended Thinkingが待機状態になったとは限らないことです。発話が終わっても、裏で考えたりツールの結果を待ったりしている場合があります。公式資料は、その後のサーバーメッセージも受信し続けるよう説明しています。思考と会話のライフサイクル。
このモデルでは、interaction_statusのIN_PROGRESSとIDLEを使ってサーバーの状態を確認します。前者は処理中、後者は推論やツール呼び出しを含む処理が終わって入力を待つ状態です。Extended Thinkingの移行上の注意。
会話を切り上げる位置が早いと、途中の返事だけを最終回答として表示するおそれがあります。反対に、待機状態へ移ったことを見ずに待ち続ける実装も避けたいところです。状態の区別は次のように読めます。

途中の返事を最終結果として扱わないための整理です。待機状態になった後も、依頼した内容が成功したかはツールの返り値で確かめます。
ここでのIDLEは、業務上の成功を保証する印ではありません。 たとえば候補検索が終了しても、条件に合う結果がゼロという場合があります。本記事の設計上の提案として、画面には「処理中か」と「何が得られたか」を分けて表示します。
ツールの設定もモデルに合わせる
非同期とは、結果が返るまで他の処理を全部止めずに進める方式です。Extended Thinkingは非同期のNON_BLOCKINGのみ対応し、同期のBLOCKINGを指定するとエラーになります。通常のLiveは両方に対応します。通常Liveの対応方式、Extended Thinkingの制約。
モデル名を切り替える前に、接続時の思考設定、ツール宣言、受信を終える条件を見直してください。過去の音声実装がある場合も、正常な一往復だけで移行を終えず、ツールが遅い場合や失敗した場合を含めて確かめます。
音声料金は、入力と出力の時間を分ける
2モデルは同じ料金欄に掲載
9月17日に確認したGemini Developer API料金表では、2モデルは同じ欄に掲載されています。有料枠の音声入力は1分0.005ドル、音声出力は1分0.018ドルという表記です。テキストや画像・動画、検索は別の項目で案内されています。公式料金表。
数える対象 | 有料枠の掲載単価 | 見積もる際の区分 |
|---|---|---|
入力音声 | 0.005ドル/分 | 利用者側から渡す音声 |
出力音声 | 0.018ドル/分 | モデルが生成する音声 |
テキスト・画像/動画・検索 | それぞれ別の単価・条件 | 音声部分に混ぜず加算 |
想定条件を置くと、試算の意味がはっきりする
想定シナリオとして、課金対象の入力音声が10分、出力音声が5分だった場合、音声部分は10 × 0.005 + 5 × 0.018 = 0.14ドルです。これは料金表から計算した例で、実際の通話を測った値ではありません。テキストや映像などの費用は含めていません。
入力と出力の単価を足した0.023ドルを、「会話をつないだ1分の固定料金」として使うのは避けます。入力と出力の量は同じとは限らず、声以外の処理も加わるためです。通話時間、入出力の使用量、最終的な請求額を別々に記録すると、見積もりとの差を追えます。
別方式の音声AIも検討している人は、GPT-Live-1のAPI構成と料金と比較できます。ただし、単価だけで安い方を決めず、音声以外の処理や利用条件を含めて見積もってください。
最初の会話は、途中で条件を1つ変えてみる
以下は本記事が用意した想定シナリオです。モデルの性能を証明する例ではなく、自分の用途で差を見つけるための試験条件として使います。最初は外部ツールを使わない会話で試せます。
明日の午後に、設計レビューと議事録整理を入れたいです。使える時間は2時間です。レビューの前に資料を読む時間も必要です。足りない条件を1つずつ質問して、時間の割り振り案を出してください。
会話の途中で、「レビュー相手が参加できるのは最後の45分だけです」と追加します。見たいのは、早く話し始めたかだけではありません。前の条件を残したまま予定を組み直したか、不足している時間を勝手に補わなかったかを確認します。
通常LiveとExtended Thinkingへ同じ条件を渡し、端末・マイク・周囲の音もできるだけそろえます。本記事の提案する確認項目は、追加条件の反映、時間配分の整合性、途中応答と最終案の区別です。1回の成功だけで使い分けを決めず、条件を変えた例も残してください。
APIでツールも試すなら、予定を登録する前に、テスト用の空き時間を返すだけの処理から始める方法があります。返答が遅い場合と候補が見つからない場合を用意し、会話表示がどちらを伝えたかを確認します。これは評価の提案であり、公式に用意されたカレンダー機能の操作手順ではありません。
新しいモデルでも、聞き取りと結果は確かめる
Googleのモデルカードは、誤った情報を出す可能性に加え、遅延やタイムアウトが起きる場合があると説明しています。会話の流暢さと、依頼内容の正しさは同じではありません。モデルカードの限界。
人名や社名、数字、日付が重要な用途では、それらを試験用の会話に含めてください。自分が話した内容と、最終案に残った内容を比べます。日程が自然な言葉で説明されていても、元の条件と合っているかは別に確認が必要です。
今回の記事で確認できたのは、2モデルの提供案内、API設定の違い、公開された料金と制約です。日本語でどちらが自分に合うか、複雑な依頼の成功率がどれだけ変わるかは、利用条件をそろえて試す部分として残ります。
まずは同じ音声依頼を用意し、通常Liveで困った点を具体的に記録します。複数条件の検討や途中経過の扱いが課題になったら、Extended Thinkingを比べる候補にしてください。選ぶ根拠は、機能名の長さよりも、その依頼の結果です。
参考・出典
- Google「Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking」(2026年9月15日掲載、参照日: 2026-09-17)https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinking/
- Google AI for Developers「Release notes」(参照日: 2026-09-17)https://ai.google.dev/gemini-api/docs/changelog
- Google AI for Developers「Gemini 3.8 Live」(参照日: 2026-09-17)https://ai.google.dev/gemini-api/docs/models/gemini-3.8-live
- Google AI for Developers「Gemini 3.8 Live Extended Thinking」(参照日: 2026-09-17)https://ai.google.dev/gemini-api/docs/models/gemini-3.8-live-extended-thinking
- Google AI for Developers「Thinking in the Live API」(参照日: 2026-09-17)https://ai.google.dev/gemini-api/docs/live-api/thinking
- Google AI for Developers「Gemini Live API overview」(参照日: 2026-09-17)https://ai.google.dev/gemini-api/docs/live-api
- Google AI for Developers「Tool use with Live API」(参照日: 2026-09-17)https://ai.google.dev/gemini-api/docs/live-api/tools
- Google AI for Developers「Ephemeral tokens」(参照日: 2026-09-17)https://ai.google.dev/gemini-api/docs/live-api/ephemeral-tokens
- Google AI for Developers「Gemini Developer API pricing」(参照日: 2026-09-17)https://ai.google.dev/gemini-api/docs/pricing
- Google DeepMind「Gemini 3.8 Audio Model Card」(参照日: 2026-09-17)https://deepmind.google/models/model-cards/gemini-3-8-audio/


