- 開始
- 2026年9月15日確度 90%出典:出典
Gemini 3.8 Liveと3.8 Live Extended Thinkingがリリース
原文から自動翻訳されています
元のタイトル: Gemini 3.8 Live and 3.8 Live Extended Thinking Released
- Googleは2026年9月15日、Gemini 3.8 LiveとGemini 3.8 Live Extended Thinkingを「当社史上最も高度なライブ対話モデル」として発表した。3.8 Liveは「スケールとコスト効率のために構築」され、Extended Thinkingは「知能と多段階の推論を強化した、高度に複雑なタスク向け」とされている。[1]
- Extended Thinkingは「推論と発話を同時に行い」、「確認させてください…」といった前置きの言葉を使いながら、複数段階のタスクをバックグラウンドで実行する間、進捗を語り続ける。[1]
- 3.8 Liveはほぼリアルタイムで視覚入力を読み取り、対応する97言語を会話の途中で検知して切り替え、ツールやAPI呼び出しがバックグラウンドで完了する間も話し続ける。[1]
- 両モデルはGemini APIとGoogle AI Studioで開発者に提供され、Gemini Enterpriseでは企業向けにプライベートプレビューとして提供された。3.8 LiveはSearch Liveに、Extended ThinkingはGemini Live、Docs Live、Gmail Live、Keep Liveに展開された。[1][5]
- 両モデルは、3月にリリースされたGemini 3.1 Flash Liveの後継となる。[5]
- 9月24日、Googleは3.8 Live向けのほぼリアルタイムのビデオペルソナ機能Live AvatarをGemini Enterpriseに追加した。[4]
注目の機能
- Extended ThinkingはArtificial AnalysisのSpeech to Speech Quality Indexで首位(82.6)となり、τ-Voiceで68.6%、Sierraのτ-Voice-bankingベンチマークで35.1%、Big Bench Audioで97.7%を記録した。3.8 LiveはSpeech Agent Arenaで2位となった。[1]
- 100万トークンあたりの価格: 入力はテキストが0.75ドル、音声が3.00ドル、画像・動画が1.00ドル。出力はテキストが4.50ドル、音声が12.00ドルで、音声入力は1分あたり約0.005ドル、出力は約0.018ドルとなる。[3]
- 音声・画像・動画・テキストの入力に対応し、入力上限131,072トークン、出力トークン65,536。非同期の関数呼び出しとGoogle検索によるグラウンディングをサポートする。[2]
- Gemini 3 Proをベースとし、知識のカットオフは2025年1月。[6]
- 生成される全ての音声には、知覚できないSynthIDの電子透かしが付与される。[1]
- Agora、LangChain、LiveKit、Pipecat、VercelなどのボイスプラットフォームがGemini Live API経由でこれをサポートし、Salesforce、Genspark、Lumerisがローンチパートナーとなっている。[1]
参考資料 6確度 87%総合信頼度: 87%ピンの情報源と参照がその日付をどれだけ裏付けているか。出典を含む 6 件の資料がピンの開始・終了時刻をどれだけ強く裏付けているかの加重平均。最新の資料より180日古くなるごとに重みは半分になります確度75%以上のピンをすべて表示
最初の項目は常にピンの出典です。全体の確度は、各資料が上記の開始・終了時刻をどれだけ強く裏付けているかの加重平均です。最新の資料より180日古くなるごとに、重みは半分になります。
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinkingblog.google· 投稿 2026年9月28日· 開始 2026年9月15日 ✓· スコアの 17%
Google[2][3]の投稿は「2026年9月15日」の日付で、「3.8 Liveは本日より展開を開始する」としている。同日の9to5Google[5]の記事も「Googleは本日、Gemini 3.8 LiveとGemini 3.8 Live Extended Thinkingを発表した」と報じ、Gemini APIのchangelogも両モデルを9月15日付けで一般提供開始と記載している。
- [2]90%Gemini 3.8 Live Extended Thinking | Gemini APIai.google.dev· 追加 2026年9月28日· スコアの 17%
The API model page for gemini-3.8-live-extended-thinking: text, image, audio and video in, text and audio out, 131,072 input and 65,536 output tokens, asynchronous function calling and search grounding supported, latest update September 2026.[1]
- [3]85%Gemini Developer API pricingai.google.dev· 追加 2026年9月28日· スコアの 17%
The pricing page lists Gemini 3.8 Live and 3.8 Live Extended Thinking together: $0.75 text, $3.00 audio and $1.00 image/video input and $4.50 text and $12.00 audio output per million tokens, or about $0.005 and $0.018 a minute of audio.[1]
- [4]75%Introducing Gemini 3.8 Live with Live Avatarblog.google· 公開 2026年9月24日· スコアの 17%
Google's[2][3] follow-up post of 24 September adds Live Avatar to 3.8 Live, pairing the voice model with near real-time video of a speaking persona, available in Gemini Enterprise.
- [5]90%Gemini 3.8 Live Extended Thinking powers Gemini Live, Gmail, & Keep9to5google.com· 公開 2026年9月15日· 開始 2026年9月15日· スコアの 16%
9to5Google's same-day report by Abner Li that Google[2][3] "today announced" both models, following 3.1 Flash Live in March; it repeats the benchmark claims and says Extended Thinking powers Gmail Live, Docs Live and Keep Live and is rolling out to Gemini Live, while 3.8 Live powers Search Live.
修正を提案
足りない点や誤りがありますか? このピンを裏付けるリンク、別の開始日・終了日とその理由、欠けている情報や誤っている情報を、自由に書いてください。AIがこのピンの出典と照らし合わせ、より良い情報源を探し、裏付けとなるページがあれば参考資料として追加します。ピン自身の出典が引き続き最も重視されます。AIは画像も確認します。別のものが写っている画像や写りの悪い画像は、後ろに回すか差し替えます。