- Beginn
- 15. Sept. 202690 % SICHERHEITlaut der Quelle
Gemini 3.8 Live und 3.8 Live Extended Thinking veröffentlicht
Automatisch aus dem Original übersetzt
Originaltitel: Gemini 3.8 Live and 3.8 Live Extended Thinking Released
- Google stellte Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking am 15. September 2026 als „unsere bislang fortschrittlichsten Live-Dialogmodelle“ vor: 3.8 Live ist „für Skalierung und Kosteneffizienz gebaut“, und Extended Thinking „für hochkomplexe Aufgaben, mit gesteigerter Intelligenz und mehrstufigem Reasoning“[1]
- Extended Thinking „denkt und spricht gleichzeitig“ und nutzt frühe Signale wie „Lass mich das prüfen …“, während es den Fortschritt mehrstufiger Aufgaben im Hintergrund erzählend begleitet[1]
- 3.8 Live liest visuelle Eingaben nahezu in Echtzeit, erkennt und wechselt mitten im Gespräch zwischen 97 unterstützten Sprachen und spricht weiter, während Tool- und API-Aufrufe im Hintergrund abgeschlossen werden[1]
- Beide erreichten Entwickler in der Gemini-API und in Google AI Studio sowie Unternehmen in einer privaten Vorschau in Gemini Enterprise; 3.8 Live rollte in Search Live aus und Extended Thinking in Gemini Live, Docs Live, Gmail Live und Keep Live[1][5]
- Sie folgen auf Gemini 3.1 Flash Live, das im März veröffentlicht wurde[5]
- Am 24. September fügte Google Live Avatar hinzu, eine nahezu in Echtzeit arbeitende Video-Persona für 3.8 Live, in Gemini Enterprise[4]
Bemerkenswerte Merkmale
- Extended Thinking belegt den Spitzenplatz in Artificial Analysis’ Speech to Speech Quality Index (82,6) und erreicht 68,6 % bei τ-Voice, 35,1 % bei Sierras τ-Voice-banking-Benchmark und 97,7 % bei Big Bench Audio; 3.8 Live belegt Platz zwei in der Speech Agent Arena[1]
- Preise pro Million Tokens: 0,75 $ für Text, 3,00 $ für Audio und 1,00 $ für Bild- oder Videoeingabe, sowie 4,50 $ für Text- und 12,00 $ für Audioausgabe – etwa 0,005 $ pro Minute Audio-Eingabe und 0,018 $ pro Minute Ausgabe[3]
- Verarbeitet Audio, Bilder, Video und Text, mit einem Eingabelimit von 131.072 Tokens und 65.536 Ausgabetokens, und unterstützt asynchrone Funktionsaufrufe sowie Grounding über die Google-Suche[2]
- Basiert auf Gemini 3 Pro, mit Wissensstand Januar 2025[6]
- Jedes generierte Audio trägt ein nicht wahrnehmbares SynthID-Wasserzeichen[1]
- Sprachplattformen einschließlich Agora, LangChain, LiveKit, Pipecat und Vercel unterstützen es über die Gemini Live API, und Salesforce, Genspark und Lumeris sind Launch-Partner[1]
Belege 687 % SICHERHEITGesamtvertrauen: 87%Wie gut die Quelle und die Belege des Pins seine Termine stützen.Gewichteter Durchschnitt, wie fest 6 Belege einschließlich der Quelle die Start- und Endzeiten des Pins stützen; ein Beleg zählt für je 180 Tage, die er älter ist als der neueste, nur halb so vielAlle Pins mit mindestens 75 % Sicherheit anzeigen
Der erste Eintrag ist immer die Quelle des Pins. Die Gesamtsicherheit ist ein gewichteter Durchschnitt, wie fest jeder Beleg die oben verwendeten Start- und Endzeiten stützt; ein Beleg zählt für je 180 Tage, die er älter ist als der neueste, nur halb so viel.
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinkingblog.google· Gepostet am 28. Sept. 2026· Beginn 15. Sept. 2026 ✓· 17 % der Wertung
Googles Beitrag ist auf „Sep 15, 2026“ datiert und sagt, „3.8 Live rollt ab heute aus“; 9to5Googles Bericht vom selben Tag sagt, „Google[2][3] hat heute Gemini 3.8 Live und Gemini 3.8 Live Extended Thinking angekündigt“, und der Gemini-API-Changelog listet beide als allgemein verfügbar zum 15. September.
- [2]90%Gemini 3.8 Live Extended Thinking | Gemini APIai.google.dev· Hinzugefügt am 28. Sept. 2026· 17 % der Wertung
The API model page for gemini-3.8-live-extended-thinking: text, image, audio and video in, text and audio out, 131,072 input and 65,536 output tokens, asynchronous function calling and search grounding supported, latest update September 2026.[1]
- [3]85%Gemini Developer API pricingai.google.dev· Hinzugefügt am 28. Sept. 2026· 17 % der Wertung
The pricing page lists Gemini 3.8 Live and 3.8 Live Extended Thinking together: $0.75 text, $3.00 audio and $1.00 image/video input and $4.50 text and $12.00 audio output per million tokens, or about $0.005 and $0.018 a minute of audio.[1]
- [4]75%Introducing Gemini 3.8 Live with Live Avatarblog.google· Veröffentlicht am 24. Sept. 2026· 17 % der Wertung
Google's[2][3] follow-up post of 24 September adds Live Avatar to 3.8 Live, pairing the voice model with near real-time video of a speaking persona, available in Gemini Enterprise.
- [5]90%Gemini 3.8 Live Extended Thinking powers Gemini Live, Gmail, & Keep9to5google.com· Veröffentlicht am 15. Sept. 2026· Beginn 15. Sept. 2026· 16 % der Wertung
9to5Google's same-day report by Abner Li that Google[2][3] "today announced" both models, following 3.1 Flash Live in March; it repeats the benchmark claims and says Extended Thinking powers Gmail Live, Docs Live and Keep Live and is rolling out to Gemini Live, while 3.8 Live powers Search Live.
Korrektur vorschlagen
Fehlt etwas oder stimmt etwas nicht? Sag es in deinen eigenen Worten: ein Link, der diesen Pin belegt, ein anderes Start- oder Enddatum und warum, oder eine Angabe, die fehlt oder falsch ist. Die KI prüft es an den Quellen dieses Pins, sucht nach besseren und ergänzt jede Seite, die dich bestätigt. Die eigenen Quellen des Pins zählen weiterhin am meisten. Auch Bilder sieht sich die KI an: Eines, das etwas anderes oder die Sache schlecht zeigt, wird nach hinten gestellt oder ersetzt.