- Début
- 15 sept. 2026CONFIANCE 90 %selon la source
Sortie de Gemini 3.8 Live et 3.8 Live Extended Thinking
Traduit automatiquement de l’original
Titre original: Gemini 3.8 Live and 3.8 Live Extended Thinking Released
- Google a présenté Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking le 15 septembre 2026 comme « nos modèles de dialogue en direct les plus avancés à ce jour » : 3.8 Live est « conçu pour la mise à l'échelle et l'efficacité des coûts », et Extended Thinking « pour les tâches très complexes, avec une intelligence accrue et un raisonnement en plusieurs étapes »[1]
- Extended Thinking « raisonne et parle simultanément », en utilisant des amorces telles que « Laisse-moi vérifier… » et en commentant sa progression pendant que des tâches en plusieurs étapes s'exécutent en arrière-plan[1]
- 3.8 Live lit l'entrée visuelle en quasi temps réel, détecte et bascule entre 97 langues prises en charge en pleine conversation, et continue de parler pendant que les appels d'outils et d'API se terminent en arrière-plan[1]
- Les deux modèles sont arrivés pour les développeurs dans l'API Gemini et Google AI Studio, et pour les entreprises en aperçu privé dans Gemini Enterprise ; 3.8 Live a été déployé dans Search Live, et Extended Thinking dans Gemini Live, Docs Live, Gmail Live et Keep Live[1][5]
- Ils font suite à Gemini 3.1 Flash Live, sorti en mars[5]
- Le 24 septembre, Google a ajouté Live Avatar, un avatar vidéo en quasi temps réel pour 3.8 Live, dans Gemini Enterprise[4]
Caractéristiques notables
- Extended Thinking arrive en tête du Speech to Speech Quality Index d'Artificial Analysis (82,6) et obtient 68,6 % sur τ-Voice, 35,1 % sur le benchmark τ-Voice-banking de Sierra et 97,7 % sur Big Bench Audio ; 3.8 Live se classe deuxième dans la Speech Agent Arena[1]
- Tarifs par million de jetons : 0,75 $ pour le texte, 3,00 $ pour l'audio et 1,00 $ pour l'image ou la vidéo en entrée, puis 4,50 $ pour le texte et 12,00 $ pour l'audio en sortie, soit environ 0,005 $ la minute d'audio en entrée et 0,018 $ en sortie[3]
- Accepte l'audio, les images, la vidéo et le texte, avec une limite d'entrée de 131 072 jetons et 65 536 jetons de sortie, et prend en charge l'appel de fonctions asynchrone et l'ancrage via Google Search[2]
- Basé sur Gemini 3 Pro, avec une date de coupure des connaissances de janvier 2025[6]
- Tout l'audio généré porte un filigrane SynthID imperceptible[1]
- Des plateformes vocales comme Agora, LangChain, LiveKit, Pipecat et Vercel le prennent en charge via l'API Gemini Live, et Salesforce, Genspark et Lumeris en sont les partenaires de lancement[1]
Références 6CONFIANCE 87 %Confiance globale: 87%Dans quelle mesure la source et les références du pin étayent ses dates.Moyenne pondérée de la fermeté avec laquelle 6 références, source comprise, étayent les heures de début et de fin de l’épingle ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récenteAfficher toutes les épingles à 75 % de confiance ou plus
La première entrée est toujours la source de l’épingle. La confiance globale est une moyenne pondérée de la fermeté avec laquelle chaque référence étaye les heures de début et de fin retenues ci-dessus ; une référence compte moitié moins pour chaque tranche de 180 jours d’ancienneté par rapport à la plus récente.
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinkingblog.google· Publié le 28 sept. 2026· Début 15 sept. 2026 ✓· 17 % du score
L'article de Google[2][3] est daté du '15 sept. 2026' et dit '3.8 Live est déployé dès aujourd'hui' ; l'article de 9to5Google[5] publié le même jour dit 'Google a annoncé aujourd'hui Gemini 3.8 Live et Gemini 3.8 Live Extended Thinking', et le journal des modifications de l'API Gemini répertorie les deux comme disponibles en version générale au 15 septembre.
- [2]90%Gemini 3.8 Live Extended Thinking | Gemini APIai.google.dev· Ajouté le 28 sept. 2026· 17 % du score
The API model page for gemini-3.8-live-extended-thinking: text, image, audio and video in, text and audio out, 131,072 input and 65,536 output tokens, asynchronous function calling and search grounding supported, latest update September 2026.[1]
- [3]85%Gemini Developer API pricingai.google.dev· Ajouté le 28 sept. 2026· 17 % du score
The pricing page lists Gemini 3.8 Live and 3.8 Live Extended Thinking together: $0.75 text, $3.00 audio and $1.00 image/video input and $4.50 text and $12.00 audio output per million tokens, or about $0.005 and $0.018 a minute of audio.[1]
- [4]75%Introducing Gemini 3.8 Live with Live Avatarblog.google· Publié le 24 sept. 2026· 17 % du score
Google's[2][3] follow-up post of 24 September adds Live Avatar to 3.8 Live, pairing the voice model with near real-time video of a speaking persona, available in Gemini Enterprise.
- [5]90%Gemini 3.8 Live Extended Thinking powers Gemini Live, Gmail, & Keep9to5google.com· Publié le 15 sept. 2026· Début 15 sept. 2026· 16 % du score
9to5Google's same-day report by Abner Li that Google[2][3] "today announced" both models, following 3.1 Flash Live in March; it repeats the benchmark claims and says Extended Thinking powers Gmail Live, Docs Live and Keep Live and is rolling out to Gemini Live, while 3.8 Live powers Search Live.
Suggérer une correction
Il manque quelque chose ou une erreur s'est glissée ? Dites-le avec vos mots : un lien qui étaye cette épingle, une autre date de début ou de fin et pourquoi, ou une information absente ou erronée. L'IA la vérifie au regard des sources de l'épingle, en cherche de meilleures et ajoute toute page qui vous donne raison. Les sources de l'épingle restent celles qui comptent le plus. L'IA regarde aussi les images : une image qui montre autre chose, ou qui le montre mal, passe en dernier ou est remplacée.