- Inicio
- 15 sept 202690% DE CONFIANZAsegún la fuente
Google lanza Gemini 3.8 Live y 3.8 Live Extended Thinking
Traducido automáticamente del original
Título original: Gemini 3.8 Live and 3.8 Live Extended Thinking Released
- Google presentó Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking el 15 de septiembre de 2026 como "nuestros modelos de diálogo en vivo más avanzados hasta la fecha": 3.8 Live está "creado para la escala y la eficiencia de costes" y Extended Thinking "para tareas de alta complejidad, con mayor inteligencia y razonamiento de varios pasos"[1]
- Extended Thinking "razona y habla simultáneamente", usando señales tempranas como "Déjame comprobar eso…" y narrando el progreso mientras las tareas de varios pasos se ejecutan en segundo plano[1]
- 3.8 Live lee la entrada visual casi en tiempo real, detecta y cambia entre 97 idiomas admitidos a mitad de conversación, y sigue hablando mientras las llamadas a herramientas y a la API terminan en segundo plano[1]
- Ambos llegaron a los desarrolladores en la API de Gemini y Google AI Studio, y a las empresas en vista previa privada en Gemini Enterprise; 3.8 Live se implementó en Search Live y Extended Thinking en Gemini Live, Docs Live, Gmail Live y Keep Live[1][5]
- Suceden a Gemini 3.1 Flash Live, lanzado en marzo[5]
- El 24 de septiembre Google añadió Live Avatar, una persona de video casi en tiempo real para 3.8 Live, en Gemini Enterprise[4]
Características destacadas
- Extended Thinking ocupa el primer puesto en el Speech to Speech Quality Index de Artificial Analysis (82,6) y obtiene 68,6% en τ-Voice, 35,1% en el benchmark τ-Voice-banking de Sierra y 97,7% en Big Bench Audio; 3.8 Live se sitúa segundo en la Speech Agent Arena[1]
- Precios por millón de tokens: 0,75 $ para texto, 3,00 $ para audio y 1,00 $ para entrada de imagen o video, y 4,50 $ para texto y 12,00 $ para salida de audio: unos 0,005 $ por minuto de audio de entrada y 0,018 $ de salida[3]
- Acepta audio, imágenes, video y texto, con un límite de entrada de 131.072 tokens y 65.536 tokens de salida, y admite llamadas a funciones asíncronas y el anclaje con Google Search[2]
- Basado en Gemini 3 Pro, con una fecha de corte de conocimiento de enero de 2025[6]
- Todo el audio generado lleva una marca de agua SynthID imperceptible[1]
- Plataformas de voz como Agora, LangChain, LiveKit, Pipecat y Vercel lo admiten a través de la Gemini Live API, y Salesforce, Genspark y Lumeris son socios de lanzamiento[1]
Referencias 687% DE CONFIANZAConfianza general: 87%Hasta qué punto la fuente y las referencias del pin respaldan sus fechas.Media ponderada de la firmeza con la que 6 referencias, incluida la fuente, respaldan las horas de inicio y fin del pin; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más recienteMostrar todos los pines con un 75% de confianza o más
La primera entrada es siempre la fuente del pin. La confianza global es una media ponderada de la firmeza con la que cada referencia respalda las horas de inicio y fin usadas arriba; una referencia cuenta la mitad por cada 180 días que sea más antigua que la más reciente.
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-live-gemini-3-8-live-extended-thinkingblog.google· Publicado el 28 sept 2026· Empieza 15 sept 2026 ✓· 17% de la puntuación
La publicación de Google[2][3] está fechada el "15 de septiembre de 2026" y dice que "3.8 Live se está implementando a partir de hoy"; el informe de 9to5Google[5] del mismo día dice que "Google anunció hoy Gemini 3.8 Live y Gemini 3.8 Live Extended Thinking", y el registro de cambios de la API de Gemini incluye ambos como disponibles con carácter general el 15 de septiembre.
- [2]90%Gemini 3.8 Live Extended Thinking | Gemini APIai.google.dev· Añadido el 28 sept 2026· 17% de la puntuación
The API model page for gemini-3.8-live-extended-thinking: text, image, audio and video in, text and audio out, 131,072 input and 65,536 output tokens, asynchronous function calling and search grounding supported, latest update September 2026.[1]
- [3]85%Gemini Developer API pricingai.google.dev· Añadido el 28 sept 2026· 17% de la puntuación
The pricing page lists Gemini 3.8 Live and 3.8 Live Extended Thinking together: $0.75 text, $3.00 audio and $1.00 image/video input and $4.50 text and $12.00 audio output per million tokens, or about $0.005 and $0.018 a minute of audio.[1]
- [4]75%Introducing Gemini 3.8 Live with Live Avatarblog.google· Publicado el 24 sept 2026· 17% de la puntuación
Google's[2][3] follow-up post of 24 September adds Live Avatar to 3.8 Live, pairing the voice model with near real-time video of a speaking persona, available in Gemini Enterprise.
- [5]90%Gemini 3.8 Live Extended Thinking powers Gemini Live, Gmail, & Keep9to5google.com· Publicado el 15 sept 2026· Empieza 15 sept 2026· 16% de la puntuación
9to5Google's same-day report by Abner Li that Google[2][3] "today announced" both models, following 3.1 Flash Live in March; it repeats the benchmark claims and says Extended Thinking powers Gmail Live, Docs Live and Keep Live and is rolling out to Gemini Live, while 3.8 Live powers Search Live.
Sugerir una corrección
¿Falta algo o hay un error? Dilo con tus palabras: un enlace que respalde este pin, otra fecha de inicio o fin y por qué, o un dato que falta o está mal. La IA lo contrasta con las fuentes del pin, busca otras mejores y añade cualquier página que te dé la razón. Las fuentes del propio pin siguen contando más. La IA también mira las imágenes: una que muestra otra cosa, o la muestra mal, pasa al final o se sustituye.