- Início
- 23 de set. de 202690% DE CONFIANÇAde a fonte
Gemini 3.8 Flash TTS e 3.8 Flash-Lite TTS são lançados
Traduzido automaticamente do original
Título original: Gemini 3.8 Flash TTS and 3.8 Flash-Lite TTS Released
- O Google apresentou o Gemini 3.8 Flash TTS e o Gemini 3.8 Flash-Lite TTS em 23 de setembro de 2026 como “nossos modelos de geração de áudio mais expressivos até agora”: o Flash TTS para direção criativa e criação de personagens, o Flash-Lite TTS para dublagem e agentes de voz de alto volume e baixo custo[1]
- O Flash TTS cria vozes novas a partir de prompts em linguagem natural em mais de 100 idiomas e dialetos, oferece mais de 2.000 vozes prontas e pode replicar uma voz a partir de uma amostra de 30 segundos quando o consentimento verbal gravado do dono corresponde ao locutor de referência[1]
- Ambos aceitam direção linha a linha sobre ritmo, emoção e sotaque, mantêm a voz estável ao longo de horas de áudio, encenam cenas com dois falantes a partir de um único roteiro e reproduzem indicações como <laughs>, <sigh> e interjeições como “mhm”[1]
- Eles foram liberados na API Gemini e no Google AI Studio, com o Flash TTS no Gemini Notebook e o Flash-Lite TTS no Google Vids; o acesso pelo Gemini Enterprise vem em breve[1][5]
- O registro de alterações da API Gemini lista o lançamento em 22 de setembro, com um novo endpoint Voices; o Flash-Lite TTS substitui a prévia do Gemini 3.1 Flash TTS[2]
- A replicação de voz no AI Studio está bloqueada no Reino Unido, no EEE, na Índia, no Texas e em Illinois[5]
Destaques
- Primeiro no geral no Voice Design Benchmark da Hume AI (71,4) e primeiro em modelagem de sotaque (60,8); Flash e Flash-Lite ficam em primeiro e segundo no Overall Quality Index da Hume, embora a ElevenLabs tenha pontuado mais alto nas categorias individuais de qualidade de voz da Hume[1][5]
- O Flash TTS custa US$ 0,50 por milhão de tokens de entrada de texto e US$ 9,00 por milhão de tokens de saída de áudio (cerca de US$ 0,00225 por 10 segundos) até 31 de dezembro de 2026, dobrando para US$ 1,00 e US$ 18,00 a partir de 1º de janeiro de 2027; o Flash-Lite TTS custa US$ 0,50 e US$ 6,00, subindo para US$ 1,00 e US$ 12,00[3]
- Entrada de texto de até 8.192 tokens e até 16.384 tokens de saída na API Gemini[4]
- Cada trecho leva uma marca d'água SynthID, e as vozes replicadas também levam credenciais C2PA[1][5]
- Entre os parceiros que integram os modelos estão Figma, HeyGen, Wondercraft, 99.co e Ollang[1]
Referências 687% DE CONFIANÇAConfiança geral: 87%Quanto a fonte e as referências do pin sustentam suas datas.Média ponderada de quanto 6 referências, incluindo a fonte, sustentam os horários de início e fim do pin; uma referência conta metade a cada 180 dias a mais em relação à mais recenteMostrar todos os pins com confiança de 75% ou mais
A primeira entrada é sempre a fonte do pin. A confiança geral é uma média ponderada de quanto cada referência sustenta os horários de início e fim usados acima; uma referência conta metade a cada 180 dias a mais em relação à mais recente.
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speechblog.google· Postado em 28 de set. de 2026· Início 23 de set. de 2026 ✓· 17% da pontuação
O texto do Google[2][3][4] é datado de “23 de set. de 2026” e diz que ambos os modelos estão “sendo liberados a partir de hoje”; o The Next Web[6] informa que “o Google lançou o Gemini 3.8 Flash TTS e o Gemini 3.8 Flash-Lite TTS na quarta-feira”. O registro de alterações da API Gemini registra a disponibilidade geral um dia antes, em 22 de setembro.
- [2]85%Release notes | Gemini APIai.google.dev· Adicionado em 28 de set. de 2026· 17% da pontuação
The Gemini API changelog under September 22, 2026 lists both models as generally available with the new Voices endpoint, voice design, voice replication and an extended library of 150+ voices, and says Flash-Lite TTS replaces gemini-3.1-flash-tts-preview.[1]
- [3]85%Gemini Developer API pricingai.google.dev· Adicionado em 28 de set. de 2026· 17% da pontuação
Flash TTS costs $0.50 per million text input tokens and $9.00 per million audio output tokens through 31 December 2026, then $1.00 and $18.00; Flash-Lite TTS $0.50 and $6.00, then $1.00 and $12.00.[1]
- [4]85%Gemini 3.8 Flash TTS | Gemini APIai.google.dev· Adicionado em 28 de set. de 2026· 17% da pontuação
The API model page for gemini-3.8-flash-tts: text in, audio out, an 8,192-token input limit and 16,384 output tokens (Gemini API serving limit), latest update September 2026.[1]
- [5]85%Gemini can now clone your voice and perform scripts like an actorandroidauthority.com· Publicado em 24 de set. de 2026· 16% da pontuação
Android Authority on the rollout to Gemini Notebook and Google[2][3][4] Vids; it notes ElevenLabs still scored higher in Hume's individual voice-quality and human-like-variation categories, and that AI Studio voice replication is blocked in the UK, the EEA, India, Texas and Illinois.
Sugerir uma correção
Falta algo ou há um erro? Diga com suas palavras: um link que sustente este pin, uma data de início ou fim diferente e por quê, ou um fato que falta ou está errado. A IA confere isso com as fontes do pin, procura outras melhores e adiciona qualquer página que dê razão a você. As fontes do próprio pin continuam contando mais. Uma imagem que mostra outra coisa, ou mostra mal, também é analisada e rebaixada ou substituída.