- Mulai
- 23 Sep 2026KEYAKINAN 90%dari sumbernya
Gemini 3.8 Flash TTS dan 3.8 Flash-Lite TTS Dirilis
Diterjemahkan otomatis dari aslinya
Judul asli: Gemini 3.8 Flash TTS and 3.8 Flash-Lite TTS Released
- Google memperkenalkan Gemini 3.8 Flash TTS dan Gemini 3.8 Flash-Lite TTS pada 23 September 2026 sebagai “model pembuat audio kami yang paling ekspresif sejauh ini”: Flash TTS untuk arahan kreatif dan desain karakter, Flash-Lite TTS untuk dubbing dan agen suara bervolume tinggi yang hemat biaya[1]
- Flash TTS membuat suara baru dari prompt bahasa alami dalam lebih dari 100 bahasa dan dialek, menawarkan lebih dari 2,000 suara siap pakai, dan dapat mereplikasi suara dari sampel 30 detik setelah persetujuan lisan terekam dari pemiliknya cocok dengan pembicara referensi[1]
- Keduanya menerima arahan baris demi baris tentang tempo, emosi, dan aksen, menjaga suara tetap stabil selama berjam-jam audio, menggelar adegan dua pembicara dari satu naskah, dan merender isyarat seperti <laughs>, <sigh> dan backchannel seperti “mhm”[1]
- Keduanya diluncurkan di Gemini API dan Google AI Studio, dengan Flash TTS di Gemini Notebook dan Flash-Lite TTS di Google Vids; akses Gemini Enterprise segera hadir[1][5]
- Changelog Gemini API mencantumkan rilis ini pada 22 September, dengan endpoint Voices baru; Flash-Lite TTS menggantikan pratinjau Gemini 3.1 Flash TTS[2]
- Replikasi suara di AI Studio diblokir di Inggris, EEA, India, Texas, dan Illinois[5]
Fitur unggulan
- Peringkat pertama secara keseluruhan pada Voice Design Benchmark milik Hume AI (71.4) dan pertama dalam pemodelan aksen (60.8); Flash dan Flash-Lite menempati peringkat pertama dan kedua pada Overall Quality Index milik Hume, meski ElevenLabs mendapat skor lebih tinggi pada kategori kualitas suara individual Hume[1][5]
- Flash TTS berharga $0.50 per juta token masukan teks dan $9.00 per juta token keluaran audio (sekitar $0.00225 per 10 detik) hingga 31 Desember 2026, berlipat ganda menjadi $1.00 dan $18.00 mulai 1 Januari 2027; Flash-Lite TTS berharga $0.50 dan $6.00, naik menjadi $1.00 dan $12.00[3]
- Masukan teks hingga 8,192 token dan keluaran hingga 16,384 token di Gemini API[4]
- Setiap klip membawa watermark SynthID, dan suara yang direplikasi juga membawa kredensial C2PA[1][5]
- Mitra yang mengintegrasikan model ini meliputi Figma, HeyGen, Wondercraft, 99.co, dan Ollang[1]
Referensi 6KEYAKINAN 87%Keyakinan keseluruhan: 87%Seberapa baik sumber dan referensi pin mendukung tanggalnya.Rata-rata tertimbang dari seberapa kuat 6 referensi, termasuk sumber, mendukung waktu mulai dan berakhir pin; bobot sebuah referensi berkurang setengahnya untuk setiap 180 hari lebih lama dari yang terbaruTampilkan semua pin dengan keyakinan 75% atau lebih tinggi
Entri pertama selalu merupakan sumber pin. Keyakinan keseluruhan adalah rata-rata tertimbang dari seberapa kuat setiap referensi mendukung waktu mulai dan berakhir yang digunakan di atas; bobot sebuah referensi berkurang setengahnya untuk setiap 180 hari lebih lama dari yang terbaru.
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speechblog.google· Diposting 28 Sep 2026· Mulai 23 Sep 2026 ✓· 17% dari skor
Unggahan Google[2][3][4] bertanggal “23 Sep 2026” dan menyatakan kedua model “mulai diluncurkan hari ini”; The Next Web[6] melaporkan “Google merilis Gemini 3.8 Flash TTS dan Gemini 3.8 Flash-Lite TTS pada hari Rabu”. Changelog Gemini API mencatat ketersediaan umum sehari sebelumnya, pada 22 September.
- [2]85%Release notes | Gemini APIai.google.dev· Ditambahkan 28 Sep 2026· 17% dari skor
The Gemini API changelog under September 22, 2026 lists both models as generally available with the new Voices endpoint, voice design, voice replication and an extended library of 150+ voices, and says Flash-Lite TTS replaces gemini-3.1-flash-tts-preview.[1]
- [3]85%Gemini Developer API pricingai.google.dev· Ditambahkan 28 Sep 2026· 17% dari skor
Flash TTS costs $0.50 per million text input tokens and $9.00 per million audio output tokens through 31 December 2026, then $1.00 and $18.00; Flash-Lite TTS $0.50 and $6.00, then $1.00 and $12.00.[1]
- [4]85%Gemini 3.8 Flash TTS | Gemini APIai.google.dev· Ditambahkan 28 Sep 2026· 17% dari skor
The API model page for gemini-3.8-flash-tts: text in, audio out, an 8,192-token input limit and 16,384 output tokens (Gemini API serving limit), latest update September 2026.[1]
- [5]85%Gemini can now clone your voice and perform scripts like an actorandroidauthority.com· Diterbitkan 24 Sep 2026· 16% dari skor
Android Authority on the rollout to Gemini Notebook and Google[2][3][4] Vids; it notes ElevenLabs still scored higher in Hume's individual voice-quality and human-like-variation categories, and that AI Studio voice replication is blocked in the UK, the EEA, India, Texas and Illinois.
Sarankan koreksi
Ada yang kurang atau salah? Sampaikan dengan kata-kata Anda sendiri: tautan yang mendukung pin ini, tanggal mulai atau berakhir yang berbeda beserta alasannya, atau fakta yang kurang atau keliru. AI memeriksanya terhadap sumber pin ini, mencari sumber yang lebih baik, dan menambahkan halaman mana pun yang mendukung Anda. Sumber pin itu sendiri tetap paling diperhitungkan. Gambar yang menampilkan hal lain, atau menampilkannya dengan buruk, juga diperiksa, lalu diturunkan atau diganti.