- เริ่ม
- 23 ก.ย. 2026ความเชื่อมั่น 90%จาก แหล่งที่มา
เปิดตัว Gemini 3.8 Flash TTS และ 3.8 Flash-Lite TTS
แปลอัตโนมัติจากต้นฉบับ
ชื่อต้นฉบับ: Gemini 3.8 Flash TTS and 3.8 Flash-Lite TTS Released
- Google เปิดตัว Gemini 3.8 Flash TTS และ Gemini 3.8 Flash-Lite TTS เมื่อวันที่ 23 กันยายน 2026 ในฐานะ “โมเดลสร้างเสียงที่สื่ออารมณ์ได้ดีที่สุดของเราจนถึงตอนนี้” โดย Flash TTS สำหรับการกำกับเชิงสร้างสรรค์และการออกแบบตัวละคร และ Flash-Lite TTS สำหรับการพากย์และเอเจนต์เสียงปริมาณมากที่ประหยัดต้นทุน[1]
- Flash TTS สร้างเสียงใหม่จากพรอมต์ภาษาธรรมชาติในกว่า 100 ภาษาและสำเนียง มีเสียงสำเร็จรูปกว่า 2,000 เสียง และสามารถจำลองเสียงจากตัวอย่าง 30 วินาทีเมื่อความยินยอมด้วยวาจาที่บันทึกไว้ของเจ้าของเสียงตรงกับผู้พูดต้นแบบ[1]
- ทั้งสองรับคำกำกับทีละบรรทัดเรื่องจังหวะ อารมณ์ และสำเนียง รักษาเสียงให้คงที่ตลอดเสียงหลายชั่วโมง จัดฉากสองผู้พูดจากสคริปต์เดียว และแสดงสัญญาณอย่าง <laughs>, <sigh> และเสียงตอบรับอย่าง “mhm”[1]
- ทยอยเปิดใน Gemini API และ Google AI Studio โดย Flash TTS อยู่ใน Gemini Notebook และ Flash-Lite TTS อยู่ใน Google Vids ส่วนการเข้าถึงผ่าน Gemini Enterprise จะมาเร็ว ๆ นี้[1][5]
- บันทึกการเปลี่ยนแปลงของ Gemini API ระบุการเปิดตัวไว้ภายใต้วันที่ 22 กันยายน พร้อมปลายทาง Voices ใหม่ โดย Flash-Lite TTS มาแทนที่ตัวอย่าง Gemini 3.1 Flash TTS[2]
- การจำลองเสียงใน AI Studio ถูกบล็อกในสหราชอาณาจักร เขตเศรษฐกิจยุโรป (EEA) อินเดีย เท็กซัส และอิลลินอยส์[5]
จุดเด่น
- อันดับหนึ่งโดยรวมใน Voice Design Benchmark ของ Hume AI (71.4) และอันดับหนึ่งด้านการสร้างแบบจำลองสำเนียง (60.8) โดย Flash และ Flash-Lite ได้อันดับหนึ่งและสองใน Overall Quality Index ของ Hume แม้ ElevenLabs จะได้คะแนนสูงกว่าในหมวดคุณภาพเสียงรายหมวดของ Hume[1][5]
- Flash TTS ราคา 0.50 ดอลลาร์ต่อหนึ่งล้านโทเค็นอินพุตข้อความ และ 9.00 ดอลลาร์ต่อหนึ่งล้านโทเค็นเอาต์พุตเสียง (ประมาณ 0.00225 ดอลลาร์ต่อ 10 วินาที) จนถึง 31 ธันวาคม 2026 แล้วเพิ่มเป็นสองเท่าเป็น 1.00 ดอลลาร์และ 18.00 ดอลลาร์ตั้งแต่ 1 มกราคม 2027 ส่วน Flash-Lite TTS ราคา 0.50 ดอลลาร์และ 6.00 ดอลลาร์ เพิ่มเป็น 1.00 ดอลลาร์และ 12.00 ดอลลาร์[3]
- อินพุตข้อความสูงสุด 8,192 โทเค็นและเอาต์พุตสูงสุด 16,384 โทเค็นบน Gemini API[4]
- ทุกคลิปมีลายน้ำ SynthID และเสียงที่จำลองยังมีข้อมูลรับรอง C2PA ด้วย[1][5]
- พันธมิตรที่นำโมเดลไปใช้ ได้แก่ Figma, HeyGen, Wondercraft, 99.co และ Ollang[1]
แหล่งอ้างอิง 6ความเชื่อมั่น 87%ความเชื่อมั่นโดยรวม: 87%แหล่งที่มาและแหล่งอ้างอิงของหมุดยืนยันวันที่ได้ดีเพียงใดค่าเฉลี่ยถ่วงน้ำหนักว่าแหล่งอ้างอิง 6 แหล่ง รวมแหล่งที่มา สนับสนุนเวลาเริ่มและสิ้นสุดของหมุดมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุดแสดงหมุดทั้งหมดที่มีความเชื่อมั่น 75% ขึ้นไป
รายการแรกคือแหล่งที่มาของหมุดเสมอ ความเชื่อมั่นโดยรวมคือค่าเฉลี่ยถ่วงน้ำหนักว่าแต่ละแหล่งอ้างอิงสนับสนุนเวลาเริ่มและสิ้นสุดด้านบนมากเพียงใด แหล่งอ้างอิงจะมีน้ำหนักลดลงครึ่งหนึ่งทุก ๆ 180 วันที่เก่ากว่าแหล่งล่าสุด
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speechblog.google· โพสต์ 28 ก.ย. 2026· เริ่ม 23 ก.ย. 2026 ✓· 17% ของคะแนน
โพสต์ของ Google[2][3][4] ลงวันที่ “23 ก.ย. 2026” และระบุว่าทั้งสองโมเดล “ทยอยเปิดตัวตั้งแต่วันนี้” ส่วน The Next Web[6] รายงานว่า “Google เปิดตัว Gemini 3.8 Flash TTS และ Gemini 3.8 Flash-Lite TTS เมื่อวันพุธ” บันทึกการเปลี่ยนแปลงของ Gemini API ระบุการพร้อมใช้งานทั่วไปไว้หนึ่งวันก่อนหน้า ภายใต้วันที่ 22 กันยายน
- [2]85%Release notes | Gemini APIai.google.dev· เพิ่มเมื่อ 28 ก.ย. 2026· 17% ของคะแนน
The Gemini API changelog under September 22, 2026 lists both models as generally available with the new Voices endpoint, voice design, voice replication and an extended library of 150+ voices, and says Flash-Lite TTS replaces gemini-3.1-flash-tts-preview.[1]
- [3]85%Gemini Developer API pricingai.google.dev· เพิ่มเมื่อ 28 ก.ย. 2026· 17% ของคะแนน
Flash TTS costs $0.50 per million text input tokens and $9.00 per million audio output tokens through 31 December 2026, then $1.00 and $18.00; Flash-Lite TTS $0.50 and $6.00, then $1.00 and $12.00.[1]
- [4]85%Gemini 3.8 Flash TTS | Gemini APIai.google.dev· เพิ่มเมื่อ 28 ก.ย. 2026· 17% ของคะแนน
The API model page for gemini-3.8-flash-tts: text in, audio out, an 8,192-token input limit and 16,384 output tokens (Gemini API serving limit), latest update September 2026.[1]
- [5]85%Gemini can now clone your voice and perform scripts like an actorandroidauthority.com· เผยแพร่ 24 ก.ย. 2026· 16% ของคะแนน
Android Authority on the rollout to Gemini Notebook and Google[2][3][4] Vids; it notes ElevenLabs still scored higher in Hume's individual voice-quality and human-like-variation categories, and that AI Studio voice replication is blocked in the UK, the EEA, India, Texas and Illinois.
เสนอการแก้ไข
มีอะไรขาดหรือผิดไหม บอกด้วยคำพูดของคุณเอง: ลิงก์ที่สนับสนุนหมุดนี้ วันที่เริ่มหรือสิ้นสุดที่ต่างออกไปพร้อมเหตุผล หรือข้อเท็จจริงที่ขาดหรือผิด AI จะตรวจสอบกับแหล่งที่มาของหมุด ค้นหาแหล่งที่ดีกว่า และเพิ่มหน้าที่สนับสนุนคุณ แหล่งที่มาของหมุดเองยังคงมีน้ำหนักมากที่สุด รูปภาพที่แสดงสิ่งอื่นหรือแสดงได้ไม่ดีก็จะถูกตรวจสอบ และเลื่อนลงหรือแทนที่