- البدء
- 23 سبتمبر 2026ثقة 90%من المصدر
إطلاق Gemini 3.8 Flash TTS وGemini 3.8 Flash-Lite TTS
تُرجم تلقائيًا من الأصل
العنوان الأصلي: Gemini 3.8 Flash TTS and 3.8 Flash-Lite TTS Released
- قدمت Google نموذجي Gemini 3.8 Flash TTS وGemini 3.8 Flash-Lite TTS في 23 سبتمبر 2026 بوصفهما «أكثر نماذجنا تعبيراً لتوليد الصوت حتى الآن»: Flash TTS للتوجيه الإبداعي وتصميم الشخصيات، وFlash-Lite TTS للدبلجة والوكلاء الصوتيين عالي الحجم وفعال التكلفة[1]
- ينشئ Flash TTS أصواتاً جديدة من أوامر بلغة طبيعية بأكثر من 100 لغة ولهجة، ويوفر أكثر من 2,000 صوت جاهز، ويمكنه استنساخ صوت من عينة مدتها 30 ثانية متى طابقت الموافقة الشفهية المسجلة لصاحب الصوت المتحدث المرجعي[1]
- يقبل كلاهما توجيهاً سطراً بسطر بشأن الإيقاع والعاطفة واللكنة، ويحافظان على ثبات الصوت عبر ساعات من التسجيل، ويخرجان مشاهد لمتحدثين اثنين من نص واحد، وينفذان إشارات مثل <laughs> و<sigh> وردود التفاعل مثل «mhm»[1]
- طُرحا في Gemini API وGoogle AI Studio، مع Flash TTS في Gemini Notebook وFlash-Lite TTS في Google Vids؛ والوصول عبر Gemini Enterprise قادم قريباً[1][5]
- يدرج سجل تغييرات Gemini API الإصدار في 22 سبتمبر، مع نقطة نهاية جديدة للأصوات Voices؛ ويحل Flash-Lite TTS محل المعاينة السابقة Gemini 3.1 Flash TTS[2]
- استنساخ الأصوات في AI Studio محظور في المملكة المتحدة والمنطقة الاقتصادية الأوروبية والهند وتكساس وإلينوي[5]
أبرز الميزات
- الأول عموماً في Voice Design Benchmark من Hume AI (71.4) والأول في نمذجة اللكنات (60.8)؛ ويحتل Flash وFlash-Lite المركزين الأول والثاني في مؤشر الجودة الإجمالية لدى Hume، وإن سجلت ElevenLabs نتائج أعلى في فئات جودة الصوت الفردية لدى Hume[1][5]
- يكلف Flash TTS 0.50 دولار لكل مليون رمز إدخال نصي و9.00 دولارات لكل مليون رمز إخراج صوتي (نحو 0.00225 دولار لكل 10 ثوانٍ) حتى 31 ديسمبر 2026، ثم يتضاعف إلى 1.00 و18.00 دولاراً اعتباراً من 1 يناير 2027؛ ويكلف Flash-Lite TTS 0.50 و6.00 دولارات، ثم يرتفع إلى 1.00 و12.00 دولاراً[3]
- إدخال نصي يصل إلى 8,192 رمزاً وإخراج يصل إلى 16,384 رمزاً في Gemini API[4]
- يحمل كل مقطع علامة SynthID المائية، وتحمل الأصوات المستنسخة أيضاً بيانات اعتماد C2PA[1][5]
- من الشركاء الذين يدمجون النموذجين Figma وHeyGen وWondercraft و99.co وOllang[1]
المراجع 6ثقة 87%الثقة الإجمالية: 87%مدى دعم مصدر الدبوس ومراجعه لتواريخه.متوسط مرجّح لمدى قوة دعم 6 مراجع، بما فيها المصدر، لوقتَي بدء الدبوس وانتهائه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجععرض كل الدبابيس بثقة 75% أو أعلى
المدخل الأول هو دائمًا مصدر الدبوس. الثقة الإجمالية متوسط مرجّح لمدى قوة دعم كل مرجع لوقتَي البدء والانتهاء المستخدمين أعلاه؛ ويقل وزن المرجع إلى النصف عن كل 180 يومًا يسبق بها أحدث مرجع.
- [1]90%blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-8-text-to-speechblog.google· نُشر 28 سبتمبر 2026· يبدأ 23 سبتمبر 2026 ✓· 17% من الدرجة
منشور Google[2][3][4] مؤرخ «23 سبتمبر 2026» ويقول إن النموذجين «يُطرحان ابتداءً من اليوم»؛ وتفيد The Next Web[6] بأن «Google أطلقت Gemini 3.8 Flash TTS وGemini 3.8 Flash-Lite TTS يوم الأربعاء». ويسجل سجل تغييرات Gemini API الإتاحة العامة قبل ذلك بيوم، في 22 سبتمبر.
- [2]85%Release notes | Gemini APIai.google.dev· أُضيف 28 سبتمبر 2026· 17% من الدرجة
The Gemini API changelog under September 22, 2026 lists both models as generally available with the new Voices endpoint, voice design, voice replication and an extended library of 150+ voices, and says Flash-Lite TTS replaces gemini-3.1-flash-tts-preview.[1]
- [3]85%Gemini Developer API pricingai.google.dev· أُضيف 28 سبتمبر 2026· 17% من الدرجة
Flash TTS costs $0.50 per million text input tokens and $9.00 per million audio output tokens through 31 December 2026, then $1.00 and $18.00; Flash-Lite TTS $0.50 and $6.00, then $1.00 and $12.00.[1]
- [4]85%Gemini 3.8 Flash TTS | Gemini APIai.google.dev· أُضيف 28 سبتمبر 2026· 17% من الدرجة
The API model page for gemini-3.8-flash-tts: text in, audio out, an 8,192-token input limit and 16,384 output tokens (Gemini API serving limit), latest update September 2026.[1]
- [5]85%Gemini can now clone your voice and perform scripts like an actorandroidauthority.com· صدر 24 سبتمبر 2026· 16% من الدرجة
Android Authority on the rollout to Gemini Notebook and Google[2][3][4] Vids; it notes ElevenLabs still scored higher in Hume's individual voice-quality and human-like-variation categories, and that AI Studio voice replication is blocked in the UK, the EEA, India, Texas and Illinois.
اقتراح تصحيح
هل ينقص شيء أو يوجد خطأ؟ قله بكلماتك: رابط يدعم هذا الدبوس، أو تاريخ بدء أو انتهاء مختلف مع السبب، أو معلومة ينقصها أو يخطئ فيها. يفحص الذكاء الاصطناعي ذلك بمقارنته بمصادر هذا الدبوس، ويبحث عن مصادر أفضل، ويضيف أي صفحة تدعم كلامك. وتبقى مصادر الدبوس نفسه الأثقل وزنًا. كما تُفحص الصورة التي تُظهر شيئًا آخر أو تُظهره بشكل سيئ، فتُنزَّل أو تُستبدل.