🎙 گوگل یه مدل جدید برای ساخت صدای AI معرفی کرده! مدل Gemini 3.8 Flash TTS برای تبدیل متن به گفتار طراحی شده و خودش رو به عنوان رقیبی برای ابزارهایی مثل ElevenLabs مطـــرح کرده. نسخه سبکتر Gemini 3.8 Flash Lite TTS برای سرعت و هزینه کمتر وجود داره. اما چیزی که جالبه، فقط کیفیت صدا نیست؛ کنترل صدا و ساخت سناریو هم دست خودته 👀 توو Google AI Studio میتونی: 🗣 چند گوینده مختلف بسازی 🎭 لحن و سبک بیان رو مشخص کنی 🎚 سرعت و شخصیت صوتی رو تنظیم کنی 🎧 قبل از خروجی، هر بخش رو جداگانه تست کنی 😮 حالتهایی مثل نجوا، شادی یا عصبانیت اضافه کنی 🎙 مکالمه چند نفره و حتی محتوای پادکستی بسازی جالبتر اینکه میتونی متن رو به چند بلوک صوتی تقسیم کنی و برای هر بخش گوینده و لحن متفاوت داشته باشی حتی تگهایی مثل: [breath] [clearing throat] [cheer] برای طبیعیتر شدن اجرا قابل استفادهان. پشتیبانی از فارسی هم داره ☀️🦁 یعنی میتونی یه سناریوی فارسی بنویسی، چند شخصیت صوتی براش بسازی و در نهایت خروجی صوتی بگیری. به نظرم این مدل بیشتر از اینکه فقط یه «تبدیل متن به صدا» باشه، داره به سمت استودیوی ساخت محتوای صوتی با AI میره 🔥


