Gemini اکنون می تواند صدای شما را شبیه سازی کند و فیلمنامه ها را مانند یک بازیگر اجرا کند
این ارتقا بیش از 2000 صدا، صحنه های دو بلندگو و کنترل های تحویل دقیق تر را اضافه می کند.
TL; DR
Google در حال عرضه Gemini 3.8 Flash TTS و Flash-Lite TTS، جدیدترین مدل های تبدیل متن به گفتار خود برای صدای تولید شده توسط هوش مصنوعی رساتر است.
Gemini 3.8 Flash TTS میتواند صداهای سفارشی ایجاد کند، صدای مجاز را از یک نمونه 30 ثانیهای تکرار کند و لهجهها، قدم زدن، احساسات و گفتگوی دو بلندگو را کنترل کند.
مدلهای جدید به Gemini Notebook و Google Vids میرسند و هر دو از طریق Google AI Studio و Gemini API در دسترس توسعهدهندگان هستند.
صداگذاران هوش مصنوعی می توانند یک اسکریپت را بخوانند. اما واداشتن آنها به اجرای واقعی آن با لهجه، قدم زدن، احساسات، مکث ها و حتی آه های گاه به گاه داستان دیگری است. برای رفع این مشکل، گوگل هفتهها صرف رشد Gemini 3.8 از Gemini 3.8 Flash به مدلهای جدید Live و Live Extended Thinking کرده است. و اکنون میخواهد که همان خانواده نقش را برعهده داشته باشند و Gemini 3.8 Flash Text-to-Speech (TTS) و Flash-Lite TTS در حال عرضه هستند.
بزرگترین تغییر برای کاربران کنترل است. در یک پست وبلاگی، گوگل میگوید Gemini 3.8 Flash TTS میتواند با پشتیبانی از بیش از 100 زبان و گویش، صدایی اصلی از یک توصیف به زبان طبیعی ایجاد کند. شما همچنین بیش از 2000 صدای آماده تولید دریافت میکنید و تکرار صدا میتواند صدایی ثابت را از یک نمونه 30 ثانیهای بازسازی کند، مشروط بر اینکه اجازه استفاده از آن را داشته باشید.
متن اصلی (انگلیسی)
Gemini can now clone your voice and perform scripts like an actor
The upgrade adds 2,000+ voices, two-speaker scenes, and finer delivery controls.