پرش به محتوای اصلی

Gemini اکنون می تواند صدای شما را شبیه سازی کند و فیلمنامه ها را مانند یک بازیگر اجرا کند

اندروید آتوریتی۱۴۰۵ مهر ۲, پنجشنبه، ساعت ۱۱:۳۲حدود 1 دقیقه مطالعه

این ارتقا بیش از 2000 صدا، صحنه های دو بلندگو و کنترل های تحویل دقیق تر را اضافه می کند.

TL; DR

Google در حال عرضه Gemini 3.8 Flash TTS و Flash-Lite TTS، جدیدترین مدل های تبدیل متن به گفتار خود برای صدای تولید شده توسط هوش مصنوعی رساتر است.

Gemini 3.8 Flash TTS می‌تواند صداهای سفارشی ایجاد کند، صدای مجاز را از یک نمونه 30 ثانیه‌ای تکرار کند و لهجه‌ها، قدم زدن، احساسات و گفتگوی دو بلندگو را کنترل کند.

مدل‌های جدید به Gemini Notebook و Google Vids می‌رسند و هر دو از طریق Google AI Studio و Gemini API در دسترس توسعه‌دهندگان هستند.

صداگذاران هوش مصنوعی می توانند یک اسکریپت را بخوانند. اما واداشتن آنها به اجرای واقعی آن با لهجه، قدم زدن، احساسات، مکث ها و حتی آه های گاه به گاه داستان دیگری است. برای رفع این مشکل، گوگل هفته‌ها صرف رشد Gemini 3.8 از Gemini 3.8 Flash به مدل‌های جدید Live و Live Extended Thinking کرده است. و اکنون می‌خواهد که همان خانواده نقش را برعهده داشته باشند و Gemini 3.8 Flash Text-to-Speech (TTS) و Flash-Lite TTS در حال عرضه هستند.

بزرگترین تغییر برای کاربران کنترل است. در یک پست وبلاگی، گوگل می‌گوید Gemini 3.8 Flash TTS می‌تواند با پشتیبانی از بیش از 100 زبان و گویش، صدایی اصلی از یک توصیف به زبان طبیعی ایجاد کند. شما همچنین بیش از 2000 صدای آماده تولید دریافت می‌کنید و تکرار صدا می‌تواند صدایی ثابت را از یک نمونه 30 ثانیه‌ای بازسازی کند، مشروط بر اینکه اجازه استفاده از آن را داشته باشید.

خواندن متن کامل در اندروید آتوریتیبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Gemini can now clone your voice and perform scripts like an actor

The upgrade adds 2,000+ voices, two-speaker scenes, and finer delivery controls.

همه‌ی اخبار فناوری