پرش به محتوای اصلی

چهره هوش مصنوعی گوگل؛ «آواتار زنده» جمنای با توانایی لب‌خوانی رونمایی شد

زومیت۱۴۰۵ مهر ۳, جمعه، ساعت ۰۹:۱۷حدود 1 دقیقه مطالعه

Live Avatar با لب‌خوانی، حالت‌های چهره و پشتیبانی از ۹۷ زبان، مکالمه با هوش مصنوعی گوگل را تصویری می‌کند.

Live Avatar با لب‌خوانی، حالت‌های چهره و پشتیبانی از ۹۷ زبان، مکالمه با هوش مصنوعی گوگل را تصویری می‌کند.

به‌روزرسانی تازه‌ی Gemini 3.8 Live به کاربران اجازه می‌دهد هنگام گفت‌وگو با مدل، پاسخ‌های یک شخصیت متحرک هوش مصنوعی را به‌صورت هم‌زمان تماشا کنند.

قابلیت Live Avatar حرکات لب را با گفتار هماهنگ می‌کند و در جریان مکالمه حالت‌های مختلف چهره را به نمایش می‌گذارد. دسترسی به قابلیت تازه فعلا فقط برای مشتریان سازمانی Gemini Enterprise فراهم شده و کاربران عادی هنوز نمی‌توانند از آن بهره ببرند.

آواتار زنده‌ی گوگل میان ۹۷ زبان پشتیبانی‌شده جابه‌جا می‌شود، بی‌آنکه کیفیت ویدئو کاهش یابد یا تصویر به‌تدریج دچار انحراف بصری شود. یکی از ویدئوهای منتشرشده از سوی گوگل ، Live Avatar را در حال صحبت به زبان‌های انگلیسی و ژاپنی نشان می‌دهد و حرکت دهان در هر دو زبان با کلمات بیان‌شده هماهنگ می‌ماند. آواتار هنگام صحبت می‌تواند اطلاعات مرتبط را نیز روی صفحه نمایش دهد.

عرضه‌ی Live Avatar حدود یک هفته پس از معرفی مدل جدید Gemini 3.8 Live انجام گرفت. گوگل می‌گوید مدل تازه ورودی‌های بصری را تقریبا به‌صورت هم‌زمان پردازش می‌کند. مشتریان به کتابخانه‌ای از آواتارهای آماده دسترسی خواهند داشت، اما سازمان‌ها می‌توانند آواتار اختصاصی خود را نیز بسازند.

خروجی Live Avatar به واترمارک نامرئی SynthID مجهز خواهد بود تا محتوای تولیدشده با هوش مصنوعی قابل شناسایی بماند.

گوگل در کنار واترمارک، تدابیر حفاظتی دیگری برای رعایت هویت افراد در نظر گرفته است. مجموعه‌ی قابلیت‌ها می‌تواند تعامل با هوش مصنوعی گوگل را از یک مکالمه‌ی صرفا صوتی یا متنی به تجربه‌ای تصویری، زنده و چهره‌محور تبدیل کند.

خواندن متن کامل در زومیتبه زبان اصلی، در سایت ناشر باز می‌شودهمه‌ی اخبار فناوری