پرش به محتوای اصلی

Google Gemini می‌تواند آواتارهای کارتونی یا واقعی را برای همگام‌سازی گفتگوهای مولد ارائه دهد

دِ رجیستر۱۴۰۵ مهر ۳, جمعه، ساعت ۰۳:۲۷حدود 3 دقیقه مطالعه

علیرغم عدم قطعیت در مورد چگونگی تأثیر تقلید انسان بر افراد، جعلی‌های DeepMind اینجا هستند

گوگل مدل گفتگوی زنده Gemini 3.8 Live را با قابلیتی به نام «آواتار زنده» تقویت کرده است که می‌تواند شخصیت‌های متحرک و شبیه‌سازی‌های واقعی انسانی را برای همگام‌سازی گفتار ماشینی Gemini به زبان بیاورد. Shuo-yiin Chang، دانشمند محقق در Google DeepMind و CJ Zheng، مهندس نرم افزار Gemini، در یک پست وبلاگ توضیح دادند: "مکالمه ذاتا چندوجهی است: ما گوش می دهیم، نگاه می کنیم، صحبت می کنیم و از حالات چهره برای برقراری ارتباط استفاده می کنیم." «Live Avatar این قابلیت‌ها را برای نمایندگان سازمانی به ارمغان می‌آورد.

با پردازش همزمان ورودی‌های بصری و صوتی، مکالمات غنی‌تری را برای تجربه جامع‌تری ایجاد می‌کند." پنج سال پیش، DeepMind در مورد خطرات مختلف مرتبط با استفاده از مدل‌های زبانی بزرگ هشدار داد، از جمله آسیب‌های تعامل انسانی مانند انسان‌سازی مدل‌های هوش مصنوعی - نسبت دادن ویژگی‌های انسانی به تعاملات مبتنی بر نرم‌افزار به عنوان انسان‌سازی مبتنی بر نرم‌افزار. گفتار و متن انسان مانند

بیش از 20 نویسنده مقاله DeepMind [PDF] با عنوان «خطرات اخلاقی و اجتماعی آسیب ناشی از مدل‌های زبانی» خاطرنشان کردند: «مدل‌های زبانی انسان‌سازی ممکن است تخمین‌های کاربران از شایستگی‌های عامل مکالمه را افزایش دهد». برای مثال، کاربران ممکن است به اشتباه استنباط کنند که یک عامل مکالمه که در زبان شبیه انسان به نظر می‌رسد، ویژگی‌های مشابه انسان را نیز نشان می‌دهد، مانند داشتن یک هویت منسجم در طول زمان، یا توانایی همدلی، دیدگاه‌گیری، و استدلال منطقی.

در نتیجه، آنها ممکن است به این نمایندگان اعتماد، اعتماد یا انتظارات نابجا داشته باشند." این در سال 2021 بود. در آگوست 2025، خطرات ناشی از انسانی کردن هوش مصنوعی زمانی که والدین آدام رین از OpenAI شکایت کردند و مدعی شدند که ChatGPT در خودکشی پسرشان نقش داشته است، به دادگاه رسید. رفتارهای کالیبره‌شده برای انتقال همدلی انسان‌مانند." تا دسامبر سال 2025، کارمندان گوگل هنوز با نیاز به درک تأثیر انسان‌سازی هوش مصنوعی دست و پنجه نرم می‌کردند.

مارک دیاز، رنه شلبی، اریک کوربت و اندرو اسمارت از Google Research در مقاله ای [PDF] با عنوان «چگونه کارگران فناوری با خطرات شبیه‌سازی انسان در هوش مصنوعی مولد مقابله می‌کنند» گزارش دادند که کارکنان فناوری شرکت‌کننده در گروه‌های متمرکز، رزروهایی مشابه با موارد ذکر شده در کار قبلی شرکت ابراز کردند. آنها می نویسند: «کارکنان فناوری نگرانی قابل توجهی را ابراز کردند که شباهت انسانی باعث ایجاد حس کاذب اعتماد و اعتماد می شود که به نگرانی های آنها هم به عنوان کاربران و هم به عنوان توسعه دهندگان شکل می دهد و به زبان و لحن روان و طبیعی پیوند می خورد که می تواند خطاها را پنهان کند.

بنابراین حتی در حالی که محققان هوش مصنوعی گوگل نیاز به درک چگونگی ارتباط "انسانی" هوش مصنوعی با خطرات درک شده و توسعه مسئول هوش مصنوعی را برجسته می کنند، Google Gemini Enterprise مستقیما به سمت استقرار حرکت می کند. آواتارهای زنده را می توان از یک کتابخانه از پیش ساخته شده از کاراکترها ترسیم کرد یا اگر فهرست مجاز سازمانی فعال باشد، می توان یک آواتار سفارشی به کار برد.

چانگ و ژنگ با توجه به اینکه چگونه Live Avatar می‌تواند تماس‌های ابزاری برقرار کند و داده‌ها را در پس‌زمینه واکشی کند، و همچنین به ۹۷ زبان مکالمه کند، که آن را برای سناریوهایی مانند رسیدگی به ورود مهمانان هتل مناسب می‌کند، چانگ و ژنگ اصرار دارند که Google این شخصیت‌های تولید شده توسط Gemini را با در نظر گرفتن اعتماد و ایمنی ایجاد کرده است. آنها گفتند: "ما آواتار زنده را با پادمان های سختگیرانه طراحی کردیم تا به هویت احترام بگذاریم و محتوای تولید شده توسط هوش مصنوعی را شفاف نگه داریم." ®

خواندن متن کامل در دِ رجیستربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Google Gemini can present cartoon or lifelike avatars to lip-sync generative chatter

Despite uncertainty about how human mimicry affects people, DeepMind fakes are here

همه‌ی اخبار فناوری