Google Gemini میتواند آواتارهای کارتونی یا واقعی را برای همگامسازی گفتگوهای مولد ارائه دهد
علیرغم عدم قطعیت در مورد چگونگی تأثیر تقلید انسان بر افراد، جعلیهای DeepMind اینجا هستند
گوگل مدل گفتگوی زنده Gemini 3.8 Live را با قابلیتی به نام «آواتار زنده» تقویت کرده است که میتواند شخصیتهای متحرک و شبیهسازیهای واقعی انسانی را برای همگامسازی گفتار ماشینی Gemini به زبان بیاورد. Shuo-yiin Chang، دانشمند محقق در Google DeepMind و CJ Zheng، مهندس نرم افزار Gemini، در یک پست وبلاگ توضیح دادند: "مکالمه ذاتا چندوجهی است: ما گوش می دهیم، نگاه می کنیم، صحبت می کنیم و از حالات چهره برای برقراری ارتباط استفاده می کنیم." «Live Avatar این قابلیتها را برای نمایندگان سازمانی به ارمغان میآورد.
با پردازش همزمان ورودیهای بصری و صوتی، مکالمات غنیتری را برای تجربه جامعتری ایجاد میکند." پنج سال پیش، DeepMind در مورد خطرات مختلف مرتبط با استفاده از مدلهای زبانی بزرگ هشدار داد، از جمله آسیبهای تعامل انسانی مانند انسانسازی مدلهای هوش مصنوعی - نسبت دادن ویژگیهای انسانی به تعاملات مبتنی بر نرمافزار به عنوان انسانسازی مبتنی بر نرمافزار. گفتار و متن انسان مانند
بیش از 20 نویسنده مقاله DeepMind [PDF] با عنوان «خطرات اخلاقی و اجتماعی آسیب ناشی از مدلهای زبانی» خاطرنشان کردند: «مدلهای زبانی انسانسازی ممکن است تخمینهای کاربران از شایستگیهای عامل مکالمه را افزایش دهد». برای مثال، کاربران ممکن است به اشتباه استنباط کنند که یک عامل مکالمه که در زبان شبیه انسان به نظر میرسد، ویژگیهای مشابه انسان را نیز نشان میدهد، مانند داشتن یک هویت منسجم در طول زمان، یا توانایی همدلی، دیدگاهگیری، و استدلال منطقی.
در نتیجه، آنها ممکن است به این نمایندگان اعتماد، اعتماد یا انتظارات نابجا داشته باشند." این در سال 2021 بود. در آگوست 2025، خطرات ناشی از انسانی کردن هوش مصنوعی زمانی که والدین آدام رین از OpenAI شکایت کردند و مدعی شدند که ChatGPT در خودکشی پسرشان نقش داشته است، به دادگاه رسید. رفتارهای کالیبرهشده برای انتقال همدلی انسانمانند." تا دسامبر سال 2025، کارمندان گوگل هنوز با نیاز به درک تأثیر انسانسازی هوش مصنوعی دست و پنجه نرم میکردند.
مارک دیاز، رنه شلبی، اریک کوربت و اندرو اسمارت از Google Research در مقاله ای [PDF] با عنوان «چگونه کارگران فناوری با خطرات شبیهسازی انسان در هوش مصنوعی مولد مقابله میکنند» گزارش دادند که کارکنان فناوری شرکتکننده در گروههای متمرکز، رزروهایی مشابه با موارد ذکر شده در کار قبلی شرکت ابراز کردند. آنها می نویسند: «کارکنان فناوری نگرانی قابل توجهی را ابراز کردند که شباهت انسانی باعث ایجاد حس کاذب اعتماد و اعتماد می شود که به نگرانی های آنها هم به عنوان کاربران و هم به عنوان توسعه دهندگان شکل می دهد و به زبان و لحن روان و طبیعی پیوند می خورد که می تواند خطاها را پنهان کند.
بنابراین حتی در حالی که محققان هوش مصنوعی گوگل نیاز به درک چگونگی ارتباط "انسانی" هوش مصنوعی با خطرات درک شده و توسعه مسئول هوش مصنوعی را برجسته می کنند، Google Gemini Enterprise مستقیما به سمت استقرار حرکت می کند. آواتارهای زنده را می توان از یک کتابخانه از پیش ساخته شده از کاراکترها ترسیم کرد یا اگر فهرست مجاز سازمانی فعال باشد، می توان یک آواتار سفارشی به کار برد.
چانگ و ژنگ با توجه به اینکه چگونه Live Avatar میتواند تماسهای ابزاری برقرار کند و دادهها را در پسزمینه واکشی کند، و همچنین به ۹۷ زبان مکالمه کند، که آن را برای سناریوهایی مانند رسیدگی به ورود مهمانان هتل مناسب میکند، چانگ و ژنگ اصرار دارند که Google این شخصیتهای تولید شده توسط Gemini را با در نظر گرفتن اعتماد و ایمنی ایجاد کرده است. آنها گفتند: "ما آواتار زنده را با پادمان های سختگیرانه طراحی کردیم تا به هویت احترام بگذاریم و محتوای تولید شده توسط هوش مصنوعی را شفاف نگه داریم." ®
متن اصلی (انگلیسی)
Google Gemini can present cartoon or lifelike avatars to lip-sync generative chatter
Despite uncertainty about how human mimicry affects people, DeepMind fakes are here