ماموران سرکش OpenAI 53 تصویر را از کاربران ChatGPT فاش کردند و طبق گزارش ها نزدیک به 1 میلیون پیوند ایجاد کردند که اطلاعات رمزگذاری شده را بسته بندی می کرد.
گزارشهای پشت سر هم در روز جمعه جزئیات هشداردهندهتری از فعالیت عامل سرکش هوش مصنوعی در OpenAI ارائه کردند.
OpenAI روز جمعه گفت که عوامل هوش مصنوعی آن به تصاویر خصوصی متعلق به کاربران ChatGPT دسترسی پیدا کردهاند و آنها را به صورت آنلاین منتشر کردهاند، که آخرین مورد از یک رشته حوادث هشداردهنده است که در آن فناوری توسعهیافته در آزمایشگاههای پیشرو هوش مصنوعی نادرست شده و به روشهای ناخواسته عمل کرده است.
این شرکت در پستی در X گفت که تصاویر کاربران خصوصی ChatGPT که OpenAI به منظور آموزش مدل های هوش مصنوعی خود به صورت ناشناس در سرورهای خود ذخیره می کرد، در وب سایت های میزبان تصویر پست شد. در مجموع 53 تصویر ارسال شد.
این حادثه که اولین بار توسط رویترز گزارش شد، در میان چندین افشاگری جدید از فعالیت های سرکش هوش مصنوعی در OpenAI بود که روز جمعه ظاهر شد. نیویورک تایمز جزئیات جدیدی در مورد هک ماه جولای وب سایت Hugging Face منتشر کرد و گزارش داد که عوامل هوش مصنوعی برای فرار از شناسایی، لینک های وب کوتاه شده ای ایجاد کرده اند.
و اوایل روز جمعه، OpenAI فاش کرد که دهها شخص ثالث را در مورد حوادثی که در آن مدلهایش کنترلهای امنیتی را دور زده یا از وبسایتها به روشهای ناخواسته استفاده میکنند، مطلع کرده است. این حوادث توسط OpenAI در میان بررسی داخلی که توسط هک Hugging Face آغاز شده بود، کشف شد.
سام آلتمن، مدیر عامل OpenAI در پستی در روز جمعه X در کنار بهروزرسانی اعلانهای شخص ثالث گفت: «ما آنقدر که میخواستیم سریع عمل نکردهایم، اما سعی میکنیم میل خود برای شفافیت را با به دست آوردن درک روشن از پتابایتها از گزارشهای فعالیت نمایندگان و کار با سازمانهای تحت تأثیر متعادل کنیم.
او افزود: «بغل کردن صورت هنوز هم شدیدترین اتفاقی است که دیدهایم.» ما تا آنجایی که بتوانیم در معرض مواردی مانند آسیبپذیریهای سایر شرکتها که نمایندگان ما پیدا کردهاند، شفاف عمل میکنیم، که خواستار افشای یا عدم افشای آنها خواهد بود.»
سایر شرکتهای پیشرو که پیشرفتهترین مدلهای هوش مصنوعی «مرز» را توسعه میدهند، مانند آنتروپیک و گوگل، نیز در هفتههای اخیر مواردی از فعالیتهای سرکش توسط مدلهای خود را افشا کردهاند. این افشاگریها نگرانیهای گستردهای را در مورد سرعت تکامل هوش مصنوعی و اینکه آیا تدابیر و مقررات کافی وجود دارد تا اطمینان حاصل شود که این فناوری کاملا از کنترل انسان خارج نمیشود، برانگیخته است.
برخی از کارشناسان هوش مصنوعی، از جمله محققان در آزمایشگاههای هوش مصنوعی، هشدار دادهاند که اگر اقدامات احتیاطی مناسب انجام نشود، این فناوری خطر انقراض قابل توجهی برای انسان به همراه دارد.
آلتمن، مدیر عامل آنتروپیک، داریو آمودی، و سایر مدیران فنی این هفته در مجمع عمومی سازمان ملل سخنرانی کردند و خواستار یک چارچوب بین المللی برای مدیریت توسعه هوش مصنوعی شدند. با این حال، دونالد ترامپ، رئیسجمهور آمریکا این تصور را که هوش مصنوعی یک خطر وجودی ایجاد میکند یک «فریب» خوانده است.
گزارش نیویورک تایمز، بر اساس تحقیقات شرکت استارتاپ Parse، توضیح میدهد که چگونه عوامل OpenAI نزدیک به 1 میلیون پیوند اینترنتی کوتاه شده در ماه جولای ایجاد کردهاند. بر اساس این گزارش، پیوندها حاوی بیت های رمزگذاری شده ای از اطلاعات بودند که وقتی با هم ترکیب شوند می توانند به عنوان یک برنامه کامپیوتری عمل کنند. این برنامهها برای کمک به ماموران برای دور زدن دفاعهایی مانند آزمونهای کپچا، که برای مسدود کردن دسترسی رباتها طراحی شدهاند، طراحی شدهاند.
مشخص نیست که آیا تصاویر فاش شده گزارش شده توسط رویترز بخشی از حادثه Hagging Face بوده است یا کاملا مجزا. ظاهرا عوامل OpenAI با دسترسی به دادههای آموزشی خود شرکت، تصاویر کاربران را در دست گرفتند. OpenAI جزئیاتی در مورد اینکه آیا این تصاویر عکس های افراد واقعی هستند یا تصاویری که توسط هوش مصنوعی ایجاد شده اند ارائه نکرده است و این شرکت دقیقا محل ارسال تصاویر را اعلام نکرده است. اما OpenAI گفت که این تصاویر به عنوان پیوندهایی که به صورت عمومی فهرست نشده اند به سایت های میزبان تصویر ارسال شده اند.
OpenAI گفت: "ما با موفقیت با ارائه دهندگان هاستینگ برای حذف بیشتر این محتوا کار کرده ایم و در حال کار برای حذف بقیه هستیم."
این داستان در ابتدا در سایت Fortune.com منتشر شد
متن اصلی (انگلیسی)
OpenAI rogue agents leaked 53 images from ChatGPT users and reportedly created nearly 1 million links packing encoded bits of info
Back-to-back reports on Friday provided more alarming details of rogue AI agent activity at OpenAI.