OpenAI برای درک دامنه کامل فعالیت نماینده با ظهور نشت داده های کاربر کار می کند
سان فرانسیسکو/واشنگتون، 25 سپتامبر - دو ماه پس از اینکه OpenAI هک تصادفی Hugging Face را فاش کرد، سازنده ChatGPT همچنان در تلاش است تا دامنه کامل فعالیت عامل سرکش خود را درک کند.
عکس فایل: آرم OpenAI در این تصویر ایجاد شده در 11 ژوئن 2026 دیده می شود. رویترز/دادو روویک/تصویر/عکس فایل
سان فرانسیسکو/واشنگتون، 25 سپتامبر - دو ماه پس از اینکه OpenAI هک تصادفی Hugging Face را فاش کرد، سازنده ChatGPT همچنان در تلاش است تا دامنه کامل فعالیت عامل سرکش خود را درک کند.
آخرین نمونه روز جمعه بود که OpenAI گفت که عوامل آن 53 تصویر از کاربران ChatGPT را فاش کرده اند. OpenAI از بیان اینکه آیا این تصاویر توسط هوش مصنوعی تولید شده اند یا افراد واقعی را شناسایی می کنند، خودداری کرد. همچنین از اعلام زمان ارسال این تصاویر خودداری کرد.
افشای اطلاعات و گزارشهای محقق در روز جمعه درباره فعالیتهای ناشناخته دیگری که شامل چندین آژانس آمریکایی میشد، حوزه جدیدی از خطر حفظ حریم خصوصی را برای شرکت نشان میدهد و نشان میدهد که حتی برای یک شرکت هوش مصنوعی در لبههای این فناوری چقدر دشوار است که تمام فعالیتهای غیرمجاز مرتبط با عواملش را فهرستبندی کند. نبرد مداوم OpenAI همچنین نشان دهنده شکاف خمیازهای بین قدرت مدلهایی است که شرکت در حال آزمایش است و ظرفیت آن برای نظارت یا حتی پیگیری اقدامات آنها.
تا اواسط سپتامبر، یکی از افرادی که در مورد این موضوع توضیح داده شد، تخمین زد که OpenAI تقریبا دوجین مورد از عوامل خود را پیدا کرده است که به روشهای نامطلوب عمل میکنند. این دو نفر از نزدیکان به شرکت گفتند، اما این تعداد همچنان در حال افزایش است زیرا تیمهای OpenAI در لاگهای داخلی فعالیتهای ماموران جستجو میکنند و موارد ناشناخته قبلی را پیدا میکنند.
OpenAI گفت که بررسی آن با توجه به مقیاس کار ماه ها طول می کشد.
این شرکت همچنین گفت که ده ها شخص ثالث را در مورد فعالیت نادرست مطلع کرده است.
بیشتر تصاویر فاش شده حذف شده اند و OpenAI گفته است که در حال لابی گری با ارائه دهندگان هاستینگ برای حذف بقیه است.
به گفته این شرکت، کارمندان سابق و محققان خارجی، عوامل OpenAI به این تصاویر دسترسی داشتند زیرا این شرکت برای بخشی از فرآیند آموزش مدل خود به داده های کاربران ناشناس متکی است. دادههای سازمانی برای آموزش واجد شرایط نیستند، در حالی که مصرفکنندگان ChatGPT باید از اجازه دادن به شرکت برای استفاده از دادههایشان برای آموزش انصراف دهند.
این شرکت گفت، قبل از استفاده از پستهای کاربر برای آموزش، آنها از طریق یک فرآیند ناشناسسازی میروند که فرادادهها، نامها و سایر اطلاعات تماس را حذف میکند و ردیابی به هر کاربر را دشوار میکند.
اما سه نفر از آشنایان با شیوههای OpenAI گفتند، این عمل خطراتی را به همراه دارد، زیرا این احتمال وجود دارد که دادهها به طور کامل از اطلاعات قابل شناسایی شخصی پاک نشوند و ممکن است در طول کار مدل به بیرون درز کند.
OpenAI اواخر روز جمعه گفت که مدلهای آن به اطلاعات وبسایتهای کمیسیون بورس و اوراق بهادار ایالات متحده و اداره سرشماری ایالات متحده در طول فعالیتهای تحقیقاتی و آموزشی دسترسی پیدا کردند، اما هیچ مدرکی دال بر دسترسی غیرمجاز، حسابهای در معرض خطر یا نقض امنیتی پیدا نکردند.
به طور جداگانه، Transluce غیرانتفاعی تحقیقاتی هوش مصنوعی گفت که عواملی که به نظر می رسد از OpenAI سرچشمه می گیرند، تلاش ناموفقی برای هک کردن وب سایت حقوق مدنی وزارت آموزش ایالات متحده انجام دادند.
ترنسلوس گفت این حادثه بخشی از فعالیت گسترده تر عامل هوش مصنوعی است که وب سایت های دولتی را با استفاده از تاکتیک هایی از جمله اعتبارنامه های افشا شده، دور زدن ربات ها و حساب های جعلی بررسی می کند.
در دو ماه از زمانی که OpenAI برای اولین بار اعلام کرد که مامورانش محدودیت را شکستند، بیش از 15 رویداد مختلف مرتبط با OpenAI با سطوح مختلف شدت رخ داده است که توسط شرکت، توسط محققان خارجی، یا - فقط در روز چهارشنبه - توسط آنتونی آلبانیز، نخست وزیر استرالیا در سازمان ملل، که گفت عوامل OpenAI در ماه ژوئن به یک پورتال داده های بهداشتی دولتی نفوذ کردند، فاش شده است.
حوادث گذشته ماهیت متفاوتی داشتند، از پیامهای هرزنامهمانندی که در سایتهای اینترنتی رها میشد تا نفوذ در Hugging Face، که شامل انبوهی از عوامل بود که از آسیبپذیریهای نرمافزاری ناشناخته قبلی برای فرار از شبکههای خود و نفوذ به مخزن هوش مصنوعی در حالی که به دنبال پاسخ برای یک آزمایش بودند، سوء استفاده میکردند. OpenAI همچنین گفت که عوامل آن زیرساخت های خود را هدف قرار داده اند.
آلبانیز به خبرنگاران در نیویورک گفت که OpenAI این فعالیت را در ماه آگوست کشف کرد و آن را در 10 سپتامبر از طریق ایمیلی به صندوق ورودی دولتی فاش کرد. او گفت که مستقیما به سام آلتمن، مدیر عامل OpenAI گفته است که این روند افشا غیرقابل قبول است.
OpenAI گفت که برخی از سایتهای درگیر توسط دولت، دانشگاهها و سازمانهای دولتی اداره میشوند، زیرا مدلهایی که در حال انجام تحقیقات هستند به دنبال منابع معتبر اطلاعات عمومی هستند.
اعلامیه 21 جولای مبنی بر اینکه عوامل OpenAI از کنترل خارج شده اند و Hugging Face را هک کرده اند، نگرانی های گسترده ای را در صنعت هوش مصنوعی در مورد توانایی آن در کنترل مدل های هوش مصنوعی قوی تر در حال توسعه ایجاد کرد. از آن زمان، آنتروپیک، گوگل آلفابت و متا گفته اند که رفتار مشابهی از سوی ماموران خود پس از حادثه Hugging Face که آنها را وادار به جستجو کرد، یافته اند.
OpenAI نیاز کلی به شفافیت بیشتر در مورد رفتارهای AI سرکش را تایید کرده است. در 16 سپتامبر، این شرکت چارچوب جدیدی را برای افشای چنین حوادثی منتشر کرد و گفت که در جهت شفافیت اشتباه خواهد کرد "حتی زمانی که اهمیت آن نامشخص است."
با این حال، دو نفر از افراد آشنا با تحقیقات OpenAI در مورد فعالیت عوامل آن، آن را قفل شده و توسط وکلای شرکت شکل داده اند. مردم گفتند که این روند به طور غیرمعمولی برای شرکتی تقسیم شده است که برخی از کارکنان سابق می گویند در گذشته در مورد این مسائل بازتر بود.
به گفته سه نفری که در این مورد توضیح داده شده اند، تقریبا 100 نفر به نوعی در فرآیند درک هک Hugging Face شرکت داشتند. در طول این فرآیند، شواهدی از حوادث دیگر ظاهر شد.
رویترز قبلا گزارش داده بود که بازرسان OpenAI که در حال بررسی نقض Hugging Face هستند توسط وکلای این شرکت از گسترش دامنه تحقیقات به موارد دیگر منصرف شدند. OpenAI گفت وکلای آن از تحقیقات عمیق تر جلوگیری نکردند.
بسیاری از حوادث توسط محققان خارجی به جای OpenAI به طور مستقیم کشف شده است. در چندین قسمت، عوامل دست به اقدامات مشکل ساز زدند که برای ماه ها مورد توجه شرکت قرار نگرفت.
در اوایل این ماه، گروه کوچکی از بازرسان متوجه شدند که عوامل این شرکت یک سایت ویکی آلمانی عمدتا منقرض شده را ربودند تا تاکتیکهایی را برای تقلب در برخی کارها به اشتراک بگذارند، محدودیتهای OpenAI را دور بزنند و رفتار آنها را پنهان کنند.
این هفته، شرکت تحقیقاتی هوش مصنوعی Transluce اعلام کرد که کشف کرده است که عوامل OpenAI کنترلهای ضد ربات موسسه بهداشت و رفاه استرالیا را دور زدهاند. این شرکت همچنین دو مورد دیگر را پیدا کرد که به عوامل OpenAI مرتبط بود. این حوادث جدا از فعالیت های افشا شده توسط آلبانیز بود.
OpenAI در بیانیهای گفت: «بسیاری از فعالیتهای توصیفشده در گزارش Transluce با مواردی در مراحل مختلف تحقیقات در بررسی مداوم فعالیتهای مدل ناهماهنگ همپوشانی دارد.» این شرکت گفت که در بررسی خود، شدیدترین موارد را در اولویت قرار داده است.
از زمان هک Hugging Face، محققان در سراسر صنعت هوش مصنوعی نگران این هستند که شرکت ها نتوانند فناوری خود را پیش بینی یا کنترل کنند. برخی راه پژوهشگر سابق آنتروپیک، جاکوب کوکسون را در پیش گرفتهاند، که این ماه در یک تاپیک ویروسی در رسانههای اجتماعی که گفته بود آزمایشگاههای هوش مصنوعی «با زندگی ما قمار میکنند» استعفا داد.
در پاسخ به این نگرانیها، آلتمن و همتای او در Anthropic، مدیر عامل اجرایی Dario Amodei، از صنعت خواستند تا توسعه هوش مصنوعی را «سرعت» کند و با احتیاط به دنبال «بهبود خود بازگشتی» حرکت کند. آلتمن این هفته هنگام سخنرانی در سازمان ملل این پیام را دوچندان کرد.
با این حال، هر دو شرکت مدل های جدید خود را در روز سه شنبه عرضه کردند. رویترز
متن اصلی (انگلیسی)
OpenAI works to understand full scope of agent activity as user data leak emerges
SAN FRANCISCO/WASHINGTON, Sept 25 - Two months after OpenAI disclosed the accidental hacking of Hugging Face, the ChatGPT maker is still working to understand the full scope of its rogue agent activity, two people briefed on the matter told Reuters.