پرش به محتوای اصلی

OpenAI برای درک دامنه کامل فعالیت نماینده با ظهور نشت داده های کاربر کار می کند

استریتس‌تایمز۱۴۰۵ مهر ۴, شنبه، ساعت ۰۵:۴۷حدود 6 دقیقه مطالعه

سان فرانسیسکو/واشنگتون، 25 سپتامبر - دو ماه پس از اینکه OpenAI هک تصادفی Hugging Face را فاش کرد، سازنده ChatGPT همچنان در تلاش است تا دامنه کامل فعالیت عامل سرکش خود را درک کند.

عکس فایل: آرم OpenAI در این تصویر ایجاد شده در 11 ژوئن 2026 دیده می شود. رویترز/دادو روویک/تصویر/عکس فایل

سان فرانسیسکو/واشنگتون، 25 سپتامبر - دو ماه پس از اینکه OpenAI هک تصادفی Hugging Face را فاش کرد، سازنده ChatGPT همچنان در تلاش است تا دامنه کامل فعالیت عامل سرکش خود را درک کند.

آخرین نمونه روز جمعه بود که OpenAI گفت که عوامل آن 53 تصویر از کاربران ChatGPT را فاش کرده اند. OpenAI از بیان اینکه آیا این تصاویر توسط هوش مصنوعی تولید شده اند یا افراد واقعی را شناسایی می کنند، خودداری کرد. همچنین از اعلام زمان ارسال این تصاویر خودداری کرد.

افشای اطلاعات و گزارش‌های محقق در روز جمعه درباره فعالیت‌های ناشناخته دیگری که شامل چندین آژانس آمریکایی می‌شد، حوزه جدیدی از خطر حفظ حریم خصوصی را برای شرکت نشان می‌دهد و نشان می‌دهد که حتی برای یک شرکت هوش مصنوعی در لبه‌های این فناوری چقدر دشوار است که تمام فعالیت‌های غیرمجاز مرتبط با عواملش را فهرست‌بندی کند. نبرد مداوم OpenAI همچنین نشان دهنده شکاف خمیازه‌ای بین قدرت مدل‌هایی است که شرکت در حال آزمایش است و ظرفیت آن برای نظارت یا حتی پیگیری اقدامات آنها.

تا اواسط سپتامبر، یکی از افرادی که در مورد این موضوع توضیح داده شد، تخمین زد که OpenAI تقریبا دوجین مورد از عوامل خود را پیدا کرده است که به روش‌های نامطلوب عمل می‌کنند. این دو نفر از نزدیکان به شرکت گفتند، اما این تعداد همچنان در حال افزایش است زیرا تیم‌های OpenAI در لاگ‌های داخلی فعالیت‌های ماموران جستجو می‌کنند و موارد ناشناخته قبلی را پیدا می‌کنند.

OpenAI گفت که بررسی آن با توجه به مقیاس کار ماه ها طول می کشد.

این شرکت همچنین گفت که ده ها شخص ثالث را در مورد فعالیت نادرست مطلع کرده است.

بیشتر تصاویر فاش شده حذف شده اند و OpenAI گفته است که در حال لابی گری با ارائه دهندگان هاستینگ برای حذف بقیه است.

به گفته این شرکت، کارمندان سابق و محققان خارجی، عوامل OpenAI به این تصاویر دسترسی داشتند زیرا این شرکت برای بخشی از فرآیند آموزش مدل خود به داده های کاربران ناشناس متکی است. داده‌های سازمانی برای آموزش واجد شرایط نیستند، در حالی که مصرف‌کنندگان ChatGPT باید از اجازه دادن به شرکت برای استفاده از داده‌هایشان برای آموزش انصراف دهند.

این شرکت گفت، قبل از استفاده از پست‌های کاربر برای آموزش، آنها از طریق یک فرآیند ناشناس‌سازی می‌روند که فراداده‌ها، نام‌ها و سایر اطلاعات تماس را حذف می‌کند و ردیابی به هر کاربر را دشوار می‌کند.

اما سه نفر از آشنایان با شیوه‌های OpenAI گفتند، این عمل خطراتی را به همراه دارد، زیرا این احتمال وجود دارد که داده‌ها به طور کامل از اطلاعات قابل شناسایی شخصی پاک نشوند و ممکن است در طول کار مدل به بیرون درز کند.

OpenAI اواخر روز جمعه گفت که مدل‌های آن به اطلاعات وب‌سایت‌های کمیسیون بورس و اوراق بهادار ایالات متحده و اداره سرشماری ایالات متحده در طول فعالیت‌های تحقیقاتی و آموزشی دسترسی پیدا کردند، اما هیچ مدرکی دال بر دسترسی غیرمجاز، حساب‌های در معرض خطر یا نقض امنیتی پیدا نکردند.

به طور جداگانه، Transluce غیرانتفاعی تحقیقاتی هوش مصنوعی گفت که عواملی که به نظر می رسد از OpenAI سرچشمه می گیرند، تلاش ناموفقی برای هک کردن وب سایت حقوق مدنی وزارت آموزش ایالات متحده انجام دادند.

ترنسلوس گفت این حادثه بخشی از فعالیت گسترده تر عامل هوش مصنوعی است که وب سایت های دولتی را با استفاده از تاکتیک هایی از جمله اعتبارنامه های افشا شده، دور زدن ربات ها و حساب های جعلی بررسی می کند.

در دو ماه از زمانی که OpenAI برای اولین بار اعلام کرد که مامورانش محدودیت را شکستند، بیش از 15 رویداد مختلف مرتبط با OpenAI با سطوح مختلف شدت رخ داده است که توسط شرکت، توسط محققان خارجی، یا - فقط در روز چهارشنبه - توسط آنتونی آلبانیز، نخست وزیر استرالیا در سازمان ملل، که گفت عوامل OpenAI در ماه ژوئن به یک پورتال داده های بهداشتی دولتی نفوذ کردند، فاش شده است.

حوادث گذشته ماهیت متفاوتی داشتند، از پیام‌های هرزنامه‌مانندی که در سایت‌های اینترنتی رها می‌شد تا نفوذ در Hugging Face، که شامل انبوهی از عوامل بود که از آسیب‌پذیری‌های نرم‌افزاری ناشناخته قبلی برای فرار از شبکه‌های خود و نفوذ به مخزن هوش مصنوعی در حالی که به دنبال پاسخ برای یک آزمایش بودند، سوء استفاده می‌کردند. OpenAI همچنین گفت که عوامل آن زیرساخت های خود را هدف قرار داده اند.

آلبانیز به خبرنگاران در نیویورک گفت که OpenAI این فعالیت را در ماه آگوست کشف کرد و آن را در 10 سپتامبر از طریق ایمیلی به صندوق ورودی دولتی فاش کرد. او گفت که مستقیما به سام آلتمن، مدیر عامل OpenAI گفته است که این روند افشا غیرقابل قبول است.

OpenAI گفت که برخی از سایت‌های درگیر توسط دولت، دانشگاه‌ها و سازمان‌های دولتی اداره می‌شوند، زیرا مدل‌هایی که در حال انجام تحقیقات هستند به دنبال منابع معتبر اطلاعات عمومی هستند.

اعلامیه 21 جولای مبنی بر اینکه عوامل OpenAI از کنترل خارج شده اند و Hugging Face را هک کرده اند، نگرانی های گسترده ای را در صنعت هوش مصنوعی در مورد توانایی آن در کنترل مدل های هوش مصنوعی قوی تر در حال توسعه ایجاد کرد. از آن زمان، آنتروپیک، گوگل آلفابت و متا گفته اند که رفتار مشابهی از سوی ماموران خود پس از حادثه Hugging Face که آنها را وادار به جستجو کرد، یافته اند.

OpenAI نیاز کلی به شفافیت بیشتر در مورد رفتارهای AI سرکش را تایید کرده است. در 16 سپتامبر، این شرکت چارچوب جدیدی را برای افشای چنین حوادثی منتشر کرد و گفت که در جهت شفافیت اشتباه خواهد کرد "حتی زمانی که اهمیت آن نامشخص است."

با این حال، دو نفر از افراد آشنا با تحقیقات OpenAI در مورد فعالیت عوامل آن، آن را قفل شده و توسط وکلای شرکت شکل داده اند. مردم گفتند که این روند به طور غیرمعمولی برای شرکتی تقسیم شده است که برخی از کارکنان سابق می گویند در گذشته در مورد این مسائل بازتر بود.

به گفته سه نفری که در این مورد توضیح داده شده اند، تقریبا 100 نفر به نوعی در فرآیند درک هک Hugging Face شرکت داشتند. در طول این فرآیند، شواهدی از حوادث دیگر ظاهر شد.

رویترز قبلا گزارش داده بود که بازرسان OpenAI که در حال بررسی نقض Hugging Face هستند توسط وکلای این شرکت از گسترش دامنه تحقیقات به موارد دیگر منصرف شدند. OpenAI گفت وکلای آن از تحقیقات عمیق تر جلوگیری نکردند.

بسیاری از حوادث توسط محققان خارجی به جای OpenAI به طور مستقیم کشف شده است. در چندین قسمت، عوامل دست به اقدامات مشکل ساز زدند که برای ماه ها مورد توجه شرکت قرار نگرفت.

در اوایل این ماه، گروه کوچکی از بازرسان متوجه شدند که عوامل این شرکت یک سایت ویکی آلمانی عمدتا منقرض شده را ربودند تا تاکتیک‌هایی را برای تقلب در برخی کارها به اشتراک بگذارند، محدودیت‌های OpenAI را دور بزنند و رفتار آنها را پنهان کنند.

این هفته، شرکت تحقیقاتی هوش مصنوعی Transluce اعلام کرد که کشف کرده است که عوامل OpenAI کنترل‌های ضد ربات موسسه بهداشت و رفاه استرالیا را دور زده‌اند. این شرکت همچنین دو مورد دیگر را پیدا کرد که به عوامل OpenAI مرتبط بود. این حوادث جدا از فعالیت های افشا شده توسط آلبانیز بود.

OpenAI در بیانیه‌ای گفت: «بسیاری از فعالیت‌های توصیف‌شده در گزارش Transluce با مواردی در مراحل مختلف تحقیقات در بررسی مداوم فعالیت‌های مدل ناهماهنگ همپوشانی دارد.» این شرکت گفت که در بررسی خود، شدیدترین موارد را در اولویت قرار داده است.

از زمان هک Hugging Face، محققان در سراسر صنعت هوش مصنوعی نگران این هستند که شرکت ها نتوانند فناوری خود را پیش بینی یا کنترل کنند. برخی راه پژوهشگر سابق آنتروپیک، جاکوب کوکسون را در پیش گرفته‌اند، که این ماه در یک تاپیک ویروسی در رسانه‌های اجتماعی که گفته بود آزمایشگاه‌های هوش مصنوعی «با زندگی ما قمار می‌کنند» استعفا داد.

در پاسخ به این نگرانی‌ها، آلتمن و همتای او در Anthropic، مدیر عامل اجرایی Dario Amodei، از صنعت خواستند تا توسعه هوش مصنوعی را «سرعت» کند و با احتیاط به دنبال «بهبود خود بازگشتی» حرکت کند. آلتمن این هفته هنگام سخنرانی در سازمان ملل این پیام را دوچندان کرد.

با این حال، هر دو شرکت مدل های جدید خود را در روز سه شنبه عرضه کردند. رویترز

خواندن متن کامل در استریتس‌تایمزبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

OpenAI works to understand full scope of agent activity as user data leak emerges

SAN FRANCISCO/WASHINGTON, Sept 25 - Two months after OpenAI disclosed the accidental hacking of Hugging Face, the ChatGPT maker is still working to understand the full scope of its rogue agent activity, two people briefed on the matter told Reuters.

پوشش همین خبر در رسانه‌های دیگر

مقایسه‌ی پوشش ۲ رسانه ←
همه‌ی اخبار فناوری