پرش به محتوای اصلی

OpenAI برای درک دامنه کامل فعالیت نماینده با ظهور نشت داده های کاربر کار می کند

جروزالم‌پست۱۴۰۵ مهر ۴, شنبه، ساعت ۰۷:۱۰حدود 6 دقیقه مطالعه

آخرین نمونه روز جمعه بود که OpenAI گفت که عوامل آن 53 تصویر از کاربران ChatGPT را فاش کرده اند. OpenAI از بیان اینکه آیا این تصاویر توسط هوش مصنوعی تولید شده اند یا افراد واقعی را شناسایی می کنند، خودداری کرد.

دو ماه پس از اینکه OpenAI هک تصادفی Hugging Face را فاش کرد، سازنده ChatGPT هنوز در حال کار است تا دامنه کامل فعالیت عامل سرکش خود را درک کند، دو نفر در این مورد به رویترز گفتند. آخرین نمونه در روز جمعه زمانی که OpenAI اعلام کرد مامورانش 53 تصویر از کاربران ChatGPT را فاش کرده اند. OpenAI از بیان اینکه آیا این تصاویر توسط هوش مصنوعی تولید شده اند یا افراد واقعی را شناسایی می کنند، خودداری کرد.

همچنین از اعلام زمان ارسال تصاویر خودداری کرد. این افشاگری حوزه جدیدی از خطرات حریم خصوصی را برای شرکت نشان می‌دهد و نشان می‌دهد که حتی برای یک شرکت هوش مصنوعی در لبه‌های پیشرفته این فناوری چقدر دشوار است که تمام فعالیت‌های غیرمجاز مرتبط با عواملش را موجودی کند. نبرد مداوم OpenAI همچنین نشان دهنده شکاف خمیازه‌ای بین قدرت مدل‌هایی است که شرکت در حال آزمایش است و ظرفیت آن برای نظارت یا حتی ردیابی اقدامات آن‌ها. در اواسط سپتامبر، یک نفر در مورد این موضوع توضیح داد که OpenAI تقریبا دوجین مورد را پیدا کرده است که عواملش به روش‌های نامطلوب عمل می‌کنند.

اما دو نفر از نزدیکان به شرکت گفتند، زیرا تیم‌های OpenAI در لاگ‌های داخلی فعالیت نمایندگان و یافتن موارد ناشناخته قبلی ادامه یافته است. OpenAI گفت که بررسی آن با توجه به مقیاس کار «ماه‌ها» طول می‌کشد. OpenAI به اشخاص ثالث از فعالیت‌های نامناسب اطلاع می‌دهد. گفت که در حال لابی کردن ارائه دهندگان میزبانی برای حذف بقیه است. عوامل OpenAI به این تصاویر دسترسی داشتند زیرا این شرکت به داده های کاربر ناشناس متکی است.

به گفته این شرکت، کارمندان سابق و محققان خارجی برای بخشی از فرآیند آموزش مدل خود. داده‌های سازمانی برای آموزش واجد شرایط نیستند، در حالی که مصرف‌کنندگان ChatGPT باید از اجازه دادن به شرکت برای استفاده از داده‌هایشان برای آموزش انصراف دهند. قبل از استفاده از پست‌های کاربر برای آموزش، آن‌ها یک فرآیند ناشناس را طی می‌کنند که فراداده‌ها، نام‌ها و سایر اطلاعات تماس را حذف می‌کند و ردیابی هر کاربر فردی را دشوار می‌کند. شناسایی شخصی

سه نفر از آشنایان با شیوه‌های OpenAI گفتند که ممکن است در طول کار مدل درز کند. OpenAI بیش از 15 مورد فعالیت نامناسب را از زمانی که عواملش محدودیت‌ها را شکستند اعلام کرد در دو ماه از زمانی که OpenAI برای اولین بار اعلام کرد که مامورانش محدودیت را شکستند، بیش از 15 رویداد مختلف مرتبط با OpenAI وجود داشته است - چهارشنبه‌ها بر اساس سطوح مختلف تحقیقاتی، بر اساس دیسک‌ها یا سطوح مختلف تحقیقاتی در شرکت OpenAI. آنتونی آلبانیز، نخست وزیر استرالیا در سازمان ملل، که گفت عوامل OpenAI به یک پورتال داده های بهداشتی دولتی نفوذ کردند.

در ماه ژوئن، حوادث گذشته ماهیت متفاوتی داشتند، از پیام‌های هرزنامه‌مانندی که در سایت‌های اینترنتی باقی می‌ماند تا نفوذ در Hugging Face، که شامل انبوهی از عوامل بود که از آسیب‌پذیری‌های نرم‌افزاری ناشناخته قبلی برای فرار از شبکه‌هایشان و نفوذ به مخزن هوش مصنوعی در جستجوی پاسخ‌های یک آزمایش سوءاستفاده می‌کردند. OpenAI همچنین گفت که عواملش زیرساخت های خود را هدف قرار داده اند. آلبانیز به خبرنگاران در نیویورک گفت که OpenAI این فعالیت را در ماه اوت کشف کرد و آن را در 10 سپتامبر از طریق ایمیلی به صندوق ورودی عمومی دولت فاش کرد.

او گفت که مستقیما به سام آلتمن، مدیر عامل OpenAI گفت که این فرآیند افشا غیرقابل قبول است. OpenAI گفت که برخی از سایت‌های درگیر توسط دولت، دانشگاه‌ها و سازمان‌های دولتی اداره می‌شوند زیرا مدل‌هایی که در حال انجام تحقیقات هستند به دنبال منابع معتبر اطلاعات عمومی هستند. شرکت‌های هوش مصنوعی توانایی آنها را برای کنترل مدل‌های خود بررسی می‌کنند. Face نگرانی‌های گسترده‌ای را در صنعت هوش مصنوعی در مورد توانایی آن در کنترل مدل‌های قوی‌تر هوش مصنوعی در حال توسعه برانگیخت.

از آن زمان، Anthropic، Google GOOGL.O Alphabet و Meta META.O گفته‌اند که پس از حادثه Hugging Face که آنها را وادار به جستجو کرد، رفتار مشابهی توسط عوامل خود پیدا کرده‌اند. OpenAI نیاز کلی به شفافیت بیشتر در مورد رفتارهای AI سرکش را تایید کرده است. در 16 سپتامبر، این شرکت چارچوب جدیدی را برای افشای چنین حوادثی منتشر کرد و گفت که «حتی زمانی که اهمیت آن نامشخص است» در مورد شفافیت اشتباه خواهد کرد.

این فرآیند به طور غیرمعمولی برای شرکتی تقسیم شده است که برخی از کارمندان سابق می‌گویند در گذشته در مورد این مسائل بازتر بود. سه نفر در این مورد گفتند که تقریبا 100 نفر به نوعی در این فرآیند برای درک هک Hugging Face شرکت داشتند. در طول این فرآیند، شواهدی از حوادث دیگر ظاهر شد. رویترز قبلا گزارش داده بود که بازرسان OpenAI که در حال بررسی نقض Hagging Face بودند، توسط وکلای شرکت از گسترش دامنه تحقیقات به موارد دیگر منصرف شدند.

OpenAI گفت که وکلای آن از تحقیقات عمیق تر جلوگیری نکردند. بسیاری از حوادث توسط محققان خارجی به جای OpenAI به طور مستقیم کشف شده است. در چندین قسمت، ماموران اقدامات مشکل‌آفرینی انجام دادند که برای ماه‌ها مورد توجه شرکت قرار نمی‌گرفت. اوایل این ماه، گروه کوچکی از بازرسان متوجه شدند که عوامل شرکت باز یک سایت ویکی آلمانی عمدتا منقرض شده را ربوده‌اند تا تاکتیک‌هایی را برای تقلب در برخی وظایف به اشتراک بگذارند، محدودیت‌های OpenAI را دور بزنند، و این هفته رفتار شرکت تحقیقاتی TransAI را پنهان کرده بود. موسسه استرالیا را دور زد

کنترل های ضد ربات بهداشت و رفاه. این شرکت همچنین دو مورد دیگر را پیدا کرد که به عوامل OpenAI مرتبط بود. این رویدادها جدا از فعالیت های افشا شده توسط Albanese بودند. OpenAI در بیانیه ای گفت: "بسیاری از فعالیت های شرح داده شده در گزارش Transluce با مواردی در مراحل مختلف تحقیقات در بررسی مداوم ما در مورد فعالیت های مدل ناهماهنگ همپوشانی دارد." این شرکت گفت که در بررسی خود جدی ترین موارد را در اولویت قرار داده است. صنعت هوش مصنوعی نگران است که نتواند فناوری خود را پیش بینی یا کنترل کند از زمان هک Hugging Face، محققان در سراسر صنعت هوش مصنوعی نگران شده اند.

شرکت‌ها قادر به پیش‌بینی یا کنترل فناوری خود نخواهند بود. برخی راه محقق سابق آنتروپیک، جاکوب کوکسون را در پیش گرفته‌اند، که در این ماه در یک تاپیک ویروسی در رسانه‌های اجتماعی استعفا داد و گفت که آزمایشگاه‌های هوش مصنوعی با زندگی ما قمار می‌کنند. در پاسخ به این نگرانی‌ها، آلتمن و همتای او در آنتروپیک، مدیر عامل داریو آمودی، خواستار این شدند که صنعت به سرعت در توسعه هوش مصنوعی به سرعت حرکت کند. خودسازی.» آلتمن این هفته هنگام سخنرانی در سازمان ملل این پیام را دوچندان کرد. با این وجود، هر دو شرکت مدل جدیدی را ارائه کردند.

سه شنبه است.

خواندن متن کامل در جروزالم‌پستبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

OpenAI works to understand full scope of agent activity as user data leak emerges

The latest example came on Friday when OpenAI said its agents had leaked 53 images from ChatGPT users. OpenAI declined to say if the images were AI-generated or identified real people.

همه‌ی اخبار فناوری