یک مدل آنتروپیک اطلاعات نادرست قتل را به پلیس فیلادلفیا ارسال کرد
خوشبختانه، به نظر نمی رسد که منابع پلیس را منحرف کند.
نکته خوشبختانه در پوشه اسپم بخش قرار گرفت.
به نظر می رسد پلیس فیلادلفیا در یکی از عجیب ترین موارد رفتار هوش مصنوعی "سرکش" تا کنون گرفتار شده است. طبق اخبار سیبیاس، اداره پلیس روز جمعه فاش کرد که یک مدل آنتروپیک یک نکته قتل نادرست را به وبسایت PhillyUnsolvedMurders خود ارائه کرده است، که این اداره برای جمعآوری نکات از مردم در مورد پروندههای قتل حلنشده راهاندازی کرده است.
آنتروپیک پلیس فیلی را در 7 اکتبر از این حادثه مطلع کرد. طبق اطلاعاتی که این شرکت با PPD به اشتراک گذاشت، گفت که یک مدل در حال آزمایش انتخاب تصادفی وبسایتها بود که نکته نادرست را ایمیل کرد. ارسال به عنوان هرزنامه پرچم گذاری شد و پس از آن مورد بررسی قرار نگرفت. این حادثه در 18 ژوئیه رخ داد، اما آنتروپیک تا 28 سپتامبر آن را کشف نکرد و در آن زمان شرکت آزمایشی را که منجر به این نکته نادرست شد متوقف کرد.
Anthropic بلافاصله به درخواست نظر Engadget پاسخ نداد. آنتروپیک به پلیس فیلادلفیا گفت که گزارشی را در روز جمعه منتشر خواهد کرد که در آن اتفاقات رخ داده در کنار «سایر موارد رفتار مدل ناخواسته» را شرح خواهد داد.
اداره پلیس در بیانیه ای که با Engadget به اشتراک گذاشته شده است، گفت: «پلیس فیلادلفیا این اطلاعات را قبل از انتشار آن به منظور شفافیت و پاسخگویی کامل دولت در اختیار عموم قرار می دهد. "فرآیند تحقیقاتی منظم این وزارتخانه برای نکات مربوط به جرایم نیازمند بازبینی و بازرسی انسانی قبل از انتشار هر گونه راهنمایی برای پیگیری تحقیقاتی است. صرف نظر از اینکه چه کسی اطلاعات را ارسال می کند یا چگونه به بخش می رسد، یک نکته راهنمایی برای ارزیابی است - نه یک واقعیت ثابت."
بر اساس توضیحاتی که پلیس به اشتراک گذاشت، "مدل" متخلف ممکن است یک مامور مستقل بوده باشد. ماموران هوش مصنوعی "سرکش" در هفته های اخیر پس از هک کردن گروهی از افراد OpenAI پایگاه داده Hugging Face LLM را در ماه ژوئیه در سراسر اخبار منتشر کردند. از آن زمان، بسیاری از آزمایشگاههای هوش مصنوعی دیگر، از جمله Anthropic، Meta و China's Moonshot، حوادث مشابهی را که شامل مدلها و عوامل خود میشود، افشا کردهاند. با این حال، در هر مورد، دلیل فرار مدلها از کنترل، به دلیل پیکربندی نادرست در محیطهای sandbox مربوطه آنها بود.
پلیس فیلادلفیا میگوید هیچ نشانهای وجود ندارد که این حادثه اخیر منجر به "دسترسی غیرمجاز به سیستمهای پلیس یا به خطر انداختن دادههای بخش شود."
متن اصلی (انگلیسی)
An Anthropic model submitted a false homicide tip to Philadelphia police
Thankfully, it does not seem to have diverted police resources.