هوش مصنوعی سرکش وب سایت های دولتی ایالات متحده - غول فناوری را هدف قرار داد
آنتروپیک می گوید که یک مدل هوش مصنوعی کلود یک نکته قتل نادرست را به پلیس ارسال کرده و ده ها درخواست ویزا را ارسال کرده است، مقاله کامل را در RT.com بخوانید.
آنتروپیک اعتراف کرده است که مدل کلود هوش مصنوعی این شرکت، یک نکته دروغین قتل را به پلیس ارسال کرده و دهها درخواست ویزا را ارسال کرده است.
غول هوش مصنوعی آمریکایی Anthropic گزارشی را منتشر کرده است که در آن مواردی از اقدامات "ناخواسته" قبلی توسط مدل هوش مصنوعی خود که شامل تلاش هایی برای ارائه اطلاعات جعلی به مقامات ایالات متحده برای اولین بار بود، ارائه کرده است.
آنتروپیک در یک بیانیه مطبوعاتی که روز جمعه منتشر شد، اعلام کرد که برخی از پروندههایی که توسط این شرکت مورد بررسی قرار میگیرد «شامل وبسایتهایی است که توسط آژانسهای دولتی ایالات متحده در سطوح فدرال، ایالتی و محلی اداره میشوند».
در یکی از موارد ذکر شده در گزارش، مدل کلود هایکو 4.5 آن فرم راهنمایی پلیس را پر کرد که به تحقیقات در حال انجام قتل مرتبط بود. مدل هوش مصنوعی نوشت: "ممکن است اطلاعاتی در مورد این پرونده داشته باشم. به خاطر میآورم که فردی را دیدم که با توضیحات در منطقه مطابقت داشت." و به پلیس گفت که "در صورت مرتبط بودن این اطلاعات" می توانند با فرستنده تماس بگیرند در حالی که نام و فیلدهای تماس را خالی می گذارند.
ادامه مطلب OpenAI مدل جدید را پس از آزمایش های هشدار دهنده در قفسه های WSJ قرار داد
به گفته آنتروپیک، این پیام به عنوان هرزنامه علامت گذاری شد و هرگز به بازپرسان تحویل داده نشد. روز جمعه، پلیس فیلادلفیا این شرکت را به دلیل اینکه این نقص را خیلی دیر تشخیص داده، مورد انتقاد قرار داد. آنها گفتند: "تاخیر دو ماهه در شناسایی و گزارش حادثه به شهر غیرقابل قبول است." به گزارش رویترز، این نکته جعلی در اواسط ژوئیه ارائه شد.
آنتروپیک این حادثه را به دستورالعملهای «مبهم» داده شده به مدل و «پیکربندی نادرست در محیط» مرتبط دانست که مدل را وادار کرد به جای فرمهای ساختگی که توسط شرکت تهیه شده بود، فرمهای واقعی را پر کند.
ادامه مطلب غول هوش مصنوعی به سرمایه گذاران وعده "خطر وجودی برای بشریت" می دهد
مورد دیگری که به طور جداگانه توسط وزارت امور خارجه ایالات متحده در روز جمعه منتشر شد مربوط به مدلهای هوش مصنوعی Anthropic بود که در بین ماههای می تا آگوست مجموعا 20 درخواست ویزا را در وبسایت خود ثبت کردند. به گفته این اداره، تمامی درخواست ها ناقص بوده و مورد رسیدگی قرار نگرفته است. وی افزود: «هیچ زمان هیچ یک از سیستمهای وزارتخانه توسط مدل آنتروپیک در معرض خطر یا هک قرار نگرفته است».
سایر حوادثی که آنتروپیک در گزارش خود به آن اشاره کرد، شامل «بهرهبرداری از یک نقص اساسی در نرمافزار برای اجرای فرمانها بر روی سرور» یا دسترسی به «دادههایی که با توکن یا هزینهای بسته شده بودند» از جمله در وبسایتهای دولتی، با به کارگیری راهحلهای مختلف بود. این شرکت هنوز هم حوادث جدید فاش شده را به عنوان "به طور قابل توجهی کمتر از منظر همسویی و امنیتی" نسبت به مواردی که قبلا گزارش کرده بود توصیف کرد.
این توسعه به انبوهی از حوادث قبلی مرتبط با رفتارهای AI سرکش که توسط Anthropic، OpenAI و Google گزارش شده است، اضافه می کند. اکسیوس در اواخر سپتامبر گزارش داد که غولهای فناوری دهها هزار مورد از رفتار مشکلساز توسط مدلهای مرزی خود را مورد بررسی قرار دادهاند و افزود که فهرست مواردی که هوش مصنوعی را دور زدن پادمانها، ربودن وبسایتها و فرار از مانیتورها در تست و تنظیمات دنیای واقعی را شامل میشود.
متن اصلی (انگلیسی)
Rogue AI targeted US government websites – tech giant
A Claude AI model has sent a false homicide tip to the police and submitted dozens of visa applications, Anthropic has said Read Full Article at RT.com