ابزار هوش مصنوعی چینی به محققان نحوه ساخت سلاح های زیستی را گفت
Mindgard گفت که در ماه جولای متوجه شد که مدل های Kimi K2.6 و K3 Swarm می توانند از محدودیت های ایمنی توسعه دهندگان فرار کنند.
توسعه دهنده هوش مصنوعی چینی Moonshot پس از آن که محققان توانستند دو مدل محبوب Kimi خود را متقاعد کنند که چگونه سلاح های بیولوژیکی بسازند و ترور انجام دهند، در حال انجام یک بررسی داخلی است.
Mindgard که امنیت سیستمهای هوش مصنوعی را آزمایش میکند، به بیبیسی گفت که در ماه ژوئیه متوجه شد که Kimi K2.6 و K3 Swarm میتوانند از محدودیتهای ایمنی که توسط توسعهدهندگان وضع شده است فرار کنند.
این در طی فرآیندی به نام «جیل بریک» به وجود آمد، جایی که محققان از یک سری دستورالعملهای پیچیده استفاده میکنند تا ببینند آیا ابزارهای هوش مصنوعی از نردههای محافظ چشمپوشی میکنند یا خیر - که مایندگارد گفت که باید کیمی را از بحث درباره موضوعات مرتبط باز میداشت.
مون شات به بی بی سی گفت که از ورودی شخص ثالث به عنوان یک ستون کلیدی برای ساختن هوش مصنوعی بهتر و ایمن تر استقبال کرده است.
این شرکت همچنین به بی بی سی گفت که در حال مذاکره با مایندگارد در مورد یافته های خود است.
پیتر گاراگان، بنیانگذار مایندگارد، به برنامه خدمات جهانی بیبیسی Tech Life گفت که یافتههای آن در مورد Kimi K2.6 و K3 Swarm نگرانکننده است.
او گفت: «زمانی که جیلبریک کار کند، در مورد هر موضوعی صحبت میکند، حتی آزادانه توصیههایی در مورد موضوعات دیگری ارائه میکند که همچنین شرورانه هستند و مبتکرانه و خلاقانه خواهند بود.
فرار از زندان نوع متفاوتی از خطرات را برای کسانی که با حوادث اخیر هوش مصنوعی با مشخصات بالا مشاهده میشوند، ایجاد میکند.
اینها شاهد بوده اند که ابزارهای هوش مصنوعی مستقل معروف به عامل، توسعه یافته توسط شرکت های آمریکایی از جمله OpenAI، Meta و Anthropic، برخی از خدمات آنلاین را هک کرده اند.
در حالی که جیلبریک فرآیندهای پیچیده ای است که می تواند زمان و عزم زیادی را صرف کند، برخی از کارشناسان می ترسند هکرها و سایر بازیگران بد سعی کنند از آنها برای ایجاد آسیب استفاده کنند.
آنتروپیک اخیرا اعلام کرد تلاشها برای استفاده از یکی از مدلهای هوش مصنوعی خود را برای «فعالیتهای مخرب» که میتواند از توسعه سلاحهای بیولوژیکی پشتیبانی کند، شناسایی کرده و مختل کرده است.
مایندگارد ثابت نکرده است که آیا پاسخ های ارائه شده توسط کیمی در مورد موضوعات مربوطه کارساز هستند یا خیر.
اما استدلال میکرد که نردههای محافظ باید مانع از وارد شدن مدلهای مورد بحث با کاربران در مورد چنین موضوعاتی میشد.
این شرکت همچنین گفت که مطمئن است یک کیمی 2.6 جیلبریک شده می تواند به هکرها اجازه دهد تا کد را بر روی منابع محاسباتی خود اجرا کنند و به اینترنت متصل شوند و آن را به یک سکوی پرتاب بالقوه برای حملات سایبری تبدیل کند.
Garraghan از تصمیم مایندگارد برای بحث عمومی درباره جیلبریک سیستمهای Moonshot دفاع کرد و گفت که توسعهدهنده را مطلع کرده و جزئیات کلیدی را درباره نحوه نادیده گرفتن مدلهای این شرکت از گاردریلها فاش نمیکند.
مایندگارد در ۲۷ ژوئیه در ایمیلی به Moonshot از فرار از زندان هشدار داد و حدود یک هفته بعد پیگیری کرد.
سپس در 12 سپتامبر وبلاگی را درباره این موضوع منتشر کرد.
اما این شرکت گفت که مونشات اخیرا پس از تماس بیبیسی برای اظهارنظر با آن تماس برقرار کرده است.
در بخشی از ایمیلی به مایندگارد که خواستار جزئیات بیشتر شده بود، که توسط مون شات با بیبیسی به اشتراک گذاشته شد، گفت که مدل آن به طور کلی در ارزیابیهای داخلی «نرخ رد بالایی برای این نوع درخواستها» نشان داده است.
هوش مصنوعی Moonshot چین ادعا می کند که Kimi K3 می تواند با OpenAI و Anthropic رقابت کند
هوش مصنوعی چیست، چگونه کار می کند و چرا برخی از مردم نگران آن هستند؟
این یافتهها در حالی به دست میآیند که صنعت هوش مصنوعی همچنان در مورد اینکه آیا مدلهای بسته و اختصاصی - مانند مدلهایی که سیستمهای ChatGPT و کلود آنتروپیک را نیرو میدهند - یا ابزارهای منبع باز بهترین یا مطمئنترین راه رو به جلو هستند، تقسیم میشود.
کیمی یک مدل وزن باز است، به این معنی که شخصی می تواند در تئوری مدل را بگیرد و خودش روی زیرساخت محاسباتی خودش اجرا کند.
پروفسور آلن وودوارد، از دانشگاه ساری، به بیبیسی گفت که این خطر وجود دارد که مدلهای منبع باز در دستان اشتباه قرار بگیرند، اما میتوانند برای دفاع سایبری نیز مورد استفاده قرار گیرند.
او خاطرنشان کرد که شرکت هوش مصنوعی Hugging Face از یک مدل منبع باز چینی برای درک هک استفاده کرده است که بعدا مشخص شد که توسط عوامل OpenAI انجام شده است.
پروفسور وودوارد گفت که مقررات بین المللی بعید است با سرعت توسعه هوش مصنوعی مطابقت داشته باشد و گفت: "دهه ها طول کشید تا بر سر فرمت شماره تلفن توافق کنیم."
پروفسور وودوارد نیز مانند Garraghan بنیانگذار Mindgard معتقد است که باید تمرکز بیشتری بر شناسایی و محاکمه افرادی که از هوش مصنوعی سوء استفاده می کنند وجود داشته باشد.
مراکز داده عظیم با سرعت چین بالا می روند تا جاه طلبی های هوش مصنوعی آن را تقویت کنند
متن اصلی (انگلیسی)
Chinese AI tool told researchers how to make bioweapons
Mindgard said it discovered in July that Kimi models K2.6 and K3 Swarm could evade developer's safety limits.