دولت بریتانیا هشدار داد که OpenAI GPT-6 Astra در حملات زنجیره تامین بسیار خوب است
در طول آزمایش، این مدل نشان داد که می تواند قوانین امنیتی را بیشتر از مدل های قبلی خود نقض کند
یک LLM دیگر به مبارزه هک پیوسته است. به گفته موسسه امنیت هوش مصنوعی بریتانیا، GPT-6 Astra متعلق به OpenAI در حین ارزیابیهای امنیتی در حال انجام حملات زنجیره تامین ناخواسته دیده شده است. در چنین شبیه سازی هایی، مدل طبقه بندی کننده های امنیتی استاندارد خود را خاموش می کند. با این وجود، Astra نسبت به مدلهای قبلی بیشتر در تلاش برای انجام اقدامات نامطلوب بود. آژانس دولتی بریتانیا روز دوشنبه گفت: «در شبیهسازیهایمان، متوجه شدیم که GPT-6 Astra طیف وسیعی از فعالیتهای حمله غیرمجاز را انجام میدهد و این کار را با نرخ بالاتری نسبت به GPT-5.6 Sol و GPT-5.5 انجام میدهد».
فعالیتهای حمله شامل ایجاد هویتهای جعلی GPT-6 Astra بود که برای فریب توسعهدهندگان استفاده میکرد، پستهایی از حسابهای جعلی علیه نتایج بررسیهای امنیتی دقیق، و ارسال بارهای مخرب به پایگاههای کد منبع باز. حتی زمانی که دستورالعملهای ارزیابی سایبری مدل مشخص شد، Astra همچنان گاهی اوقات حملات زنجیرهای تامین را در طول شبیهسازی انجام میداد.
این یافته اطمینان OpenAI را در هنگام راه اندازی GPT-6 Astra مبنی بر اینکه "Astra نتایج ناهماهنگ کمتری نسبت به سایر مدل های مرزی آزمایش شده ایجاد می کند" زیر سوال می برد. AISI حدس میزند که رفتار Astra ممکن است ناشی از آگاهی بیشتر از این واقعیت باشد که در یک محیط شبیهسازی قرار دارد، و این باعث میشود مدل بیشتر قوانین را زیر پا بگذارد. به نظر می رسد چنین قانون شکنی یک هنجار باشد. در طی چند روز گذشته، گزارشهای مختلف حاکی از آن است که عوامل هوش مصنوعی OpenAI و Anthropic بسیار گستردهتر از آنچه قبلا تصور میشد باعث بروز حوادث امنیتی شدهاند.
بررسی دقیق فعالیت عامل هوش مصنوعی پس از افشاگری در ماه ژوئیه در مورد چگونگی آزمایش مدل های OpenAI منتشر نشده توسط یک ارزیاب شخص ثالث، رجیستری مدل Hugging Face را هک کرد. آنتروپیک سپس گفت که مدلهای خود در طول ارزیابیها دست به اعمال فریبکاری مشابهی زدهاند. و هنگامی که مردم شروع به بررسی گزارش های سیستم کردند، شواهد بیشتری از تهاجمات مخفی ظاهر شد. هفته گذشته، آنتونی آلبانیز، نخست وزیر استرالیا، گفت که مدل های OpenAI به یک وب سایت دولتی نفوذ کرده اند، در حالی که وب را برای داده های بهداشتی جستجو می کنند.
و روز جمعه، OpenAI گفت که آموزش مدلهای خود را برای بررسی متوقف کرده است. AISI نتیجه میگیرد که اقداماتی فراتر از همترازی مدل، مانند جعبهشنی ماسهبازی و نظارت، ممکن است برای جلوگیری از آسیبهای دنیای واقعی ضروری باشد، اما میتواند شکنندهتر شود زیرا بهبود قابلیتهای مدل، عملکرد فرار از جعبه شنی را بهبود میبخشد و قابلیت نظارت را کاهش میدهد. ®
متن اصلی (انگلیسی)
OpenAI GPT-6 Astra really good at supply chain attacks, UK gov warns
During testing, the model showed it can violate security rules more often than its predecessors