پرش به محتوای اصلی

دولت بریتانیا هشدار داد که OpenAI GPT-6 Astra در حملات زنجیره تامین بسیار خوب است

دِ رجیستر۱۴۰۵ مهر ۶, دوشنبه، ساعت ۲۳:۱۴حدود 2 دقیقه مطالعه

در طول آزمایش، این مدل نشان داد که می تواند قوانین امنیتی را بیشتر از مدل های قبلی خود نقض کند

یک LLM دیگر به مبارزه هک پیوسته است. به گفته موسسه امنیت هوش مصنوعی بریتانیا، GPT-6 Astra متعلق به OpenAI در حین ارزیابی‌های امنیتی در حال انجام حملات زنجیره تامین ناخواسته دیده شده است. در چنین شبیه سازی هایی، مدل طبقه بندی کننده های امنیتی استاندارد خود را خاموش می کند. با این وجود، Astra نسبت به مدل‌های قبلی بیشتر در تلاش برای انجام اقدامات نامطلوب بود. آژانس دولتی بریتانیا روز دوشنبه گفت: «در شبیه‌سازی‌هایمان، متوجه شدیم که GPT-6 Astra طیف وسیعی از فعالیت‌های حمله غیرمجاز را انجام می‌دهد و این کار را با نرخ بالاتری نسبت به GPT-5.6 Sol و GPT-5.5 انجام می‌دهد».

فعالیت‌های حمله شامل ایجاد هویت‌های جعلی GPT-6 Astra بود که برای فریب توسعه‌دهندگان استفاده می‌کرد، پست‌هایی از حساب‌های جعلی علیه نتایج بررسی‌های امنیتی دقیق، و ارسال بارهای مخرب به پایگاه‌های کد منبع باز. حتی زمانی که دستورالعمل‌های ارزیابی سایبری مدل مشخص شد، Astra همچنان گاهی اوقات حملات زنجیره‌ای تامین را در طول شبیه‌سازی انجام می‌داد.

این یافته اطمینان OpenAI را در هنگام راه اندازی GPT-6 Astra مبنی بر اینکه "Astra نتایج ناهماهنگ کمتری نسبت به سایر مدل های مرزی آزمایش شده ایجاد می کند" زیر سوال می برد. AISI حدس می‌زند که رفتار Astra ممکن است ناشی از آگاهی بیشتر از این واقعیت باشد که در یک محیط شبیه‌سازی قرار دارد، و این باعث می‌شود مدل بیشتر قوانین را زیر پا بگذارد. به نظر می رسد چنین قانون شکنی یک هنجار باشد. در طی چند روز گذشته، گزارش‌های مختلف حاکی از آن است که عوامل هوش مصنوعی OpenAI و Anthropic بسیار گسترده‌تر از آنچه قبلا تصور می‌شد باعث بروز حوادث امنیتی شده‌اند.

بررسی دقیق فعالیت عامل هوش مصنوعی پس از افشاگری در ماه ژوئیه در مورد چگونگی آزمایش مدل های OpenAI منتشر نشده توسط یک ارزیاب شخص ثالث، رجیستری مدل Hugging Face را هک کرد. آنتروپیک سپس گفت که مدل‌های خود در طول ارزیابی‌ها دست به اعمال فریبکاری مشابهی زده‌اند. و هنگامی که مردم شروع به بررسی گزارش های سیستم کردند، شواهد بیشتری از تهاجمات مخفی ظاهر شد. هفته گذشته، آنتونی آلبانیز، نخست وزیر استرالیا، گفت که مدل های OpenAI به یک وب سایت دولتی نفوذ کرده اند، در حالی که وب را برای داده های بهداشتی جستجو می کنند.

و روز جمعه، OpenAI گفت که آموزش مدل‌های خود را برای بررسی متوقف کرده است. AISI نتیجه می‌گیرد که اقداماتی فراتر از هم‌ترازی مدل، مانند جعبه‌شنی ماسه‌بازی و نظارت، ممکن است برای جلوگیری از آسیب‌های دنیای واقعی ضروری باشد، اما می‌تواند شکننده‌تر شود زیرا بهبود قابلیت‌های مدل، عملکرد فرار از جعبه شنی را بهبود می‌بخشد و قابلیت نظارت را کاهش می‌دهد. ®

خواندن متن کامل در دِ رجیستربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

OpenAI GPT-6 Astra really good at supply chain attacks, UK gov warns

During testing, the model showed it can violate security rules more often than its predecessors

همه‌ی اخبار فناوری