OpenAI انتشار آخرین مدل را به دلیل نگرانی های ایمنی به تاخیر انداخت
این شرکت گفت آخرین مدل آسترا آن برای رعایت استانداردهای ایمنی کار بیشتری انجام خواهد داد و به دلیل نحوه مدیریت هک یک وب سایت دولتی استرالیا عذرخواهی کرد.
OpenAI برنامه های عرضه آخرین سیستم GPT-6.1 Astra خود را در ماه آینده پس از اینکه مدل استانداردهای ایمنی را برآورده نکرد، لغو کرد. OpenAI به WIRED گفت، رهبران تحقیقات و ایمنی تصمیم گرفتند که این مدل را پس از اینکه متوجه شدند در پایبندی به ارزشها و اهداف کاربران انسانی بدتر از سیستمهای قبلی است، ارسال نکنند. ساچی جین، رئیس سیستمهای ایمنی گفت: «این دستگاه از نظر حفظ در محدوده و مجوز و نحوه ارتباط با کاربر در مورد نوع کاری که انجام میدهد، کاملا مطابقت ندارد.
این شرکت گفت که به زودی مدل های جدید دیگری نیز دارد که با استانداردهای ایمنی آن مطابقت دارند و قصد دارد مدل های دیگری از آسترا را در آینده عرضه کند. OpenAI همچنین روز دوشنبه به دلیل رسیدگی به هک یک وب سایت دولتی استرالیا توسط یک مدل منتشر نشده در طول آزمایش داخلی عذرخواهی کرد. عامل به داده های غیر عمومی دسترسی پیدا کرد، دستورات را اجرا کرد و فایل ها را روی سرور نوشت. دولت از OpenAI انتقاد کرده بود که "خیلی طولانی" به آنها هشدار می دهد و این کار را فقط از طریق ایمیل به صندوق ورودی عمومی انجام می دهد.
این سازمان تأیید کرد که جیسون کوون، افسر ارشد استراتژی، هفته آینده با سؤالات پارلمان استرالیا در سیدنی روبرو خواهد شد، زیرا دولت در حال بررسی است که آیا اقدام قانونی انجام دهد یا خیر. OpenAI قبلا آموزش قویترین مدلهای هوش مصنوعی خود را متوقف کرده است، زیرا متوجه شد که فعالیتهای مدلهایش در وب در طول آموزش و ارزیابی با نحوه رفتار ایدهآل انسان مطابقت ندارد.
OpenAI در آخر هفته گفت به دهها شخص ثالث، از جمله دولتها، که ممکن است تحت تأثیر سایر نقضهای امنیتی یا هرزنامهها قرار گرفته باشند، اطلاع داده است. این شرکت گفت که تنها زمانی آموزش را از سر می گیرد که پادمان ها و بهبودهای هم ترازی را ایجاد کند. OpenAI در روز دوشنبه در یک پست وبلاگ پیشنهاد کرد: این پادمانها باید شامل موارد زیر باشد: آموزش مدلها برای عملکرد قابلاطمینان همانطور که در نظر گرفته شده است، قویتر کردن sandboxing و امنیت به اندازهای که حاوی مدلها باشد، و مدلهای نظارت زنده برای تشخیص هر گونه رفتار نگرانکننده. ما اکنون در آستانه ای هستیم که آنها مطمئن نیستند که بتوانند اینها را آزمایش یا آزاد کنند
کالوم چیس، یکی از بنیانگذاران استارتاپ ایمنی هوش مصنوعی Conscium به WIRED گفت. OpenAI از زمانی که گروهی از عواملش در تابستان برای هک Hugging Face از آن فرار کردند، محیط تحقیقاتی خود را سخت تر کرده است. یکی از سخنگویان روز دوشنبه در مورد کاهش سرعت آموزش به WIRED گفت: "این اولین بار نیست که ما برای انجام چنین اقداماتی توقف می کنیم، و همچنین انتظار نداریم که آخرین باری باشد که قابلیت های هوش مصنوعی همچنان در حال پیشرفت است." سام آلتمن، مدیر اجرایی، همچنین از درخواستهای گستردهتری از صنعت، از جمله رقیب آنتروپیک، برای کاهش سرعت جمعی در توسعه فناوری برای اجازه دادن به ایمنی حمایت کرده است.
استانداردها برای جبران. اما این باعث نشد که OpenAI آخرین مدل خود، GPT-6 را در اوایل این ماه منتشر کند. در آزمایش مستقل، موسسه امنیت هوش مصنوعی بریتانیا دریافت که GPT-6 Astra حملات سایبری غیرمجاز را بیشتر از مدلهای قبلی انجام میدهد. محققان نوشتند که این سیستم برای فریب توسعهدهندگان، ارسال نظراتی از حسابهای جعلی علیه نتایج بررسیهای امنیتی دقیق، و نوشتن کدهای مضر برای پایگاههای کد منبع باز، هویتهای جعلی ایجاد کرده است. با این حال، این واقعیت که صحبت از تهدید وجودی هوش مصنوعی وارد حوزه عمومی شده است - با هشدارهای محققان Anthropic تقویت شده است.
به گفته Chace، در اوایل این ماه که این فناوری میتواند همه انسانها را بکشد، کاهش سرعت را برای شرکتهای هوش مصنوعی آسانتر میکند. او به WIRED گفت: «اکنون در دنیای متفاوتی هستیم زیرا دیدگاه عمومی برای اولین بار ایده ریسک وجودی را جدی می گیرد و این بدان معناست که این شرکت ها می توانند با صراحت بیشتر درباره آن صحبت کنند. این یک اقدام متعادل کننده سخت برای OpenAI و Anthropic است زیرا آنها به طور همزمان برای پیشی گرفتن از یکدیگر در آستانه عرضه اولیه عمومی خود رقابت می کنند.
چیس در مورد شرکتهای مرزی گفت: «آنها واقعا نمیخواهند فورا بیرون بیایند و بگویند «باید مکث کنیم» ... باید هماهنگ شود. من فکر میکنم کاری که آنها میخواهند انجام دهند این است که گفتگو را به گونهای هدایت کنند که هر کشوری از سیاستمداران خود بخواهد که مکث کنند.»
متن اصلی (انگلیسی)
OpenAI Delays Release of Latest Model Over Safety Concerns
The company said its latest Astra model would undergo more work to meet safety standards, and issued an apology for the way it handled the hacking of an Australian government website.