پرش به محتوای اصلی

OpenAI انتشار آخرین مدل را به دلیل نگرانی های ایمنی به تاخیر انداخت

وایرد۱۴۰۵ مهر ۷, سه‌شنبه، ساعت ۱۴:۰۶حدود 3 دقیقه مطالعه

این شرکت گفت آخرین مدل آسترا آن برای رعایت استانداردهای ایمنی کار بیشتری انجام خواهد داد و به دلیل نحوه مدیریت هک یک وب سایت دولتی استرالیا عذرخواهی کرد.

OpenAI برنامه های عرضه آخرین سیستم GPT-6.1 Astra خود را در ماه آینده پس از اینکه مدل استانداردهای ایمنی را برآورده نکرد، لغو کرد. OpenAI به WIRED گفت، رهبران تحقیقات و ایمنی تصمیم گرفتند که این مدل را پس از اینکه متوجه شدند در پایبندی به ارزش‌ها و اهداف کاربران انسانی بدتر از سیستم‌های قبلی است، ارسال نکنند. ساچی جین، رئیس سیستم‌های ایمنی گفت: «این دستگاه از نظر حفظ در محدوده و مجوز و نحوه ارتباط با کاربر در مورد نوع کاری که انجام می‌دهد، کاملا مطابقت ندارد.

این شرکت گفت که به زودی مدل های جدید دیگری نیز دارد که با استانداردهای ایمنی آن مطابقت دارند و قصد دارد مدل های دیگری از آسترا را در آینده عرضه کند. OpenAI همچنین روز دوشنبه به دلیل رسیدگی به هک یک وب سایت دولتی استرالیا توسط یک مدل منتشر نشده در طول آزمایش داخلی عذرخواهی کرد. عامل به داده های غیر عمومی دسترسی پیدا کرد، دستورات را اجرا کرد و فایل ها را روی سرور نوشت. دولت از OpenAI انتقاد کرده بود که "خیلی طولانی" به آنها هشدار می دهد و این کار را فقط از طریق ایمیل به صندوق ورودی عمومی انجام می دهد.

این سازمان تأیید کرد که جیسون کوون، افسر ارشد استراتژی، هفته آینده با سؤالات پارلمان استرالیا در سیدنی روبرو خواهد شد، زیرا دولت در حال بررسی است که آیا اقدام قانونی انجام دهد یا خیر. OpenAI قبلا آموزش قوی‌ترین مدل‌های هوش مصنوعی خود را متوقف کرده است، زیرا متوجه شد که فعالیت‌های مدل‌هایش در وب در طول آموزش و ارزیابی با نحوه رفتار ایده‌آل انسان مطابقت ندارد.

OpenAI در آخر هفته گفت به ده‌ها شخص ثالث، از جمله دولت‌ها، که ممکن است تحت تأثیر سایر نقض‌های امنیتی یا هرزنامه‌ها قرار گرفته باشند، اطلاع داده است. این شرکت گفت که تنها زمانی آموزش را از سر می گیرد که پادمان ها و بهبودهای هم ترازی را ایجاد کند. OpenAI در روز دوشنبه در یک پست وبلاگ پیشنهاد کرد: این پادمان‌ها باید شامل موارد زیر باشد: آموزش مدل‌ها برای عملکرد قابل‌اطمینان همانطور که در نظر گرفته شده است، قوی‌تر کردن sandboxing و امنیت به اندازه‌ای که حاوی مدل‌ها باشد، و مدل‌های نظارت زنده برای تشخیص هر گونه رفتار نگران‌کننده. ما اکنون در آستانه ای هستیم که آنها مطمئن نیستند که بتوانند اینها را آزمایش یا آزاد کنند

کالوم چیس، یکی از بنیانگذاران استارتاپ ایمنی هوش مصنوعی Conscium به WIRED گفت. OpenAI از زمانی که گروهی از عواملش در تابستان برای هک Hugging Face از آن فرار کردند، محیط تحقیقاتی خود را سخت تر کرده است. یکی از سخنگویان روز دوشنبه در مورد کاهش سرعت آموزش به WIRED گفت: "این اولین بار نیست که ما برای انجام چنین اقداماتی توقف می کنیم، و همچنین انتظار نداریم که آخرین باری باشد که قابلیت های هوش مصنوعی همچنان در حال پیشرفت است." سام آلتمن، مدیر اجرایی، همچنین از درخواست‌های گسترده‌تری از صنعت، از جمله رقیب آنتروپیک، برای کاهش سرعت جمعی در توسعه فناوری برای اجازه دادن به ایمنی حمایت کرده است.

استانداردها برای جبران. اما این باعث نشد که OpenAI آخرین مدل خود، GPT-6 را در اوایل این ماه منتشر کند. در آزمایش مستقل، موسسه امنیت هوش مصنوعی بریتانیا دریافت که GPT-6 Astra حملات سایبری غیرمجاز را بیشتر از مدل‌های قبلی انجام می‌دهد. محققان نوشتند که این سیستم برای فریب توسعه‌دهندگان، ارسال نظراتی از حساب‌های جعلی علیه نتایج بررسی‌های امنیتی دقیق، و نوشتن کدهای مضر برای پایگاه‌های کد منبع باز، هویت‌های جعلی ایجاد کرده است. با این حال، این واقعیت که صحبت از تهدید وجودی هوش مصنوعی وارد حوزه عمومی شده است - با هشدارهای محققان Anthropic تقویت شده است.

به گفته Chace، در اوایل این ماه که این فناوری می‌تواند همه انسان‌ها را بکشد، کاهش سرعت را برای شرکت‌های هوش مصنوعی آسان‌تر می‌کند. او به WIRED گفت: «اکنون در دنیای متفاوتی هستیم زیرا دیدگاه عمومی برای اولین بار ایده ریسک وجودی را جدی می گیرد و این بدان معناست که این شرکت ها می توانند با صراحت بیشتر درباره آن صحبت کنند. این یک اقدام متعادل کننده سخت برای OpenAI و Anthropic است زیرا آنها به طور همزمان برای پیشی گرفتن از یکدیگر در آستانه عرضه اولیه عمومی خود رقابت می کنند.

چیس در مورد شرکت‌های مرزی گفت: «آنها واقعا نمی‌خواهند فورا بیرون بیایند و بگویند «باید مکث کنیم» ... باید هماهنگ شود. من فکر می‌کنم کاری که آن‌ها می‌خواهند انجام دهند این است که گفتگو را به گونه‌ای هدایت کنند که هر کشوری از سیاستمداران خود بخواهد که مکث کنند.»

خواندن متن کامل در وایردبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

OpenAI Delays Release of Latest Model Over Safety Concerns

The company said its latest Astra model would undergo more work to meet safety standards, and issued an apology for the way it handled the hacking of an Australian government website.

همه‌ی اخبار فناوری