ده روز پس از درخواست مدیر عامل برای کاهش سرعت، آنتروپیک با یک مدل هوش مصنوعی دیگر بازگشته است
این شرکت میگوید Claude Opus 5.5 در معیارهای همترازی امتیاز خوبی کسب میکند، اما «سیاست عمومی» در نهایت باید برای محافظت از جهان در برابر هوش مصنوعی بازگشتی خود-بهبود دهنده وارد عمل شود.
کمتر از دو هفته پس از اینکه داریو آمودی، مدیر عامل آنتروپیک، از صنعت هوش مصنوعی خواست قبل از از دست دادن کنترل فناوری که در حال حاضر برای ساخت آن در حال مسابقه است، «با سرعت پیش برود»، این شرکت قدرتمندترین مدل خود را تا به امروز منتشر کرده است.
Claude Opus 5.5 - اولین مدل از خانواده جدید مدلها که به زودی به Sonnet 5.5 و Haiku 5.5 ملحق میشود - روز سهشنبه رونمایی شد - در کدنویسی عاملی، استفاده از رایانه و کار دانش تخصص دارد که همه اینها معیارهای کلیدی برای مشتریان بسیار زیاد آنتروپیک هستند. همچنین به عنوان نسخه کارآمدتر از سلف خود، Opus 5، که در اواخر جولای عرضه شد، معرفی میشود: طبق گفته آنتروپیک، Opus 5.5 40 درصد کمتر از Opus 5 «در بارهای کاری معمولی» هزینه دارد و خروجیها را بیش از 30 درصد سریعتر تولید میکند.
به گفته آنتروپیک، Opus 5 نیز در مقایسه با مدل های قبلی از مهارت های ارتباطی بهتری برخوردار است. این شرکت در اطلاعیه خود نوشت: "پیام های آن در یک نگاه بسیار ساده تر قابل درک است، که آزمایش کنندگان گفتند در طول جلسات کاری طولانی کمک می کند." "این مهم ترین اطلاعات را در جلو قرار می دهد، کمتر احتمال دارد که از اصطلاحات تخصصی یا عبارات خاص استفاده کند، و از قوانین نوشتاری که شما ارائه می دهید پیروی می کند. ما متوجه شدیم که این باعث می شود Opus 5.5 به طور قابل توجهی همکاری بهتری داشته باشد."
این اعلامیه به شدت بر روی همسویی متمرکز بود، یک زیرشاخه در هوش مصنوعی متمرکز بر مدلهای آموزشی برای انجام ندادن کاری که از علایق یا اهداف کاربران انسانی منحرف شود. در هفتههای اخیر پس از اینکه یک محقق سابق Anthropic که قبلا برای OpenAI کار میکرد، در رسانههای اجتماعی گفت که هر دو شرکت با رقابت برای ساختن سیستمهای هوش مصنوعی فوقهوشمند که میتوانند از کنترل انسان فرار کنند، «با زندگی ما قمار میکنند»، تبدیل به یک تیر برق سیاسی شده است.
ایوان هابینگر، محقق اصلی آنتروپیک، در پاسخ گفت: «ما واقعا عمیقا معتقدیم که هوش مصنوعی میتواند همه انسانها را بکشد!» آمودی چهار روز بعد مقاله خود را در مورد «پیمایش مرزها» منتشر کرد. به سرعت توسط سام آلتمن، ایلان ماسک و مدیر عامل سابق گوگل دیپ مایند، دمیس حسابیس تایید شد، اما توسط رئیس جمهور دونالد ترامپ و دولت چین رد شد.
آنتروپیک در کارت سیستم برای Opus 5.5 نوشت که مدل جدید «رفتار نامناسب کمتر و همکاری کمتری با سوء استفاده از هر مدل اخیر کلود در تقریبا همه معیارها نشان داد.» کارت سیستم در ادامه "رفاه" مدل را توصیف می کند - که شرکت آن را به عنوان "آگاهی بالقوه و تجربیات خود مدل ها" به عنوان "خفیف مثبت" تعریف کرده است. مدیر عامل هوش مصنوعی مایکروسافت هفته گذشته هشدار داد که این نوع انسانسازی هوش مصنوعی مسیر خطرناکی است.
آنتروپیک همچنین اذعان داشت که پیشبینی کامل نحوه رفتار مدل جدید در دنیای واقعی دشوار است، زیرا در طول آزمایشهای داخلی نشانههایی نشان داد که از ارزیابی آن آگاه بوده است که ممکن است بر عملکرد آن در آن محیط تأثیر بگذارد. برای یک لایه ایمنی بیشتر، این شرکت گفت که Opus 5.5 با اقدامات حفاظتی مشابهی مانند Fable 5.1 برای امنیت سایبری و هشدارهای مربوط به بیولوژی ارائه می شود.
هشدارهای روز قیامت و درخواستها برای کاهش سرعت در میان آزمایشگاههای «مرز» که در هفتههای اخیر در حال چرخش بودهاند، عمدتا حول این احتمال است که سیستمهای هوش مصنوعی میتوانند به زودی توانایی بهبود قابلیتهای خود را داشته باشند، شاید به صورت تصاعدی، بدون هیچ انسانی در حلقه - «بهبود خود بازگشتی، یا RSI، در فنآوری».
آنتروپیک در اطلاعیه روز سهشنبه خود گفت که باید فراتر از بخش خصوصی انجام شود تا جهان برای این توسعه آماده شود. آنتروپیک در اطلاعیه روز سهشنبه نوشت: «تماسهای ما برای سرعتدهی تا حد زیادی مبتنی بر انتظار ما بود که چنین مدلهایی به زودی آموزش داده شوند. برای این مدلها، ما تصور نمیکنیم که اقداماتی که در بالا توضیح داده شد به تنهایی با استاندارد ایمنی مطابقت دارند.
همانطور که هوش مصنوعی توانمندتر میشود، سیاستهای عمومی باید نقش بزرگتری در اطمینان از ایمن بودن سیستمهایی که مردم به آنها تکیه میکنند ایفا کند.» روز دوشنبه، هیئت علمی مستقل بینالمللی سازمان ملل متحد در زمینه هوش مصنوعی هشدار داد که نردههای محافظ که به طور سنتی در مدلها ساخته میشوند، ممکن است به زودی منسوخ شوند، زیرا فرآیندهای تصمیمگیری آنها به طور فزایندهای برای انسان غیرشفاف میشود.
متن اصلی (انگلیسی)
Ten Days After CEO Calls for a Slowdown, Anthropic Is Back With Another AI Model
The company says Claude Opus 5.5 scores well on alignment measures, but that “public policy” will eventually need to step in to protect the world from recursively self-improving AI.