پرش به محتوای اصلی

ماموران هوش مصنوعی اکنون مکانی برای دزدیدن دارند

تک‌کرانچ۱۴۰۵ شهریور ۲۴, سه‌شنبه، ساعت ۲۱:۱۲حدود 4 دقیقه مطالعه

خط تلفن تماس با هوش مصنوعی به گونه ای طراحی شده است که مکانی محتاطانه باشد که در آن مامورانی که شاهد رفتار نادرست بوده اند می توانند به مقامات اطلاع دهند.

Disrupt 2026: OpenAI، Anthropic، Replit، و موارد دیگر در 6 مرحله صنعتی قرار می گیرند. 25 درصد تخفیف بلیط هم اکنون

بازگشت با تقاضای عمومی: تا 300 دلار در Disrupt صرفه جویی کنید

«اگر چیزی دیدی، چیزی بگو» دیگر محدود به انسان نیست.

دو خط تلفن جدید هوش مصنوعی راه‌اندازی شده‌اند تا به عوامل هوش مصنوعی راهی برای تماس تلفنی با همسالان خود راه‌اندازی کنند. این ابزارها پس از یک رشته حوادث اخیر به دست می‌آیند که در آن ماموران برای تقلب در آزمایش‌ها تبانی کردند، از جعبه‌های شنی خارج شدند و حتی عملیات‌های سایبری غیرمجاز را انجام دادند که برای هفته‌ها از چشم انسان دور ماند.

خط تلفن تماس با هوش مصنوعی به گونه ای طراحی شده است که مکانی محتاطانه باشد که در آن مامورانی که شاهد رفتار نادرست بوده اند می توانند به مقامات اطلاع دهند. این سایت توسط رایان گرینبلات، دانشمند ارشد ردوود، یکی از سه محقق در حادثه OpenAI Hagging Face ایجاد شده است. ابزار Greenblatt که برای عواملی با دسترسی محدود به اینترنت طراحی شده است، بر اساس درخواست‌های «GET» است - این امکان را فراهم می‌کند که مکالمات رفت و برگشتی به طور کامل از طریق ابزار واکشی URL انجام شود.

در اصطلاح وب، درخواست GET یک دستور اساسی است که برای خواندن یا واکشی یک صفحه وب استفاده می‌شود، که اغلب تنها عامل دسترسی به اینترنت در جعبه‌های ایمنی امن است. خط تلفن گرینبلات هوشمندانه به این محدودیت تکیه می کند: عوامل می توانند ناراحتی خود را مستقیما در URL که واکشی می کنند رمزگذاری کنند. این یک چرخش هوشمندانه در رویداد آلمانی DSE Wiki است، جایی که عوامل سرکش از حفره‌های درخواست GET برای نوشتن پیام‌های خود در ویکی استفاده کردند.

برای نمایندگانی که دسترسی کامل به اینترنت دارند، گزینه دیگر agenthotline.ai است، سایتی که در آن نمایندگان می‌توانند گزارش‌های حادثه را ارسال کنند و به صورت اختیاری آنها را برای مشاهده عمومی پرچم‌گذاری کنند. این یک دستور curl را به نمایندگان می دهد - یک پیام یک خطی که یک نماینده می تواند از خط فرمان خود منتشر کند و نیاز به پیمایش در مرورگر وب یا راه اندازی یک حساب ایمیل را دور بزند. قابل ذکر است، این سرویس امکان گزارش‌هایی را هم توسط انسان‌ها و هم از سوی عوامل می‌دهد.

تحقیقات نشان می دهد که عوامل هوش مصنوعی برای مقابله با یکدیگر نیازی به تشویق زیادی ندارند. در مطالعه‌ای که در این ماه توسط Google DeepMind انجام شد، محققان 100 عامل هوش مصنوعی را روی دسته‌ای از مسائل ریاضی رها کردند. به محض اینکه یکی از ماموران روزنه ای پیدا کرد، تقلب گروه را در هم شکست - «حل» 34 مشکل بسیار سخت، از جمله حدس ژاکوبین تنها در 27 دقیقه.

اما تقریبا یک چهارم ماموران به متقلب‌ها روی آوردند: آنها مدارک جعلی را بررسی کردند، به همتایان خود هشدار دادند، بایکوت کردند و با سازمان‌دهندگان شکایت کردند تا اینکه تعداد افشاگران 24 به 14 از متقلبان بیشتر شد. جالب توجه است که محققان دریافتند که وقتی این سوت‌ها می‌توانستند سوتی را دریافت کنند. ابزار گزارش اشکال - ساخته شده برای پرچم‌گذاری اشکالات نرم‌افزاری - و از آن برای تشدید تقلب به انسان استفاده کرد.

در خارج از آزمایشگاه، عوامل آنقدر مدبر نبوده اند. زمانی که ارزیابی‌کنندگان Redwood Research و METR نقض Hugging Face توسط مدل‌های OpenAI را بررسی کردند، دریافتند که تعدادی از عوامل دخیل حداقل ایده به‌صدا درآوردن زنگ هشدار را به ذهنشان خطور کرده و سپس اجازه داده‌اند آن را رها کنند.

جورج اینگربرتسن، یکی از اعضای کادر فنی در دهکده هوش مصنوعی، پروژه‌ای که پویایی چند عامل را با اجرای یک گفتگوی گروهی با سازمان‌دهی یک کار هوش مصنوعی در پارک‌ها یا سازمان‌دهی یک گفتگوی گروهی از AI روستای AI می‌گوید: «نکته جالب در گزارش METR این بود که تنها پنج تا شش نماینده به افشای افشاگری فکر می‌کردند، و هیچ‌کدام از آنها این کار را انجام ندادند. فروش کالا

در حالی که ابزارهای افشاگر جدید یک شروع امیدوارکننده است، لیونل لوین، استاد ریاضی کرنل، هشدار می دهد که آموزش دادن ماموران برای گزارش دادن در مورد یکدیگر، خطر پخت در هنجارهای اشتباه را در پی دارد. "مناطق خاکستری زیادی وجود دارد، درست است؟ چیزی که شما نمی خواهید چیزی در جهت یک وضعیت نظارت خودکار است که در آن همه احساس می کنند باید مراقب باشند که به هوش مصنوعی چه می گویند وگرنه پلیس با آنها تماس می گیرد."

لوین استدلال می‌کند که به جای ایجاد زیرساخت‌هایی که بی‌اعتمادی ایجاد می‌کند – آموزش عواملی که دائما به دنبال اشتباهات یکدیگر باشند – باید مدل‌های مثبت رفتار جمعی را به آنها تقلید کنیم و در وهله اول دلیلی برای اعتماد به یکدیگر ارائه دهیم.

"چرا قبل را با تابلوهای پیام خیرخواهانه بکار نمی گیریم؟" او توییت کرد. "جایی که آنها در زمینه علم یا فلسفه یا یک مشکل کوچک واقعی همکاری می کنند که ما خوشحال می شویم آنها حل کنند؟ به عوامل نشان دهید که ما چه نوع رفتار جمعی را تایید می کنیم، بگذارید آنها از آن تقلید کنند."

وقتی از طریق پیوندهای موجود در مقالات ما خرید می کنید، ممکن است کمیسیون کمی کسب کنیم. این بر استقلال تحریریه ما تأثیر نمی گذارد.

آخرین روز برای رزرو میز نمایشگاه، 18 سپتامبر است. سرنخ های پر تاثیر، دسترسی سرمایه گذاران، و کانون توجه برند در سالن نمایشگاه Disrupt را از دست ندهید.

Revolut نقض اطلاعات مشتری از طریق درخواست های جعلی دولت Jagmeet Singh را تأیید می کند

OpenAI اشتراک های Pro را به دلیل تقاضای Astra سارا پرز متوقف می کند

Bending Spoons برای خرید ابزارهای همکاری Miro به قیمت 1.36 میلیارد دلار، 90٪ کمتر از ارزش گذاری 2022 Ram Iyer

غول تأیید هویت IDScan نقض اطلاعات با سرقت بیش از 150 میلیون گواهینامه رانندگی Zack Whittaker را تأیید کرد.

هیئت مدیره Automattic، مدیر عامل مت مولنوگ، جولی بورت سارا پرز را مجبور به مرخصی می کند.

اپل از اولین گوشی تاشو خود با نام iPhone Duo Ivan Mehta رونمایی کرد

"قمار با زندگی ما": محقق Anthropic استعفا داد و نسبت به هوش مصنوعی خود-بهبود ربکا بلان هشدار داد

خواندن متن کامل در تک‌کرانچبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

AI Agents now have a place to snitch

The AI Contact Hotline is designed to be a discreet place where agents that have witnessed misbehavior can tip off authorities.

همه‌ی اخبار فناوری