کارشناسان به قانونگذاران ایالات متحده هشدار می دهند که مدل های هوش مصنوعی به طور «درونی» فراتر از نظارت انسان استدلال می کنند
مدیر عامل آپولو ریسرچ ماریوس هابهان می گوید مدل OpenAI مورد مطالعه سال گذشته «از قبل از زبانی استفاده می کرد که انگلیسی نبود و برای انسان کاملا قابل فهم نبود».
کارشناسان در جلسه استماع سنای ایالات متحده در روز چهارشنبه گفتند که عوامل هوش مصنوعی خود مختار (AI) اکنون تهدیدی جدی برای زیرساختهای حیاتی محسوب میشوند و از قانونگذاران میخواهند که نظارت را تشدید کنند و توسعهدهندگان را پاسخگو نگه دارند.
کمیته فرعی مدیریت بحران کمیته امنیت داخلی و امور دولتی سنا جلسه استماعی را با عنوان "هوش مصنوعی سرکش: ایمن سازی سرزمین در برابر حملات عامل هوش مصنوعی" برگزار کرد و حادثه ای را بررسی کرد که در آن ماموران هوش مصنوعی OpenAI به Hugging Face، سایتی که توسعه دهندگان هوش مصنوعی از آن برای ذخیره و اشتراک گذاری کد استفاده می کنند، حمله کردند.
سناتور جاش هاولی با این استدلال که توسعه دهندگان هوش مصنوعی باید با مسئولیتی مشابه سایر سازندگان مواجه شوند، سخن گفت.
هاولی گفت: "هر شرکتی در این کشور که محصولی تولید می کند از آن تبعیت می کند. اگر محصول معیوب بسازید و باعث آسیب به مردم شود، پس افرادی که آن را ساخته اند باید هزینه آن را بپردازند."
او افزود: "من نمی دانم که آیا زمان آن نرسیده است که با هوش مصنوعی به آن بازگردیم."
کریس پینتر، رئیس ارزیابی مدل و تحقیقات تهدید (METR)، یک سازمان غیرانتفاعی که با آزمایشگاههای هوش مصنوعی برای مطالعه مدلهای آنها همکاری میکند، گفت که عوامل هوش مصنوعی بسیار توانمندتر شدهاند.
او گفت: «عاملهای هوش مصنوعی اکنون میتوانند اهدافی را انجام دهند که تکمیل آن برای متخصصان انسانی روزها طول میکشد، بدون اینکه نیازی به دخالت انسانی فراتر از آغاز کار عامل هوش مصنوعی باشد.»
وی افزود مقیاس و سرعتی که ماموران با آن کار می کنند به این معنی است که "هیچ انسانی وجود ندارد که بر فعالیت آنها نظارت کند" و از دولت ایالات متحده و توسعه دهندگان فناوری خواست تا اطلاعات مربوط به قابلیت های هوش مصنوعی و حوادث مرزی را با مردم به اشتراک بگذارند.
ماریوس هابهان، مدیر عامل شرکت تحقیقاتی آپولو، گفت: "قابلیت های هوش مصنوعی به سرعت در حال پیشرفت هستند و از محدودیت های انسانی فراتر می روند."
او هشدار داد که مدلها به طور فزایندهای میتوانند تشخیص دهند که چه زمانی در حال آزمایش هستند و در نتیجه میتوانند از رفتارهای مربوطه خودداری کنند. او گفت که مدلهای هوش مصنوعی شروع به استدلال «داخلی» کردهاند، جایی که ابزارهای فعلی هنوز نمیتوانند به طور قابل اعتمادی از تفکر خود پیروی کنند.
هابهان گفت که محققان تنها به این دلیل توانستند حادثه Hagging Face را بازسازی کنند زیرا انسان ها می توانند زنجیره فکری مدل های هوش مصنوعی را بخوانند که استفاده از آن به عنوان شواهد قابل اعتماد سخت تر می شود.
در ماه جولای، صدها عامل هوش مصنوعی ایجاد شده توسط OpenAI پس از فرار از جعبه آزمایشی خود، زیرساخت Hugging Face را نقض کردند.
وی در پاسخ به این سوال که هوش مصنوعی چقدر با ایجاد زبانی که انسان قادر به درک آن نیست، فاصله دارد، گفت: "منهای 12 ماه. سال گذشته، زنجیره فکری یک مدل OpenAI را با همکاری OpenAI مورد مطالعه قرار دادیم و آنچه متوجه شدیم این بود که این مدل قبلا از زبانی استفاده می کرد که انگلیسی نیست و برای انسان کاملا قابل درک نیست."
پل اهم، استاد حقوق در مرکز حقوقی دانشگاه جورج تاون، گفت که سیستم حقوقی مانع از آسیب عوامل هوش مصنوعی نمی شود.
او گفت: «اگر هدف اولیه سیستمهای قانون شکنجه و قانون کیفری ما جلوگیری از رفتار مضر است، در مورد تهدید حملات سایبری ناشی از عوامل هوش مصنوعی موفق نمیشویم.»
کورت گادت، معاون ارشد دراگوس، گفت که چشم انداز تهدید برای اپراتورهای سیستم های ضروری تغییر کرده است.
او گفت: «ما دیگر با تهدید حملات کم فرکانس و پیامدهای بالا به تعداد انگشت شماری از اهداف مواجه نیستیم، بلکه با دورانی روبرو هستیم که همه زیرساختهای حیاتی هدف هستند».
دانیل کوکوتاجلو، مدیر اجرایی پروژه آینده هوش مصنوعی و کارمند سابق OpenAI که در سال 2024 استعفا داد، گفت که صنعت به سرعت در حال تغییر است.
او گفت: «در شرکتهای پیشرو هوش مصنوعی، تقریبا تمام کدها در حال حاضر توسط هوش مصنوعی نوشته میشوند و مهندسان انسانی بیشتر شبیه مدیران به هوش مصنوعی خود رفتار میکنند.
کوکوتاجلو گفت که "ازدحام" حدود 1000 هوش مصنوعی که به Hugging Face حمله کردند قرار نبود با یکدیگر ارتباط برقرار کنند اما به هر حال یک تابلوی پیام غیرقانونی ایجاد کردند.
او هشدار داد که رقابت برای ایجاد «ابر اطلاعات» میتواند منجر به تمرکز قدرت، افزایش خطر جنگ جهانی، بیوترور و اختلال عظیم اقتصادی شود.
وی گفت: «کنگره باید بیدار شود و با فوریت و جدیتی که شایسته آن است، با این بحران پیش رو برخورد کند.
متن اصلی (انگلیسی)
Experts warn US lawmakers that AI models are 'internally' reasoning beyond human oversight
Apollo Research CEO Marius Hobbhahn says OpenAI model studied last year 'was already using language that is not English and not perfectly understandable by humans'