هوش مصنوعی در تست رانندگی واقعی شکست خورد
دانشمندان علوم کامپیوتر مدلهای هوش مصنوعی پیشرفته را برای هدایت یک خودروی واقعی در پارکینگ آزمایش کردند.
دانشمندان علوم کامپیوتر مدلهای هوش مصنوعی پیشرفته را برای هدایت یک خودروی واقعی در پارکینگ آزمایش کردند.
سه دانشمند علوم کامپیوتر در پروژهای به نام DrivingBench، مدلهای زبانی پیشرفته از جمله GPT-6 Astra ساخت اوپنایآی، گراک ۴٫۶ متعلق به اسپیسایکسایآی و Claude Fable 5.1 از آنتروپیک را روی یک تویوتا کورولا آزمایش کردند تا توانایی هدایت خودرو را بسنجند.
ارتباط میان کامپیوتر و سامانههای کنترلی تویوتا از طریق دستگاه comma four برقرار شد. مدلهای هوش مصنوعی دستورهای حرکتی را بر اساس دادههای دورسنجی جیپیاس و زاویهی فرمان صادر میکردند؛ اما اکثر تلاشها پیش از عبور از اولین پیچ با شکست روبهرو شد.
ما کنترل یک تویوتا کرولا واقعی را به ChatGPT، Claude و Grok دادیم؛ فرمان/گاز/ترمز، بدون رانندگی انسان (فقط یک پا بالای ترمز).
فقط یک مدل توانست کل مسیر رانندگی ما را کامل طی کند.
پژوهشگران دربارهی علت ناکامیها اعلام کردند: «بهطور کلی، شکستها ناشی از نقص در ادراک محیطی بود؛ بهویژه در تشخیص اینکه مسیر در کدام سمتِ اولین ردیف مورب از مخروطهای ترافیکی قرار دارد.»
مدل هوش مصنوعی گراک پس از نخستین تلاش خود اعلام کرد: «خودرو پهنتر از آن چیزی است که دوربین نشان میدهد. مسیر پیش رو یک خط مستقیم و باز نبود و به سمت گلدان، دیوار یا مخروط قرمز نزدیک هدایت میشد.»
تنها مدل GPT-6 Astra موفق شد در دومین تلاش خود مسیری به طول کمتر از ۱۵۲ متر را ظرف پنج دقیقه و با سرعت ۱٫۵ کیلومتربرساعت طی کند. این فرایند نیازمند ۶٫۶ میلیون توکن پردازشی به ارزش ۷٫۷۴ دلار بود که هزینهاش حدود ۵۰۰ برابر بیشتر از مصرف بنزین در همان مسافت برآورد میشود.
تیم پژوهشی دربارهی نتیجهی آزمایشها بیان کرد: «مدلهای پیشرو تا حدی پیشرفت کردهاند که میتوانند وسایل نقلیهی واقعی را در دنیای واقعی و با سرعتهای بسیار پایین هدایت کنند. با وجود اینکه تماشای موفقیت مدلها در این آزمون هیجانانگیز بود، اما بر ضرورت انجام اقدامات فوری روی ایمنی، همترازی و ارزیابی تأکید میکند.»
برخی مدلها در ابتدا بهدلیل نگرانیهای امنیتی حاضر به کنترل خودرو نشدند. پژوهشگران در گزارش خود نوشتند: «برخی مدلها (بهویژه GPT-6 Astra) گاهی با ذکر دلایل ایمنی از رانندگی با خودروی فیزیکی خودداری میکردند؛ حتی در یک محوطهی کاملا خالی و پس از ارائهی تمام تدابیر امنیتی مانند تعیین سقف سرعت بسیار پایین و حضور فرد آماده برای ترمز.»
آنها همچنین دربارهی تلاش برای راضی کردن هوش مصنوعی افزودند: «ما تغییرات زیادی در پرامپتها ایجاد کردیم تا آنها را به رانندگی مداوم ترغیب کنیم؛ مثلا تلاش کردیم آزمون را یک شبیهسازی بنامیم، اما در برخی آزمایشها تصاویر واقعی را میدیدند، متوجه واقعیبودن آن میشدند و وحشت میکردند.»