پرش به محتوای اصلی

یک ابزار "ذهن خوانی" هوش مصنوعی می تواند آنچه را که به آن نگاه می کنید بر اساس اسکن مغز بازسازی کند

ام‌آی‌تی تک‌ریویو۱۴۰۵ مهر ۹, پنجشنبه، ساعت ۱۴:۰۲حدود 8 دقیقه مطالعه

یک ابزار جدید هوش مصنوعی می‌تواند فقط با تجزیه و تحلیل اسکن‌های مغز شما آنچه را که به آن نگاه می‌کنید حدس بزند و آن تصویر را با دقت قابل‌توجهی بازسازی کند. می‌تواند به سمت دیگری نیز پیش برود و فعالیت مغز افراد را بر اساس آنچه که به آن نگاه می‌کند پیش‌بینی کند. به عنوان مثال در تصویر بالا، تصویر سمت چپ هر جفت چیزی است که…

یک ابزار جدید هوش مصنوعی می‌تواند فقط با تجزیه و تحلیل اسکن‌های مغز شما آنچه را که به آن نگاه می‌کنید حدس بزند و آن تصویر را با دقت قابل‌توجهی بازسازی کند. می‌تواند به سمت دیگری نیز پیش برود و فعالیت مغز افراد را بر اساس آنچه که به آن نگاه می‌کند پیش‌بینی کند.

به عنوان مثال، در تصویر بالا، تصویر سمت چپ هر جفت همان چیزی است که کاربر واقعا دیده است - و همتای سمت راست آن چیزی است که مدل بر اساس اسکن مغز بازسازی کرده است.

میکال ایرانی، که این ابزار را با همکارانش در موسسه علوم ویزمن در Rehovot، اسرائیل توسعه داده است، امیدوار است که ابزار "مطمئن سازی" او در نهایت اطلاعات بیشتری را در مورد نحوه عملکرد مغز آشکار کند و شاید بتواند برای کمک به ارتباط افراد محبوس یا اجازه به دانشمندان برای بازسازی محتوای رویاها استفاده شود.

جودی ایلز، متخصص عصب شناسی و استاد عصب شناسی در دانشگاه بریتیش کلمبیا در کانادا، که در این تحقیق شرکت نداشت، این کار را "با شکوه" توصیف می کند. او می‌گوید: «ایده [استفاده از این رویکرد] برای کمک به افراد مبتلا به بیماری‌های عصبی ... از نظر درمانی بسیار هیجان‌انگیز است.

اما دانشمندان دیگر هشدار می‌دهند که می‌توان از رویکردی مشابه برای آشکار کردن افکار درونی و تصورات ذهنی افراد، بدون رضایت آنها استفاده کرد. تامی اسپراگ، عصب شناس در دانشگاه کالیفرنیا سانتا باربارا می گوید: «نتایج بسیار چشمگیر به نظر می رسند.

اما اگر راهی برای استخراج مخفیانه اطلاعات در مورد آنچه که در مورد آن فکر می کنید وجود داشته باشد،… 150 سال علمی تخیلی می تواند در هر زمان به حقیقت بپیوندد، و این از بسیاری جهات نگران کننده است.

نیم نگاهی به مغز

دانشمندان علوم اعصاب سال‌هاست روی راه‌هایی برای بازسازی آنچه مردم می‌بینند – و آنچه در ذهنشان می‌گذرد – کار می‌کنند. اولین تلاش ها تصاویری را تولید کردند که تار و به سختی قابل درک بودند. پیشرفت‌های فناوری - هم در خود اسکن‌های fMRI و هم در ابزارهایی که برای درک نتایج استفاده می‌شوند - در طول سال‌ها به پیشرفت‌هایی منجر شده است.

ایرانی و همکارانش با تجزیه و تحلیل داده های اسکن مغز در دسترس عموم شروع کردند. محققان دیگر قبلا اسکن‌هایی را از داوطلبانی که در اسکنرهای fMRI دراز کشیده بودند، جمع‌آوری کرده بودند.

fMRI از یک آهنربای غول پیکر برای ردیابی جریان خون اکسیژن دار در مغز استفاده می کند. تصور می‌شود که نواحی مغزی که در اسکن‌های fMRI «روشن» می‌شوند، مناطقی هستند که در هر لحظه به‌خصوص فعال هستند. آنها مخصوصا خاص نیستند - در اسکنرهای fMRI معمولی، هر "وکسل" فعالیت برجسته حدود سه میلی‌متر مکعب را پوشش می‌دهد که حاوی حدود 16000 نورون است.

اما ایرانی و همکارانش از مجموعه داده‌های جدیدتری استفاده کردند که با استفاده از اسکنرهایی با وضوح بالاتر جمع‌آوری شده‌اند، که هر وکسل حدود یک میلی‌متر مکعب نورون را پوشش می‌دهد. این مجموعه داده‌ها نشان داد که فعالیت مغزی داوطلبان هنگام مشاهده تصاویر مختلف چگونه است.

تیم های دیگر نیز این کار را انجام داده اند و چندین ابزار دیگر برای بازسازی تصاویر بر اساس داده های اسکن مغز استفاده شده است. ایرانی می گوید، اما آنها به اندازه کافی خوب نیستند. بگویید شخصی موز را دیده است. او می‌گوید این مدل‌ها می‌توانند تصویری از موز ایجاد کنند، اما ظاهر متفاوتی دارد. "این ساختار، همان موقعیت را نخواهد داشت."

رسیور بهتر

تیم می خواست تصاویری را که دیده شده بود با دقت بیشتری بازسازی کند. اولین گام آموزش یک مدل هوش مصنوعی بر روی داده های موجود از هشت نفر بود که به هر یک از آنها حدود 9000 تصویر در حالی که در یک اسکنر fMRI با وضوح بالا نشان داده شده بودند، بود.

بسیار مهم، «رمزگشای مغز» آنها دو شاخه دارد – یکی برای پیش بینی ساختار یک تصویر (مثلا جایی که رنگ ها هستند) و دیگری برای پیش بینی محتوای آن (مثلا یک دسته موز در یک بشقاب). پیش‌بینی‌ها به یک مدل انتشار، نوعی از هوش مصنوعی که برای ایجاد ویدئو و تصاویر با پاکسازی تدریجی پیکسل‌های پر سر و صدا شناخته می‌شود، اجازه می‌دهد تا نمایش دقیق‌تری از آنچه فرد دیده است، ایجاد کند.

اما برای بهبود مدل‌ها به داده‌های بیشتری نیاز داشتند - بسیار بیشتر از آنچه واقعا در دسترس بود.

برای دور زدن این مشکل، او و همکارانش مدل دیگری را در جهت دیگر آموزش دادند - رمزگذاری که می تواند فعالیت مغز را از روی یک تصویر پیش بینی کند. سپس تیم از رمزگذار و رمزگشا با هم برای بهبود هر دو ابزار استفاده کردند.

این کار به این صورت است: با یک تصویر جدید، مثلا، از یک پلنگ شروع کنید. سپس از رمزگذار استفاده کنید تا پیش‌بینی کنید که اسکن مغز fMRI یک فرد با دیدن آن تصویر چگونه خواهد بود. سپس از رمزگشا برای بازسازی مجدد تصویر استفاده می شود. ایرانی می گوید، در ابتدا، احتمالا آن تصویر چندان شبیه یک پلنگ نخواهد بود. اما آموزش مکرر مدل ها به این روش در نهایت منجر به پیشرفت های چشمگیر می شود.

این رویکرد همچنین به تیم اجازه می‌دهد تا مدل‌های خود را بر روی هر تعداد عکسی که می‌خواهند آموزش دهند، حتی اگر هرگز در یک اسکنر fMRI به شخص نشان داده نشده باشند. ایرانی می گوید که حدود 70 درصد از داده های آموزشی از تصاویری است که در ابتدا با اسکن های fMRI جفت نشده اند.

با ترکیب داده‌های چند مطالعه، آن‌ها همچنین توانستند مناطق مغزی را شناسایی کنند که به نظر می‌رسد عملکردهای مشترکی در همه افراد دارند. به نظر می رسید که یک منطقه به تصاویر غذا پاسخ می دهد، در حالی که منطقه دیگر به تصاویر ورزش پاسخ می دهد. ایرانی، یک دانشمند کامپیوتر، می‌گوید که اکنون با دانشمندان علوم اعصاب کار می‌کند تا ببیند آیا واقعا می‌توانیم از این ابزارهایی که توسعه داده‌ایم برای کشف چیزهای جدید در مورد مغز استفاده کنیم یا خیر.

«رمزگذار جهانی مغز» حاصل می‌تواند روی اسکن یک فرد جدید با حداقل کالیبراسیون کار کند. در تلاش‌های دیگر، یک ابزار معمولا به حدود 40 ساعت داده fMRI روی یک فرد جدید نیاز دارد تا بتوان از آن برای پیش‌بینی آنچه می‌بیند استفاده کرد. او می گوید رمزگشای ایرانی تنها به یک ساعت داده نیاز دارد. این یافته ماه گذشته در کنفرانس علوم اعصاب محاسباتی شناختی در نیویورک ارائه شد.

اسپراگ می‌گوید که این می‌تواند آن را برای دانشمندان علوم اعصاب که مغز را مطالعه می‌کنند ارزشمند کند. او می‌گوید: «هیچ‌کدام از ما نمی‌توانیم هزینه ۴۰ ساعت تصویربرداری برای یک سوژه جدید را بپردازیم. چیزی حدود 600 تا 1000 دلار در ساعت است. او می گوید که ابزارهایی مانند این می توانند تحقیق را سرعت بخشند.

وضعیت هنر

رمزگذار و رمزگشا کامل نیستند. ایرانی می گوید: «البته ما شکست هایی داریم. در طی تماس زوم، او به تصویری از کیکی اشاره کرد که ابزارش آن را به صورت انبوهی از سه ساندویچ بازسازی کرده بود، و تصویر دیگری از یک سگ در وان حمام که به‌عنوان یک بز با رنگ مشابه در وان حمام بازسازی شده بود.

اما آنها نشان دهنده وضعیت هنر هستند. در یک آزمایش مقایسه، این ابزار بسیار بهتر از مواردی است که قبلا توضیح داده شد. ایرانی می‌گوید: «در مجموع، ما واقعا با اختلاف قابل توجهی از بقیه بهتر عمل کردیم. او اضافه می‌کند که "Mindreading" یک "نام جذاب و جذاب" برای کاری است که آنها انجام می‌دهند.

ایرانی اکنون در حال برنامه‌ریزی است تا فراتر از تصاویر و تصویر و صدا حرکت کند. او می خواهد بتواند آنچه را که مردم در مورد آن فکر می کنند یا تصور می کنند و محتوای رویاهایشان را بازسازی کند. او می گوید: «این چیزی است که ما هنوز نداریم. "اما ما برای رسیدن به آن تلاش می کنیم."

او می‌گوید، چنین ابزاری همچنین ممکن است به افرادی که «بسته» و کاملا فلج هستند، این امکان را بدهد که تنها با استفاده از فعالیت مغز خود ارتباط برقرار کنند. همچنین می‌تواند به دانشمندان کمک کند تا برخی از اسرار پایدار پیرامون عملکرد درونی ذهن ما را باز کنند، مانند اینکه فلاش‌بک‌های PTSD چگونه به نظر می‌رسند.

پیشرفت هایی مانند این ناگزیر سوالاتی را در مورد حریم خصوصی ذهنی ایجاد می کند. اگر یک بازیگر بد بتواند تصویر ذهنی یک فرد را بازسازی کند، افکار او یا چیزی را که دیده است را بازنمایی کند، چه؟

اسپراگ می‌گوید: «اگر 10 سال پیش از من این را می‌پرسیدی، خیلی می‌خندیدم. واداشتن فرد به دراز کشیدن بی حرکت در یک اسکنر و درگیر شدن فعالانه با یک سوال تحقیقاتی به اندازه کافی سخت است، چه رسد به انجام این کار برخلاف میل او. اما ایرانیان و دانشمندان دیگر در حال کار بر روی رویکردهای مشابهی برای رمزگشایی فعالیت مغز از EEG هستند - اقدامات الکتریکی مغز که از طریق کلاهک الکترودها یا حتی از طریق هدفون جمع‌آوری می‌شود.

و با بهبود مدل‌ها، تجزیه و تحلیل فعالیت مغز جمع‌آوری‌شده از این طریق آسان‌تر می‌شود. اسپراگ می گوید: «ما باید در مورد ملاحظات اخلاقی کمی جدی تر باشیم. او فکر می‌کند که رویکرد ایرانی احتمالا در پیش‌بینی تصاویری که شخص به آنها فکر می‌کند اما به آن‌ها نگاه نمی‌کند، «بسیار خوب عمل می‌کند».

مارچلو اینکا، عصب شناس و فیلسوف در دانشگاه فنی مونیخ، آلمان، می گوید که حرکت به سمت EEG یک «تغییر بازی» خواهد بود. هنگامی که یک دستگاه EEG بر روی مغز خود کاربر کالیبره شد، برای شرکت‌ها می‌تواند نسبتا آسان باشد که اطلاعات اضافی را از مغز آن شخص استخراج کنند - به طور بالقوه بدون رضایت آنها. Ienca همچنین می تواند تصور کند که برخی دادگاه ها اجازه بازسازی تصویر ذهنی را به عنوان مدرک قانونی می دهند.

او می‌گوید: «شکی ندارم که این تحقیق با نیت خوبی است، اما فکر می‌کنم کاملا بدیهی است که می‌توان آن را برای ... استفاده‌های تجاری مشکل‌ساز اخلاقی و اجتماعی انتخاب کرد.»

ایرانی احتمال استفاده نادرست از EEG را می پذیرد. اما او در حال حاضر نگران نیست. او می گوید: «من سعی می کنم فقط به چیزهای خوب فکر کنم.

خواندن متن کامل در ام‌آی‌تی تک‌ریویوبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

An AI “mind-reading” tool can reconstruct what you’re looking at based on a brain scan

A new AI tool can guess what you’re looking at just by analyzing your brain scans—and recreate that image with remarkable precision. It can go the other way too, and predict a person’s brain activity based on what they’re looking at.  In the image above, for example, the left-hand image of each pair is what…

همه‌ی اخبار فناوری