پرش به محتوای اصلی

جادوی هوش مصنوعی؛ جدا کردن سازهای مختلف از یک آهنگ تنها در ۴۰ ثانیه

زومیت۱۴۰۵ مهر ۱۵, چهارشنبه، ساعت ۰۶:۰۰حدود 3 دقیقه مطالعه

نرم‌افزار AudioPrism آهنگ‌ها را در ۴۰ ثانیه به ترک‌های جداگانه تقسیم می‌کند.

نرم‌افزار AudioPrism آهنگ‌ها را در ۴۰ ثانیه به ترک‌های جداگانه تقسیم می‌کند.

AudioPrism نرم‌افزاری برای ویندوز است که می‌تواند یک آهنگ کامل را روی کامپیوتر شخصی به بخش‌های جداگانه مثل وکال، بیس، درام و سایر سازها تقسیم کند. این برنامه ۷۹٫۹۹ دلار قیمت دارد و در حال حاضر با تخفیف ۵۹٫۹۹ دلار فروخته می‌شود. AudioPrism همچنین می‌تواند بخش‌های جداشده را به فایل MIDI تبدیل کند و با استفاده از مربی آموزشی KeyPrism، به کاربر در یادگیری موسیقی کمک کند.

جدا کردن سازها و صدای خواننده از یک آهنگ موضوع تازه‌ای نیست، اما پیشرفت هوش مصنوعی و یادگیری ماشین این کار را بسیار ساده‌تر کرده است. ابزارهایی مانند Spleeter از دیزر و Demucs از متا نیز در سال‌های اخیر امکان جداسازی بخش‌های مختلف آهنگ را برای کاربران فراهم کرده‌اند.

AudioPrism در آزمایش‌ها عملکرد متفاوتی داشت. برای آزمایش اول، آهنگ Dreams از فلیت‌وود مک انتخاب شد؛ قطعه‌ای استودیویی با کیفیت بالا که صدای بیس در آن به‌خوبی از سایر سازها قابل تشخیص است. AudioPrism توانست این آهنگ را روی کارت گرافیک RTX 5070 Ti در کمتر از ۴۰ ثانیه به چهار بخش جدا تقسیم کند.

نتیجه‌ی جداسازی بیس بسیار خوب بود. وقتی چهار بخش جداشده دوباره در نرم‌افزار Audacity با یکدیگر ترکیب شدند، تفاوت محسوسی با نسخه‌ی اصلی آهنگ وجود نداشت.

آزمایش دوم سخت‌تر بود. این بار تیم بررسی سراغ اجرای زنده‌ی Red Rain از پیتر گابریل در آلبوم Secret World Live رفت؛ قطعه‌ای که به‌دلیل صدای هم‌زمان سازهای مختلف، انعکاس صدا و فضای اجرای زنده، جداسازی بخش‌های آن دشوارتر است.

AudioPrism در این آزمایش هم توانست بیس را جدا کند، اما کیفیت آن به‌اندازه‌ی آزمایش اول نبود. صدای بیس مقداری نویز و اعوجاج داشت و گاهی حالت تیز و ناخوشایندی پیدا می‌کرد. بااین‌حال، نتیجه همچنان برای استفاده‌ی معمول قابل قبول بود.

مشکل اصلی AudioPrism زمانی مشخص می‌شود که بخواهید بعد از جداسازی، روی بخش‌های مختلف آهنگ کار کنید. با وجود اینکه برنامه می‌تواند استم‌های جداگانه تولید کند، میکسر داخلی ندارد. یعنی نمی‌توانید مستقیماً داخل برنامه صدای بیس را کم کنید یا یک ساز را به‌تنهایی بشنوید. برای این کار باید فایل‌های جداشده را به نرم‌افزار دیگری مانند Audacity منتقل کنید.

نمی‌توان مستقیما از خود برنامه صدای بیس را کم کرد یا یک ساز را به‌تنهایی شنید

ابزار رایگان و متن‌بازی مانند StemKit همین قابلیت را به شکل کامل‌تری ارائه می‌دهد. StemKit می‌تواند بخش‌های مختلف آهنگ را با استفاده از کارت گرافیک جدا کند و یک میکسر داخلی هم دارد که به کاربر اجازه می‌دهد صدای هر بخش را کم‌وزیاد، قطع یا به‌صورت جداگانه پخش کند.

بخش تبدیل صدا به MIDI نیز چندان موفق نبود. AudioPrism هنگام تبدیل صدای بیس تمیز آهنگ Dreams به MIDI، نتایج نامنظمی تولید کرد. پخش نت‌ها در KeyPrism نیز چند بار با لگ و اختلال همراه شد.

رابط کاربری برنامه هم چندان ساده و آرام نیست. پس‌زمینه‌ی متحرک، افکت‌های درخشان، ردپای نشانگر ماوس و گرافیک‌های متحرک زیادی روی صفحه دیده می‌شود که می‌توانند حواس کاربر را پرت کنند. ظاهراً گزینه‌ای برای خاموش کردن این جلوه‌ها نیز وجود ندارد.

AudioPrism در بازاری وارد شده که رقبای قدرتمندی دارد. Ultimate Vocal Remover یک ابزار رایگان و متن‌باز است که از مدل‌هایی مانند Demucs و MDX-Net برای جدا کردن بخش‌های مختلف آهنگ استفاده می‌کند.

Moises نیز امکانات بیشتری برای کار با آهنگ‌های جداشده ارائه می‌دهد. این سرویس پس از جداسازی سازها و وکال، آن‌ها را داخل یک میکسر قرار می‌دهد تا کاربر بتواند هر بخش را جداگانه تنظیم، قطع یا پخش کند. البته پردازش Moises به فضای ابری وابسته است.

پردازش روی خود کامپیوتر نیز دیگر مزیت منحصربه‌فرد AudioPrism نیست. مدل Lyra از LALAL.AI می‌تواند جداسازی سازها را مستقیماً روی دستگاه انجام دهد و از طریق اپلیکیشن دسکتاپ و پلاگین VST در دسترس است. البته استفاده از پردازش محلی در این سرویس به اشتراک ماهانه‌ی ۱۹٫۹۹ دلاری Pro نیاز دارد.

خواندن متن کامل در زومیتبه زبان اصلی، در سایت ناشر باز می‌شودهمه‌ی اخبار فناوری