پرش به محتوای اصلی

علی بابا می‌خواهد تا سال 2032 ظرفیت مرکز داده را به بیش از 20 گیگاوات افزایش دهد، می‌گوید تراشه جدید هوش مصنوعی V900 آن می‌تواند تا دسته‌های 500000 کارتی گسترش یابد، اما آیا «قوی‌ترین تراشه هوش مصنوعی چین» برای جایگزینی پردازنده‌های گرافیکی Nvidia کافی است؟

تک‌رادار۱۴۰۵ مهر ۳, جمعه، ساعت ۲۲:۴۰حدود 5 دقیقه مطالعه

علی بابا در مورد جزئیات بیشتر صحبت می کند زیرا قصد دارد هواوی و تراشه های نسل آخر انویدیا را در بازارهای داخلی به چالش بکشد.

T-Head علی بابا از Zhenwu V900 با 216 گیگابایت حافظه، لینک های 1.2 ترابایت بر ثانیه و افزایش 3 برابری ادعایی نسبت به M890 که قبلا عرضه شده بود، رونمایی کرد.

جزئیات بسیار کمی مرتبط با عملکرد خام آن: علی‌بابا هیچ رقم FLOPS، گره، ریخته‌گری یا قدرت ارائه نکرد و هر دو مشخصاتی را که به اشتراک گذاشت، پیش‌بینی می‌کنند که پس از Ascend 960DT هوآوی، که در همان سه‌ماهه عرضه می‌شود، خواهد بود.

مدیرعامل ادی وو بیش از 20 گیگاوات از ظرفیت عملیاتی ابری علی بابا را تا سال 2032 هدف قرار داده است در حالی که اذعان داشت کمبود زنجیره تامین رشد شرکت را محدود می کند. علی بابا کنفرانس سالانه آپسارا خود را در هانگژو با سه رقم بزرگ افتتاح کرد: تراشه‌ای که می‌گوید عملکرد نسل قبلی خود را سه برابر می‌کند، خوشه‌های هوش مصنوعی که می‌توانند تا 500000 تراشه از این تراشه‌ها گسترش پیدا کنند، و تعهدی که به نقل از ساوت چاینا مورنینگ پست، مبنی بر اینکه مراکز داده Alibaba Cloud با ظرفیت 30 gigatwa در سراسر جهان کار می‌کنند.

ادی وو، مدیرعامل جدید Zhenwu V900 که توسط واحد تراشه T-Head این گروه طراحی شده است، "قوی ترین تراشه هوش مصنوعی در چین امروز" نامیده است.

این بخشی از آدرسی بود که پیشنهاد علی‌بابا را به‌عنوان یک GPU به جای ASIC متمایز کرد و آن را کاملا در قلمرو Nvidia فرود آورد، حتی در شرایطی که GPU H200 دومی بسیار مورد توجه آزمایشگاه‌های هوش مصنوعی است.

یک پیشنهاد قدرتمند روی کاغذ، اما پیشنهادی که عملکرد واقعی را منتشر نمی کند

برگه مشخصات Zhenwu V900 ممکن است عمدا کوتاه باشد، حتی با وجود اینکه ارقام عملکرد آن در برابر پردازنده‌های گرافیکی نسل فعلی Nvidia که یک گزینه ممنوعه است، می‌تواند علاقه را قبل از عرضه محدود کند.

با این حال، علی بابا مقدار قابل توجهی از حافظه و اتصال متقابل را اضافه کرده است که به آن اجازه می دهد پیکربندی را که ادعا می کند می تواند تا 500000 GPU را به صورت موازی اجرا کند، دسته بندی کند.

V900، طبق گزارش Zhidx، 216 گیگابایت حافظه و 1200 گیگابایت بر ثانیه پهنای باند تراشه به تراشه را فهرست می‌کند و در ابتدا انتظار می‌رفت در سه ماهه سوم سال 2027 در دسترس مشتریان قرار گیرد، قبل از اینکه اصلاحات اخیر دو سه ماهه قبل از آن انجام شود.

گائو هوی، نایب رئیس T-Head اکنون می گوید که این شرکت در آینده، آهنگ یک نسل در سال را حفظ خواهد کرد و J900 در سه ماهه سوم سال 2028 به فروش خواهد رسید.

علی‌رغم جدول زمانی نزدیک‌تر، جالب است که علی‌بابا هیچ رقم FLOPS، گره فرآیند، ریخته‌گری، رتبه‌بندی توان یا حتی پهنای باند حافظه داخلی V900 منتشر نکرده است، که سنجش قدرتمندترین عرضه تک‌تراشه‌اش را از نظر هوش مصنوعی خام و عملکرد محاسباتی دشوار می‌کند.

این به ویژه در زمانی که رقابت هواوی، Ascend 960DT، که پس از سه چهارم کاهش زودتر در همان سه ماهه عرضه شد، جزئیات بسیار بیشتری را ارائه می دهد، بسیار طعنه آمیز است.

2 پتافلاپ محاسباتی FP8، 288 گیگابایت حافظه، 9.6 ترابایت بر ثانیه پهنای باند حافظه و اتصال 2.2 ترابایت بر ثانیه را فهرست می کند که بر اساس اطلاعاتی که علی بابا قبلا منتشر کرده است، آن را به یک پیشنهاد با VRAM بالاتر و اتصال اتصال بالاتر تبدیل می کند.

رقم 500000 کارت به طرز جالبی ممکن است فقط یک محدودیت مقیاس باشد، نه سیستمی که کسی ساخته است. برای مقیاس، T-Head در می 2026 گفت که در مجموع بیش از 560000 تراشه Zhenwu ارسال کرده است. به عبارت دیگر، یک کلاستر V900 حداکثر به همان تعداد تراشه نیاز دارد که این شرکت در تمام تاریخ خود ارسال کرده است.

با این حال، یک محاسبه ثانویه را وارد معادله می‌کند: اگر هر V900 همان چیزی را که Nvidia H200 خود را تا 700 وات رتبه‌بندی می‌کند، می‌کشید، شتاب‌دهنده‌ها به تنهایی در چنین خوشه‌ای مقدار قابل‌توجهی نیرو خواهند داشت. یک تراشه جدیدتر و بزرگ‌تر می‌تواند داغ‌تر و پرقدرت‌تر از تراشه‌های هاپر انویدیا باشد، حتی با وجود اینکه چین به دلیل تحریم‌های آمریکا بر روی تراشه‌ها و تجهیزات ساخت تراشه، محدود به گره‌های فرآیند قدیمی‌تر است.

بدون شک یک خوشه بزرگ از 500000 پردازنده گرافیکی یا مشابه، نیازهای برق را به میزان قابل توجهی برای نیروگاه هوش مصنوعی منطقه ای تامین می کند، و 20 گیگاوات تا سال 2032 یک رویداد غیرقابل پیش بینی نیست، زمانی که در نظر بگیریم که مصرف انرژی هر GPU فقط به سمت آینده قابل پیش بینی پیش می رود، زیرا تراشه ها در همان زمان سریعتر و یکنواخت تر می شوند.

وو گفت که تقاضای میان‌مدت تا بلندمدت بسیار فراتر از چیزی است که علی‌بابا می‌تواند عرضه کند، و کمبود در سراسر زنجیره تامین مرکز داده هوش مصنوعی «در حال حاضر سرعتی را که ما می‌توانیم زیرساخت‌های محاسباتی خود را با آن مقیاس‌سازی کنیم، محدود می‌کند». این هدف ظرفیتی را پوشش می‌دهد که علی‌بابا کلود عمل می‌کند، و این شرکت نگفته است که آیا این به معنای بار فناوری اطلاعات است یا کل توان تسهیلات.

یادداشت Nomura منتشر شده توسط سینا، ردپای فعلی علی‌بابا را تقریبا 4 گیگاوات می‌داند و انتظار می‌رود که ساخت‌وسازهای آتی سایت‌های دارای مالکیت، اجاره‌ای و سرمایه‌گذاری شده توسط شخص ثالث را با هم ترکیب کنند که حاکی از رشد پنج برابری در شش سال است.

اینکه آیا V900 آینده، حتی اندکی از تسلط انویدیا بر بازار جهانی خارج می‌شود، مشخص نیست، چرا که تیم گرین در بازاری که مشتریان هوش مصنوعی سال‌ها قبل پردازنده‌های گرافیکی خریداری می‌کنند، بسیار جلوتر است. اما وضعیت در پکن بسیار متفاوت است.

در چین، بسیاری از اختلالات قبلا رخ داده است و آزمایشگاه‌های هوش مصنوعی چینی «متقاعد» شده‌اند تا از راه‌حل‌های انویدیا توسط دولت دور بمانند. آخرین 10-Q انویدیا می گوید که محموله های محصولات مرکز داده هاپر به چین کمتر از 1 درصد از درآمد 89 میلیارد دلاری آن از مرکز داده برای سه ماهه منتهی به 26 ژوئیه بوده است، و این شرکت در گزارش درآمد خود اعلام کرد که مخالفت ها در پکن مانع از آن شده است که حجم کامل H200 هایی را که واشنگتن مجوز داده بود، به فروش برساند.

آزمایشگاه‌های چینی به ترکیبی از راه‌حل‌های داخلی، از جمله ASIC، پردازنده‌های گرافیکی، و پردازنده‌های مرکزی خاص روی آورده‌اند که به بازیکنان محلی مانند علی‌بابا، هواوی و دیگران اجازه می‌دهد در بازاری عاری از رقابت خارجی پیشرفت کنند.

با توجه به اینکه دولت ایالات متحده محدودیت های قدرت انویدیا را محدود کرده است و دولت چین نگاهی ضعیف به آزمایشگاه های محلی بسته به تراشه های خارجی دارد، GPU V900 علی بابا نیازی به غلبه بر پردازنده های گرافیکی Rubin انویدیا یا حتی پیشنهادات Blackwell آن ندارد. این به سادگی نیاز دارد تا جایگزین مناسبی برای یک GPU که دو نسل قدیمی‌تر است را بپذیرد: H200 (بر اساس معماری هاپر انویدیا).

چالش‌های بزرگ‌تر آن، تولید داخلی Ascend 960DT هوآوی و تراشه‌های پیکربندی مشابه از شرکت‌های طراحی تراشه‌های محلی آتی و همچنین محدودیت‌های زنجیره تامین است که می‌تواند تولید کلی را محدود کند و به‌طور پروکسی، استقرار شرکتی را که می‌خواهد میلیاردها دلار در زیرساخت‌های هوش مصنوعی در روزهای آینده هزینه کند، حتی اگر وضعیت «قوی‌ترین» آن، که در زمان عرضه‌اش در حال حاضر منتشر شده است، محدود کند.

خواندن متن کامل در تک‌راداربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Alibaba wants to expand data center capacity past 20 GW by 2032, says its new V900 AI chip can scale to 500,000-card clusters, but will 'China's most powerful AI chip' be enough to displace Nvidia GPUs?

Alibaba remains tight-lipped about the details as it aims to challenge Huawei and last-generation Nvidia chips in domestic markets.

همه‌ی اخبار فناوری