علی بابا میخواهد تا سال 2032 ظرفیت مرکز داده را به بیش از 20 گیگاوات افزایش دهد، میگوید تراشه جدید هوش مصنوعی V900 آن میتواند تا دستههای 500000 کارتی گسترش یابد، اما آیا «قویترین تراشه هوش مصنوعی چین» برای جایگزینی پردازندههای گرافیکی Nvidia کافی است؟
علی بابا در مورد جزئیات بیشتر صحبت می کند زیرا قصد دارد هواوی و تراشه های نسل آخر انویدیا را در بازارهای داخلی به چالش بکشد.
T-Head علی بابا از Zhenwu V900 با 216 گیگابایت حافظه، لینک های 1.2 ترابایت بر ثانیه و افزایش 3 برابری ادعایی نسبت به M890 که قبلا عرضه شده بود، رونمایی کرد.
جزئیات بسیار کمی مرتبط با عملکرد خام آن: علیبابا هیچ رقم FLOPS، گره، ریختهگری یا قدرت ارائه نکرد و هر دو مشخصاتی را که به اشتراک گذاشت، پیشبینی میکنند که پس از Ascend 960DT هوآوی، که در همان سهماهه عرضه میشود، خواهد بود.
مدیرعامل ادی وو بیش از 20 گیگاوات از ظرفیت عملیاتی ابری علی بابا را تا سال 2032 هدف قرار داده است در حالی که اذعان داشت کمبود زنجیره تامین رشد شرکت را محدود می کند. علی بابا کنفرانس سالانه آپسارا خود را در هانگژو با سه رقم بزرگ افتتاح کرد: تراشهای که میگوید عملکرد نسل قبلی خود را سه برابر میکند، خوشههای هوش مصنوعی که میتوانند تا 500000 تراشه از این تراشهها گسترش پیدا کنند، و تعهدی که به نقل از ساوت چاینا مورنینگ پست، مبنی بر اینکه مراکز داده Alibaba Cloud با ظرفیت 30 gigatwa در سراسر جهان کار میکنند.
ادی وو، مدیرعامل جدید Zhenwu V900 که توسط واحد تراشه T-Head این گروه طراحی شده است، "قوی ترین تراشه هوش مصنوعی در چین امروز" نامیده است.
این بخشی از آدرسی بود که پیشنهاد علیبابا را بهعنوان یک GPU به جای ASIC متمایز کرد و آن را کاملا در قلمرو Nvidia فرود آورد، حتی در شرایطی که GPU H200 دومی بسیار مورد توجه آزمایشگاههای هوش مصنوعی است.
یک پیشنهاد قدرتمند روی کاغذ، اما پیشنهادی که عملکرد واقعی را منتشر نمی کند
برگه مشخصات Zhenwu V900 ممکن است عمدا کوتاه باشد، حتی با وجود اینکه ارقام عملکرد آن در برابر پردازندههای گرافیکی نسل فعلی Nvidia که یک گزینه ممنوعه است، میتواند علاقه را قبل از عرضه محدود کند.
با این حال، علی بابا مقدار قابل توجهی از حافظه و اتصال متقابل را اضافه کرده است که به آن اجازه می دهد پیکربندی را که ادعا می کند می تواند تا 500000 GPU را به صورت موازی اجرا کند، دسته بندی کند.
V900، طبق گزارش Zhidx، 216 گیگابایت حافظه و 1200 گیگابایت بر ثانیه پهنای باند تراشه به تراشه را فهرست میکند و در ابتدا انتظار میرفت در سه ماهه سوم سال 2027 در دسترس مشتریان قرار گیرد، قبل از اینکه اصلاحات اخیر دو سه ماهه قبل از آن انجام شود.
گائو هوی، نایب رئیس T-Head اکنون می گوید که این شرکت در آینده، آهنگ یک نسل در سال را حفظ خواهد کرد و J900 در سه ماهه سوم سال 2028 به فروش خواهد رسید.
علیرغم جدول زمانی نزدیکتر، جالب است که علیبابا هیچ رقم FLOPS، گره فرآیند، ریختهگری، رتبهبندی توان یا حتی پهنای باند حافظه داخلی V900 منتشر نکرده است، که سنجش قدرتمندترین عرضه تکتراشهاش را از نظر هوش مصنوعی خام و عملکرد محاسباتی دشوار میکند.
این به ویژه در زمانی که رقابت هواوی، Ascend 960DT، که پس از سه چهارم کاهش زودتر در همان سه ماهه عرضه شد، جزئیات بسیار بیشتری را ارائه می دهد، بسیار طعنه آمیز است.
2 پتافلاپ محاسباتی FP8، 288 گیگابایت حافظه، 9.6 ترابایت بر ثانیه پهنای باند حافظه و اتصال 2.2 ترابایت بر ثانیه را فهرست می کند که بر اساس اطلاعاتی که علی بابا قبلا منتشر کرده است، آن را به یک پیشنهاد با VRAM بالاتر و اتصال اتصال بالاتر تبدیل می کند.
رقم 500000 کارت به طرز جالبی ممکن است فقط یک محدودیت مقیاس باشد، نه سیستمی که کسی ساخته است. برای مقیاس، T-Head در می 2026 گفت که در مجموع بیش از 560000 تراشه Zhenwu ارسال کرده است. به عبارت دیگر، یک کلاستر V900 حداکثر به همان تعداد تراشه نیاز دارد که این شرکت در تمام تاریخ خود ارسال کرده است.
با این حال، یک محاسبه ثانویه را وارد معادله میکند: اگر هر V900 همان چیزی را که Nvidia H200 خود را تا 700 وات رتبهبندی میکند، میکشید، شتابدهندهها به تنهایی در چنین خوشهای مقدار قابلتوجهی نیرو خواهند داشت. یک تراشه جدیدتر و بزرگتر میتواند داغتر و پرقدرتتر از تراشههای هاپر انویدیا باشد، حتی با وجود اینکه چین به دلیل تحریمهای آمریکا بر روی تراشهها و تجهیزات ساخت تراشه، محدود به گرههای فرآیند قدیمیتر است.
بدون شک یک خوشه بزرگ از 500000 پردازنده گرافیکی یا مشابه، نیازهای برق را به میزان قابل توجهی برای نیروگاه هوش مصنوعی منطقه ای تامین می کند، و 20 گیگاوات تا سال 2032 یک رویداد غیرقابل پیش بینی نیست، زمانی که در نظر بگیریم که مصرف انرژی هر GPU فقط به سمت آینده قابل پیش بینی پیش می رود، زیرا تراشه ها در همان زمان سریعتر و یکنواخت تر می شوند.
وو گفت که تقاضای میانمدت تا بلندمدت بسیار فراتر از چیزی است که علیبابا میتواند عرضه کند، و کمبود در سراسر زنجیره تامین مرکز داده هوش مصنوعی «در حال حاضر سرعتی را که ما میتوانیم زیرساختهای محاسباتی خود را با آن مقیاسسازی کنیم، محدود میکند». این هدف ظرفیتی را پوشش میدهد که علیبابا کلود عمل میکند، و این شرکت نگفته است که آیا این به معنای بار فناوری اطلاعات است یا کل توان تسهیلات.
یادداشت Nomura منتشر شده توسط سینا، ردپای فعلی علیبابا را تقریبا 4 گیگاوات میداند و انتظار میرود که ساختوسازهای آتی سایتهای دارای مالکیت، اجارهای و سرمایهگذاری شده توسط شخص ثالث را با هم ترکیب کنند که حاکی از رشد پنج برابری در شش سال است.
اینکه آیا V900 آینده، حتی اندکی از تسلط انویدیا بر بازار جهانی خارج میشود، مشخص نیست، چرا که تیم گرین در بازاری که مشتریان هوش مصنوعی سالها قبل پردازندههای گرافیکی خریداری میکنند، بسیار جلوتر است. اما وضعیت در پکن بسیار متفاوت است.
در چین، بسیاری از اختلالات قبلا رخ داده است و آزمایشگاههای هوش مصنوعی چینی «متقاعد» شدهاند تا از راهحلهای انویدیا توسط دولت دور بمانند. آخرین 10-Q انویدیا می گوید که محموله های محصولات مرکز داده هاپر به چین کمتر از 1 درصد از درآمد 89 میلیارد دلاری آن از مرکز داده برای سه ماهه منتهی به 26 ژوئیه بوده است، و این شرکت در گزارش درآمد خود اعلام کرد که مخالفت ها در پکن مانع از آن شده است که حجم کامل H200 هایی را که واشنگتن مجوز داده بود، به فروش برساند.
آزمایشگاههای چینی به ترکیبی از راهحلهای داخلی، از جمله ASIC، پردازندههای گرافیکی، و پردازندههای مرکزی خاص روی آوردهاند که به بازیکنان محلی مانند علیبابا، هواوی و دیگران اجازه میدهد در بازاری عاری از رقابت خارجی پیشرفت کنند.
با توجه به اینکه دولت ایالات متحده محدودیت های قدرت انویدیا را محدود کرده است و دولت چین نگاهی ضعیف به آزمایشگاه های محلی بسته به تراشه های خارجی دارد، GPU V900 علی بابا نیازی به غلبه بر پردازنده های گرافیکی Rubin انویدیا یا حتی پیشنهادات Blackwell آن ندارد. این به سادگی نیاز دارد تا جایگزین مناسبی برای یک GPU که دو نسل قدیمیتر است را بپذیرد: H200 (بر اساس معماری هاپر انویدیا).
چالشهای بزرگتر آن، تولید داخلی Ascend 960DT هوآوی و تراشههای پیکربندی مشابه از شرکتهای طراحی تراشههای محلی آتی و همچنین محدودیتهای زنجیره تامین است که میتواند تولید کلی را محدود کند و بهطور پروکسی، استقرار شرکتی را که میخواهد میلیاردها دلار در زیرساختهای هوش مصنوعی در روزهای آینده هزینه کند، حتی اگر وضعیت «قویترین» آن، که در زمان عرضهاش در حال حاضر منتشر شده است، محدود کند.
متن اصلی (انگلیسی)
Alibaba wants to expand data center capacity past 20 GW by 2032, says its new V900 AI chip can scale to 500,000-card clusters, but will 'China's most powerful AI chip' be enough to displace Nvidia GPUs?
Alibaba remains tight-lipped about the details as it aims to challenge Huawei and last-generation Nvidia chips in domestic markets.