مسابقه هوش مصنوعی فقط ناخوشایند شد
آدرس مقاله: https://insufferable.dev/posts/the-ai-race-just-got-awkward/ آدرس نظرات: https://news.ycombinator.com/item?id=49910553 امتیاز: 311 # نظرات: 282
اگر این روزها عناوین اخبار را بخوانید، فکر می کنید که آزمایشگاه های غربی به طور انبوه توسط آزمایشگاه های چینی کمپ می شوند، بخشیده می شوید.
هفته ای نمی گذرد که آنتروپیک مقاله دیگری در مورد چگونگی تقطیر مدل های چینی ها، تبدیل شدن به یک خطر برای خود بشریت و غیره منتشر نکند.
گفتن این موضوع برای آنها مفید است زیرا زمینه را فراهم می کند تا این مدل ها بعدا از نظر قانونی و نظارتی محدود شوند.
اما واضح است که روزهای تقطیر بیمعنایی به پایان رسیده است.
نه فقط به پایان رسید. بازی جدید در شهر از پیشرفت های آزمایشگاه های چینی استفاده می کند. توجه داشته باشید که من چگونه این پذیرش را به جای "دزدی" که آنتروپیک تمایل دارد از آن استفاده کند، حاوی شیشه است.
این به این دلیل است که برخلاف شرکت های غربی، چینی ها تقریبا دستور العمل های خود را ارائه می دهند.
آخرین موردی که با بی شرمی و بدون تایید کپی شده است، پیشرفت در بهینه سازی کش KV است که DeepSeek سخاوتمندانه با جهان به اشتراک گذاشته است.
این یک بهینهسازی شگفتانگیز است که اساسا ردپای حافظه پنهان KV را برای موارد استفاده خاصی که از یک زمینه جلسه طولانی مانند کدنویسی استفاده میکنند، تقریبا 437 برابر در مقایسه با DeepSeek-V1 کاهش داد.
آنها اولین کسانی بودند که معماری MLA را منتشر کردند که کش را تقریبا 15 برابر فشرده کرد و سپس آن را با "توجه پراکنده فشرده" و "توجه فشرده فشرده" دنبال کرد. آخرین DeepSeek-V4.1-Flash آن را با CSA2، حافظه نهان متقاطع، استفاده مجدد از حافظه نهان متقاطع، یک معماری cachder-Cusal، و یک معماری causal-Cusal، به ارمغان می آورد. حافظه پنهان KV به 890 بایت در هر توکن کاهش می یابد.
چرا این چیزها اهمیت دارد؟ زیرا برای ارائه مدل های با زمینه طولانی، یکی از بزرگترین هزینه ها، VRAM مورد نیاز برای نگهداری این کش در حافظه GPU است.
در زیر نمودار نشان می دهد که چقدر این کل دیوانه کننده است:
آن را با هزینهای که همان ردیف تقریبا دو ماه پیش داشت مقایسه کنید. تمام قیمت های زیر به ازای 1 میلیون توکن است:
همه اینها باید به این معنی باشد که شرکتهای غربی هوش مصنوعی اکنون بسیار مثبت هستند.
محدودیتهای دسترسی به پردازندههای گرافیکی پیشرفته، آزمایشگاههای چینی را مجبور کرد تا بهینهسازی عملکرد را به عنوان یک هدف شماره یک قرار دهند و این در نتایج نشان داده میشود.
حالا نمیدانم چرا آنها آزادانه چنین پیشرفتی را ارائه میکنند، اما این کار را انجام دادند، و برای یک بار هم که Anthropic و OpenAI مدلهایی را منتشر کردند که اساسا سطح بالایی هستند و از این بهینهسازیها استفاده میکنند.
به نظر می رسد آنها از کپی کردن کمی خجالت می کشند. از این رو، نسخههای بیصدا و بدون پیشاعلام زیادی برای Claude Opus 5.5 و GPT-6.1 Sol منتشر میشوند.
نظرات کاربران فوق العاده بوده است. استفاده، و به نظر می رسد کیفیت در مقایسه با مدل های پرچمدار آنها (Claude Fable 5.1 و GPT-6 Astra) چندان دور از دسترس نباشد.
هزینههای خواندن حافظه پنهان گواهی بر پذیرش است. آنها به شدت کاهش یافتند: Opus 5.5 قیمت کش خواندن را 60٪ در مقابل Opus 5 کاهش داد، در حالی که GPT-6.1 Sol آن را 80٪ در مقابل قیمت GPT-5.6 Sol در اواخر ژوئیه کاهش داد.
بنابراین آزمایشگاههای چینی راه نجاتی برای آزمایشگاههای زیانده غربی انداختهاند، و من نمیدانم چرا.
متن اصلی (انگلیسی)
The AI Race Just Got Awkward
Article URL: https://insufferable.dev/posts/the-ai-race-just-got-awkward/ Comments URL: https://news.ycombinator.com/item?id=49910553 Points: 311 # Comments: 282