پرش به محتوای اصلی

مسابقه هوش مصنوعی فقط ناخوشایند شد

هکرنیوز۱۴۰۵ مهر ۸, چهارشنبه، ساعت ۱۹:۲۰حدود 3 دقیقه مطالعه

آدرس مقاله: https://insufferable.dev/posts/the-ai-race-just-got-awkward/ آدرس نظرات: https://news.ycombinator.com/item?id=49910553 امتیاز: 311 # نظرات: 282

اگر این روزها عناوین اخبار را بخوانید، فکر می کنید که آزمایشگاه های غربی به طور انبوه توسط آزمایشگاه های چینی کمپ می شوند، بخشیده می شوید.

هفته ای نمی گذرد که آنتروپیک مقاله دیگری در مورد چگونگی تقطیر مدل های چینی ها، تبدیل شدن به یک خطر برای خود بشریت و غیره منتشر نکند.

گفتن این موضوع برای آنها مفید است زیرا زمینه را فراهم می کند تا این مدل ها بعدا از نظر قانونی و نظارتی محدود شوند.

اما واضح است که روزهای تقطیر بی‌معنایی به پایان رسیده است.

نه فقط به پایان رسید. بازی جدید در شهر از پیشرفت های آزمایشگاه های چینی استفاده می کند. توجه داشته باشید که من چگونه این پذیرش را به جای "دزدی" که آنتروپیک تمایل دارد از آن استفاده کند، حاوی شیشه است.

این به این دلیل است که برخلاف شرکت های غربی، چینی ها تقریبا دستور العمل های خود را ارائه می دهند.

آخرین موردی که با بی شرمی و بدون تایید کپی شده است، پیشرفت در بهینه سازی کش KV است که DeepSeek سخاوتمندانه با جهان به اشتراک گذاشته است.

این یک بهینه‌سازی شگفت‌انگیز است که اساسا ردپای حافظه پنهان KV را برای موارد استفاده خاصی که از یک زمینه جلسه طولانی مانند کدنویسی استفاده می‌کنند، تقریبا 437 برابر در مقایسه با DeepSeek-V1 کاهش داد.

آنها اولین کسانی بودند که معماری MLA را منتشر کردند که کش را تقریبا 15 برابر فشرده کرد و سپس آن را با "توجه پراکنده فشرده" و "توجه فشرده فشرده" دنبال کرد. آخرین DeepSeek-V4.1-Flash آن را با CSA2، حافظه نهان متقاطع، استفاده مجدد از حافظه نهان متقاطع، یک معماری cachder-Cusal، و یک معماری causal-Cusal، به ارمغان می آورد. حافظه پنهان KV به 890 بایت در هر توکن کاهش می یابد.

چرا این چیزها اهمیت دارد؟ زیرا برای ارائه مدل های با زمینه طولانی، یکی از بزرگترین هزینه ها، VRAM مورد نیاز برای نگهداری این کش در حافظه GPU است.

در زیر نمودار نشان می دهد که چقدر این کل دیوانه کننده است:

آن را با هزینه‌ای که همان ردیف تقریبا دو ماه پیش داشت مقایسه کنید. تمام قیمت های زیر به ازای 1 میلیون توکن است:

همه اینها باید به این معنی باشد که شرکت‌های غربی هوش مصنوعی اکنون بسیار مثبت هستند.

محدودیت‌های دسترسی به پردازنده‌های گرافیکی پیشرفته، آزمایشگاه‌های چینی را مجبور کرد تا بهینه‌سازی عملکرد را به عنوان یک هدف شماره یک قرار دهند و این در نتایج نشان داده می‌شود.

حالا نمی‌دانم چرا آن‌ها آزادانه چنین پیشرفتی را ارائه می‌کنند، اما این کار را انجام دادند، و برای یک بار هم که Anthropic و OpenAI مدل‌هایی را منتشر کردند که اساسا سطح بالایی هستند و از این بهینه‌سازی‌ها استفاده می‌کنند.

به نظر می رسد آنها از کپی کردن کمی خجالت می کشند. از این رو، نسخه‌های بی‌صدا و بدون پیش‌اعلام زیادی برای Claude Opus 5.5 و GPT-6.1 Sol منتشر می‌شوند.

نظرات کاربران فوق العاده بوده است. استفاده، و به نظر می رسد کیفیت در مقایسه با مدل های پرچمدار آنها (Claude Fable 5.1 و GPT-6 Astra) چندان دور از دسترس نباشد.

هزینه‌های خواندن حافظه پنهان گواهی بر پذیرش است. آنها به شدت کاهش یافتند: Opus 5.5 قیمت کش خواندن را 60٪ در مقابل Opus 5 کاهش داد، در حالی که GPT-6.1 Sol آن را 80٪ در مقابل قیمت GPT-5.6 Sol در اواخر ژوئیه کاهش داد.

بنابراین آزمایشگاه‌های چینی راه نجاتی برای آزمایشگاه‌های زیان‌ده غربی انداخته‌اند، و من نمی‌دانم چرا.

خواندن متن کامل در هکرنیوزبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

The AI Race Just Got Awkward

Article URL: https://insufferable.dev/posts/the-ai-race-just-got-awkward/ Comments URL: https://news.ycombinator.com/item?id=49910553 Points: 311 # Comments: 282

همه‌ی اخبار فناوری