پرش به محتوای اصلی

مدل جدید DeepSeek یک الگو برای LLM های قدرتمندی که ناب کار می کنند تنظیم می کند

دِ رجیستر۱۴۰۵ شهریور ۲۰, جمعه، ساعت ۱۰:۴۵حدود 1 دقیقه مطالعه

فلش DeepSeek V4.1 ثابت می کند که فقط به این دلیل که یک مدل بزرگتر می سازید به این معنی نیست که برای ارائه آن به پردازنده های گرافیکی بیشتری نیاز دارید.

خواندن متن کامل در دِ رجیستربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

DeepSeek's new model sets a template for powerful LLMs that run lean

DeepSeek V4.1 Flash proves that just because you build a bigger model doesn't mean you need more GPUs to serve it

همه‌ی اخبار فناوری