مدل جدید DeepSeek یک الگو برای LLM های قدرتمندی که ناب کار می کنند تنظیم می کند
فلش DeepSeek V4.1 ثابت می کند که فقط به این دلیل که یک مدل بزرگتر می سازید به این معنی نیست که برای ارائه آن به پردازنده های گرافیکی بیشتری نیاز دارید.
خواندن متن کامل در دِ رجیستربه زبان اصلی، در سایت ناشر باز میشودمتن اصلی (انگلیسی)
DeepSeek's new model sets a template for powerful LLMs that run lean
DeepSeek V4.1 Flash proves that just because you build a bigger model doesn't mean you need more GPUs to serve it