معیارها نشان میدهند که تراشه Jalapeño OpenAI برای استنتاج سریع در مقیاس ساخته شده است
Jalapeño که روی معیار InferenceX Semianalysis آزمایش شد، توکنهای بیشتری را به ازای هر کاربر ثبت کرد و توان عملیاتی بیشتری را در هر کیلووات نسبت به آخرین موجود در حال حاضر ثبت کرد.
خواندن متن کامل در تککرانچبه زبان اصلی، در سایت ناشر باز میشودمتن اصلی (انگلیسی)
OpenAI’s Jalapeño chip is built for fast inference at scale, benchmarks show
Tested on Semianalysis’s InferenceX benchmark, Jalapeño registered both more tokens per user and more throughput per kilowatt than the currently available state-of-the art.