پرش به محتوای اصلی

کلود هایکو 5.5

هکرنیوز۱۴۰۵ مهر ۱۵, چهارشنبه، ساعت ۲۱:۳۱حدود 2 دقیقه مطالعه

آدرس مقاله: https://www.anthropic.com/claude-haiku-5-5 آدرس نظرات: https://news.ycombinator.com/item?id=49996437 امتیاز: 310 # نظرات: 149

معرفی کلود هایکو 5.5: ارزان ترین، سریع ترین و تواناترین مدل کوچکی که تا به حال عرضه کرده ایم.

Claude Haiku 5.5 برای کارهای با حجم بالا و حساس به هزینه طراحی شده است. این به طور قابل اعتماد بارهای کاری سریع و تکراری (مانند خلاصه ها، فشرده سازی ها، پرس و جوهای پایگاه داده و درخواست های طبقه بندی) را مدیریت می کند. این به خوبی با Opus 5.5 و Sonnet 5.5 به عنوان یک عامل فرعی در کار کدنویسی جفت می شود. و از آنجایی که سریع‌ترین مدل ما تا به امروز است، به ویژه برای کارهای حساس به سرعت مانند پشتیبانی مستقیم مشتری و استفاده از مرورگر خوب عمل می‌کند.¹

هایکو 5.5 با قیمت بسیار پایین تری نسبت به هایکو 4.5 موجود است. به طور متوسط، اکنون حدود 75٪ هزینه کمتری برای اجرا دارد.²

همراه با این راه اندازی، ما در حال بهبود ارزش محدوده مدل خود هستیم. ما در حال نصف کردن قیمت حافظه پنهان کلود سونت 5.5 هستیم، به این معنی که Sonnet 5.5 اکنون در اکثر کارهای نمایندگی حدود 20 درصد ارزان تر است. و ما در حال معرفی یک اعتبار ماهانه API جدید برای مشترکین Claude Max و Team خود هستیم که برای پشتیبانی از کاربران خود در ساخت عوامل و برنامه‌های کاربردی جدید که روی پلتفرم Claude اجرا می‌شوند، طراحی شده است.

در اینجا نحوه عملکرد کلود هایکو 5.5 در طیف وسیعی از معیارها آمده است:

برای جزئیات در مورد نحوه اجرای ارزیابی های خود، به کارت سیستم هایکو 5.5 مراجعه کنید.

هایکو 5.5 اولین مدل کلاس هایکو ما است که با تنظیمات تلاش قابل تنظیم ارائه می شود. این بدان معنی است که مانند سایر مدل‌های ما، کاربران می‌توانند تصمیم بگیرند که آیا برای هزینه یا هوشمندی بهینه‌سازی کنند. نمودارهای زیر نشان می دهد که هایکو 5.5 چگونه در سه معیار در هر تنظیم تلاش عمل می کند:

OSWorld 2.1 اندازه گیری می کند که عوامل چگونه می توانند یک کامپیوتر واقعی را برای انجام کارهای طولانی و چند مرحله ای کار کنند.

GDPval-AA نسخه 2.1 تجزیه و تحلیل مصنوعی، عوامل را در کار حرفه ای دنیای واقعی در 44 شغل ارزیابی می کند.

Humanity’s Last Exam (HLE) آزمونی برای دانش و استدلال علمی در سطح متخصص است.

در آزمایش اولیه، مشتریان ما نتایج منطبق با بهبود عملکرد و هزینه نشان داده شده در بالا را گزارش کردند. در اینجا چیزی است که آنها در مورد مدل جدید به ما گفتند:

ما از Claude Haiku 5.5 بسیار تحت تأثیر قرار گرفتیم، به ویژه سرعت آن. ما آن را از طریق مجموعه ارزیابی خود برای هم تیمی های هوش مصنوعی، محصول عامل هوش مصنوعی خود، پوشش موارد استفاده مانند تریاژ اشکالات، راه اندازی پروژه ها، و جستجوی پورتفولیوهای بزرگ برای ظاهر کردن کارهای پرخطر یا عقب افتاده اجرا کردیم. در مقایسه با مدل کاهشی بیش از یک کار تا 30 درصدی که امروز از آن استفاده می کنیم. استنتاج 2.5 برابر سریعتر در هر نوبت عامل، تجربه بسیار سریعتری است.

خواندن متن کامل در هکرنیوزبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Claude Haiku 5.5

Article URL: https://www.anthropic.com/claude-haiku-5-5 Comments URL: https://news.ycombinator.com/item?id=49996437 Points: 310 # Comments: 149

پوشش همین خبر در رسانه‌های دیگر

مقایسه‌ی پوشش ۲ رسانه ←
همه‌ی اخبار فناوری