پرش به محتوای اصلی

AWS مهار عامل منبع باز را به هم متصل می کند و می گوید که نسبت به رقبا توکن های کمتری مصرف می کند

دِ رجیستر۱۴۰۵ شهریور ۳۰, دوشنبه، ساعت ۱۹:۳۰حدود 3 دقیقه مطالعه

Strands ادعا می کند که تقریبا با Claude Code و Codex در معیارها برابری می کند، اگرچه فقط با عوامل برنامه نویسی مسابقه داد و تکالیف خود را مشخص کرد.

AWS وارد بازی منبع باز مبتنی بر هوش مصنوعی شده است و ادعا می کند که Strands جدید آن با رقبای خود در معیارها مطابقت دارد و در عین حال از یک چهارم توکن کمتر استفاده می کند. مهار Strands، همانطور که از نامش پیداست، بر روی Strands Harness SDK AWS ساخته شده است، اما بسته‌بندی شده و آماده است تا از جعبه خارج شود، چه به صورت محلی و چه برای کار با هر ارائه‌دهنده هوش مصنوعی که مشتری ترجیح می‌دهد. AWS در اعلامیه خود خاطرنشان کرد: لحظه ای که نماینده خود را می سازید، تنها هستید.

سیم‌کشی اولیه‌های درست به اندازه کافی برای تطابق با احساس «فقط کار کرد» مشکل است.» AWS اضافه می‌کند که این گزینه منبع باز جدید به این معنی است که «تمام چیزی که نیاز دارید یک خط پایتون یا TypeScript است تا آن را با مدل انتخابی خود کار کنید.» علاوه بر اینکه در طراحی نسبتا plug-and-play است، AWS ادعا می‌کند که مهار Strands به «نمرات معیار تقریبا برابر» در مقابل Claude Code، Codex و «سایر چارچوب‌ها بدون استفاده از هارنس‌های محبوب، دست یافته است». سرورهای مجازی EC2 خود AWS برای تست های محک.

طبق ادعای AWS، Strands 28 درصد توکن کمتری را در شش تست معیار در مقایسه با مدل‌های Claude یا GPT مصرف کرد و در برخی موارد دقت بهتری نسبت به سایر مهارها داشت. AWS اذعان می‌کند که مهار DeepSeek کارآمدتر بود، اما - به ما گفته می‌شود - در آزمایش‌های مشابه دقت کمتری داشت. AWS این عملکرد را به تنظیمات پیش‌فرض ذخیره‌سازی سریع و مدیریت زمینه Strands می‌رساند.

طبق پست اعلامیه، به‌طور پیش‌فرض، نتایج ابزار بیش از 1500 توکن را کوتاه می‌کند، زمانی که از 85 درصد فراتر رفت، به‌طور خودکار پنجره زمینه خود را فشرده می‌کند، و به‌طور خودکار سعی می‌کند در موارد سرریز، زمینه را بازیابی کند. با این حال، شایان ذکر است که AWS مهار Strands را به‌عنوان یک عامل همه منظوره به جای یک عامل کدنویس توصیف می‌کند. با توجه به اینکه هر دسته عاملی که در معیارهای AWS با آن مقایسه شده است (Claude Code، Codex، oh-my-pi، OpenCode، و DeepSeek Harness) به عنوان یک عامل کدنویسی صورت‌حساب می‌شود، جای سوال دارد که سایر عوامل هوش مصنوعی چگونه کار می‌کنند.

d در مقایسه با مهار Strands جدید کارایی دارد. آمازون قصد دارد مقاله ای از محققان خود را با جزئیات معیار بیشتری منتشر کند - ما برای دیدن جزئیات بیشتر در مورد نحوه ارزیابی آن، چشمان خود را زیر نظر خواهیم داشت. در همین حال، هر کسی که می‌خواهد از پیش بسته‌بندی‌شده، منبع باز و مهار رشته‌های همه منظوره استفاده کند، می‌تواند با استفاده از دستورالعمل‌های موجود در پست اعلامیه این کار را انجام دهد. این به عنوان کتابخانه Python یا TypeScript در دسترس است و همچنین دارای CLI است.

و با یک فایل مهارت ارسال می شود، بنابراین اتصال ابزارهای دلخواه شما نسبتا آسان است. ابزارهای پوسته، فایل و وب در زمان راه اندازی گنجانده شده است. AWS در مورد طراحی مهار Strands می‌گوید: «ما معتقدیم که نمونه‌سازی سریع با باتری‌هایی که دارای مهار هستند، عوامل مفیدتری ایجاد می‌کند. اکنون فعال است، بنابراین اگر به‌دنبال گزینه منبع باز دیگری هستید، زمانی که آماده باشید آماده است، حتی اگر سنج مستقل‌تری از عملکرد آن در حال حاضر وجود نداشته باشد. ®

خواندن متن کامل در دِ رجیستربه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

AWS bolts together open source agent harness, says it sips fewer tokens than rivals

Strands claims near-parity with Claude Code and Codex on benchmarks, though it only raced coding agents and marked its own homework

همه‌ی اخبار فناوری