پرش به محتوای اصلی

تحریک کلود اپوس 5.5

هکرنیوز۱۴۰۵ مهر ۶, دوشنبه، ساعت ۱۱:۰۳حدود 11 دقیقه مطالعه

آدرس مقاله: https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5 آدرس نظرات: https://news.ycombinator.com/item?id=49874728 امتیاز: 154 # نظرات: 15

این راهنما الگوهای درخواستی خاص Claude Opus 5.5 را پوشش می دهد. برای اطلاع از قابلیت‌های مدل و تغییرات API، به موارد جدید در Claude Opus 5.5 مراجعه کنید. برای تکنیک‌هایی که در همه مدل‌های فعلی کلود اعمال می‌شوند، به پیشنهاد بهترین شیوه‌ها مراجعه کنید.

Claude Opus 5.5 توکن های خروجی را بیش از 30 درصد سریعتر از Claude Opus 5 تولید می کند و تمایل دارد همان کار را با توکن های کمتر به پایان برساند. درخواست‌های موجود Claude Opus 5 باید بدون تغییر عملکرد خوبی داشته باشند، و الگوهای Prompting Claude Opus 5 نقطه شروع معقولی باقی می‌مانند. با بخشی شروع کنید که با آنچه مشاهده می کنید مطابقت دارد:

قابلیت هایی که بیشترین اهمیت را برای ترغیب دارند عبارتند از:

تلاش کنترل اصلی برای میزان فکر کردن Claude Opus 5.5 است، و از آنجایی که تفکر همیشه روشن است، اولین تنظیمی است که هنگام معامله با هوش، تأخیر و هزینه تنظیم می شود. از متوسط ​​شروع کنید، پیش‌فرض Claude Opus 5.5 (Claude Opus 5 به طور پیش‌فرض روی high)، آن را به صراحت تنظیم کنید، و به جای اینکه تنظیماتی را که در Claude Opus 5 استفاده کرده‌اید، چندین سطح را با همتایان خود آزمایش کنید.

نام‌های سطح تلاش با میزان تفکر یکسانی در بین مدل‌ها مطابقت ندارند: در آزمایش آنتروپیک، Claude Opus 5.5 در موارد متوسط ​​مطابقت دارد یا از Claude Opus 5 در ارزیابی‌های کدنویسی و دانش-کار برتری دارد، و در چندین ارزیابی کدگذاری، پایین با هزینه بسیار کمتر به آن نزدیک می‌شود. سطوح تلاش توصیه شده برای Claude Opus 5.5 را ببینید.

در یک سطح معین، Claude Opus 5.5 تمایل دارد در هر نوبت بیشتر از Claude Opus 5 فکر کند، به خصوص در xhigh و max. اگر مقدار تلاشی را که برای Claude Opus 5 تنظیم کرده اید حفظ کنید، انتظار چرخش های طولانی تر و توکن های خروجی بیشتری را داشته باشید. سه تنظیم کمک می کند:

تغییر مقدار تلاش سطح بالا بین درخواست‌ها، حافظه پنهان درخواست را باطل می‌کند. برای اجرای نوبت های فردی در سطوح مختلف، به جای آن از تغییر تلاش برای هر پیام (بتا) استفاده کنید که حافظه پنهان را حفظ می کند.

Claude Opus 5 تفکر را می پذیرد: {"type": "disabled"} با تلاش زیاد یا کمتر. Claude Opus 5.5 ندارد، و راهنمای مهاجرت تغییر درخواست را پوشش می دهد. اگر ادغام Claude Opus 5 شما با تفکر غیرفعال اجرا شد، چهار تغییر به همراه دارد:

در کارهای طولانی با چندین بخش، Claude Opus 5.5 کاربر را در حین کار به‌روز نگه می‌دارد، و برخی از این به‌روزرسانی‌ها به جای تماس ابزار، نوبت را با متن به پایان می‌رسانند (stop_reason: "end_turn"). یک حلقه عامل بدون مراقبت که چنین چرخشی را به عنوان پایان کار در آنجا متوقف می کند. چند مهار و تغییرات سریع به ادامه کار کمک می کند.

پایان نوبت فقط متنی را به‌عنوان گزارش به‌جای اثبات انجام کار در نظر بگیرید. بخش‌های کار را در یک چک لیست به‌روزرسانی‌های مدل نگه دارید، مانند ابزار کار یا فایل. اگر یک نوبت با مواردی که هنوز باز هستند و هیچ مسدود کننده ای ذکر نشده است به پایان می رسد، یک پیام کوتاه برای کاربر با نام آنها ارسال کنید، مانند مورد زیر. همچنین می‌توانید شرایط تکمیل را از قبل بیان کنید و از یک مدل جداگانه و کوچک‌تر بخواهید مکالمه را در هر انتهای نوبت بررسی کند و دلیل آن را به‌عنوان پیام کاربر بعدی در زمانی که شرط برآورده نشده است، برگرداند.

در هر صورت، پس از دو یا سه ادامه خودکار روی همان کار به جای تکرار نامحدود، توقف کنید، تا یک اجرا که واقعا گیر کرده است به پایان برسد و بتوان آن را مرور کرد.

اگر چیزی که مدل شروع کرده همچنان در حال اجرا است، مانند دستور پس‌زمینه یا عامل فرعی، آن کار را هنوز انجام ندهید: منتظر بمانید تا تمام شود و خروجی آن را به عنوان پیام کاربر بعدی به مدل برگردانید.

اضافه کردن سریع سیستم همچنین می تواند این توقف های اولیه را کمتر تکرار کند. Claude Opus 5.5 به دستورالعمل‌هایی پاسخ می‌دهد که انواع خاصی از توقف اولیه را که می‌خواهید از آن اجتناب کنید، نام می‌برند، مانند پایان دادن به چرخش با خلاصه‌ای که به جای برداشتن مرحله بعدی، مرحله بعدی را اعلام می‌کند. همچنین به نام‌گذاری ایستگاه‌هایی که می‌خواهید کمک می‌کند، برای مثال زمانی که هیچ کاری نمی‌تواند بدون ورودی کاربر پیشروی کند.

پاراگراف زیر نمونه ای از چنین افزودنی هایی است که برای عواملی نوشته شده است که کاملا بدون مراقبت کار می کنند، جایی که شما می خواهید مدل به جای توقف برای گزارش، به کار خود ادامه دهد. آن را به عنوان یک نقطه شروع در نظر بگیرید: ممکن است لازم باشد آن را برای کاربرد خود تطبیق دهید. آن را در پایان درخواست سیستم خود از اولین درخواست جلسه اضافه کنید: اضافه کردن آن به صورت نیمه تمام، اعلان سیستم را تغییر می دهد و بلوک های فکر قبلی مکالمه را باطل می کند (به تفکر حفظ شده مراجعه کنید).

از آنجایی که به مدل می‌گوید که یادداشت‌های وضعیت را در پیامی مشابه با تماس ابزار بعدی خود قرار دهد، این یادداشت‌ها بین تماس‌های ابزار به‌عنوان به‌روزرسانی‌های پیشرفت می‌رسند، که متن آن در پیش‌فرض thinking.display خالی برمی‌گردد. نمایشگر را تنظیم کنید: "به روز رسانی ها" را برای دریافت خلاصه ای از هر یک (به به روز رسانی های پیشرفت رو به رو کاربر مراجعه کنید). با این افزودن، مدل به جایی ادامه می‌دهد که در غیر این صورت برای چک کردن متوقف می‌شد، بنابراین مرحله تأیید خود را برای اقدامات مخاطره‌آمیز یا غیرقابل برگشت حفظ کنید، و اضافه کردن را در برنامه‌های انسان در حلقه، جایی که کسی برای پاسخ دادن وجود دارد، کنار بگذارید.

انتظار تماس‌های ابزار و نشانه‌های خروجی بیشتر در هر کار را داشته باشید.

Claude Opus 5.5 طبقه‌بندی‌کننده‌های ایمنی از جمله برای زیست‌شناسی، امنیت سایبری و استخراج استدلال را اجرا می‌کند.

کاهش طبقه‌بندی کننده به عنوان یک پاسخ عادی با stop_reason: "refusal" و یک شی stop_details که دسته را نامگذاری می‌کند، می‌رسد. می‌توانید درخواست را به‌طور خودکار در یک مدل بازگشتی دوباره امتحان کنید، به‌جز موارد رد استدلال_استخراج، که بازگشت سمت سرور به‌جای تلاش مجدد، به شما برمی‌گرداند. امتناع و بازگشت را ببینید.

بین تماس‌های ابزار، Claude Opus 5.5 به‌روزرسانی‌های کوتاهی را برای پیشرفت کاربر می‌نویسد: آنچه را که اخیرا پیدا کرده و کارهای بعدی را انجام می‌دهد. چهار اهرم آنچه را که کاربران شما می بینند کنترل می کنند.

ابتدا بررسی کنید که مشتری شما آنها را دریافت کند: در Claude Opus 5.5 این یادداشت‌ها به‌عنوان بلوک‌های فکری به‌روزرسانی پیشرفت به‌جای بلوک‌های متنی برمی‌گردند و متن آن‌ها در پیش‌فرض thinking.display خالی است، بنابراین کلاینت‌ای که فقط بلوک‌های متنی را رندر می‌کند می‌تواند در طول یک چرخش طولانی عامل بی‌صدا به نظر برسد. تنظیم نمایش: "به روز رسانی" (بتا، تفکر-نمایش-به روز رسانی-2026-08-18 سرصفحه) برای دریافت خلاصه کوتاهی از هر یادداشت. راهنمای مهاجرت نحوه رندر کردن آنها را نشان می دهد.

ثانیا، اگر مدل ممکن است نیاز داشته باشد که در یک چرخش طولانی، چیزی را به طور کلمه به کلمه به کاربر تحویل دهد، مانند یک قطعه کد، یک ابزار ساده برای ارسال پیام به کاربر داده و به او بگویید که ابزار را برای آن محتوا رزرو کند. ابزار را از اولین درخواست جلسه در ابزارها اعلام کنید: افزودن آن به ابزارها بعدا پیشوند مکالمه را ویرایش می‌کند و بلوک‌های فکر قبلی را باطل می‌کند (به تفکر حفظ شده مراجعه کنید).

سوم، اگر به‌روزرسانی‌های مکرر یا قابل پیش‌بینی‌تری می‌خواهید، مانند یک بیانیه قصد یک خطی قبل از اولین تماس ابزار و یک خلاصه کوتاه در پایان، این را در اعلان سیستم بگویید. مدل به چنین دستورالعمل هایی پاسخ می دهد. این بیشتر به کار انسان در حلقه کمک می کند.

چهارم، اگر نوبت‌های طولانی‌تر تماس با ابزار همچنان برای مدت طولانی‌تر از آنچه می‌خواهید بی‌صدا می‌مانند، از تسمه خود بخواهید که به‌روزرسانی شود. با نمایش: تنظیم "به روز رسانی" (اولین اهرم)، مراحل متوالی فراخوانی ابزار را بشمارید که چیزی برای خواندن به کاربر نمی دهد: بدون بلوک متنی و بدون متن پیشرفت-به روز رسانی. پس از چندین بار متوالی (مثلا پنج)، یادآوری مانند تصویر زیر را پس از آخرین نتایج ابزار، به‌عنوان یک پیام سیستم با محدوده نوبت اضافه کنید (clear_at: "next_user_message" ; beta, mid-conversation-system-clear-at-2026-08-21 header).

اگر نوبت بی صدا می ماند، به جای ارسال بیشتر، پس از دو یا سه یادآوری متوقف شوید. از آنجایی که هر یادآوری به جای اینکه برای یک درخواست درج شود و در درخواست بعدی حذف شود، ضمیمه شده و در جای خود باقی می‌ماند، حافظه پنهان اعلان مطابقت می‌کند و بلوک‌های فکری پس از آن معتبر می‌مانند. در آزمایش آنتروپیک بر روی وظایف کدگذاری عاملی، این تقریبا سهم وظایف را با یک کشش طولانی بی‌صدا، بدون تغییر قابل اندازه‌گیری در هزینه، به نصف کاهش داد.

در اتوماسیون گردش کار در چندین برنامه متصل مانند ایمیل، اسناد، صفحات گسترده و سوابق CRM، اطلاعاتی که یک کار به آنها وابسته است اغلب در جایی قرار می گیرد که درخواست به صراحت به آن اشاره نمی کند: به عنوان مثال، یک خط مشی در یک رشته ایمیل قدیمی، یک قانون در برگه صفحه گسترده دیگر، یا یادداشتی در سابقه مشتری. Claude Opus 5.5 تمایل دارد به سرعت به کار خود ادامه دهد و در کارهایی که به طور محدود مشخص شده اند، به مدل کمک می کند تا قبل از اقدام، منابع مربوطه را بررسی کند.

اگر نماینده شما در چندین برنامه برای کارهایی مانند این کار می کند، یک جمله در فرمان سیستم باعث می شود قبل از تغییر چیزی به اطراف نگاه کند:

در آزمایش آنتروپیک بر روی وظایف اتوماسیون چند برنامه ای، کلود اوپوس 5.5 به میزان قابل توجهی تعداد بیشتری از آنها را به درستی با این دستورالعمل تکمیل کرد، هم با تلاش متوسط ​​و هم حداکثر، به قیمت تماس ها و توکن های ابزار کمی بیشتر. از آنجایی که به مدل می‌گوید بر اساس آنچه پیدا می‌کند عمل کند، محتوای غیرقابل اعتماد را از رکوردهایی که جستجو می‌کند دور نگه دارد.

Claude Opus 5.5 به اطلاعات مربوط به زمان سپری شده توجه زیادی می کند، و در یک راه اندازی چند عامله، برای مثال یک عامل اصلی که به عوامل فرعی واگذار می کند، می توانید از آن برای سرعت بخشیدن به کار از طریق موازی سازی بهتر استفاده کنید. اگر می‌توانید تخمین بزنید که کار چقدر طول می‌کشد، به مدل یک بودجه زمانی بدهید: از هارنس خود بخواهید در پایان هر پیامی که به مدل ارسال می‌کند، یک خط کوتاه اضافه کند که زمان سپری شده را نسبت به آن بودجه، بر حسب ثانیه، مثلا 340 ثانیه / 1200 ثانیه سپری شده، اضافه کند.

مدل سرعت کار خود را تا پایان بودجه انجام می دهد و معمولا قبل از آن تمام می شود، بنابراین بودجه را تا حدودی بالاتر از زمانی که واقعا می خواهید صرف کنید تنظیم کنید و آن را بر روی نمونه ای از وظایف خود تنظیم کنید. اگر نمی توانید بودجه معقولی را پیش بینی کنید، زمان سپری شده را به تنهایی نشان دهید و یک جمله به دستور سیستم اضافه کنید:

در ارزیابی‌های آنتروپیک از تیم‌های کوچک عامل در وظایف تحقیقاتی، هر دو سیگنال باعث می‌شوند تیم‌ها زودتر از یک نماینده که بدون آن‌ها کار می‌کند، کار را به پایان برسانند. تیم هایی که بودجه ای در نظر گرفته شده بودند، کیفیت پاسخ را در مقایسه با یک نماینده واحد حفظ کردند در حالی که خیلی زودتر به پایان رسیدند. بودجه محدودتر تأثیر متفاوتی با تنظیم تلاش کمتر دارد: کاهش تلاش، خود کار را کاهش می‌دهد، در حالی که بودجه بیشتر باعث می‌شود که عوامل بیشتری به موازات هم کار کنند. بودجه مشاوره ای است و هیچ چیز مدل را در حد محدود متوقف نمی کند، بنابراین اگر به توقف سخت نیاز دارید، تایم اوت خود را حفظ کنید.

همچنین کیفیت پاسخ را در وظایف خود بررسی کنید، زیرا تحت فشار زمان ممکن است مدل کمی کمتر جستجو و تأیید کند.

در برنامه‌های چت، اگر سیستم شما حاوی دستورالعمل‌هایی است که به کلود می‌گوید قبل از پاسخ دادن به دقت فکر کند، آن‌ها را برای Claude Opus 5.5 حذف کنید. مدل خودش تصمیم می گیرد که چقدر فکر کند و تلاش کنترل اصلی است. در آزمایش آنتروپیک در یک محصول چت، حذف چنین خطی، پاسخ‌های ساخته شده زودتر شروع می‌شود، بدون افت واضح در کیفیت پاسخ.

در چت چند نوبتی، Claude Opus 5.5 گاهی اوقات به پاسخ قبلی برمی‌گردد در حالی که به پیام جدیدی فکر می‌کند، حتی یک پیگیری کوتاه، که تفکر و تأخیر را در نوبت‌های بعدی اضافه می‌کند. اگر ترجیح می‌دهید که مدل پاسخ‌های قبلی را حل و فصل کند، دو جمله در انتهای فرمان سیستم اضافه کنید:

در آزمایش آنتروپیک، این تفکر در نوبت های بعدی را کاهش داد و باعث شد که پاسخ ها زودتر شروع شوند بدون اینکه بر کیفیت تأثیر بگذارند. جایی را که می‌خواهید مدل به بررسی مجدد کار قبلی خود ادامه دهد، به عنوان مثال در تحلیل‌های طولانی، یا در کارهای عاملی که در مرحله بعدی می‌تواند اشتباهی را در مرحله قبلی آشکار کند، کنار بگذارید. این دستورالعمل همچنین ممکن است باعث شود مدل به خودی خود به اشتباه اشاره کند، بنابراین اگر برای برنامه شما مهم است، قبل از پذیرش دستورالعمل، آن را آزمایش کنید.

Claude Opus 5.5 در برابر تزریق سریع غیرمستقیم مقاومت می کند، به این معنی که دستورالعمل هایی که از طریق نتایج ابزار، صفحات وب و محتوای روی صفحه یا مرورگر دریافت می شوند، بهتر از هر مدل قبلی Opus. با زمینه مناسب، در برابر دستورالعمل‌های داخل محتوایی که کاربر از جای دیگر در پیام خود کپی کرده است، مانند ایمیل یا صفحه وب، قوی است. برای دریافت این رفتار، مشخص کنید کدام متن متعلق به کاربر است و کدام متن از جای دیگری چسبانده شده است.

هر بلوک چسبانده شده را در یک تگ باز و بسته بپیچید که هر دو دارای شناسه تصادفی کوتاه یکسانی هستند که توسط برنامه شما تولید شده است، با هر برچسب در خط خودش:

این می تواند گاهی اوقات مدل را کمی محتاط تر کند، بنابراین تأثیر آن را روی وظایف خود اندازه گیری کنید. برچسب‌ها متن ساده هستند و می‌توان آنها را تقلید کرد، بنابراین به عنوان یک نرده محافظ در کنار سایر دفاع‌های تزریق سریع رفتار کنید.

از آنجایی که Claude Opus 5.5 نمودارها، نمودارها و اسکرین شات ها را به طور قابل توجهی دقیق تر از Claude Opus 5 بدون ابزار می خواند (به قابلیت های مربوط به درخواست مراجعه کنید)، دوباره آزمایش کنید که آیا هنوز به داربست هایی که برای ورودی های بصری در مدل های قبلی ساخته اید نیاز دارید یا خیر. برای متراکم ترین ورودی ها، دو چیز همچنان دقت را اضافه می کند. تصاویر با وضوح بالاتر، بیشتر از همه برای ورودی هایی مانند نقشه های فنی کمک می کنند.

ابزارهای پردازش تصویر را نیز انجام دهید: مدل را به عنوان یک عامل با دسترسی به محفظه‌ای که تصاویر خام را در خود نگه می‌دارد و دارای کتابخانه‌هایی مانند PIL و OpenCV نصب شده است، اجرا کنید تا بتواند کار خود را برش، بزرگ‌نمایی، اندازه‌گیری و تأیید کند. اگر یک ظرف بیش از حد بالای سر باشد، یک ابزار کشت به تنهایی هنوز کمک می کند. دستور العمل ابزار برش یک تعریف کاربردی دارد. این مدل از این ابزارها به طور مؤثرتری در سطوح تلاش بالاتر استفاده می کند. بدون ابزار، افزایش تلاش خواندن نقشه های فنی را بهبود می بخشد، اما برای نمودارها کار چندانی انجام نمی دهد.

کلود اپوس 5.5 در صورت درخواست برای کار جلویی بدون جهت طراحی، به چند سبک پیش‌فرض بازمی‌گردد، و یک دستورالعمل کلی مانند «پرهیز از ظاهر هوش مصنوعی عمومی» عمدتا یک پیش‌فرض را با دیگری عوض می‌کند. به دستورالعمل‌هایی که الگوهای خاصی را نام می‌برند که باید اجتناب شود، مانند مثال زیر، به خوبی پاسخ می‌دهد. به صورت تکراری کار کنید: بررسی کنید که اولین نتیجه از کدام سبک استفاده شده است و در صورت نیاز لیست را گسترش دهید.

خواندن متن کامل در هکرنیوزبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Prompting Claude Opus 5.5

Article URL: https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5 Comments URL: https://news.ycombinator.com/item?id=49874728 Points: 154 # Comments: 156

همه‌ی اخبار فناوری