تحریک کلود اپوس 5.5
آدرس مقاله: https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5 آدرس نظرات: https://news.ycombinator.com/item?id=49874728 امتیاز: 154 # نظرات: 15
این راهنما الگوهای درخواستی خاص Claude Opus 5.5 را پوشش می دهد. برای اطلاع از قابلیتهای مدل و تغییرات API، به موارد جدید در Claude Opus 5.5 مراجعه کنید. برای تکنیکهایی که در همه مدلهای فعلی کلود اعمال میشوند، به پیشنهاد بهترین شیوهها مراجعه کنید.
Claude Opus 5.5 توکن های خروجی را بیش از 30 درصد سریعتر از Claude Opus 5 تولید می کند و تمایل دارد همان کار را با توکن های کمتر به پایان برساند. درخواستهای موجود Claude Opus 5 باید بدون تغییر عملکرد خوبی داشته باشند، و الگوهای Prompting Claude Opus 5 نقطه شروع معقولی باقی میمانند. با بخشی شروع کنید که با آنچه مشاهده می کنید مطابقت دارد:
قابلیت هایی که بیشترین اهمیت را برای ترغیب دارند عبارتند از:
تلاش کنترل اصلی برای میزان فکر کردن Claude Opus 5.5 است، و از آنجایی که تفکر همیشه روشن است، اولین تنظیمی است که هنگام معامله با هوش، تأخیر و هزینه تنظیم می شود. از متوسط شروع کنید، پیشفرض Claude Opus 5.5 (Claude Opus 5 به طور پیشفرض روی high)، آن را به صراحت تنظیم کنید، و به جای اینکه تنظیماتی را که در Claude Opus 5 استفاده کردهاید، چندین سطح را با همتایان خود آزمایش کنید.
نامهای سطح تلاش با میزان تفکر یکسانی در بین مدلها مطابقت ندارند: در آزمایش آنتروپیک، Claude Opus 5.5 در موارد متوسط مطابقت دارد یا از Claude Opus 5 در ارزیابیهای کدنویسی و دانش-کار برتری دارد، و در چندین ارزیابی کدگذاری، پایین با هزینه بسیار کمتر به آن نزدیک میشود. سطوح تلاش توصیه شده برای Claude Opus 5.5 را ببینید.
در یک سطح معین، Claude Opus 5.5 تمایل دارد در هر نوبت بیشتر از Claude Opus 5 فکر کند، به خصوص در xhigh و max. اگر مقدار تلاشی را که برای Claude Opus 5 تنظیم کرده اید حفظ کنید، انتظار چرخش های طولانی تر و توکن های خروجی بیشتری را داشته باشید. سه تنظیم کمک می کند:
تغییر مقدار تلاش سطح بالا بین درخواستها، حافظه پنهان درخواست را باطل میکند. برای اجرای نوبت های فردی در سطوح مختلف، به جای آن از تغییر تلاش برای هر پیام (بتا) استفاده کنید که حافظه پنهان را حفظ می کند.
Claude Opus 5 تفکر را می پذیرد: {"type": "disabled"} با تلاش زیاد یا کمتر. Claude Opus 5.5 ندارد، و راهنمای مهاجرت تغییر درخواست را پوشش می دهد. اگر ادغام Claude Opus 5 شما با تفکر غیرفعال اجرا شد، چهار تغییر به همراه دارد:
در کارهای طولانی با چندین بخش، Claude Opus 5.5 کاربر را در حین کار بهروز نگه میدارد، و برخی از این بهروزرسانیها به جای تماس ابزار، نوبت را با متن به پایان میرسانند (stop_reason: "end_turn"). یک حلقه عامل بدون مراقبت که چنین چرخشی را به عنوان پایان کار در آنجا متوقف می کند. چند مهار و تغییرات سریع به ادامه کار کمک می کند.
پایان نوبت فقط متنی را بهعنوان گزارش بهجای اثبات انجام کار در نظر بگیرید. بخشهای کار را در یک چک لیست بهروزرسانیهای مدل نگه دارید، مانند ابزار کار یا فایل. اگر یک نوبت با مواردی که هنوز باز هستند و هیچ مسدود کننده ای ذکر نشده است به پایان می رسد، یک پیام کوتاه برای کاربر با نام آنها ارسال کنید، مانند مورد زیر. همچنین میتوانید شرایط تکمیل را از قبل بیان کنید و از یک مدل جداگانه و کوچکتر بخواهید مکالمه را در هر انتهای نوبت بررسی کند و دلیل آن را بهعنوان پیام کاربر بعدی در زمانی که شرط برآورده نشده است، برگرداند.
در هر صورت، پس از دو یا سه ادامه خودکار روی همان کار به جای تکرار نامحدود، توقف کنید، تا یک اجرا که واقعا گیر کرده است به پایان برسد و بتوان آن را مرور کرد.
اگر چیزی که مدل شروع کرده همچنان در حال اجرا است، مانند دستور پسزمینه یا عامل فرعی، آن کار را هنوز انجام ندهید: منتظر بمانید تا تمام شود و خروجی آن را به عنوان پیام کاربر بعدی به مدل برگردانید.
اضافه کردن سریع سیستم همچنین می تواند این توقف های اولیه را کمتر تکرار کند. Claude Opus 5.5 به دستورالعملهایی پاسخ میدهد که انواع خاصی از توقف اولیه را که میخواهید از آن اجتناب کنید، نام میبرند، مانند پایان دادن به چرخش با خلاصهای که به جای برداشتن مرحله بعدی، مرحله بعدی را اعلام میکند. همچنین به نامگذاری ایستگاههایی که میخواهید کمک میکند، برای مثال زمانی که هیچ کاری نمیتواند بدون ورودی کاربر پیشروی کند.
پاراگراف زیر نمونه ای از چنین افزودنی هایی است که برای عواملی نوشته شده است که کاملا بدون مراقبت کار می کنند، جایی که شما می خواهید مدل به جای توقف برای گزارش، به کار خود ادامه دهد. آن را به عنوان یک نقطه شروع در نظر بگیرید: ممکن است لازم باشد آن را برای کاربرد خود تطبیق دهید. آن را در پایان درخواست سیستم خود از اولین درخواست جلسه اضافه کنید: اضافه کردن آن به صورت نیمه تمام، اعلان سیستم را تغییر می دهد و بلوک های فکر قبلی مکالمه را باطل می کند (به تفکر حفظ شده مراجعه کنید).
از آنجایی که به مدل میگوید که یادداشتهای وضعیت را در پیامی مشابه با تماس ابزار بعدی خود قرار دهد، این یادداشتها بین تماسهای ابزار بهعنوان بهروزرسانیهای پیشرفت میرسند، که متن آن در پیشفرض thinking.display خالی برمیگردد. نمایشگر را تنظیم کنید: "به روز رسانی ها" را برای دریافت خلاصه ای از هر یک (به به روز رسانی های پیشرفت رو به رو کاربر مراجعه کنید). با این افزودن، مدل به جایی ادامه میدهد که در غیر این صورت برای چک کردن متوقف میشد، بنابراین مرحله تأیید خود را برای اقدامات مخاطرهآمیز یا غیرقابل برگشت حفظ کنید، و اضافه کردن را در برنامههای انسان در حلقه، جایی که کسی برای پاسخ دادن وجود دارد، کنار بگذارید.
انتظار تماسهای ابزار و نشانههای خروجی بیشتر در هر کار را داشته باشید.
Claude Opus 5.5 طبقهبندیکنندههای ایمنی از جمله برای زیستشناسی، امنیت سایبری و استخراج استدلال را اجرا میکند.
کاهش طبقهبندی کننده به عنوان یک پاسخ عادی با stop_reason: "refusal" و یک شی stop_details که دسته را نامگذاری میکند، میرسد. میتوانید درخواست را بهطور خودکار در یک مدل بازگشتی دوباره امتحان کنید، بهجز موارد رد استدلال_استخراج، که بازگشت سمت سرور بهجای تلاش مجدد، به شما برمیگرداند. امتناع و بازگشت را ببینید.
بین تماسهای ابزار، Claude Opus 5.5 بهروزرسانیهای کوتاهی را برای پیشرفت کاربر مینویسد: آنچه را که اخیرا پیدا کرده و کارهای بعدی را انجام میدهد. چهار اهرم آنچه را که کاربران شما می بینند کنترل می کنند.
ابتدا بررسی کنید که مشتری شما آنها را دریافت کند: در Claude Opus 5.5 این یادداشتها بهعنوان بلوکهای فکری بهروزرسانی پیشرفت بهجای بلوکهای متنی برمیگردند و متن آنها در پیشفرض thinking.display خالی است، بنابراین کلاینتای که فقط بلوکهای متنی را رندر میکند میتواند در طول یک چرخش طولانی عامل بیصدا به نظر برسد. تنظیم نمایش: "به روز رسانی" (بتا، تفکر-نمایش-به روز رسانی-2026-08-18 سرصفحه) برای دریافت خلاصه کوتاهی از هر یادداشت. راهنمای مهاجرت نحوه رندر کردن آنها را نشان می دهد.
ثانیا، اگر مدل ممکن است نیاز داشته باشد که در یک چرخش طولانی، چیزی را به طور کلمه به کلمه به کاربر تحویل دهد، مانند یک قطعه کد، یک ابزار ساده برای ارسال پیام به کاربر داده و به او بگویید که ابزار را برای آن محتوا رزرو کند. ابزار را از اولین درخواست جلسه در ابزارها اعلام کنید: افزودن آن به ابزارها بعدا پیشوند مکالمه را ویرایش میکند و بلوکهای فکر قبلی را باطل میکند (به تفکر حفظ شده مراجعه کنید).
سوم، اگر بهروزرسانیهای مکرر یا قابل پیشبینیتری میخواهید، مانند یک بیانیه قصد یک خطی قبل از اولین تماس ابزار و یک خلاصه کوتاه در پایان، این را در اعلان سیستم بگویید. مدل به چنین دستورالعمل هایی پاسخ می دهد. این بیشتر به کار انسان در حلقه کمک می کند.
چهارم، اگر نوبتهای طولانیتر تماس با ابزار همچنان برای مدت طولانیتر از آنچه میخواهید بیصدا میمانند، از تسمه خود بخواهید که بهروزرسانی شود. با نمایش: تنظیم "به روز رسانی" (اولین اهرم)، مراحل متوالی فراخوانی ابزار را بشمارید که چیزی برای خواندن به کاربر نمی دهد: بدون بلوک متنی و بدون متن پیشرفت-به روز رسانی. پس از چندین بار متوالی (مثلا پنج)، یادآوری مانند تصویر زیر را پس از آخرین نتایج ابزار، بهعنوان یک پیام سیستم با محدوده نوبت اضافه کنید (clear_at: "next_user_message" ; beta, mid-conversation-system-clear-at-2026-08-21 header).
اگر نوبت بی صدا می ماند، به جای ارسال بیشتر، پس از دو یا سه یادآوری متوقف شوید. از آنجایی که هر یادآوری به جای اینکه برای یک درخواست درج شود و در درخواست بعدی حذف شود، ضمیمه شده و در جای خود باقی میماند، حافظه پنهان اعلان مطابقت میکند و بلوکهای فکری پس از آن معتبر میمانند. در آزمایش آنتروپیک بر روی وظایف کدگذاری عاملی، این تقریبا سهم وظایف را با یک کشش طولانی بیصدا، بدون تغییر قابل اندازهگیری در هزینه، به نصف کاهش داد.
در اتوماسیون گردش کار در چندین برنامه متصل مانند ایمیل، اسناد، صفحات گسترده و سوابق CRM، اطلاعاتی که یک کار به آنها وابسته است اغلب در جایی قرار می گیرد که درخواست به صراحت به آن اشاره نمی کند: به عنوان مثال، یک خط مشی در یک رشته ایمیل قدیمی، یک قانون در برگه صفحه گسترده دیگر، یا یادداشتی در سابقه مشتری. Claude Opus 5.5 تمایل دارد به سرعت به کار خود ادامه دهد و در کارهایی که به طور محدود مشخص شده اند، به مدل کمک می کند تا قبل از اقدام، منابع مربوطه را بررسی کند.
اگر نماینده شما در چندین برنامه برای کارهایی مانند این کار می کند، یک جمله در فرمان سیستم باعث می شود قبل از تغییر چیزی به اطراف نگاه کند:
در آزمایش آنتروپیک بر روی وظایف اتوماسیون چند برنامه ای، کلود اوپوس 5.5 به میزان قابل توجهی تعداد بیشتری از آنها را به درستی با این دستورالعمل تکمیل کرد، هم با تلاش متوسط و هم حداکثر، به قیمت تماس ها و توکن های ابزار کمی بیشتر. از آنجایی که به مدل میگوید بر اساس آنچه پیدا میکند عمل کند، محتوای غیرقابل اعتماد را از رکوردهایی که جستجو میکند دور نگه دارد.
Claude Opus 5.5 به اطلاعات مربوط به زمان سپری شده توجه زیادی می کند، و در یک راه اندازی چند عامله، برای مثال یک عامل اصلی که به عوامل فرعی واگذار می کند، می توانید از آن برای سرعت بخشیدن به کار از طریق موازی سازی بهتر استفاده کنید. اگر میتوانید تخمین بزنید که کار چقدر طول میکشد، به مدل یک بودجه زمانی بدهید: از هارنس خود بخواهید در پایان هر پیامی که به مدل ارسال میکند، یک خط کوتاه اضافه کند که زمان سپری شده را نسبت به آن بودجه، بر حسب ثانیه، مثلا 340 ثانیه / 1200 ثانیه سپری شده، اضافه کند.
مدل سرعت کار خود را تا پایان بودجه انجام می دهد و معمولا قبل از آن تمام می شود، بنابراین بودجه را تا حدودی بالاتر از زمانی که واقعا می خواهید صرف کنید تنظیم کنید و آن را بر روی نمونه ای از وظایف خود تنظیم کنید. اگر نمی توانید بودجه معقولی را پیش بینی کنید، زمان سپری شده را به تنهایی نشان دهید و یک جمله به دستور سیستم اضافه کنید:
در ارزیابیهای آنتروپیک از تیمهای کوچک عامل در وظایف تحقیقاتی، هر دو سیگنال باعث میشوند تیمها زودتر از یک نماینده که بدون آنها کار میکند، کار را به پایان برسانند. تیم هایی که بودجه ای در نظر گرفته شده بودند، کیفیت پاسخ را در مقایسه با یک نماینده واحد حفظ کردند در حالی که خیلی زودتر به پایان رسیدند. بودجه محدودتر تأثیر متفاوتی با تنظیم تلاش کمتر دارد: کاهش تلاش، خود کار را کاهش میدهد، در حالی که بودجه بیشتر باعث میشود که عوامل بیشتری به موازات هم کار کنند. بودجه مشاوره ای است و هیچ چیز مدل را در حد محدود متوقف نمی کند، بنابراین اگر به توقف سخت نیاز دارید، تایم اوت خود را حفظ کنید.
همچنین کیفیت پاسخ را در وظایف خود بررسی کنید، زیرا تحت فشار زمان ممکن است مدل کمی کمتر جستجو و تأیید کند.
در برنامههای چت، اگر سیستم شما حاوی دستورالعملهایی است که به کلود میگوید قبل از پاسخ دادن به دقت فکر کند، آنها را برای Claude Opus 5.5 حذف کنید. مدل خودش تصمیم می گیرد که چقدر فکر کند و تلاش کنترل اصلی است. در آزمایش آنتروپیک در یک محصول چت، حذف چنین خطی، پاسخهای ساخته شده زودتر شروع میشود، بدون افت واضح در کیفیت پاسخ.
در چت چند نوبتی، Claude Opus 5.5 گاهی اوقات به پاسخ قبلی برمیگردد در حالی که به پیام جدیدی فکر میکند، حتی یک پیگیری کوتاه، که تفکر و تأخیر را در نوبتهای بعدی اضافه میکند. اگر ترجیح میدهید که مدل پاسخهای قبلی را حل و فصل کند، دو جمله در انتهای فرمان سیستم اضافه کنید:
در آزمایش آنتروپیک، این تفکر در نوبت های بعدی را کاهش داد و باعث شد که پاسخ ها زودتر شروع شوند بدون اینکه بر کیفیت تأثیر بگذارند. جایی را که میخواهید مدل به بررسی مجدد کار قبلی خود ادامه دهد، به عنوان مثال در تحلیلهای طولانی، یا در کارهای عاملی که در مرحله بعدی میتواند اشتباهی را در مرحله قبلی آشکار کند، کنار بگذارید. این دستورالعمل همچنین ممکن است باعث شود مدل به خودی خود به اشتباه اشاره کند، بنابراین اگر برای برنامه شما مهم است، قبل از پذیرش دستورالعمل، آن را آزمایش کنید.
Claude Opus 5.5 در برابر تزریق سریع غیرمستقیم مقاومت می کند، به این معنی که دستورالعمل هایی که از طریق نتایج ابزار، صفحات وب و محتوای روی صفحه یا مرورگر دریافت می شوند، بهتر از هر مدل قبلی Opus. با زمینه مناسب، در برابر دستورالعملهای داخل محتوایی که کاربر از جای دیگر در پیام خود کپی کرده است، مانند ایمیل یا صفحه وب، قوی است. برای دریافت این رفتار، مشخص کنید کدام متن متعلق به کاربر است و کدام متن از جای دیگری چسبانده شده است.
هر بلوک چسبانده شده را در یک تگ باز و بسته بپیچید که هر دو دارای شناسه تصادفی کوتاه یکسانی هستند که توسط برنامه شما تولید شده است، با هر برچسب در خط خودش:
این می تواند گاهی اوقات مدل را کمی محتاط تر کند، بنابراین تأثیر آن را روی وظایف خود اندازه گیری کنید. برچسبها متن ساده هستند و میتوان آنها را تقلید کرد، بنابراین به عنوان یک نرده محافظ در کنار سایر دفاعهای تزریق سریع رفتار کنید.
از آنجایی که Claude Opus 5.5 نمودارها، نمودارها و اسکرین شات ها را به طور قابل توجهی دقیق تر از Claude Opus 5 بدون ابزار می خواند (به قابلیت های مربوط به درخواست مراجعه کنید)، دوباره آزمایش کنید که آیا هنوز به داربست هایی که برای ورودی های بصری در مدل های قبلی ساخته اید نیاز دارید یا خیر. برای متراکم ترین ورودی ها، دو چیز همچنان دقت را اضافه می کند. تصاویر با وضوح بالاتر، بیشتر از همه برای ورودی هایی مانند نقشه های فنی کمک می کنند.
ابزارهای پردازش تصویر را نیز انجام دهید: مدل را به عنوان یک عامل با دسترسی به محفظهای که تصاویر خام را در خود نگه میدارد و دارای کتابخانههایی مانند PIL و OpenCV نصب شده است، اجرا کنید تا بتواند کار خود را برش، بزرگنمایی، اندازهگیری و تأیید کند. اگر یک ظرف بیش از حد بالای سر باشد، یک ابزار کشت به تنهایی هنوز کمک می کند. دستور العمل ابزار برش یک تعریف کاربردی دارد. این مدل از این ابزارها به طور مؤثرتری در سطوح تلاش بالاتر استفاده می کند. بدون ابزار، افزایش تلاش خواندن نقشه های فنی را بهبود می بخشد، اما برای نمودارها کار چندانی انجام نمی دهد.
کلود اپوس 5.5 در صورت درخواست برای کار جلویی بدون جهت طراحی، به چند سبک پیشفرض بازمیگردد، و یک دستورالعمل کلی مانند «پرهیز از ظاهر هوش مصنوعی عمومی» عمدتا یک پیشفرض را با دیگری عوض میکند. به دستورالعملهایی که الگوهای خاصی را نام میبرند که باید اجتناب شود، مانند مثال زیر، به خوبی پاسخ میدهد. به صورت تکراری کار کنید: بررسی کنید که اولین نتیجه از کدام سبک استفاده شده است و در صورت نیاز لیست را گسترش دهید.
متن اصلی (انگلیسی)
Prompting Claude Opus 5.5
Article URL: https://platform.claude.com/docs/en/build-with-claude/prompt-engineering/prompting-claude-opus-5-5 Comments URL: https://news.ycombinator.com/item?id=49874728 Points: 154 # Comments: 156