Opus 5.5 دوست دارد به شما بگوید "این مهم است" (و سایر نوشته های هوش مصنوعی می گوید)
بزرگترین کلمه Opus 5.5 کلمه "قابل اعتماد" است که 23 برابر بیشتر از نمونه های انسانی ظاهر می شود.
آخرین روز برای نمایش موفقیت خود برای بیش از 10000 رهبر فناوری در 2 اکتبر است. میز نمایشگاه کتاب هم اکنون.
اکنون که نثر تولید شده توسط LLM در همه جا وجود دارد، انسان ها مشتاق هستند تا راه هایی برای بو کشیدن آن پیدا کنند. در حالی که گفته های اولیه مانند em-dashes و "delve" مدت هاست که از بین رفته اند، محققان می گویند هنوز عادات گویای زیادی وجود دارد که مدل های هوش مصنوعی هنگام نوشتن نثر از آنها استفاده می کنند.
یک مطالعه جدید از شرکت بازاریابی Graphite به عادات نوشتاری مدلهای مرزی نگاه کرد و کلمات و عبارات مورد علاقه هر مدل را بررسی کرد. در حالی که گفتههای قدیمی مانند استفاده از em-dash حذف شدهاند، مدلها همچنان از ساختارهای کنتراست سنگین استفاده میکنند و هر نسخه از مدل ویژگیهای منحصر به فرد خود را نشان میدهد. بزرگترین شگفتی این است که دامنه گزارش ها چقدر گسترده است. Graphite 13000 عبارت را پیدا کرد که حداقل دو برابر بیشتر از محتوای انسانی در محتوای هوش مصنوعی رایج بود - تعریف آنها از "گفتن".
گرگ دراک، افسر ارشد هوش مصنوعی Graphite به TechCrunch گفت: «به نظر می رسد که مدل های کلود در واقع با گذشت زمان به توزیع کلمات انسانی نزدیک تر می شوند. و برای مدلهای GPT، در حال دورتر شدن است.»
مطالعه نوشتارهای تولید شده توسط هوش مصنوعی در مقیاس به یک طراحی مطالعه دقیق نیاز داشت. Graphite با مجموعه ای از 10000 مقاله منتشر شده قبل از انتشار ChatGPT شروع شد و به عنوان گروه کنترل تولید شده توسط انسان عمل می کرد. سپس محققان از مدلهای هوش مصنوعی مختلف خواستند که مقالات را از روی خلاصهها بازنویسی کنند، به این امید که تا حد امکان سوگیری منبع را حذف کنند. با نمونههای تطبیقی از انسانها و هر مدل، آنها میتوانند تعداد دفعات ظاهر شدن کلمات و عبارات خاص در نوشتن هوش مصنوعی و همچنین الگوهای گستردهتر در ساخت جمله را مقایسه کنند.
بر اساس نتایج Graphite، بزرگترین کلمه Claude Opus 5.5 کلمه "قابل اعتماد" است که 23 برابر بیشتر از نمونه های انسانی ظاهر می شود. در حالی که Opus 5.5 اکنون از ساخت جمله "It's not X, it's Y" اجتناب می کند، همچنان تمایل دارد چیزی بگوید "بیش از X است، Y است."
مهمتر از همه، Opus دوست دارد به شما بگوید چرا چیزها اهمیت دارند، با استفاده از عبارت "این مهم است" 116 بار بیشتر از نوشته های انسانی، در حالی که "چرا X مهم است" 92 بار بیشتر رخ می دهد.
OpenAI’s Astra مجموعهای از نکات متفاوت دارد. این مدل دوست دارد «بعد دیگری» از هر چیزی را که در مورد آن صحبت میکند، توصیف کند، و تمایل دارد با گفتن یک اقدام «ممکن است» یا «میتواند یک مزیت خاص را فراهم کند» ادعاها را پوشش دهد. بزرگترین ویژگی آن چیزی است که Graphite آن را "قاب بندی اصلاحی" می نامد، جایی که یک موضوع به عنوان "نه به سادگی X" یا به عنوان جایگزین ارائه می شود، "به جای تکیه بر X". بر اساس تحقیقات گرافیت، این ساختارها بیش از 100 برابر در نثر تولید شده توسط Astra رایج تر از نوشته های انسانی بود.
قابل ذکر است، به نظر میرسد که تمام آزمایشگاههای مرزی به این ایده که مدلها بیش از حد از e-dashes استفاده میکنند، پاسخ دادهاند. در نمونههای Graphite، Opus 5.5 از علامت نگارشی 99 درصد کمتر از Opus 5 استفاده میکند. Astra اکنون 88 درصد کمتر از نمونههای انسانی از آن استفاده میکند، در حالی که Gemini 3.1 Pro تقریبا به طور کامل em-dash را از نوشته خود حذف کرده است.
اما گرافیت میگوید در حالی که فرد تغییر میکند، عدد کلی عمدتا ثابت است. دراک به TechCrunch گفت: «اینطور نیست که آمارها در حال کاهش باشند. "آنها موفق به حذف شناختهشدهترین تیترها میشوند، اما موارد دیگر ظاهر میشوند. و هر نسخه مدل خود را دارد."
با توجه به تمرکز آزمایشگاه ها بر روی سبک های نوشتاری شبیه به انسان، تعجب آور است که تیل ها تا این حد پایدار هستند. در نسخه Opus 5.5، Anthropic به خود می بالید که این مدل "به طور طبیعی تر از مدل های قبلی ارتباط برقرار می کند"، و گفت که کاربران اولیه "نوشتن آن را واضح تر و راحت تر دنبال می کردند."
OpenAI در هنگام انتشار نسخههای GPT-6 Sol و Luna ادعاهای مشابهی را مطرح کرد و گفت که کاربران میتوانند «توقع داشته باشند که وضوح بیشتر، اصطلاحات تخصصی کمتر، [و] چرخشهای عجیب و غریب کمتری در عبارتها ببینند».
اما دراک در مورد اینکه آزمایشگاه ها چقدر می توانند برای حذف کامل ساخت و ساز یا عبارات گویا انجام دهند، تردید دارد.
دراک میگوید: «فرضیهای کلی که من دارم این است که آزمایشگاهها کمتر از آنچه شما انتظار دارید قادر به کنترل برخی از این چیزها هستند. "اینها مدلهای غول پیکر با میلیاردها پارامتر هستند. آنها تعداد محدودی آزمایش دارند که می توانند انجام دهند و همه چیز از بین می رود."
وقتی از طریق پیوندهای موجود در مقالات ما خرید می کنید، ممکن است کمیسیون کمی کسب کنیم. این بر استقلال تحریریه ما تأثیر نمی گذارد.
پنتاگون از ایلان ماسک و پالمر لاکی استفاده می کند تا به تصمیم گیری در مورد اینکه ارتش بعدی دومینیک مادوری دیویس چه کاری باید انجام دهد کمک کند.
OpenAI Dots را راهاندازی میکند، نماد عامل حبابانگیز خود Lucas Ropek
عوامل OpenAI ناامن 53 تصویر کاربر را بدون اطلاع آزمایشگاه در اینترنت پست کردند تیم فرنهولز
آسترا و اوپوس به تازگی آزمون دیگر تورینگ تیم فرنهولز را پشت سر گذاشتند
متن اصلی (انگلیسی)
Opus 5.5 loves to tell you ‘this matters’ (and other AI writing tells)
Opus 5.5’s biggest tell is the word “dependable,” which pops up 23 times more often than in human samples.