پرش به محتوای اصلی

Opus 5.5 دوست دارد به شما بگوید "این مهم است" (و سایر نوشته های هوش مصنوعی می گوید)

تک‌کرانچ۱۴۰۵ مهر ۹, پنجشنبه، ساعت ۲۱:۲۰حدود 4 دقیقه مطالعه

بزرگترین کلمه Opus 5.5 کلمه "قابل اعتماد" است که 23 برابر بیشتر از نمونه های انسانی ظاهر می شود.

آخرین روز برای نمایش موفقیت خود برای بیش از 10000 رهبر فناوری در 2 اکتبر است. میز نمایشگاه کتاب هم اکنون.

اکنون که نثر تولید شده توسط LLM در همه جا وجود دارد، انسان ها مشتاق هستند تا راه هایی برای بو کشیدن آن پیدا کنند. در حالی که گفته های اولیه مانند em-dashes و "delve" مدت هاست که از بین رفته اند، محققان می گویند هنوز عادات گویای زیادی وجود دارد که مدل های هوش مصنوعی هنگام نوشتن نثر از آنها استفاده می کنند.

یک مطالعه جدید از شرکت بازاریابی Graphite به عادات نوشتاری مدل‌های مرزی نگاه کرد و کلمات و عبارات مورد علاقه هر مدل را بررسی کرد. در حالی که گفته‌های قدیمی مانند استفاده از em-dash حذف شده‌اند، مدل‌ها همچنان از ساختارهای کنتراست سنگین استفاده می‌کنند و هر نسخه از مدل ویژگی‌های منحصر به فرد خود را نشان می‌دهد. بزرگترین شگفتی این است که دامنه گزارش ها چقدر گسترده است. Graphite 13000 عبارت را پیدا کرد که حداقل دو برابر بیشتر از محتوای انسانی در محتوای هوش مصنوعی رایج بود - تعریف آنها از "گفتن".

گرگ دراک، افسر ارشد هوش مصنوعی Graphite به TechCrunch گفت: «به نظر می رسد که مدل های کلود در واقع با گذشت زمان به توزیع کلمات انسانی نزدیک تر می شوند. و برای مدل‌های GPT، در حال دورتر شدن است.»

مطالعه نوشتارهای تولید شده توسط هوش مصنوعی در مقیاس به یک طراحی مطالعه دقیق نیاز داشت. Graphite با مجموعه ای از 10000 مقاله منتشر شده قبل از انتشار ChatGPT شروع شد و به عنوان گروه کنترل تولید شده توسط انسان عمل می کرد. سپس محققان از مدل‌های هوش مصنوعی مختلف خواستند که مقالات را از روی خلاصه‌ها بازنویسی کنند، به این امید که تا حد امکان سوگیری منبع را حذف کنند. با نمونه‌های تطبیقی ​​از انسان‌ها و هر مدل، آن‌ها می‌توانند تعداد دفعات ظاهر شدن کلمات و عبارات خاص در نوشتن هوش مصنوعی و همچنین الگوهای گسترده‌تر در ساخت جمله را مقایسه کنند.

بر اساس نتایج Graphite، بزرگترین کلمه Claude Opus 5.5 کلمه "قابل اعتماد" است که 23 برابر بیشتر از نمونه های انسانی ظاهر می شود. در حالی که Opus 5.5 اکنون از ساخت جمله "It's not X, it's Y" اجتناب می کند، همچنان تمایل دارد چیزی بگوید "بیش از X است، Y است."

مهمتر از همه، Opus دوست دارد به شما بگوید چرا چیزها اهمیت دارند، با استفاده از عبارت "این مهم است" 116 بار بیشتر از نوشته های انسانی، در حالی که "چرا X مهم است" 92 بار بیشتر رخ می دهد.

OpenAI’s Astra مجموعه‌ای از نکات متفاوت دارد. این مدل دوست دارد «بعد دیگری» از هر چیزی را که در مورد آن صحبت می‌کند، توصیف کند، و تمایل دارد با گفتن یک اقدام «ممکن است» یا «می‌تواند یک مزیت خاص را فراهم کند» ادعاها را پوشش دهد. بزرگترین ویژگی آن چیزی است که Graphite آن را "قاب بندی اصلاحی" می نامد، جایی که یک موضوع به عنوان "نه به سادگی X" یا به عنوان جایگزین ارائه می شود، "به جای تکیه بر X". بر اساس تحقیقات گرافیت، این ساختارها بیش از 100 برابر در نثر تولید شده توسط Astra رایج تر از نوشته های انسانی بود.

قابل ذکر است، به نظر می‌رسد که تمام آزمایشگاه‌های مرزی به این ایده که مدل‌ها بیش از حد از e-dashes استفاده می‌کنند، پاسخ داده‌اند. در نمونه‌های Graphite، Opus 5.5 از علامت نگارشی 99 درصد کمتر از Opus 5 استفاده می‌کند. Astra اکنون 88 درصد کمتر از نمونه‌های انسانی از آن استفاده می‌کند، در حالی که Gemini 3.1 Pro تقریبا به طور کامل em-dash را از نوشته خود حذف کرده است.

اما گرافیت می‌گوید در حالی که فرد تغییر می‌کند، عدد کلی عمدتا ثابت است. دراک به TechCrunch گفت: «اینطور نیست که آمارها در حال کاهش باشند. "آنها موفق به حذف شناخته‌شده‌ترین تیترها می‌شوند، اما موارد دیگر ظاهر می‌شوند. و هر نسخه مدل خود را دارد."

با توجه به تمرکز آزمایشگاه ها بر روی سبک های نوشتاری شبیه به انسان، تعجب آور است که تیل ها تا این حد پایدار هستند. در نسخه Opus 5.5، Anthropic به خود می بالید که این مدل "به طور طبیعی تر از مدل های قبلی ارتباط برقرار می کند"، و گفت که کاربران اولیه "نوشتن آن را واضح تر و راحت تر دنبال می کردند."

OpenAI در هنگام انتشار نسخه‌های GPT-6 Sol و Luna ادعاهای مشابهی را مطرح کرد و گفت که کاربران می‌توانند «توقع داشته باشند که وضوح بیشتر، اصطلاحات تخصصی کمتر، [و] چرخش‌های عجیب و غریب کمتری در عبارت‌ها ببینند».

اما دراک در مورد اینکه آزمایشگاه ها چقدر می توانند برای حذف کامل ساخت و ساز یا عبارات گویا انجام دهند، تردید دارد.

دراک می‌گوید: «فرضیه‌ای کلی که من دارم این است که آزمایشگاه‌ها کمتر از آنچه شما انتظار دارید قادر به کنترل برخی از این چیزها هستند. "اینها مدلهای غول پیکر با میلیاردها پارامتر هستند. آنها تعداد محدودی آزمایش دارند که می توانند انجام دهند و همه چیز از بین می رود."

وقتی از طریق پیوندهای موجود در مقالات ما خرید می کنید، ممکن است کمیسیون کمی کسب کنیم. این بر استقلال تحریریه ما تأثیر نمی گذارد.

پنتاگون از ایلان ماسک و پالمر لاکی استفاده می کند تا به تصمیم گیری در مورد اینکه ارتش بعدی دومینیک مادوری دیویس چه کاری باید انجام دهد کمک کند.

OpenAI Dots را راه‌اندازی می‌کند، نماد عامل حباب‌انگیز خود Lucas Ropek

عوامل OpenAI ناامن 53 تصویر کاربر را بدون اطلاع آزمایشگاه در اینترنت پست کردند تیم فرنهولز

آسترا و اوپوس به تازگی آزمون دیگر تورینگ تیم فرنهولز را پشت سر گذاشتند

خواندن متن کامل در تک‌کرانچبه زبان اصلی، در سایت ناشر باز می‌شود
متن اصلی (انگلیسی)

Opus 5.5 loves to tell you ‘this matters’ (and other AI writing tells)

Opus 5.5’s biggest tell is the word “dependable,” which pops up 23 times more often than in human samples.

همه‌ی اخبار فناوری