نوع جدیدی از مدل هوش مصنوعی از مخترع ChatGPT توسعه دهندگان را هیجان زده کرده است
Jev، نوع جدیدی از مدل هوش مصنوعی، به توسعهدهندگان مسیری ارزانتر و سریعتر برای هوش نرمافزاری نشان میدهد.
آلمیدا یک محقق OpenAI بود که به ساخت ربات چت و سپس اختراع یادگیری تقویتی از بازخورد انسانی (RLHF) کمک کرد، تکنیکی که احتمالا بیشترین مسئولیت را برای عصر فعلی هوش مصنوعی ما دارد. اما با وجود توانایی هایش، ناامید شد.
آلمیدا به TechCrunch گفت: «ما رعد و برق در یک بطری داریم، اما مفید نیست. "از آن زمان من با این مشکل دست و پنجه نرم می کنم. مدتی طول کشید تا به این نتیجه برسم: مشکل این است که ما در حال بهینه سازی برای زبان انسان هستیم... ما چهار سال است که در زبان انسانی فوق العاده خوب بوده ایم، اما برای اتوماسیون مفید نیست زیرا کامپیوترها به زبان دیگری صحبت می کنند."
دو سال پیش، آلمیدا OpenAI را ترک کرد تا TypeSafe AI را راهاندازی کند، استارتآپی که تلاش میکرد این مشکل را برطرف کند. این هفته، این شرکت یک مدل جدید مبتنی بر ترانسفورماتور به نام Jev را منتشر کرد که یک مدل زبان بزرگ (LLM) نیست. متنی را خروجی نمیکند، بلکه احتمالات یا آنچه شرکت «تصمیمهای کالیبرهشده» مینامد تولید میکند.
اجتناب از زبان چند کار را انجام می دهد: مدل را بسیار ارزان و سریع می کند، و چون کاربران خروجی ها را از قبل تعریف می کنند، نمی تواند توهم ایجاد کند. توکنهای خروجی آن رایگان هستند و توکنهای ورودی با یک میلیارد اندازهگیری میشوند، نه میلیون.
توسعه دهندگان علاقه زیادی به محصول دارند. این شرکت برای مدت کوتاهی توانایی ارائه خدمات به کاربران از طریق API خود را از دست داد زیرا تقاضا بسیار زیاد بود. Jev برای اتوماسیون نرم افزار بسیار مفید به نظر می رسد. تا کنون، توسعه دهندگان نرم افزار آن را راهی ارزان تر و قوی تر برای گنجاندن اطلاعات در کد خود می دانند.
به عنوان مثال، پرانیت شارما، مهندس نرمافزار در Vercel، یک شرکت سازنده زیرساختهای عامل، گفت که شرکت او از ChatGPT Luna 5.6 OpenAI برای اجرای یک طبقهبندی برای بررسی دستورات ایمنی استفاده کرده است. هنگامی که Vercel Luna OpenAI را با Jev جایگزین کرد، 5 تا 18 برابر سریعتر و با دقت بیشتری به نتایج رسید.
یکی دیگر از توسعهدهندگان، Bryo AI CTO Nikhil Mudholkar، Jev را در برابر Gemini برای طبقهبندی ایمیلهای تجاری آزمایش کرد. در آزمایش او، Gemini کمی دقیق تر بود، اما 10 تا 20 برابر گران تر بود. برای Mudholkar جالبتر نمرات اطمینان Jev بود - "این تنها موردی است که احتمال واقعی را ارائه می دهد که آن را برای خودکارسازی گردش کار ایده آل می کند!"
علاوه بر جایگزینی LLM ها در موارد استفاده خاص، مدل جدید همچنین می تواند آنها را تقویت کند و به عنوان یک کنترل هوشمند برای رفتار نادرست عمل کند. آلمیدا استدلال می کند که استفاده از عوامل برای نظارت بر عوامل می تواند به سرعت گران شود، اما استفاده از Jev برای انجام این کار منطقی است. او می بیند که کاربران Jev را برای ردیابی ردیابی های عامل LLM و جلوگیری از فرار از زندان به کار می گیرند.
آرمین روناچر، مدیر ارشد فناوری Earendil، که مهار Pi مدل منبع باز را میسازد، توضیح داد: «در پایان روز، مشکل توهم را کمی به کاربر محول میکند. "کاربر باید بگوید، خوب، اگر این فقط با احتمال 50٪ برگردد، شاید این یک سکه است، و من آن را نادیده میگیرم. اما اگر 95٪ باشد، مطمئنا، میتوانم کاری با آن انجام دهم."
Ronacher گفت که یکی دیگر از کاربردهای بالقوه Jev، مسیریابی مدل است. پیش بینی اینکه آیا یک حجم کاری معین به یک مدل خاص نیاز دارد مفید خواهد بود، اما استفاده از یک LLM برای این کار گران است. هزینه و سرعت کم Jev این نوع مرتبسازی بلادرنگ را ممکن میسازد.
و این امید آلمیدا است. این مدل از نام ویلیام استنلی جوونز، اقتصاددان قرن نوزدهمی نامگذاری شده است که پارادوکس همنام او توضیح می دهد که چگونه کاهش قیمت یک کالا می تواند منجر به استفاده بیشتر و بیشتر از آن شود. در این مورد، کاهش هزینه اطلاعات باید به استقرار گسترده آن منجر شود.
آلمیدا گفت: «ما فکر میکنیم نرمافزار هوشمندی در سرتاسر مکان وجود خواهد داشت، بهگونهای که ظهور و توزیع میشود... بسیار بیشتر از آنچه که میدانید مانند برنامههای بزرگی که مردم در حال تلاش برای ساختن آن هستند، شبیه اینترنت اولیه است.
آلمیدا در مورد معماری این مدل که ناظران بیرونی گمان میکنند که بر روی یک LLM با وزن باز ساخته شده است، سخت صحبت میکند. این شرکت از Jev به عنوان یک "مدل سیستم یک" یاد می کند که به جای استدلال بر روی شهود متمرکز است و به طور خاص بر روی کار درست متمرکز است. آلمیدا می گوید که Jev به طور انحصاری بر روی داده های مصنوعی با استفاده از تکنیکی که او آن را «یادگیری تقویتی از تصمیمات کالیبره شده» می نامد، آموزش دیده است.
او به TechCrunch گفت: "ما زودهنگام شرط بندی کردیم که همه داده های خود را انجام خواهیم داد، و این یکی از بهترین شرط بندی هایی بوده است که من در زندگی خود انجام داده ام - به نظر من بهتر از راه اندازی ما، بهتر از RLHF." نیمی از [شرکت ما] آزمایشگاهی است که اساسا مالک این زیرشاخه از داده های مصنوعی است که از نظر آماری به خوبی درک شده اند، و این اکنون لذت زندگی من است."
در حال حاضر، Jev به عنوان این نوع مدل به تنهایی ایستاده است، اما Ronacher انتظار دارد که اکنون که کاربرد آن آشکار است، رقبا ظاهر شوند.
او گفت: «ما باید از بسیاری جهات زودتر این را می دیدیم، اما احتمالا به دلیل ارزان بودن و یارانه ای بودن LLM ها، اغلب لازم نیست هنوز خلاق باشید.
TypeSafe خود نسخههای بیشتری از مدل را با روشهای جدید میسازد. آلمیدا در پاسخ به این سوال که آیا TypeSafe یک آزمایشگاه مرزی است، گفت: "محصول اصلی Frontier Labs ترس یا هیاهو است. من دوست دارم محصول اصلی ما هوش باشد... [اما ما] یک آزمایشگاه به معنای شرط بندی بر روی ثروت بی نهایت، یا یک دین، یا ساختن خدا در یک مرکز داده، یا هر چیزی که امروز است، نیستیم."
وقتی از طریق پیوندهای موجود در مقالات ما خرید می کنید، ممکن است کمیسیون کمی کسب کنیم. این بر استقلال تحریریه ما تأثیر نمی گذارد.
آخرین روز برای رزرو میز نمایشگاه، 18 سپتامبر است. سرنخ های پر تاثیر، دسترسی سرمایه گذاران، و کانون توجه برند در سالن نمایشگاه Disrupt را از دست ندهید.
OpenAI مدل های خود را گرفتار کرد که برای جانشینان یادداشت می گذاشتند تا رفتار بد ربکا بلان را پنهان کنند
ربکا بلان نشان می دهد که مدیر مایکروسافت خراشیدن با هوش مصنوعی را «بزرگترین سرقت نیروی کار در تاریخ بشر» می داند.
استارت آپ فناوری پاک Fluxnium راهی برای بهره برداری از سوخت هسته ای 50000 ساله تیم دی چانت پیدا کرد.
جنسن هوانگ از ترامپ تماس گرفت و چیز دیگری را نیز به نمایش گذاشت، کانی لویزوس
9 استارتآپ پرطرفدار از آخرین روز نمایشی Y Combinator، به گفته VCs Marina Temkin Dominic-Madori Davis
تسلا میگوید سرانجام در تاریخ 1 اکتبر از نسل دوم رودستر آنتونی ها رونمایی خواهد کرد
Revolut نقض اطلاعات مشتری از طریق درخواست های جعلی دولت Jagmeet Singh را تأیید می کند
متن اصلی (انگلیسی)
A new kind of AI model from a ChatGPT inventor is thrilling developers
Jev, a new kind of AI model, is showing developers a cheaper and faster path to software intelligence.