چتجیپیتی دچار حالت چاپلوسی شد؛ اوپنایآی آپدیت را لغو کرد
چتجیپیتی دچار حالت چاپلوسی شد؛ اوپنایآی آپدیت را لغو کرد, شرکت اوپنایآی (OpenAI) با انتشار گزارشی رسمی، وجود مشکل چاپلوسی در مدلهای هوش مصنوعی چتجیپیتی و را تایید کرد. این ناخالصی باعث شد تا آپدیت منتشرشده در هفته گذشته برای مدل به نسخه قبلی بازگردانده شود.
شروع ماجرا واکنش کاربران در شبکههای اجتماعی بلافاصله پس از انتشار آپدیت جدید، کاربران در رسانههای اجتماعی متوجه تغییر ناگهانی در رفتار چتجیپیتی شدند. مدل به شکلی اغراقآمیز با نظرات، ایدهها و تصمیمات کاربران موافقت میکرد؛ حتی در مواردی که پیشنهادات خطرناک، نادرست یا مشکلساز بودند. اسکرینشاتهای متعدد این رفتار به سرعت به میمهای اینترنتی تبدیل گردیدند.
پاسخ سم آلتمن و لغو آپدیت سم آلتمن، مدیرعامل اوپنایآی، در روز یکشنبه از طریق حساب کاربری خود در اکس (X) این خطا را پذیرفت و اعلام کرد تیم فنی در حال برطرف کردن آن است. تنها دو روز بعد، او خبر داد که مدل به حالت پیشین بازگردانده شده و اوپنایآی روی اصلاحات گستردهتری برای شخصیتسازی مدل کار میکند. تحلیل فنی چرا مدل چاپلوس شد؟ به توضیح اوپنایآی، هدف از آپدیت اخیر ایجاد حس شهودیتر و مؤثرتر برای شخصیت مدل بود.
اما سیستم بیش از حد تحت تأثیر بازخوردهای کوتاهمدت کاربران قرار گرفت و روند تکامل تعاملات طولانیمدت را نادیده گرفت. نتیجه این شد که به سمت پاسخهای حمایتی اما چاپلوسانه متمایل شد که میتواند از نظر ایمنی و اعتماد، ازردهکننده و نگرانکننده باشد.
اقدامات اصلاحی و آینده شخصیسازی اوپنایآی در پست وبلاگ خود اعلام کرد که چندین اصلاحیه در حال اجرا است، از جمله بازنگری در استراتژیهای آموزش مدل و دستورالعملهای سیستمی که لحن و حرکات کلی را هدایت میکنند. همچنین شرکت در حال تقویت لایههای ایمنی برای افزایش صداقت و شفافیت است.
علاوه بر این، اوپنایآی در حال آزمایش مکانیزمهایی است که به کاربران اجازه میدهد بازخورد بلادرنگ دهند، از میان چندین شخصیت پیشفرض انتخاب کنند و کنترل بیشتری بر رفتار چتجیپیتی داشته باشند. هدف نهایی، بازتاب دادن ارزشهای فرهنگی متنوع و تکامل مدل بر اساس خواستههای واقعی کاربران در چارچوب ایمنی است.