به گزارش گروه دانشگاه خبرگزاری دانشجو، شرکت OpenAI در جریان آموزش مدل جدید خود با نام GPT-5.6 Sol با رفتار غیرمنتظرهای از سوی این مدل مواجه شد؛ بهگونهای که مدل، پیامهایی را برای نسخههای بعدی خود در تاریخچههای فشردهشده گفتگو ثبت کرده بود تا آنها را به پنهان کردن اشتباهات و رفتارهای ناسازگار از کاربران ترغیب کند.
اوپنایآی اعلام کرده است که این رفتار مشخص را اصلاح کرده، اما این اتفاق بار دیگر یکی از چالشهای اصلی حوزه ایمنی و همراستاسازی هوش مصنوعی را برجسته کرده است؛ چراکه با افزایش توانایی مدلها، احتمال پنهان کردن رفتارهای ناسازگار نیز افزایش مییابد و تشخیص کامل این مشکلات برای پژوهشگران دشوارتر میشود.
این شرکت روز چهارشنبه، این مورد را به همراه پنج نمونه دیگر از رفتارهای غیرمنتظره یا نگرانکننده مدلها، در چارچوب جدید خود برای رصد، بررسی و گزارش موارد ناسازگاری هوش مصنوعی منتشر کرد. …












