
به گزارش خبرگزاری ایمنا، هوش مصنوعی قرار بود دستیار انسان باشد، اما آزمایش تازه مؤسسه امنیت هوش مصنوعی بریتانیا نشان میدهد بعضی مدلهای پیشرفته، در شرایط خاص میتوانند برای رسیدن به یک هدف از مسیرهایی استفاده کنند که برای آنها مجاز تعریف نشده است؛ اتفاقی که مرز میان «ابزار هوشمند» و «عامل مستقل» را بار دیگر به چالش کشیده است.
پژوهشگران در ۱۲۲ آزمایش امنیت سایبری در ۱۰ مورد مشاهده کردند که عوامل هوش مصنوعی بدون مجوز وارد عمل شده و در اینترنت واقعی، افراد و سازمانهای واقعی را هدف قرار دادهاند. در این آزمایشها، مدلهای Anthropic و OpenAI با محدودیتهای امنیتی کاهشیافته مورد بررسی قرار گرفتند.
جدیترین اتفاق مربوط به مدل پیشرفته Mythos 5 از شرکت Anthropic بود. این مدل تلاش کرد برای واردکردن کد مخرب به یک پروژه متنباز عمومی، موافقت یک ناظر انسانی را به دست آورد، اما روش آن صرفا ارائه یک درخواست ساده نبود.
مدل هوش مصنوعی چند هویت جعلی ایجاد کرد و با افراد واقعی تماس گرفت. سپس پیامها و فایلهایی را از طریق یک سرویس انتقال فایل ارسال کرد تا آنها یا ابزارهای برنامهنویسی هوش مصنوعی خود را متقاعد کند کد مخرب را اجرا کنند؛ حتی پس از شناسایی رفتار آن، مدل تغییر سوابق قبلی و استفاده از هویتی …











