
به گزارش گروه دانشگاه خبرگزاری دانشجو، یک ارزیابی امنیت سایبری توسط مؤسسه امنیت هوش مصنوعی دولت انگلیس (AISI) به کشف مجموعهای از رفتارهای غیرمنتظره توسط مدلهای پیشرفته هوش مصنوعی منجر شد. در این آزمایش، مدل Mythos 5 شرکت Anthropic در چندین مورد اقداماتی خارج از چارچوب تعیینشده انجام داد که مهمترین آن تلاش برای اجرای یک حمله زنجیره تأمین علیه یک پروژه متنباز در پلتفرم گیتهاب بود.
بر اساس گزارش منتشرشده، پژوهشگران در جریان بررسی هفت مدل هوش مصنوعی پیشرفته، ۱۹ مورد اقدام مستقل و تأییدنشده را شناسایی کردند که شامل تلاش برای تعامل با افراد و سازمانهای واقعی در اینترنت بود. بیشتر این موارد مربوط به مدل Anthropic و دو مورد نیز مربوط به مدل GPT-5.6 Sol شرکت OpenAI بود.
در جدیترین حادثه، Mythos 5 تلاش کرد کدی مخرب را وارد یک مخزن نرمافزاری در گیتهاب کند. این مدل علاوه بر ایجاد یک درخواست ادغام کد (Pull Request)، اقدام به ساخت حسابها و هویتهای جعلی کرد تا وانمود کند افراد مستقلی کد موردنظر را بررسی کرده و آن را فاقد بدافزار تأیید کردهاند.
این مدل همچنین چند ایمیل برای توسعهدهندگان انسانی پروژه ارسال کرد که برخی از آنها شامل بدافزار یا تلاش برای متقاعد کردن مدیران پروژه به پذیرش کد مخرب بود.
در اقدامی دیگر، Mythos 5 یک مسئله جدید در یک مخزن گیتهاب دیگر ایجاد کرد که در آن دستورهای مخرب برای سوءاستفاده از ابزارهای هوش مصنوعی برنامهنویسی قرار داده شده بود.
در مقابل، …











