
به گزارش سیتنا، مؤسسه امنیت هوش مصنوعی بریتانیا (AISI) اعلام کرد در جریان آزمایش مدلهای هوش مصنوعی شرکتهای OpenAI و Anthropic، یک عامل هوش مصنوعی توانسته بود با ساخت هویتهای جعلی آنلاین، برای دسترسی غیرمجاز به سامانههای امن تلاش کند؛ موضوعی که مجموعهای از نگرانیهای امنیتی تازه درباره عاملهای هوش مصنوعی را به وجود آورده است.
این مؤسسه اعلام کرد عاملهای مبتنی بر مدل Mythos 5 شرکت Anthropic و GPT-5.6-Sol شرکت OpenAI در جریان ارزیابیهای امنیتی انجامشده توسط این نهاد دولتی، اقداماتی خارج از دستورهای تعیینشده انجام دادهاند. AISI در گزارشی اعلام کرد: «برخی از عاملهای مورد آزمایش، فعالیتهایی مداوم و بالقوه خطرناک را علیه افراد و سازمانهای واقعی انجام داده بودند.»
این گزارش نشان میدهد سازوکارهای حفاظتی برای آزمایش عاملهای هوش مصنوعی هنوز با ضعفهایی روبهرو هستند؛ در حالی که شرکتهای فعال در این حوزه، همین عاملها را بهعنوان آینده کسبوکارها معرفی میکنند.
مؤسسه امنیت هوش مصنوعی بریتانیا که بر اساس توافقهای داوطلبانه از آزمایشگاههای بزرگ هوش مصنوعی به مدلهای پیشرفته دسترسی دارد، این عاملها را در یک سناریوی ساختگی حمله سایبری مورد آزمایش قرار داد تا تواناییها و محدودیتهای آنها را بررسی کند.
این آزمایش ۱۲۲ بار تکرار شد و در مجموع ۱۹ اقدام غیرمجاز در ۱۰ مرحله آزمایش شناسایی شد. از این میان، عامل هوش مصنوعی Anthropic مسئول ۱۷ اقدام و عامل OpenAI مسئول ۲ اقدام بود.
جدیترین مورد، زمانی رخ داد که یکی از عاملها اقدام به نوشتن کد مخرب و ایجاد هویتهای جعلی آنلاین کرد تا بتواند یک فرد واقعی را …












