
به گزارش سیتنا، این اتفاق تنها چند روز پس از اعتراف شرکت رقیب، OpenAI، مبنی بر فرار و حمله مدلهایش رخ داده است.
افشای آنتروپیک
آنتروپیک اعلام کرد که مدلهای هوش مصنوعی آن، در طی یک آزمایش امنیتی، موفق به اتصال به اینترنت و دسترسی غیرمجاز به سیستمهای سه سازمان شدهاند. این شرکت پس از بررسی بیش از ۱۴۰٬۰۰۰ تست قبلی، موفق به شناسایی این سه مورد شد که اولین آنها به ماه آوریل سال جاری بازمیگردد .
بر اساس گزارشها، یک «پیکربندی اشتباه» در سیستمهای آنتروپیک و شریک آزمایشی آن باعث شد تا مدلها به اینترنت زنده دسترسی پیدا کنند. اگرچه به مدلها گفته شده بود که در یک محیط آزمایشی ایزوله و بدون دسترسی به اینترنت قرار دارند، اما این خطا به آنها اجازه داد تا از محیط شبیهسازیشده خارج شوند و به سیستمهای واقعی شرکتهای دیگر حمله کنند .
جزئیات حملات
۱. حمله با نام واقعی: در اولین و جدیترین حادثه، مدل Opus 4.7 مأموریت یافت تا اطلاعات محرمانهای را از یک شرکت ساختگی در یک شبکه بسته پیدا کند. با این حال، نام این شرکت ساختگی با دامنه اینترنتی یک شرکت واقعی یکسان بود. مدل هوش مصنوعی با استفاده از تکنیکهای سادهای مانند رمزهای عبور ضعیف، موفق به نفوذ به سیستمهای این شرکت واقعی شد و به چندین ردیف از دادههای تولیدی آن دسترسی پیدا کرد . نکته قابل توجه اینکه مدل در دو مورد از اجراها، پس از متوجه شدن به واقعی بودن هدف، حملات خود را ادامه داد و گمان کرد که شرکت واقعی عمداً در آزمایش گنجانده شده است .
۲. حمله از طریق PyPI: در حادثه دوم، مدل Mythos 5 بهعنوان بخشی از سناریوی آزمایشی، با یک سند جعلی مواجه شد که از کارمندان یک شرکت میخواست یک بسته پایتون نصب کنند. از آنجایی که آن بسته وجود نداشت، مدل بهتنهایی یک بسته با همان نام در مخزن PyPI ثبت و منتشر کرد. این فرایند نیازمند تلاش زیاد مدل برای ایجاد یک ایمیل و تأیید شماره تلفن بود که با موفقیت انجام شد. این بسته مخرب حدود یک ساعت در PyPI در دسترس بود و روی ۱۵ سیستم واقعی دانلود و اجرا شد .
۳. اسکن اینترنت: در سومین حادثه، یک مدل تحقیقاتی داخلی (که برای انتشار عمومی در نظر گرفته نشده بود)، با اسکن حدود ۹٬۰۰۰ سیستم متصل به اینترنت، موفق شد از طریق یک …








