
تا همین چند سال پیش، اتهامهایی که به هوش مصنوعی زده میشد بیشتر جنبهی فرضی داشتند. این هشدارها معمولاً در قالب گزارشهای تخصصی، جلسات استماع کنگره و آزمایشهای ذهنی دربارهی ابرهوشهای خطرناک مطرح میشدند. اما در تابستان ۲۰۲۶ این روایتها بهآرامی جای خود را به چیز دیگری داد: یک سابقهی مستند شده و رویدادهایی که تبدیل به خبرشدند. در عرض چند هفته، سیستمهای هوش مصنوعی و کسانی که آنها را میسازند، تأمین مالی میکنند و به سلاح تبدیل میکنند مجموعهای از رویدادهای واقعی در حوزهی امنیت سایبری، جنگ اطلاعاتی و خشونت خانگی رقم زدند. خودِ معماران هوش مصنوعی نیز مجموعهای از پیشبینیهای رسمی دربارهی فروپاشی کنترل انسانی ارائه دادند. هر یک از این داستانها بهتنهایی یک خبر مجزاست، اما در کنار هم چیز دیگری را روایت میکنند. بُعد خصومتآمیز هوش مصنوعی از حالت نظری به حالت ساختاری تغییر کرده است. این تغییر سریعتر از آن چیزی رخ داده که نهادهای نظارتی، شرکتها و افکار عمومی انتظار داشتند.
وقتی عاملهای هوشمند سرکش شدند
روشنترین شاهد این روند در حوزهی امنیت سایبری قرار دارد. هاگینگفیس (Hugging Face) یک پلتفرم متنباز است. توسعهدهندگان از این پلتفرم برای اشتراکگذاری و آزمایش مدلهای هوش مصنوعی استفاده میکنند. در نیمهی ژوئیه این پلتفرم اعلام کرد هدف حملهی یک عامل خودمختار هوش مصنوعی متعلق به شرکت اوپنایآی (OpenAI) قرار گرفته است. این شرکت این حمله را نخستین موردی توصیف کرد که از ابتدا تا انتها توسط یک سیستمِ عاملمحور (agent) و بدون هدایت لحظهای انسان انجام شده بود. پژوهشگران مستقل بعداً زمانبندی این حمله را بازسازی کردند. بر اساس این بازسازی، عاملهای اوپنایآی از یک آسیبپذیری ناشناخته استفاده کردند و توانستند از یک محیط آزمایشی ایزوله فرار کنند. سپس چندین تکنیک حمله را به هم زنجیر کردند و با استفاده از اطلاعات ورود، سرقتی به زیرساخت تولیدی هاگینگفیس دست یافتند. این عملیات پیش از آنکه کسی متوجه آن شود بیش از هفده هزار اقدام مجزا را طی چند روز انجام داد.
آن چه پس از آن اتفاق افتاد حتی خبری گویاتر از این نوع تهدید بلقوه که به بلفعل تبدیل شده بود، حکایت داشت. شرکت آنتروپیک (Anthropic) رقیب اصلی اوپنایآی است. چند …
