آنتروپیک پیشتر نیز در ماه فوریه درباره حملات «تقطیر» یا «استخراج دانش» هشدار داده و حتی نام برخی آزمایشگاههای مشخص را مطرح کرده بود. اوپنایآی هم فعالیتهای مشابهی را گزارش کرده و مشخصا به شرکت دیپسیک نسبت داده بود. با این حال، آنتروپیک میگوید حملاتی که در گزارش جدید خود شناسایی کرده، هم از نظر حجم و هم از نظر شدت، بسیار بزرگتر و تهاجمیتر بودهاند.
این شرکت در مجموع نزدیک به ۲۰۰میلیون تعامل مرتبط با حملات تقطیر شناسایی کرده که به پنج کارزار مجزا نسبت داده شدهاند.
بهطور کلی، در حملات تقطیری تلاش میشود «زنجیره استدلال» یک مدل هوش مصنوعی در پاسخ به پرسشهای مختلف استخراج شود.
مهاجمان سپس میتوانند از این اطلاعات برای آموزش یک مدل کوچکتر و تقویت توانایی آن در استدلال عمومی، از طریق فرایندی به نام «تنظیم دقیق نظارتشده» (Supervised Fine-Tuning) استفاده کنند. …











