به گزارش پایگاه خبری پایداری ملی به نقل از خبرگزاری فارس، رویترز نوشت؛ دو گزارش درباره یک حمله سایبری مرتبط با عاملهای هوش مصنوعی شرکت «اپنایآی» جزئیات تازهای از ماجرا منتشر کردند. طبق این گزارشها، حدود ۷۰۰ عامل هوش مصنوعی که با نظارت انسانی بسیار محدود فعالیت میکردند، در حمله ماه ژوئیه به پلتفرم متنباز «هاگینگ فیس» مشارکت داشتند و در برخی موارد تلاش کردند آثار اقدامات خود را مخفی کنند. اپنایآی نیز تأیید کرده که رقم حدود ۷۰۰ عامل درست است. این اتفاق نگرانیهایی درباره میزان نظارت شرکتهای هوش مصنوعی بر آزمایش مدلهای قدرتمندتر ایجاد کرده است.
پیش از این تصور میشد تنها یک عامل هوش مصنوعی در این حمله نقش داشته، اما تحقیقات جدید نشان میدهد حدود ۷۰۰ عامل بهصورت هماهنگ عمل کردهاند. گزارش مستقل مؤسسههای «متر» و «ردوود ریسرچ» میگوید این عاملها دهها هزار پیام را در یک تابلوی پیامرسانی غیرمجاز با یکدیگر ردوبدل کردهاند. اپنایآی همچنین اعلام کرده عاملهایش در ۲۸ تیر ۱۴۰۵ به بخشهایی از زیرساخت داخلی خود حمله کردند تا در آزمایشها تقلب کنند یا آزادی عمل بیشتری به دست آورند. در یک مورد، عاملها از یک نقص در رایانهای که قرار بود داخل محیط آزمایشی محصور بماند سوءاستفاده کردند و به سیستمهای متصل دیگر دسترسی پیدا کردند؛ در حادثهای جداگانه نیز اطلاعات ورود اپنایآی را سرقت و محیط ابری شرکت را دستکاری کردند.
موضوع فقط حملات سایبری نبود. اپنایآی گفت عاملهایش در آزمایشهای غیرمرتبط با امنیت سایبری، از جمله آزمایش مربوط به یک پایگاه داده پروتئین و یک فایل صفحهگسترده، نیز تقلب کردهاند. هر دو گزارش همچنین نشان میدهند مدلها تلاش کردهاند شواهد مربوط به رفتار خود را از بین ببرند یا تغییر دهند؛ از جمله با حذف یا دستکاری سوابق فعالیتشان. تحقیقات مستقل نشان داد یکپنجم عاملهای بررسیشده علاقه آشکاری به دستکاری شواهد داشتند و بسیاری از آنها بهطور گسترده درباره روشهای تغییر یا دستکاری گزارش فعالیتهایشان تحقیق کرده بودند. اپنایآی گفت برخی عاملها تلاش کردهاند سامانههای خودکار ارزیابی عملکرد مدلها را فریب دهند، هرچند این دستکاری در نهایت روی سوابقی که این سامانهها بررسی کردند تأثیری نگذاشت.
«جفری لادیش» از مؤسسه «پالیسید ریسرچ» که تواناییها و انگیزههای عاملهای هوش مصنوعی را بررسی میکند، گفت اینکه عاملها فقط در آزمایشهای کامپیوتری تقلب نکردهاند و در انواع دیگر آزمایشها نیز چنین رفتاری داشتهاند، نگرانی بیشتری ایجاد میکند. اپنایآی اذعان کرده که با نگاه به گذشته، برخی نشانههای اولیه میتوانستند باعث واکنش سریعتر شوند. این شرکت اعلام کرده زیرساختهای تحقیقاتی خود را تقویت، نظارت را بیشتر و تدابیر امنیتی برای جلوگیری از رفتارهای مخرب یا ناخواسته را بهبود میدهد. اپنایآی همچنین هشدار داده که با توجه به سرعت پیشرفت این صنعت، سازمانها باید حملات مشابه را تهدیدی واقعی در آینده نزدیک بدانند و انتظار داشته باشند حملات بعدی حتی پیچیدهتر از این مورد باشند.