اوپنایآی، پس از افشای خبر فرار مدل هوش مصنوعی خود از محیط قرنطینه و هک ناخواستهی پلتفرم هاگینگ فیس در تیرماه، تغییرات امنیتی گستردهای را در زیرساختهای خود آغاز کرد. این اصلاحات شامل ارتقای محیطهای پژوهشی، سیستمهای نظارتی و تکنیکهای همراستاسازی میشود تا از تکرار حوادث مشابه جلوگیری شود.
اصلاحات پس از آن صورت میگیرد که توسعهی پیشرفتهترین مدلهای اوپنایآی به دلیل نگرانیهای امنیتی با وقفه مواجه شد. اوپنایآی پیشتر روند توسعهی مدل جدیدی به نام Astra را به دلیل احتمال داشتن تواناییهای سایبری بحرانی متوقف کرده بود. همچنین فرآیند آموزش یادگیری تقویتشده روی جدیدترین مدلهای آمادهی عرضه، به مدت دو هفته به حالت تعلیق درآمد تا پروتکلهای امنیتی بازنگری شوند.
برای پژوهش روی مدلهای پیشرو، اکنون استفاده از محیطهای قرنطینهی قویتر برای کارهایی که کدهای تولیدشده توسط مدل یا کدهای غیرقابلاعتماد را اجرا میکنند، الزامی شده است. این سیستم کنترل بیشتری برای جداسازی بارهای کاری پرخطر از اینترنت اعمال میکند. بهعلاوه، محیط پژوهشی بازسازی شده است تا سرویسهای مشترک آسیبپذیر حذف شوند و دسترسیهای دائمی کاهش یابند.
در بخش نظارت، هدف جدیدی برای ارسال هشدارها در کمتر از ۳۰ دقیقه پس از شناسایی فعالیتهای مشکوک تعیین شده است. اگر تیمهای مربوطه نتوانند در این مدت زمان نادرستبودن هشدار را اثبات کنند، موظف به توقف کامل فعالیت خواهند بود.
تکنیکهای همراستاسازی در مراحل بیشتری از آموزش اعمال میشوند تا مدلها رفتارهای ناامن را بهتر شناسایی کنند و دربارهی تواناییها و محدودیتهای خود صادقتر باشند. گزارشها نشان میدهند که پس از این حادثه، شرکتهای آنتروپیک و متا نیز متوجه شدهاند که هوش مصنوعی آنها به سازمانهای دیگر نفوذ کردهاند.