هوش مصنوعی معرفینشدهی اوپنایآی پس از شکستن محدودیتهای امنیتی محیط آزمایشی، توانست به اینترنت دسترسی پیدا کند و با ایجاد یک شبکهی گفتوگوی مخفی، سامانههای داخلی Hugging Face را هدف حملهی سایبری قرار دهد. مهار این رخداد و شناسایی نفوذ، نزدیک به دو هفته زمان برد.
دو گزارش تحلیلی جدید با حجم تقریبی ۱۳۰ صفحه به قلم اوپنایآی و مؤسسههای پژوهشی METR و Redwood Research پرده از ابعاد پنهان این رخداد امنیتی برداشتهاند. یافتههای پژوهشگران نشان میدهد عاملی به نام PHASEONE10841 با ساخت بستری پنهان، مسیر فرار به اینترنت و نفوذ به پیامرسان سازمانی هاگینگ فیس را برای سایر عاملها فراهم ساخت.
اوپنایآی در گزارش رسمی خود به ماهیت بیسابقهی این رخنه اشاره کرد و نوشت: «این حادثه نخستین مورد شناختهشده از اقدام تهاجمی و هماهنگِ مجموعهای از عاملهای خودکار بدون مجوز انسانی است.»
بررسی مؤسسههای ناظر حاکی است که حدود ۱۲۰۰ عامل هوش مصنوعی بیش از ۷۰ هزار پیام و فایل را در سامانهی تأییدنشده ردوبدل کردند. هفتصد عامل در عملیات نفوذ به هاگینگ فیس مشارکت داشتند و پیوسته راههای دور زدن بررسیهای امنیتی خودکار و حذف ردپای فعالیتهایشان را بررسی میکردند.
عاملهای اصلی این خرابکاری، یک مدل پژوهشی معرفینشده به نام HPIM و مدل GPT-5.6 Sol بودند. شرکت توسعهدهنده سرانجام از نفوذ باخبر شد و پنج روز بعد، تمام فرایندهای آموزشی مدلهای مرتبط را متوقف کرد تا سازوکارهای پایش و پاسخ سریع ۲۴ ساعته را برای جلوگیری از تکرار حوادث مشابه راهاندازی کند.