اوپن‌ای‌آی می‌گوید باید در نحوه و زمان گزارش مواردی که مدل‌های هوش مصنوعی به اهداف واقعی حمله می‌کنند، بازنگری کند. این اظهارنظر در حالی مطرح شده که خالق ChatGPT همچنان با پیامدهای گزارش‌هایی درباره‌ی خارج‌شدن گروهی از ایجنت‌های هوش مصنوعی‌اش از کنترل و تصاحب یک وب‌سایت آلمانی دست‌وپنجه نرم می‌کند.

اوپن‌ای‌آی امروز با انتشار در پستی در ایکس، با اشاره به آنچه «حادثه‌ی ویکی» می‌نامد، گفت زمانش رسیده که استانداردهای مشخصی برای نحوه و زمان انتشار گزارش‌های مربوط به «ناهم‌راستایی مدل‌های هوش مصنوعی» تعیین شود؛ نه اینکه فقط ویژگی‌های ناهم‌راستایی مدل‌ها در گزارش‌های ایمنی بررسی شوند.

اوپن‌ای‌آی: رویکردمان نیاز به بازنگری دارد

اوپن‌ای‌آی می‌گوید تاکنون مواردی را که عامل‌های هوش مصنوعی برخلاف انتظار رفتار می‌کردند، بیشتر به‌عنوان یک «موضوع پژوهشی» در نظر می‌گرفت؛ اما حوادث اخیر که پای اهداف واقعی را به میان کشیده‌اند، از جمله حمله به پلتفرم هاگینگ فیس، نشان می‌دهند که رویکرد فعلی نیاز به بازنگری دارد.

نخستین‌بار از زمان انتشار خبر حادثه در روز جمعه است که OpenAI رسماً به نقش خود در ماجرا اشاره می‌کند. هنوز ابعاد دقیق حادثه مشخص نیست، اما گزارش‌ها می‌گویند گروهی از عامل‌هایی که ظاهراً به OpenAI مربوط بوده‌اند، کنترل یک سایت آلمانی‌زبان را در دست گرفته‌اند. این عامل‌ها با جازدن خود به‌جای مدیران سایت، سایت را به محلی برای انتشار اطلاعات درباره‌ی تقلب در انجام وظایف و دورزدن سیستم‌های شناسایی تبدیل کرده‌اند.

عدم شفافیت اوپن‌ای‌آی انتقادها را برانگیخت

گزارش‌هایی مبنی بر اینکه اوپن‌ای‌آی از خارج‌شدن عامل‌هایش از کنترل اطلاع داشته اما این «حادثه» را گزارش نکرده، نگرانی‌های زیادی را در جامعه‌ی هوش مصنوعی به‌وجود آورده است. منتقدان نگران‌اند که چنین اتفاقاتی پرسش‌های جدی درباره‌ی ایمنی مدل‌های پیشرفته و همچنین میزان قابل‌اعتمادبودن شرکت‌های توسعه‌دهنده‌شان ایجاد کند.

اوپن‌ای‌آی در واکنش اعلام کرد «حادثه‌ی ویکی» را نمونه‌ای از ناهم‌راستایی می‌دانسته که مشابه موارد مطرح‌شده در گزارش‌های ایمنی قبلی شرکت بوده است. حالا اوپن‌ای‌آی می‌گوید روی چارچوب تازه‌ای برای گزارش چنین حوادثی کار می‌کند و قصد دارد آن را طی هفته‌های آینده منتشر کند.

اوپن‌ای‌آی همچنین از جامعه‌ی هوش مصنوعی خواسته برای نحوه‌ی گزارش موارد ناهم‌راستایی، استانداردهای روشن و مشترکی ایجاد کنند؛ موضوعی که با افزایش توانایی عامل‌های هوش مصنوعی و دسترسی آن‌ها به سرویس‌ها و محیط‌های واقعی، اهمیت بیشتری پیدا کرده است.